Monitorowanie zużycia tokenów i kosztów
Speedwave monitoruje wykorzystanie zasobów modeli za pośrednictwem dwóch interfejsów: paska telemetrycznego pod polem czatu oraz zagregowanego panelu analitycznego prezentującego historię zapytań projektu. Oba widoki korzystają ze strukturalnych logów audytowych zapisywanych w pliku <data_dir>/usage/<project>/proxy/usage.jsonl. Strukturę katalogów opisano w rozdziale Ścieżki tokenów i danych uwierzytelniających.
Sprawdzanie statystyk zużycia
Dział zatytułowany „Sprawdzanie statystyk zużycia”-
Wskaźniki bieżącej sesji: Pod polem wprowadzania wiadomości w aplikacji Desktop możesz monitorować bieżące wartości: tokeny wejściowe (
in), tokeny wyjściowe (out), zapełnienie okna kontekstu (ctx), limity subskrypcyjne (limit) oraz szacowany koszt sesji (chat). -
Pasek stanu w terminalu CLI: W sesjach terminalowych Claude Code wyświetla analogiczny zestaw informacji w jednym wierszu:
claude-opus-4-8 │ feat/docs │ CTX ██░░░ 40% │ 5h ██░░░ 30% reset 16:42 │ 7d █░░░░ 12% reset 14.04 │ $0.1409Limity zapytań są widoczne przy subskrypcjach Claude, a koszty finansowe przy użyciu bezpośrednich kluczy API.
-
Panel analityczny użycia LLM: Otwórz widok Użycie LLM, aby analizować trendy historyczne dla wybranego projektu.
-
Karty podsumowujące: Sprawdzaj liczbę zapytań, bilans tokenów, efektywność pamięci podręcznej promptów (cache hit rate), przepustowość dekodowania (tokeny/s), błędy oraz całkowity koszt.
-
Wykresy i raporty: Analizuj dzienne zużycie tokenów, podział według dostawców, mapę aktywności godzinowej oraz zestawienia dla poszczególnych modeli.
Speedwave usuwa zduplikowane rekordy na podstawie unikalnych identyfikatorów odpowiedzi dostawcy. Uszkodzone wpisy logów są pomijane bez przerywania agregacji danych.
Modele wyceny dostawców
Dział zatytułowany „Modele wyceny dostawców”Sposób kalkulacji kosztów zależy od wybranego dostawcy w sekcji Ustawienia -> Dostawcy LLM (zobacz Dostawcy LLM):
- Anthropic (klucz API): Oblicza koszt na podstawie oficjalnego cennika Anthropic, rozbijając stawki za prompt wejściowy, generację, zapis oraz odczyt z cache (w tym taryfy dla kontekstu 1M).
- Anthropic (subskrypcja OAuth): Wyświetla kreskę (
-) oznaczającą zryczałtowane rozliczenie abonamentowe. - Lokalne serwery modeli: Wyświetla kreskę (
-), wskazując na brak kosztów per-token przy modelach własnych. - OpenRouter: Pobiera rzeczywiste koszty rozliczeniowe z API OpenRouter. Nowe zapytania mogą chwilowo przyjmować stan odroczony odroczone do czasu rozliczenia transakcji przez platformę.
Nieudane zapytania nie generują żadnych kosztów. Pełne zestawienie statusów rozliczeniowych znajdziesz w rozdziale Dokumentacja stanów kosztu.