Śledź użycie i koszty
Speedwave pokazuje w dwóch miejscach, ile projekt zużywa i wydaje: na bieżącym pasku pod polem czatu oraz na stronie użycia LLM, która zbiera wszystkie zapytania projektu w jedno zestawienie. Oba źródła sięgają po te same zapisane dane o użyciu, czyli plik JSON Lines w <data_dir>/usage/<project>/proxy/usage.jsonl. To, jak zorganizowany jest katalog danych, opisują ścieżki tokenów i danych uwierzytelniających.
Sprawdź użycie dla projektu
Dział zatytułowany „Sprawdź użycie dla projektu”-
Podczas sesji zerknij na pasek ze statystykami pod polem czatu: tokeny wejściowe (
in), tokeny wyjściowe (out), jaką część okna kontekstu zajmuje dana tura (ctx), limit zapytań z twojej subskrypcji, o ile z niej korzystasz (limit), oraz dotychczasowy koszt projektu (chat). Najedź na dowolne pole, żeby zobaczyć szczegóły. -
W środku kontenera te same dane znajdziesz w jednym wierszu, na pasku stanu samego Claude Code:
claude-opus-4-8 │ feat/docs │ CTX ██░░░ 40% │ 5h ██░░░ 30% reset 16:42 │ 7d █░░░░ 12% reset 14.04 │ $0.1409Limity zapytań widać tylko przy subskrypcji Claude, a koszt tylko przy kluczu API.
-
Sumy i trendy znajdziesz na stronie użycia LLM. Pokazuje ona jeden projekt naraz, a nie kilka zwiniętych w jeden wynik.
-
Karty na górze strony podsumowują wybrany okres: liczbę zapytań, tokeny wejściowe i wyjściowe, współczynnik trafień w cache promptów, średnią szybkość, błędy i koszt. Średnia szybkość liczy sam czas dekodowania, więc oddaje tempo generowania, a nie czas spędzony na oczekiwaniu.
-
Pod kartami znajdziesz dzienny wykres tokenów, podział tokenów według dostawcy, mapę cieplną według dnia tygodnia i godziny oraz tabelę z danymi dziennymi dla każdego modelu.
Speedwave usuwa duplikaty rekordów użycia po identyfikatorze odpowiedzi (a w przypadku OpenRouter po identyfikatorze generacji), przy czym liczy się pierwszy zapis. Wiersz logu, którego nie da się odczytać, zostaje pominięty i zliczony, a Speedwave pokazuje go jako “N rekordów pominiętych”, zamiast po cichu go porzucać. Projekt, który nie ma jeszcze pliku użycia, pokazuje po prostu puste podsumowanie, a nie błąd.
Co wpływa na koszt
Dział zatytułowany „Co wpływa na koszt”Koszt zależy od tego, z którego dostawcy korzysta projekt, a wybierasz go w Ustawienia -> Dostawcy LLM. Ta sama kwota pojawia się na pasku, na stronie użycia i na pasku stanu, więc zmiana dostawcy przestawia od razu wszystkie trzy widoki. To, jak skonfigurować i wybrać każdego z nich, opisują Dostawcy LLM.
- Klucz API: Anthropic (klucz API) pokazuje rzeczywisty koszt, wyliczony z cennika Anthropic dołączonego do repozytorium. Tokeny promptu, dokończenia, odczytu z cache i zapisu do cache mają osobne stawki. Identyfikator modelu zakończony na
[1m]wyceniamy według stawki dla kontekstu 1M danego modelu, a gdy cennik nie ma dla niego ceny 1M, wracamy do stawki bazowej. - Subskrypcja: Anthropic (OAuth), czyli twoja subskrypcja Claude, pokazuje kreskę, nigdy
$0. Subskrypcja ma stałą stawkę, więc koszt pojedynczego zapytania po prostu nie ma tu zastosowania. - Lokalny: Model lokalny pokazuje kreskę, dokładnie tak jak subskrypcja, a nie
$0. Uruchamianie modelu, który hostujesz u siebie, nic w Speedwave nie kosztuje. - OpenRouter: pokazuje rzeczywisty koszt, pobrany z jego własnego cennika dla danej generacji. Świeżą turę zapisujemy najpierw bez kosztu odroczone, bo OpenRouter wycenia generację dopiero chwilę po zakończeniu przesyłania. Speedwave sprawdza ceny ponownie, gdy otwierasz stronę użycia LLM, więc odroczona tura dostaje swój rzeczywisty koszt przy kolejnym przejściu.
Zapytanie, które się nie powiedzie, nie jest rozliczane u żadnego dostawcy. Wewnętrznie Speedwave śledzi więcej stanów kosztu niż te cztery, a pełną listę znajdziesz w dokumentacji stanów kosztu.
Po resztę codziennej pracy z projektem sięgnij do Przewodników.