Dostawcy LLM
Każdy projekt w Speedwave korzysta z jednego dostawcy modelu: Anthropic, lokalnego serwera modelu lub serwisu OpenRouter. Wybór ten jest zapisywany w konfiguracji użytkownika (a nie w repozytorium), dzięki czemu jeden projekt może korzystać z subskrypcji Anthropic, a inny łączyć się z serwerem lokalnym.
Sesja jest powiązana z jednym dostawcą
Dział zatytułowany „Sesja jest powiązana z jednym dostawcą”Wybrany dostawca obowiązuje przez całą sesję: komenda /model pozwala przełączać wyłącznie modele dostępne u aktywnego dostawcy.
Skrócone nazwy opus, sonnet i haiku działają również na serwerach lokalnych oraz w OpenRouter - Speedwave automatycznie mapuje je na odpowiednie modele danego dostawcy.
Stały katalog modeli Anthropic
Dział zatytułowany „Stały katalog modeli Anthropic”Rozwijana lista modeli Anthropic dzieli je na grupy Latest oraz Legacy, podając rozmiar okna kontekstowego oraz identyfikator modelu. Lista ta pochodzi z wbudowanego katalogu Speedwave, a nie z dynamicznego odpytywania API.
| Model | Kontekst | Status |
|---|---|---|
| Fable 5 | 1M tokenów | Latest |
| Opus 5 | 1M tokenów | Latest |
| Sonnet 5 | 1M tokenów | Latest |
| Haiku 4.5 | 200k tokenów | Latest |
| Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 4.6 | 1M tokenów | Legacy |
Fable 5 oraz modele z rodziny Opus należą do warstwy premium, natomiast Sonnet i Haiku do warstwy standardowej.
Koszty zależą od wybranego modelu oraz długości kontekstu. W artykule Zużycie i koszty sprawdzisz szczegóły naliczania opłat.
Wykrywanie modeli na serwerach lokalnych
Dział zatytułowany „Wykrywanie modeli na serwerach lokalnych”Lokalny dostawca kieruje żądania do serwera modelu uruchomionego na Twoim komputerze pod domyślnym adresem http://host.docker.internal:11434 (odpowiadającym standardowemu portowi Ollamy). Speedwave odpytuje ten adres i wyświetla listę dostępnych modeli. Przycisk discover models pozwala odświeżyć listę na żądanie po pobraniu nowego modelu. Automatyczne wykrywanie działa dla środowisk Ollama, LM Studio oraz serwerów kompatybilnych z llama.cpp.
Gdy serwer jest niedostępny lub zwraca nieprawidłową odpowiedź, pole wyboru modelu zostaje zastąpione komunikatem błędu. Po upewnieniu się, że serwer działa pod wskazanym adresem URL, wystarczy ponownie uruchomić wykrywanie.
Własny adres bazowy musi być poprawnym adresem URL protokołu http lub https z prostą ścieżką (np. http://localhost:11434/v1). Konfiguracja niestandardowych nagłówków jest opcją zaawansowaną: ich podanie powoduje ominięcie proxy projektu, co wyłącza zliczanie zużycia tokenów. Ponadto Speedwave blokuje podawanie wrażliwych nagłówków, takich jak Authorization, Cookie czy Host. W rozdziale Dane i prywatność sprawdzisz, jakie dane opuszczają Twój komputer przy poszczególnych dostawcach.
Dlaczego nie można bezpośrednio użyć klucza OpenAI lub Gemini? Speedwave nie stosuje warstwy translacji formatów zapytań pomiędzy różnymi dostawcami. Proxy przekazuje komunikację Anthropic Messages API bezpośrednio, dlatego lokalny serwer musi natywnie obsługiwać ten format (jak czynią to Ollama, LM Studio i llama.cpp). Bezpośrednie wpisanie klucza API innego dostawcy nie zadziała.
Katalog OpenRouter
Dział zatytułowany „Katalog OpenRouter”OpenRouter stanowi stałą pozycję na liście dostawców. Po wprowadzeniu klucza API OpenRouter Speedwave pobiera listę modeli bezpośrednio z katalogu serwisu, filtrując ją do modeli obsługujących wywołania narzędzi (function calling / tools).
Przechowywanie konfiguracji
Dział zatytułowany „Przechowywanie konfiguracji”Informacja o aktywnym dostawcy, adresie bazowym i parametrach połączenia jest zapisywana w pliku konfiguracyjnym użytkownika ~/.speedwave/config.json. Pełną strukturę opisano w zestawieniu Klucze konfiguracji. Klucze API dostawców są przechowywane odrębnie w katalogu ~/.speedwave/tokens/<project>/llm/ z uprawnieniami ograniczonymi do właściciela. Szczegółowe zasady bezpieczeństwa przedstawiono w artykule Zarządzanie poświadczeniami.