Transkrypcja spotkań
Transkrypcja spotkań nagrywa spotkanie i zamienia je w transkrypcję ze znacznikami czasu. Speedwave przechwytuje dźwięk na hoście aplikacji Desktop i transkrybuje go lokalnie za pomocą whisper.cpp, dzięki czemu nagranie nigdy nie opuszcza twojego komputera. Kontener, w którym działa Claude, nie ma dostępu do dźwięku.
Co przechwytuje
Dział zatytułowany „Co przechwytuje”Przy każdym nagraniu wybierasz jedno z trzech źródeł: całe spotkanie (dźwięk systemowy zmiksowany z mikrofonem), sam dźwięk systemowy albo sam mikrofon. Cokolwiek wybierzesz, trafia do jednego strumienia mono 16 kHz. Transkrypcja ma znaczniki czasu, ale nie oznacza mówców. Żeby dowiedzieć się, kto co powiedział, wyślij ją do Claude i poproś, żeby wywnioskował kolejność wypowiedzi.
Włączanie
Dział zatytułowany „Włączanie”- Otwórz Ustawienia -> Funkcje beta i włącz funkcje beta, aby odsłonić zakładkę Transkrypcja spotkań.
- Otwórz Ustawienia -> Transkrypcja spotkań i pobierz model mowy: Whisper large-v3 albo large-v3-turbo, dobrany do twojego sprzętu. Model waży mniej więcej od 1,5 do 2,9 GiB i jest weryfikowany sumą kontrolną SHA-256. Sieć jest potrzebna tylko przy pobieraniu, potem transkrypcja działa offline. Pobieranie ma łączny limit 12 GiB, a przekierowania są dopuszczane wyłącznie do listy zaufanych hostów (Hugging Face, GitHub i ich sieci CDN).
- Otwórz zakładkę Transkrypcja spotkań, wybierz język (polski albo angielski; nie ma automatycznego rozpoznawania) i naciśnij Start, aby nagrywać.
Transkrypcja odbywa się w dwóch etapach. Najpierw powstaje wersja na żywo, w trakcie nagrywania. Potem, gdy naciśniesz Stop, uruchamia się dokładniejszy etap offline, który przetwarza całe nagranie od nowa i zastępuje tekst zapisany na żywo. Panel sterowania pokazuje, z jakiego przyspieszenia korzystasz: Metal albo CPU only. Jeśli etap offline się nie powiedzie, na przykład z powodu brakującego lub pustego nagrania, sesja dostaje odznakę failed: <reason>, ale wersja z etapu na żywo zostaje na miejscu, gotowa do przeczytania albo wysłania do Claude.
Wysyłanie transkrypcji do Claude
Dział zatytułowany „Wysyłanie transkrypcji do Claude”Transkrypcja zostaje na twoim komputerze, dopóki sam nie zdecydujesz się jej wysłać. Przycisk „Wyślij do Claude” prosi najpierw o potwierdzenie, a potem przekazuje tekst transkrypcji do skonfigurowanego dostawcy LLM, żeby Claude mógł go podsumować albo wyciągnąć z niego zadania do wykonania. Wysyłany jest wyłącznie tekst, nagranie nigdy nie trafia do sieci.
Gdzie przechowywane są nagrania
Dział zatytułowany „Gdzie przechowywane są nagrania”Każde nagranie trafia do katalogu ~/.speedwave/transcripts/<id>/, gdzie pliki audio.wav i transcript.json leżą obok siebie. Dostęp do nich ma tylko właściciel, nie są szyfrowane na dysku i nic ich automatycznie nie usuwa ani nie ogranicza czasu przechowywania. Przy długich nagraniach bufor dźwięku w pamięci rośnie o mniej więcej 115 MB na godzinę (mono 16 kHz), a co 30 minut Speedwave zapisuje o tym ostrzeżenie w logach aplikacji.
Transkrypcja spotkań wymaga systemu macOS 14.4 lub nowszego. Na Windows dźwięk systemowy przechwytuje WASAPI. Na macOS pierwsze nagranie wywołuje prośbę o zgodę na dostęp do mikrofonu, którą możesz zresetować poleceniem tccutil reset Microphone pl.speedwave.desktop.audio-capture.
Zajrzyj do Danych i prywatności, żeby zobaczyć, jak to wpisuje się w całościowe podejście Speedwave do danych.