Ludzie zadają to pytanie w dwóch nastrojach: z czystej ciekawości oraz z tym specyficznym, zimnym uczuciem, które pojawia się zaraz po podyktowaniu czegoś osobistego. Tak czy inaczej, odpowiedź powinna pochodzić z pierwotnych źródeł — dlatego ta strona trzyma się tego, co mówi własna dokumentacja Microsoftu, a także faktów strukturalnych dotyczących tego, gdzie fizycznie odbywa się rozpoznawanie mowy.

Czy Win+H przetwarza mój głos w chmurze?

Domyślnie tak. Pisanie głosowe w systemie Windows korzysta z internetowego rozpoznawania mowy Microsoftu: Twój dźwięk trafia na serwery Microsoftu, tam jest konwertowany na tekst, a tekst wraca na Twój ekran. Dokumentacja prywatności Microsoftu opisuje to bezpośrednio — dane głosowe są wysyłane "wyłącznie w celu świadczenia usługi i tworzenia transkrypcji tekstowych," a Microsoft stwierdza, że "nie przechowuje, nie próbkuje ani nie nasłuchuje nagrań głosowych bez Twojej zgody."

To są znaczące zobowiązania i cytujemy je uczciwie. Równie uczciwe jest nazwanie leżącej u podstaw struktury: Twój głos opuszcza Twój komputer, a Twoja prywatność jest obietnicą dotrzymywaną przez firmę, a nie właściwością maszyny przed Tobą.

Czym jest rozpoznawanie na urządzeniu i co Microsoft o tym mówi?

Rozpoznawanie na urządzeniu (offline) uruchamia model mowy na Twoim własnym sprzęcie. Własne sformułowanie Microsoftu dotyczące jego funkcji mowy opartych na urządzeniu jest najczystszym podsumowaniem, dlaczego to ma znaczenie: ono "przetwarza Twój głos lokalnie na Twoim urządzeniu. Żadne dane głosowe nie są wysyłane do Microsoftu." Funkcja Voice Access w systemie Windows 11 działa w ten sposób. Podobnie jak CaringDictate — dla każdego użytkownika, w każdym języku, bez trybu chmury w ogóle.

Obraz prywatności, narzędzie po narzędziu

NarzędzieGdzie przetwarzana jest mowaCo to oznacza
CaringDictateTwój komputer, zawszeBrak przesyłania dźwięku; działa bez Wi-Fi; $49 jednorazowo
Pisanie głosowe w systemie Windows (Win+H)Serwery Microsoft, domyślnieDźwięk wysyłany do chmury zgodnie z deklarowaną polityką Microsoft
Windows Voice Access (Win 11)Twój komputerNa urządzeniu; stworzone do sterowania głosem, a nie dla komfortu pisania
Wispr Flow, OtterSerwery dostawcySposób obsługi dźwięku określa dokumentacja i polityka prywatności każdego dostawcy — warto je przeczytać przed dokonaniem wyboru

Pytania, które warto zadać każdemu dostawcy oprogramowania do dyktowania

  • Czy działa bez dostępu do internetu? Jedyna deklaracja prywatności, którą możesz samodzielnie zweryfikować w dziesięć sekund.
  • Czy jest wymagane konto? Brak konta oznacza, że nawyki dyktowania nie mogą być powiązane z tożsamością.
  • Czy dźwięk jest kiedykolwiek przechowywany? Przy przetwarzaniu na urządzeniu odpowiedź jest strukturalna: nic nie jest przechowywane nigdzie poza Twoją własną maszyną.
  • Co finansuje ten produkt? Jednorazowa cena nie wymaga stałej relacji danych z Tobą; niektóre darmowe narzędzia tak.

Pytania i odpowiedzi

Prywatność pisania głosowego — często zadawane pytania

Czy pisanie głosowe w systemie Windows wysyła mój głos do Microsoftu?

Domyślnie tak. Win+H używa internetowego rozpoznawania mowy Microsoftu, więc Twój dźwięk jest wysyłany na serwery Microsoftu w celu konwersji na tekst. Własna dokumentacja prywatności Microsoftu mówi, że dane głosowe są wysyłane „wyłącznie w celu świadczenia usługi i tworzenia transkrypcji tekstowych” oraz że nie przechowuje, nie próbkuje ani nie nasłuchuje nagrań bez pozwolenia.

Czy to problem?

To zależy od tego, co dyktujesz i komu ufasz. Microsoft określa jasne ograniczenia dotyczące tego, co robi z dźwiękiem. Fakt strukturalny pozostaje: dźwięk opuszcza Twój komputer, a prywatność staje się polityką, na której polegasz, a nie fizyczną właściwością oprogramowania. W przypadku list zakupów niewiele osób się tym przejmuje; w przypadku notatek medycznych lub projektów prawnych, wiele osób tak.

Czym są klipy głosowe i czy powinienem je udostępniać?

Udostępnianie klipów głosowych to opcjonalny program Microsoftu mający na celu poprawę rozpoznawania mowy za pomocą próbek dźwięku prawdziwych użytkowników. Jest on wyłączony, chyba że wyrazisz zgodę, a odmowa nie wpływa na Twoją zdolność do korzystania z pisania głosowego. Jeśli prywatność jest Twoim priorytetem, nie ma powodu, aby wyrażać zgodę.

Czy system Windows może rozpoznawać mowę bez chmury?

Częściowo. Funkcja Windows Voice Access w systemie Windows 11 przetwarza mowę na urządzeniu — dokumentacja Microsoftu dotycząca rozpoznawania na urządzeniu jasno stwierdza, że żadne dane głosowe nie są wysyłane do Microsoftu. Sam Win+H jest domyślnie online, z trybem pakietu językowego offline w niektórych kompilacjach, ale ze zmniejszoną dokładnością.

Czym różni się CaringDictate pod względem prywatności?

Model rozpoznawania znajduje się i działa zawsze na Twoim własnym komputerze. Nie ma trybu chmury, do którego można by się cofnąć, nie ma konta ani przesyłania dźwięku — internet jest używany tylko do początkowego pobierania, sprawdzania aktualizacji i jednorazowej aktywacji licencji. Twoje dyktowanie działa identycznie po odłączeniu kabla sieciowego, co jest najsilniejszą deklaracją prywatności, jaką oprogramowanie może złożyć.

Co powinni faktycznie zrobić zaniepokojeni użytkownicy?

Trzy rozsądne kroki: nie dyktuj niczego wrażliwego za pomocą narzędzi chmurowych; odrzuć opcjonalny wkład klipów głosowych w ustawieniach prywatności systemu Windows; a jeśli dyktowanie jest codziennym nawykiem, użyj narzędzia działającego na urządzeniu, aby pytanie zniknęło całkowicie. CaringDictate kosztuje $49 jednorazowo z 7-dniowym bezpłatnym okresem próbnym — a sam możesz zweryfikować działanie offline, wyłączając Wi-Fi.

Dziesięciosekundowy test prywatności

Zainstaluj CaringDictate (7-dniowy bezpłatny okres próbny, bez karty, $49 jednorazowo jeśli się sprawdzi), wyłącz Wi-Fi i podyktuj akapit. Wszystko działające jest całym argumentem prywatności, zademonstrowanym. Więcej szczegółów w naszym przewodniku po prywatności dyktowania głosowego oraz w przewodniku po dyktowaniu offline.