Большинство людей, использующих голосовую диктовку, никогда не задумываются о том, куда на самом деле уходит их голос. Маркетинг говорит вам, что программа «конфиденциальна» или «безопасна», и вы в основном доверяете этому. Для медицинских разговоров, финансового письма и личной переписки это доверие заслуживает большей проверки. Вот что на самом деле происходит, когда вы диктуете в разные продукты.
Различие между облаком и локальной обработкой
Распознавание голоса может выполняться в двух принципиально разных местах: на сервере где-то в интернете (облако) или на процессоре вашего собственного компьютера (локально, на устройстве). Пользовательский опыт похож — вы говорите, появляются слова, — но последствия для конфиденциальности очень разные.
Облачная диктовка отправляет аудио вашего голоса на сервер, где выполняется распознавание, и присылает обратно полученный текст. Ваш голос был загружен в инфраструктуру третьей стороны. Хранится ли это аудио, протоколируется, используется для обучения, передаётся партнёрам или удаляется, целиком зависит от политики поставщика — которую вы обычно не читали.
Локальная диктовка / диктовка на устройстве выполняет распознавание на вашем собственном процессоре компьютера с помощью загруженной модели. Аудио вашего голоса никогда не покидает устройство. Никому нечего протоколировать, хранить или обучать на этом, потому что ничего не было загружено изначально.
Какие инструменты к чему относятся в 2026 году
Локальные (ваш голос остаётся на вашем компьютере):
- CaringDictate — полностью локальный. Whisper Large v3 Turbo работает на вашем процессоре. Ничего не загружается, никогда. Политика конфиденциальности здесь.
- Dragon Professional Individual v16 — локальный. Более старая технология распознавания, но работает на вашем компьютере.
- Apple Dictation на более новых Mac и iPhone — локальная на устройствах с Apple Neural Engine (Mac 2020+ годов, iPhone XS или новее). Более старые устройства Apple отправляют аудио на серверы Apple.
- Microsoft Voice Access на Windows 11 — локальная.
- VoiceInk (Mac) — локальная.
Облачные (ваш голос уходит на сервер):
- Dragon Anywhere — только облако.
- Dragon Medical One — только облако.
- Otter.ai — только облако.
- Wispr Flow — облачный (несмотря на маркетинг, подразумевающий иное; их распознавание выполняется на их серверах).
- Google Docs Voice Typing — только облако. Аудио отправляется в Google.
- Voiceitt — только облако.
- Более старые устройства Apple — облако, аудио отправляется на серверы Apple.
Для пользователей с разговорами, относящимися к HIPAA, финансово чувствительными обсуждениями, опасениями по поводу адвокатской тайны или просто личным предпочтением не давать третьим сторонам слышать их — облачная категория это однозначное «нет».
Что обычно означает «соответствие HIPAA» (и что не означает)
Многие облачные сервисы диктовки рекламируют «соответствие HIPAA». Это звучит как гарантия конфиденциальности. В основном это не так.
Соответствие HIPAA для облачного поставщика обычно означает, что поставщик подписал Соглашения с деловым партнёром (Business Associate Agreements) с подпадающими под действие закона организациями (больницами, клиниками), внедрил определённые средства контроля доступа и следует определённым требованиям аудита. Это не означает, что ваш голос не загружается на их серверы. Это означает, что они обрабатывают эту загрузку согласно правилам HIPAA — что всё равно включает хранение данных, наличие сотрудников с доступом к ним и (во многих случаях) использование их для улучшения сервиса.
Для отдельного пациента или члена семьи, который хочет, чтобы его голос никогда не покидал его компьютер, правильный тест — не «соответствует ли это HIPAA?». Правильный тест — «локальная ли это обработка?». Если ответ да, то конфиденциальность технически гарантирована архитектурой, а не политикой. Если ответ нет — даже если облачный сервис соответствует HIPAA — ваш голос был загружен.
Что на самом деле сохраняется, даже в облачных сервисах
Для облачных сервисов диктовки то, что сохраняется, варьируется. Распространённые шаблоны включают:
- Аудиозаписи — хранятся для улучшения сервиса, отладки или обучения моделей. Некоторые сервисы позволяют отказаться; многие — нет.
- Транскрипты — текстовые результаты часто хранятся бессрочно. Большинство пользователей не осознают, что транскрипты всего, что они диктуют, существуют в облаке.
- Метаданные — время, информация об устройстве, IP-адрес. Полезно для аналитики, но это всё равно данные о вашем использовании.
- Голосовые профили — некоторые сервисы со временем выстраивают профиль вашего голоса для лучшего распознавания. Это буквально отпечаток голоса, что имеет биометрические последствия.
Ничего из этого не существует для локальных инструментов диктовки, потому что ничего не было загружено.
Вопрос «обучения ИИ»
Многие люди теперь оправданно настороженно относятся к тому, что их голос или письмо используются для обучения моделей ИИ. Облачные сервисы диктовки часто (не всегда) включают в свои условия использования пункты о данных для обучения. Эти пункты предоставляют поставщику лицензию на использование вашего аудио и транскриптов для улучшения их моделей распознавания.
Для некоторых пользователей это нормально. Для других — особенно для тех, кто пишет о медицинских состояниях, семейных делах или интеллектуально защищённой работе — это неприемлемо. Защита — использовать локальную диктовку. С CaringDictate (и любым другим полностью локальным инструментом) ничего не было загружено, поэтому нечего использовать для обучения.
Вопрос необходимости интернета
Связанная, но отдельная проблема: облачная диктовка требует интернета. Если ваш домашний интернет не работает, ваша облачная диктовка не работает. Если вы путешествуете там, где плохая связь, качество вашей диктовки может пострадать или вовсе отказать. Для пользователей, которые зависят от диктовки по причинам доступности, эта зависимость от стабильного интернет- соединения является уязвимостью.
Локальная диктовка работает без интернета. CaringDictate загружает модель распознавания один раз при первоначальной установке, и с этого момента работает полностью офлайн. Это важно для путешествий, для нестабильных соединений и для (всё более редких) случаев, когда вы просто не хотите, чтобы ваш компьютер обо всём «звонил домой».
Как именно CaringDictate обращается с конфиденциальностью
Наша архитектура намеренно проста для проверки:
- Whisper Large v3 Turbo (движок распознавания) загружается один раз при установке и хранится на вашем компьютере.
- Когда вы диктуете, аудио захватывается микрофоном, обрабатывается Whisper на вашем процессоре и преобразуется в текст. Затем аудиобуфер удаляется.
- Текст вставляется в то текстовое поле, где находится курсор.
- Ничего не отправляется через интернет. Ничего не протоколируется. Ничего не хранится.
- Вы можете проверить это любым инструментом сетевого мониторинга — CaringDictate не устанавливает исходящих соединений во время диктовки.
Единственный сетевой трафик, который вообще генерирует CaringDictate, — во время первоначальной установки (загрузка модели распознавания и любые проверки обновлений). После установки она полностью офлайн.
Практические рекомендации по сценариям использования
Для общей диктовки (почта, документы, веб-формы): Подойдёт любой локальный инструмент диктовки — CaringDictate, Dragon или Apple Dictation на более новом Mac.
Для медицинских разговоров или работы, относящейся к HIPAA: Только локальная обработка — правильный ответ. CaringDictate создан специально для этого; старый Dragon Professional тоже работает (хотя ему не хватает обновлений).
Для встреч, которые вы хотите транскрибировать: Otter.ai — стандартный выбор, но он облачный — убедитесь, что все участники встречи согласны на это.
Для конфиденциального личного письма (дневники, мемуары): Определённо локальная обработка. CaringDictate или старая Apple Dictation. Избегайте облачных сервисов полностью.
Куда двигаться дальше
Для полных технических деталей о том, как CaringDictate обращается с вашими данными, смотрите нашу политику конфиденциальности. Для сравнения с облачными альтернативами смотрите против Dragon Anywhere, в сравнении с Wispr Flow, в сравнении с Otter.ai.