Люди задают этот вопрос в двух состояниях: из праздного любопытства и с тем особым холодным чувством, которое возникает сразу после диктовки чего-то личного. В любом случае, ответ должен исходить из первоисточников — поэтому эта страница придерживается того, что говорится в собственной документации Microsoft, а также структурных фактов о том, где физически происходит распознавание речи.
Обрабатывает ли Win+H мой голос в облаке?
По умолчанию, да. Голосовой набор Windows использует онлайн-распознавание речи Microsoft: ваш аудиопоток отправляется на серверы Microsoft, там преобразуется в текст, и текст возвращается на ваш экран. Документация Microsoft по конфиденциальности прямо описывает это — голосовые данные отправляются "только для предоставления услуги и создания текстовых расшифровок," и Microsoft заявляет, что "не хранит, не анализирует и не прослушивает голосовые записи без вашего разрешения."
Это значимые обязательства, и мы цитируем их честно. Столь же честно назвать лежащую в основе структуру: ваш голос покидает ваш компьютер, и ваша конфиденциальность — это обещание, данное компанией, а не свойство машины перед вами.
Что такое распознавание на устройстве, и что Microsoft говорит об этом?
Распознавание на устройстве (офлайн) запускает речевую модель на вашем собственном оборудовании. Собственная формулировка Microsoft для своих функций речи на основе устройства — это самое ясное изложение того, почему это важно: оно "обрабатывает ваш голос локально на вашем устройстве. Никакие голосовые данные не отправляются в Microsoft." Функция Voice Access в Windows 11 работает таким образом. Так же работает и CaringDictate — для каждого пользователя, на любом языке, без какого-либо облачного режима.
Картина конфиденциальности, инструмент за инструментом
| Инструмент | Где обрабатывается речь | Что это значит |
|---|---|---|
| CaringDictate | Ваш компьютер, всегда | Загрузка аудио отсутствует; работает без Wi-Fi; $49 один раз |
| Голосовой ввод Windows (Win+H) | Серверы Microsoft, по умолчанию | Аудио отправляется в облако в соответствии с заявленной политикой Microsoft |
| Windows Voice Access (Win 11) | Ваш компьютер | На устройстве; создан для голосового управления, а не для удобства набора текста |
| Wispr Flow, Otter | Серверы поставщика | Порядок обработки аудио указан в документации и политике конфиденциальности каждого поставщика — стоит прочитать их перед выбором |
Вопросы, которые стоит задать любому поставщику диктовки
- Может ли это работать без интернета? Единственное заявление о конфиденциальности, которое вы можете проверить самостоятельно за десять секунд.
- Есть ли учетная запись? Отсутствие учетной записи означает, что привычки диктовки не могут быть связаны с личностью.
- Сохраняется ли аудио когда-либо? При обработке на устройстве ответ является структурным: ничего не сохраняется нигде, кроме вашей собственной машины.
- Что финансирует продукт? Единовременная цена не требует постоянных отношений по обмену данными с вами; некоторые бесплатные инструменты требуют.
Вопросы и ответы
Конфиденциальность голосового набора — частые вопросы
Отправляет ли голосовой набор Windows мой голос в Microsoft?
По умолчанию, да. Win+H использует онлайн-распознавание речи Microsoft, поэтому ваше аудио отправляется на серверы Microsoft для преобразования в текст. Собственная документация Microsoft по конфиденциальности гласит, что голосовые данные отправляются «только для предоставления услуги и создания текстовых расшифровок» и что она не хранит, не сэмплирует и не прослушивает записи без разрешения.
Это проблема?
Это зависит от того, что вы диктуете и кому вы доверяете. Microsoft устанавливает четкие ограничения на то, что она делает с аудио. Структурный факт остается: аудио покидает ваш компьютер, и конфиденциальность становится политикой, на которую вы полагаетесь, а не физическим свойством программного обеспечения. Для списков покупок мало кто беспокоится; для медицинских записей или юридических черновиков — многие.
Что такое голосовые клипы и стоит ли мне их предоставлять?
Предоставление голосовых клипов — это необязательная программа Microsoft для улучшения распознавания речи с использованием образцов аудио реальных пользователей. Она отключена, если вы не дадите согласие, и отказ не влияет на вашу способность использовать голосовой набор. Если конфиденциальность является вашим приоритетом, нет причин соглашаться.
Может ли Windows выполнять распознавание речи без облака?
Частично. Функция Voice Access в Windows 11 обрабатывает речь на устройстве — документация Microsoft для распознавания на устройстве прямо заявляет, что голосовые данные не отправляются в Microsoft. Сам Win+H по умолчанию работает онлайн, с режимом автономного языкового пакета на некоторых сборках с пониженной точностью.
Чем CaringDictate отличается в вопросах конфиденциальности?
Модель распознавания всегда находится и работает на вашем собственном компьютере. Нет облачного режима для отката, нет учетной записи и нет загрузки аудио — интернет используется только для первоначальной загрузки, проверки обновлений и однократной активации лицензии. Ваша диктовка работает идентично при отключенном сетевом кабеле, что является самым сильным заявлением о конфиденциальности, которое может сделать программное обеспечение.
Что на самом деле следует делать обеспокоенным пользователям?
Три разумных шага: не диктуйте ничего конфиденциального через облачные инструменты; отклоните необязательное участие в сборе голосовых фрагментов в настройках конфиденциальности Windows; и если диктовка — это ежедневная привычка, используйте локальный инструмент, чтобы вопрос исчез полностью. CaringDictate стоит $49 один раз с 7-дневной бесплатной пробной версией — и вы можете сами проверить утверждение о работе в автономном режиме, отключив Wi-Fi.
Десятисекундный тест конфиденциальности
Установите CaringDictate (7-дневная бесплатная пробная версия, без карты, $49 один раз если она себя окупит), отключите Wi-Fi и продиктуйте абзац. То, что все работает, является полным доказательством конфиденциальности. Более подробная информация в нашем руководстве по конфиденциальности голосовой диктовки и в руководстве по автономной диктовке.