Mọi người hỏi câu hỏi này với hai tâm trạng: tò mò vu vơ, và cảm giác lạnh lẽo đặc biệt xuất hiện ngay sau khi đọc chính tả một điều gì đó riêng tư. Dù sao đi nữa, câu trả lời nên đến từ các nguồn chính — vì vậy trang này bám sát những gì tài liệu của Microsoft nói, cộng với các sự thật cấu trúc về nơi nhận dạng giọng nói thực sự diễn ra.

Win+H có xử lý giọng nói của tôi trên đám mây không?

Theo mặc định, có. Gõ bằng giọng nói của Windows sử dụng nhận dạng giọng nói trực tuyến của Microsoft: âm thanh của bạn được gửi đến máy chủ của Microsoft, được chuyển đổi thành văn bản ở đó, và văn bản quay trở lại màn hình của bạn. Tài liệu quyền riêng tư của Microsoft mô tả trực tiếp — dữ liệu giọng nói được gửi "chỉ để cung cấp dịch vụ và tạo bản ghi văn bản," và Microsoft tuyên bố rằng "không lưu trữ, lấy mẫu hoặc nghe các bản ghi giọng nói mà không có sự cho phép của bạn."

Đó là những cam kết có ý nghĩa, và chúng tôi trích dẫn chúng một cách công bằng. Cũng công bằng khi nêu tên cấu trúc bên dưới: giọng nói của bạn rời khỏi máy tính của bạn, và quyền riêng tư của bạn là một lời hứa được giữ bởi một công ty chứ không phải là một thuộc tính của máy tính trước mặt bạn.

Nhận dạng trên thiết bị là gì, và Microsoft nói gì về nó?

Nhận dạng trên thiết bị (ngoại tuyến) chạy mô hình giọng nói trên phần cứng của riêng bạn. Cách diễn đạt của Microsoft về các tính năng giọng nói dựa trên thiết bị của họ là bản tóm tắt rõ ràng nhất về lý do tại sao điều này quan trọng: nó "xử lý giọng nói của bạn cục bộ trên thiết bị của bạn. Không có dữ liệu giọng nói nào được gửi đến Microsoft." Voice Access của Windows 11 hoạt động theo cách này. CaringDictate cũng vậy — cho mọi người dùng, mọi ngôn ngữ, hoàn toàn không có chế độ đám mây.

Bức tranh quyền riêng tư, từng công cụ một

Công cụNơi giọng nói được xử lýĐiều đó có nghĩa là gì
CaringDictateMáy tính của bạn, luôn luônKhông có tải lên âm thanh; hoạt động khi tắt Wi-Fi; $49 một lần
Gõ giọng nói của Windows (Win+H)Máy chủ của Microsoft, theo mặc địnhÂm thanh được gửi lên đám mây theo chính sách đã nêu của Microsoft
Windows Voice Access (Win 11)Máy tính của bạnTrên thiết bị; được xây dựng để điều khiển bằng giọng nói hơn là để viết thoải mái
Wispr Flow, OtterMáy chủ nhà cung cấpTài liệu và chính sách quyền riêng tư của từng nhà cung cấp quy định cách xử lý âm thanh — nên đọc trước khi lựa chọn

Những câu hỏi đáng hỏi bất kỳ nhà cung cấp phần mềm đọc chính tả nào

  • Nó có thể hoạt động khi không có internet không? Tuyên bố về quyền riêng tư duy nhất bạn có thể tự mình xác minh trong mười giây.
  • Có tài khoản không? Không có tài khoản có nghĩa là thói quen đọc chính tả không thể bị ràng buộc với một danh tính.
  • Âm thanh có bao giờ được lưu giữ không? Với việc xử lý trên thiết bị, câu trả lời mang tính cấu trúc: không có gì để lưu giữ ở bất cứ đâu ngoài máy tính của chính bạn.
  • Điều gì tài trợ cho sản phẩm? Mức giá một lần không cần mối quan hệ dữ liệu liên tục với bạn; một số công cụ miễn phí thì có.

Câu hỏi & trả lời

Quyền riêng tư khi gõ bằng giọng nói — các câu hỏi thường gặp

Tính năng gõ bằng giọng nói của Windows có gửi giọng nói của tôi đến Microsoft không?

Theo mặc định, có. Win+H sử dụng tính năng nhận dạng giọng nói trực tuyến của Microsoft, vì vậy âm thanh của bạn được gửi đến máy chủ của Microsoft để chuyển đổi thành văn bản. Tài liệu về quyền riêng tư của Microsoft nói rằng dữ liệu giọng nói được gửi "chỉ để cung cấp dịch vụ và tạo bản ghi văn bản," và rằng họ không lưu trữ, lấy mẫu hoặc nghe các bản ghi mà không có sự cho phép.

Đó có phải là một vấn đề không?

Điều đó phụ thuộc vào những gì bạn đọc chính tả và người mà bạn cảm thấy thoải mái khi tin tưởng. Microsoft nêu rõ các giới hạn về những gì họ làm với âm thanh. Thực tế cấu trúc vẫn là: âm thanh rời khỏi máy tính của bạn, và quyền riêng tư trở thành một chính sách mà bạn dựa vào hơn là một thuộc tính vật lý của phần mềm. Đối với danh sách mua sắm, ít người quan tâm; đối với ghi chú y tế hoặc bản nháp pháp lý, nhiều người thì có.

Các đoạn âm thanh là gì và tôi có nên đóng góp chúng không?

Đóng góp đoạn âm thanh là chương trình tùy chọn của Microsoft để cải thiện khả năng nhận dạng giọng nói của họ bằng cách sử dụng các mẫu âm thanh của người dùng thực. Nó bị tắt trừ khi bạn chọn tham gia, và việc từ chối không ảnh hưởng đến khả năng sử dụng tính năng gõ bằng giọng nói của bạn. Nếu quyền riêng tư là ưu tiên của bạn, không có lý do gì để chọn tham gia.

Windows có thể nhận dạng giọng nói mà không cần đám mây không?

Một phần. Tính năng Voice Access của Windows 11 xử lý giọng nói trên thiết bị — tài liệu của Microsoft về nhận dạng dựa trên thiết bị nêu rõ rằng không có dữ liệu giọng nói nào được gửi đến Microsoft. Bản thân Win+H mặc định là trực tuyến, với chế độ gói ngôn ngữ ngoại tuyến trên một số bản dựng với độ chính xác giảm.

CaringDictate khác biệt như thế nào về quyền riêng tư?

Mô hình nhận dạng luôn nằm và chạy trên máy tính của chính bạn. Không có chế độ đám mây để quay lại, không có tài khoản và không có tải lên âm thanh — internet chỉ được sử dụng cho lần tải xuống ban đầu, kiểm tra cập nhật và kích hoạt giấy phép một lần. Tính năng đọc chính tả của bạn hoạt động giống hệt khi cáp mạng bị rút, đây là tuyên bố quyền riêng tư mạnh mẽ nhất mà phần mềm có thể đưa ra.

Người dùng lo lắng nên làm gì?

Ba bước hợp lý: không đọc chính tả bất kỳ nội dung nhạy cảm nào qua các công cụ đám mây; từ chối đóng góp đoạn ghi âm giọng nói tùy chọn trong cài đặt quyền riêng tư của Windows; và nếu đọc chính tả là thói quen hàng ngày, hãy sử dụng một công cụ trên thiết bị để câu hỏi biến mất hoàn toàn. CaringDictate có giá $49 một lần với bản dùng thử miễn phí 7 ngày — và bạn có thể tự mình xác minh tuyên bố ngoại tuyến bằng cách tắt Wi-Fi.

Bài kiểm tra quyền riêng tư mười giây

Cài đặt CaringDictate (7 ngày dùng thử miễn phí, không cần thẻ, $49 một lần nếu nó xứng đáng), tắt Wi-Fi của bạn và đọc chính tả một đoạn văn. Mọi thứ hoạt động là toàn bộ lập luận về quyền riêng tư, đã được chứng minh. Chi tiết hơn trong hướng dẫn quyền riêng tư đọc chính tả bằng giọng nóihướng dẫn đọc chính tả ngoại tuyến.