Sebagian besar orang yang memakai dikte suara tidak pernah memikirkan ke mana sebenarnya suara mereka pergi. Pemasaran memberi tahu Anda bahwa perangkat lunaknya "privat" atau "aman" dan Anda umumnya memercayainya. Untuk percakapan medis, tulisan keuangan, dan korespondensi pribadi, kepercayaan ini layak mendapat lebih banyak telaah. Inilah yang sebenarnya terjadi ketika Anda mendiktekan ke berbagai produk.

Perbedaan cloud vs lokal

Pengenalan suara bisa berjalan di dua tempat yang secara mendasar berbeda: di sebuah server di suatu tempat di internet (cloud), atau di prosesor komputer Anda sendiri (lokal, di perangkat). Pengalaman penggunanya serupa — Anda berbicara, kata-kata muncul — tetapi implikasi privasinya sangat berbeda.

Dikte berbasis cloud mengirimkan audio suara Anda ke sebuah server, tempat pengenalan dijalankan, lalu mengirim kembali teks hasilnya. Suara Anda telah diunggah ke infrastruktur pihak ketiga. Apakah audio itu disimpan, dicatat, dipakai untuk pelatihan, dibagikan ke mitra, atau dihapus sepenuhnya bergantung pada kebijakan vendor — yang biasanya tidak Anda baca.

Dikte lokal/di perangkat menjalankan pengenalan di CPU komputer Anda sendiri menggunakan model yang telah diunduh. Audio suara Anda tidak pernah meninggalkan perangkat. Tidak ada apa pun yang bisa dicatat, disimpan, atau dilatih oleh siapa pun, karena memang tidak ada yang diunggah sejak awal.

Alat mana saja yang termasuk apa, pada 2026

Lokal (suara Anda tetap di komputer Anda):

  • CaringDictate — sepenuhnya lokal. Whisper Large v3 Turbo berjalan di komputer Anda sendiri. Tidak ada yang diunggah, tidak pernah. Kebijakan privasi di sini.
  • Dragon Professional Individual v16 — lokal. Pengenalan berjalan di komputer Anda sendiri.
  • Apple Dictation pada Mac dan iPhone yang lebih baru — lokal pada perangkat dengan Apple Neural Engine (Mac 2020+, iPhone XS atau yang lebih baru). Perangkat Apple yang lebih lama mengirim audio ke server Apple.
  • Microsoft Voice Access pada Windows 11 — lokal.
  • VoiceInk (Mac) — lokal.

Cloud (suara Anda dikirim ke sebuah server):

  • Dragon Medical One — hanya cloud.
  • Otter.ai — hanya cloud.
  • Wispr Flow — berbasis cloud; pengenalannya berjalan di servernya.
  • Google Docs Voice Typing — hanya cloud. Audio dikirim ke Google.
  • Voiceitt — hanya cloud.
  • Perangkat Apple yang lebih lama — cloud, audio dikirim ke server Apple.

Bagi pengguna dengan percakapan yang relevan dengan HIPAA, pembahasan keuangan yang sensitif, kekhawatiran tentang kerahasiaan hukum, atau sekadar preferensi pribadi agar tidak didengar pihak ketiga — kategori cloud sama sekali tidak bisa diterima.

Apa arti "HIPAA compliant" yang biasa (dan bukan)

Banyak layanan dikte cloud beriklan sebagai "HIPAA compliant." Ini terdengar seperti jaminan privasi. Sebagian besar bukan.

Kepatuhan HIPAA bagi vendor cloud umumnya berarti vendor tersebut telah menandatangani Business Associate Agreement dengan entitas tercakup (rumah sakit, klinik), menerapkan kontrol akses tertentu, dan mengikuti persyaratan audit tertentu. Yang tidak berarti bukan bahwa suara Anda tetap berada di komputer Anda: dengan layanan cloud, audio tetap dikirim ke vendor, dan HIPAA mengatur bagaimana itu ditangani, bukan apakah itu dikirimkan sama sekali. Apa yang dilakukan vendor tertentu dengan itu diatur dalam kebijakan privasi dan ketentuan mereka sendiri, yang merupakan dokumen yang perlu dibaca.

Bagi seorang pasien individu atau anggota keluarga yang ingin suaranya tidak pernah meninggalkan komputer mereka, uji yang tepat bukanlah "apakah ia patuh HIPAA?" Uji yang tepat adalah "apakah ia lokal?" Jika jawabannya ya, suara Anda tidak pernah meninggalkan komputer Anda secara desain — bukan berdasarkan kebijakan. Jika jawabannya tidak — bahkan jika layanan cloud itu patuh HIPAA — suara Anda telah diunggah.

Apa yang sebenarnya disimpan, bahkan di layanan cloud

Untuk layanan dikte cloud, apa yang disimpan bervariasi. Pola yang umum meliputi:

  • Rekaman audio — masa retensi bervariasi tergantung vendor dan paket; kebijakan privasi vendor adalah tempat hal ini dinyatakan.
  • Transkrip — keluaran teks sering kali disimpan tanpa batas waktu. Sebagian besar pengguna tidak menyadari bahwa transkrip dari segala hal yang mereka diktekan ada di cloud.
  • Metadata — waktu, informasi perangkat, alamat IP. Berguna untuk analitik, tetapi itu tetap data tentang penggunaan Anda.
  • Profil suara — beberapa layanan membangun profil suara Anda dari waktu ke waktu untuk pengenalan yang lebih baik. Ini secara harfiah adalah sidik suara, yang memiliki implikasi biometrik.

Tidak satu pun dari ini ada pada alat dikte lokal, karena memang tidak ada yang diunggah.

Pertanyaan soal "pelatihan AI"

Kini banyak orang yang secara wajar berhati-hati agar suara atau tulisan mereka tidak dipakai untuk melatih model AI. Layanan dikte cloud sering kali (tidak selalu) menyertakan klausul data pelatihan dalam ketentuan layanannya. Klausul ini memberi vendor lisensi untuk menggunakan audio dan transkrip Anda guna meningkatkan model pengenalan mereka.

Bagi sebagian pengguna ini tidak masalah. Bagi yang lain — terutama mereka yang menulis tentang kondisi medis, urusan keluarga, atau karya yang dilindungi hak kekayaan intelektual — ini tidak dapat diterima. Pertahanannya adalah menggunakan dikte lokal. Dengan CaringDictate (dan alat lokal sepenuhnya lainnya), tidak ada yang diunggah, jadi tidak ada yang bisa dilatih.

Pertanyaan soal keharusan internet

Persoalan yang terkait namun terpisah: dikte cloud memerlukan internet. Jika internet rumah Anda mati, dikte cloud Anda tidak berfungsi. Jika Anda bepergian ke tempat dengan konektivitas yang buruk, kualitas dikte Anda bisa menurun atau gagal sepenuhnya. Bagi pengguna yang bergantung pada dikte untuk alasan aksesibilitas, ketergantungan pada koneksi internet yang stabil ini adalah sebuah kerentanan.

Dikte lokal berfungsi tanpa internet. CaringDictate mengunduh model pengenalan sekali saja saat instalasi awal, dan sejak saat itu, ia berfungsi sepenuhnya luring. Ini penting untuk bepergian, untuk koneksi yang tidak menentu, dan untuk kasus (yang semakin jarang) ketika Anda sekadar tidak ingin komputer Anda "menelepon pulang" untuk segala hal.

Bagaimana CaringDictate menangani privasi secara khusus

Arsitektur kami sengaja dibuat sederhana untuk diverifikasi:

  • Whisper Large v3 Turbo (mesin pengenalan) diunduh sekali saja saat instalasi dan disimpan di komputer Anda.
  • Ketika Anda mendikte, audio ditangkap oleh mikrofon, diproses oleh Whisper di komputer Anda sendiri, dan diubah menjadi teks. Buffer audio kemudian dibuang.
  • Teks tersebut disisipkan ke kolom teks mana pun yang sedang ditempati kursor.
  • Suara Anda dan teks yang didiktekan tidak pernah dikirim melalui internet, tidak pernah diunggah, dan tidak pernah disimpan di server mana pun.
  • Anda dapat memverifikasi ini dengan alat pemantauan jaringan apa pun — CaringDictate tidak membuat koneksi keluar apa pun selama dikte berlangsung.

Satu-satunya lalu lintas jaringan yang pernah dihasilkan CaringDictate adalah saat instalasi awal (mengunduh model pengenalan dan pemeriksaan pembaruan apa pun). Setelah terpasang, ia sepenuhnya luring.

Rekomendasi praktis menurut kasus penggunaan

Untuk dikte umum (email, dokumen, formulir web): Alat dikte lokal mana pun bisa digunakan — CaringDictate, Dragon, atau Apple Dictation pada Mac yang lebih baru.

Untuk percakapan medis atau pekerjaan yang relevan dengan HIPAA: Hanya lokal adalah jawaban yang tepat. CaringDictate dibuat khusus untuk ini, dan Dragon Professional juga menjalankan pengenalannya di komputer Anda sendiri.

Untuk rapat yang ingin Anda transkripsikan: Otter.ai adalah pilihan standar tetapi berbasis cloud — pastikan semua orang dalam rapat menyetujui hal itu.

Untuk tulisan pribadi yang sensitif terhadap privasi (jurnal, memoar): Pasti lokal. CaringDictate atau Apple Dictation yang lebih lama. Hindari layanan cloud sama sekali.

Ke mana melangkah dari sini

Untuk detail teknis lengkap tentang bagaimana CaringDictate menangani data Anda, lihat kebijakan privasi. Untuk perbandingan dengan opsi lain, lihat Dragon, vs Wispr Flow, vs Otter.ai.