Sebagian besar orang yang memakai dikte suara tidak pernah memikirkan ke mana sebenarnya suara mereka pergi. Pemasaran memberi tahu Anda bahwa perangkat lunaknya "privat" atau "aman" dan Anda umumnya memercayainya. Untuk percakapan medis, tulisan keuangan, dan korespondensi pribadi, kepercayaan ini layak mendapat lebih banyak telaah. Inilah yang sebenarnya terjadi ketika Anda mendiktekan ke berbagai produk.

Perbedaan cloud vs lokal

Pengenalan suara bisa berjalan di dua tempat yang secara mendasar berbeda: di sebuah server di suatu tempat di internet (cloud), atau di prosesor komputer Anda sendiri (lokal, di perangkat). Pengalaman penggunanya serupa — Anda berbicara, kata-kata muncul — tetapi implikasi privasinya sangat berbeda.

Dikte berbasis cloud mengirimkan audio suara Anda ke sebuah server, tempat pengenalan dijalankan, lalu mengirim kembali teks hasilnya. Suara Anda telah diunggah ke infrastruktur pihak ketiga. Apakah audio itu disimpan, dicatat, dipakai untuk pelatihan, dibagikan ke mitra, atau dihapus sepenuhnya bergantung pada kebijakan vendor — yang biasanya tidak Anda baca.

Dikte lokal/di perangkat menjalankan pengenalan di CPU komputer Anda sendiri menggunakan model yang telah diunduh. Audio suara Anda tidak pernah meninggalkan perangkat. Tidak ada apa pun yang bisa dicatat, disimpan, atau dilatih oleh siapa pun, karena memang tidak ada yang diunggah sejak awal.

Alat mana saja yang termasuk apa, pada 2026

Lokal (suara Anda tetap di komputer Anda):

  • CaringDictate — sepenuhnya lokal. Whisper Large v3 Turbo berjalan di CPU Anda. Tidak ada yang diunggah, sama sekali. Kebijakan privasi di sini.
  • Dragon Professional Individual v16 — lokal. Teknologi pengenalan yang lebih lama, tetapi berjalan di komputer Anda.
  • Apple Dictation pada Mac dan iPhone yang lebih baru — lokal pada perangkat dengan Apple Neural Engine (Mac 2020+, iPhone XS atau yang lebih baru). Perangkat Apple yang lebih lama mengirim audio ke server Apple.
  • Microsoft Voice Access pada Windows 11 — lokal.
  • VoiceInk (Mac) — lokal.

Cloud (suara Anda dikirim ke sebuah server):

  • Dragon Anywhere — hanya cloud.
  • Dragon Medical One — hanya cloud.
  • Otter.ai — hanya cloud.
  • Wispr Flow — berbasis cloud (meski pemasaran menyiratkan sebaliknya; pengenalan mereka berjalan di server mereka).
  • Google Docs Voice Typing — hanya cloud. Audio dikirim ke Google.
  • Voiceitt — hanya cloud.
  • Perangkat Apple yang lebih lama — cloud, audio dikirim ke server Apple.

Bagi pengguna dengan percakapan yang relevan dengan HIPAA, pembahasan keuangan yang sensitif, kekhawatiran tentang kerahasiaan hukum, atau sekadar preferensi pribadi agar tidak didengar pihak ketiga — kategori cloud sama sekali tidak bisa diterima.

Apa arti "HIPAA compliant" yang biasa (dan bukan)

Banyak layanan dikte cloud beriklan sebagai "HIPAA compliant." Ini terdengar seperti jaminan privasi. Sebagian besar bukan.

Kepatuhan HIPAA bagi vendor cloud biasanya berarti vendor telah menandatangani Business Associate Agreement dengan entitas tercakup (rumah sakit, klinik), menerapkan kontrol akses tertentu, dan mengikuti persyaratan audit tertentu. Hal itu tidak berarti suara Anda tidak diunggah ke server mereka. Itu berarti mereka menangani unggahan tersebut sesuai aturan HIPAA — yang masih mencakup penyimpanan data, adanya karyawan yang memiliki akses ke data itu, dan (dalam banyak kasus) menggunakannya untuk peningkatan layanan.

Bagi pasien atau anggota keluarga perorangan yang menginginkan suaranya tidak pernah meninggalkan komputernya, uji yang tepat bukanlah "apakah ini HIPAA compliant?" Uji yang tepat adalah "apakah ini lokal?" Jika jawabannya ya, privasinya secara teknis dijamin oleh arsitektur, bukan oleh kebijakan. Jika jawabannya tidak — bahkan jika layanan cloud itu HIPAA compliant — suara Anda telah diunggah.

Apa yang sebenarnya disimpan, bahkan di layanan cloud

Untuk layanan dikte cloud, apa yang disimpan bervariasi. Pola yang umum meliputi:

  • Rekaman audio — disimpan untuk peningkatan layanan, pemecahan masalah, atau pelatihan model. Beberapa layanan membolehkan Anda menolak; banyak yang tidak.
  • Transkrip — keluaran teks sering kali disimpan tanpa batas waktu. Sebagian besar pengguna tidak menyadari bahwa transkrip dari segala hal yang mereka diktekan ada di cloud.
  • Metadata — waktu, informasi perangkat, alamat IP. Berguna untuk analitik, tetapi itu tetap data tentang penggunaan Anda.
  • Profil suara — beberapa layanan membangun profil suara Anda dari waktu ke waktu untuk pengenalan yang lebih baik. Ini secara harfiah adalah sidik suara, yang memiliki implikasi biometrik.

Tidak satu pun dari ini ada pada alat dikte lokal, karena memang tidak ada yang diunggah.

Pertanyaan soal "pelatihan AI"

Kini banyak orang yang secara wajar berhati-hati agar suara atau tulisan mereka tidak dipakai untuk melatih model AI. Layanan dikte cloud sering kali (tidak selalu) menyertakan klausul data pelatihan dalam ketentuan layanannya. Klausul ini memberi vendor lisensi untuk menggunakan audio dan transkrip Anda guna meningkatkan model pengenalan mereka.

Bagi sebagian pengguna ini tidak masalah. Bagi yang lain — terutama mereka yang menulis tentang kondisi medis, urusan keluarga, atau karya yang dilindungi hak kekayaan intelektual — ini tidak dapat diterima. Pertahanannya adalah menggunakan dikte lokal. Dengan CaringDictate (dan alat lokal sepenuhnya lainnya), tidak ada yang diunggah, jadi tidak ada yang bisa dilatih.

Pertanyaan soal keharusan internet

Persoalan yang terkait namun terpisah: dikte cloud memerlukan internet. Jika internet rumah Anda mati, dikte cloud Anda tidak berfungsi. Jika Anda bepergian ke tempat dengan konektivitas yang buruk, kualitas dikte Anda bisa menurun atau gagal sepenuhnya. Bagi pengguna yang bergantung pada dikte untuk alasan aksesibilitas, ketergantungan pada koneksi internet yang stabil ini adalah sebuah kerentanan.

Dikte lokal berfungsi tanpa internet. CaringDictate mengunduh model pengenalan sekali saja saat instalasi awal, dan sejak saat itu, ia berfungsi sepenuhnya luring. Ini penting untuk bepergian, untuk koneksi yang tidak menentu, dan untuk kasus (yang semakin jarang) ketika Anda sekadar tidak ingin komputer Anda "menelepon pulang" untuk segala hal.

Bagaimana CaringDictate menangani privasi secara khusus

Arsitektur kami sengaja dibuat sederhana untuk diverifikasi:

  • Whisper Large v3 Turbo (mesin pengenalan) diunduh sekali saja saat instalasi dan disimpan di komputer Anda.
  • Ketika Anda mendikte, audio ditangkap oleh mikrofon, diproses oleh Whisper di CPU Anda, dan diubah menjadi teks. Buffer audio kemudian dibuang.
  • Teks tersebut disisipkan ke kolom teks mana pun yang sedang ditempati kursor.
  • Tidak ada yang dikirim melalui internet. Tidak ada yang dicatat. Tidak ada yang disimpan.
  • Anda dapat memverifikasi ini dengan alat pemantauan jaringan apa pun — CaringDictate tidak membuat koneksi keluar apa pun selama dikte berlangsung.

Satu-satunya lalu lintas jaringan yang pernah dihasilkan CaringDictate adalah saat instalasi awal (mengunduh model pengenalan dan pemeriksaan pembaruan apa pun). Setelah terpasang, ia sepenuhnya luring.

Rekomendasi praktis menurut kasus penggunaan

Untuk dikte umum (email, dokumen, formulir web): Alat dikte lokal mana pun bisa digunakan — CaringDictate, Dragon, atau Apple Dictation pada Mac yang lebih baru.

Untuk percakapan medis atau pekerjaan yang relevan dengan HIPAA: Hanya lokal adalah jawaban yang tepat. CaringDictate dibuat khusus untuk ini; Dragon Professional yang lebih lama juga berfungsi (meski tanpa pembaruan).

Untuk rapat yang ingin Anda transkripsikan: Otter.ai adalah pilihan standar tetapi berbasis cloud — pastikan semua orang dalam rapat menyetujui hal itu.

Untuk tulisan pribadi yang sensitif terhadap privasi (jurnal, memoar): Pasti lokal. CaringDictate atau Apple Dictation yang lebih lama. Hindari layanan cloud sama sekali.

Ke mana melangkah dari sini

Untuk detail teknis lengkap tentang bagaimana CaringDictate menangani data Anda, lihat kebijakan privasikami. Untuk perbandingan dengan alternatif berbasis cloud, lihat vs Dragon Anywhere, vs Wispr Flow, vs Otter.ai.