La mayoría de las personas que usan el dictado por voz nunca piensan en adónde va realmente su voz. El marketing te dice que el software es "privado" o "seguro" y, en general, te lo crees. Para las conversaciones médicas, la escritura financiera y la correspondencia personal, esta confianza merece más escrutinio. Esto es lo que pasa de verdad cuando dictas en distintos productos.
La distinción entre nube y local
El reconocimiento de voz puede ejecutarse en dos lugares fundamentalmente distintos: en un servidor en algún punto de internet (la nube) o en el propio procesador de tu ordenador (local, en el dispositivo). La experiencia de uso es similar: hablas, aparecen las palabras, pero las implicaciones de privacidad son muy diferentes.
Dictado basado en la nube envía el audio de tu voz a un servidor, donde se ejecuta el reconocimiento, y devuelve el texto resultante. Tu voz se subió a la infraestructura de un tercero. Que ese audio se almacene, se registre, se use para entrenamiento, se comparta con socios o se elimine depende por completo de las políticas del proveedor, que normalmente no leíste.
Dictado local/en el dispositivo ejecuta el reconocimiento en el propio procesador de tu ordenador usando un modelo descargado. El audio de tu voz nunca sale del dispositivo. No hay nada que nadie pueda registrar, almacenar ni usar para entrenamiento, porque nada se subió en primer lugar.
Qué herramientas son cada cosa, en 2026
Local (tu voz se queda en tu ordenador):
- CaringDictate — totalmente local. Whisper Large v3 Turbo se ejecuta en tu propio ordenador. Nada se sube, nunca. Política de privacidad aquí.
- Dragon Professional Individual v16 — local. El reconocimiento se ejecuta en tu propio ordenador.
- Apple Dictation en Mac e iPhone más recientes — local en dispositivos con el Apple Neural Engine (Mac de 2020 en adelante, iPhone XS o más recientes). Los dispositivos Apple más antiguos envían el audio a los servidores de Apple.
- Microsoft Voice Access en Windows 11 — local.
- VoiceInk (Mac) — local.
Nube (tu voz va a un servidor):
- Dragon Medical One — solo en la nube.
- Otter.ai — solo en la nube.
- Wispr Flow — basado en la nube; el reconocimiento funciona en sus servidores.
- Google Docs Voice Typing — solo en la nube. El audio se envía a Google.
- Voiceitt — solo en la nube.
- Dispositivos Apple más antiguos — nube, el audio se envía a los servidores de Apple.
Para los usuarios con conversaciones relevantes para la HIPAA, debates financieros sensibles, preocupaciones de secreto profesional jurídico o simplemente por preferencia personal de que terceros no los oigan, la categoría de la nube es un rotundo no.
Qué suele significar "cumple con la HIPAA" (y qué no)
Muchos servicios de dictado en la nube anuncian que "cumplen con la HIPAA". Esto suena a garantía de privacidad. En su mayor parte no lo es.
El cumplimiento de HIPAA por parte de un proveedor en la nube generalmente significa que el proveedor ha firmado Acuerdos de Asociado Comercial con entidades cubiertas (hospitales, clínicas), ha implementado ciertos controles de acceso, y sigue ciertos requisitos de auditoría. Lo que no no significa es que su voz se quede en su computadora: con un servicio en la nube, el audio sí se envía al proveedor, y HIPAA regula cómo se maneja, no si se transmite en absoluto. Lo que hace cada proveedor en concreto con él se detalla en su propia política de privacidad y términos, que es el documento a leer.
Para un paciente individual o un familiar que quiere que su voz nunca salga de su ordenador, la pregunta correcta no es "¿cumple con la HIPAA?". La pregunta correcta es "¿es local?". Si la respuesta es sí, tu voz nunca sale de tu ordenador por diseño, no por una política. Si la respuesta es no —incluso si el servicio en la nube cumple con la HIPAA— tu voz se subió.
Qué se almacena en realidad, incluso en los servicios en la nube
En los servicios de dictado en la nube, lo que se almacena varía. Los patrones comunes incluyen:
- Grabaciones de audio — la retención varía según el proveedor y el plan; la política de privacidad de un proveedor es el lugar donde se indica esto.
- Transcripciones — los textos de salida a menudo se almacenan indefinidamente. La mayoría de los usuarios no se dan cuenta de que las transcripciones de todo lo que dictan existen en la nube.
- Metadatos — hora, información del dispositivo, dirección IP. Útil para analíticas, pero sigue siendo información sobre tu uso.
- Perfiles de voz — algunos servicios construyen un perfil de tu voz con el tiempo para un mejor reconocimiento. Esto es literalmente una huella vocal, lo que tiene implicaciones biométricas.
Nada de esto existe para las herramientas de dictado locales, porque nada se subió.
La cuestión del "entrenamiento de IA"
Mucha gente ahora desconfía con razón de que su voz o su escritura se usen para entrenar modelos de IA. Los servicios de dictado en la nube a menudo (no siempre) incluyen cláusulas de datos de entrenamiento en sus términos de servicio. Estas cláusulas conceden al proveedor una licencia para usar tu audio y tus transcripciones para mejorar sus modelos de reconocimiento.
Para algunos usuarios esto está bien. Para otros —especialmente quienes escriben sobre condiciones médicas, asuntos familiares o trabajo protegido intelectualmente— esto es inaceptable. La defensa es usar dictado local. Con CaringDictate (y cualquier otra herramienta totalmente local), nada se subió, así que no hay nada con lo que entrenar.
La cuestión de la necesidad de internet
Un asunto relacionado pero distinto: el dictado en la nube requiere internet. Si tu internet doméstico se cae, tu dictado en la nube no funciona. Si viajas a un lugar con mala conectividad, la calidad de tu dictado puede empeorar o fallar por completo. Para los usuarios que dependen del dictado por motivos de accesibilidad, esta dependencia de una conexión a internet estable es una vulnerabilidad.
El dictado local funciona sin internet. CaringDictate descarga el modelo de reconocimiento una vez durante la instalación inicial y, a partir de ese momento, funciona totalmente sin conexión. Esto importa para viajar, para las conexiones intermitentes y para los casos (cada vez más raros) en que simplemente no quieres que tu ordenador esté reportando todo a casa.
Cómo gestiona la privacidad CaringDictate en concreto
Nuestra arquitectura es intencionadamente sencilla de verificar:
- Whisper Large v3 Turbo (el motor de reconocimiento) se descarga una vez durante la instalación y se guarda en tu ordenador.
- Cuando dictas, el audio lo captura el micrófono, lo procesa Whisper en tu propio ordenador y se convierte en texto. El búfer de audio se descarta después.
- El texto se inserta en el campo de texto que tenga el cursor.
- Tu voz y tu texto dictado nunca se envían por internet, nunca se suben y nunca se almacenan en ningún servidor.
- Puedes verificar esto con cualquier herramienta de monitoreo de red: CaringDictate no realiza conexiones salientes durante el dictado.
El único tráfico de red que CaringDictate genera es durante la instalación inicial (descargar el modelo de reconocimiento y cualquier comprobación de actualización). Una vez instalado, funciona totalmente sin conexión.
Recomendaciones prácticas por caso de uso
Para el dictado general (correo, documentos, formularios web): Cualquier herramienta de dictado local servirá: CaringDictate, Dragon o Apple Dictation en un Mac más reciente.
Para conversaciones médicas o trabajo relevante para la HIPAA: Solo local es la respuesta correcta. CaringDictate está construido específicamente para esto, y Dragon Professional también ejecuta su reconocimiento en su propia computadora.
Para reuniones que quieras transcribir: Otter.ai es la opción estándar pero está basado en la nube: asegúrate de que todos en la reunión consienten a eso.
Para la escritura personal sensible para la privacidad (diarios, memorias): Definitivamente local. CaringDictate o el viejo Apple Dictation. Evita los servicios en la nube por completo.
A dónde ir desde aquí
Para el detalle técnico completo sobre cómo gestiona tus datos CaringDictate, consulta nuestra política de privacidad. Para comparaciones con otras opciones, consulte Dragon, frente a Wispr Flow, frente a Otter.ai.