La mayoría de las personas que usan el dictado por voz nunca piensan en adónde va realmente su voz. El marketing te dice que el software es "privado" o "seguro" y, en general, te lo crees. Para las conversaciones médicas, la escritura financiera y la correspondencia personal, esta confianza merece más escrutinio. Esto es lo que pasa de verdad cuando dictas en distintos productos.
La distinción entre nube y local
El reconocimiento de voz puede ejecutarse en dos lugares fundamentalmente distintos: en un servidor en algún punto de internet (la nube) o en el propio procesador de tu ordenador (local, en el dispositivo). La experiencia de uso es similar: hablas, aparecen las palabras, pero las implicaciones de privacidad son muy diferentes.
Dictado basado en la nube envía el audio de tu voz a un servidor, donde se ejecuta el reconocimiento, y devuelve el texto resultante. Tu voz se subió a la infraestructura de un tercero. Que ese audio se almacene, se registre, se use para entrenamiento, se comparta con socios o se elimine depende por completo de las políticas del proveedor, que normalmente no leíste.
Dictado local/en el dispositivo ejecuta el reconocimiento en el propio procesador de tu ordenador usando un modelo descargado. El audio de tu voz nunca sale del dispositivo. No hay nada que nadie pueda registrar, almacenar ni usar para entrenamiento, porque nada se subió en primer lugar.
Qué herramientas son cada cosa, en 2026
Local (tu voz se queda en tu ordenador):
- CaringDictate — totalmente local. Whisper Large v3 Turbo se ejecuta en tu CPU. Nada se sube, nunca. Política de privacidad aquí.
- Dragon Professional Individual v16 — local. Tecnología de reconocimiento más antigua, pero se ejecuta en tu ordenador.
- Apple Dictation en Mac e iPhone más recientes — local en dispositivos con el Apple Neural Engine (Mac de 2020 en adelante, iPhone XS o más recientes). Los dispositivos Apple más antiguos envían el audio a los servidores de Apple.
- Microsoft Voice Access en Windows 11 — local.
- VoiceInk (Mac) — local.
Nube (tu voz va a un servidor):
- Dragon Anywhere — solo en la nube.
- Dragon Medical One — solo en la nube.
- Otter.ai — solo en la nube.
- Wispr Flow — basado en la nube (a pesar de que el marketing dé a entender lo contrario; su reconocimiento se ejecuta en sus servidores).
- Google Docs Voice Typing — solo en la nube. El audio se envía a Google.
- Voiceitt — solo en la nube.
- Dispositivos Apple más antiguos — nube, el audio se envía a los servidores de Apple.
Para los usuarios con conversaciones relevantes para la HIPAA, debates financieros sensibles, preocupaciones de secreto profesional jurídico o simplemente por preferencia personal de que terceros no los oigan, la categoría de la nube es un rotundo no.
Qué suele significar "cumple con la HIPAA" (y qué no)
Muchos servicios de dictado en la nube anuncian que "cumplen con la HIPAA". Esto suena a garantía de privacidad. En su mayor parte no lo es.
El cumplimiento de la HIPAA para un proveedor de nube suele significar que el proveedor ha firmado Acuerdos de Asociado Comercial con entidades cubiertas (hospitales, clínicas), ha implementado ciertos controles de acceso y sigue ciertos requisitos de auditoría. No no significa que tu voz no se suba a sus servidores. Significa que manejan esa subida según las reglas de la HIPAA, lo que aún incluye almacenar los datos, tener empleados con acceso a ellos y (en muchos casos) usarlos para mejorar el servicio.
Para un paciente o familiar individual que quiere que su voz nunca salga de su ordenador, la prueba correcta no es "¿cumple con la HIPAA?". La prueba correcta es "¿es local?". Si la respuesta es sí, la privacidad está garantizada técnicamente por la arquitectura, no por una política. Si la respuesta es no —aunque el servicio en la nube cumpla con la HIPAA— tu voz se subió.
Qué se almacena en realidad, incluso en los servicios en la nube
En los servicios de dictado en la nube, lo que se almacena varía. Los patrones comunes incluyen:
- Grabaciones de audio — conservadas para mejorar el servicio, depurar o entrenar modelos. Algunos servicios te dejan optar por no participar; muchos no.
- Transcripciones — los textos de salida a menudo se almacenan indefinidamente. La mayoría de los usuarios no se dan cuenta de que las transcripciones de todo lo que dictan existen en la nube.
- Metadatos — hora, información del dispositivo, dirección IP. Útil para analíticas, pero sigue siendo información sobre tu uso.
- Perfiles de voz — algunos servicios construyen un perfil de tu voz con el tiempo para un mejor reconocimiento. Esto es literalmente una huella vocal, lo que tiene implicaciones biométricas.
Nada de esto existe para las herramientas de dictado locales, porque nada se subió.
La cuestión del "entrenamiento de IA"
Mucha gente ahora desconfía con razón de que su voz o su escritura se usen para entrenar modelos de IA. Los servicios de dictado en la nube a menudo (no siempre) incluyen cláusulas de datos de entrenamiento en sus términos de servicio. Estas cláusulas conceden al proveedor una licencia para usar tu audio y tus transcripciones para mejorar sus modelos de reconocimiento.
Para algunos usuarios esto está bien. Para otros —especialmente quienes escriben sobre condiciones médicas, asuntos familiares o trabajo protegido intelectualmente— esto es inaceptable. La defensa es usar dictado local. Con CaringDictate (y cualquier otra herramienta totalmente local), nada se subió, así que no hay nada con lo que entrenar.
La cuestión de la necesidad de internet
Un asunto relacionado pero distinto: el dictado en la nube requiere internet. Si tu internet doméstico se cae, tu dictado en la nube no funciona. Si viajas a un lugar con mala conectividad, la calidad de tu dictado puede empeorar o fallar por completo. Para los usuarios que dependen del dictado por motivos de accesibilidad, esta dependencia de una conexión a internet estable es una vulnerabilidad.
El dictado local funciona sin internet. CaringDictate descarga el modelo de reconocimiento una vez durante la instalación inicial y, a partir de ese momento, funciona totalmente sin conexión. Esto importa para viajar, para las conexiones intermitentes y para los casos (cada vez más raros) en que simplemente no quieres que tu ordenador esté reportando todo a casa.
Cómo gestiona la privacidad CaringDictate en concreto
Nuestra arquitectura es intencionadamente sencilla de verificar:
- Whisper Large v3 Turbo (el motor de reconocimiento) se descarga una vez durante la instalación y se guarda en tu ordenador.
- Cuando dictas, el micrófono captura el audio, Whisper lo procesa en tu CPU y lo convierte en texto. El búfer de audio se descarta a continuación.
- El texto se inserta en el campo de texto que tenga el cursor.
- No se envía nada por internet. No se registra nada. No se almacena nada.
- Puedes verificar esto con cualquier herramienta de monitoreo de red: CaringDictate no realiza conexiones salientes durante el dictado.
El único tráfico de red que CaringDictate genera es durante la instalación inicial (descargar el modelo de reconocimiento y cualquier comprobación de actualización). Una vez instalado, funciona totalmente sin conexión.
Recomendaciones prácticas por caso de uso
Para el dictado general (correo, documentos, formularios web): Cualquier herramienta de dictado local servirá: CaringDictate, Dragon o Apple Dictation en un Mac más reciente.
Para conversaciones médicas o trabajo relevante para la HIPAA: Lo correcto es solo local. CaringDictate está construido específicamente para esto; el viejo Dragon Professional también funciona (aunque le faltan actualizaciones).
Para reuniones que quieras transcribir: Otter.ai es la opción estándar pero está basado en la nube: asegúrate de que todos en la reunión consienten a eso.
Para la escritura personal sensible para la privacidad (diarios, memorias): Definitivamente local. CaringDictate o el viejo Apple Dictation. Evita los servicios en la nube por completo.
A dónde ir desde aquí
Para el detalle técnico completo sobre cómo gestiona tus datos CaringDictate, consulta nuestra política de privacidad. Para comparaciones con alternativas basadas en la nube, mira frente a Dragon Anywhere, frente a Wispr Flow, frente a Otter.ai.