Privacidad en apps de dictado para Mac: ¿A dónde va realmente tu voz?
Cada vez que usas una aplicación de dictado de voz, estás enviando audio de tu voz — tus palabras, tus reuniones, tus mensajes privados — a algún lugar. La pregunta que la mayoría de personas nunca hace es: ¿adónde, exactamente? ¿Quién lo procesa? ¿Cuánto tiempo se conserva? ¿Podría usarse para entrenar modelos?
No son preocupaciones hipotéticas. Determinan si tus notas médicas dictadas, borradores legales o mensajes privados permanecen privados. Revisamos las políticas de privacidad, la documentación sobre el comportamiento de red y las divulgaciones de arquitectura de cada gran aplicación de dictado para Mac en 2026. Esto es lo que encontramos.
Los tres niveles de privacidad
Tras analizar cada aplicación, se agrupan en tres categorías distintas según cómo gestionan tu audio:
- Tier 1 — API directa (más privado): Tu audio va desde tu Mac directamente a un único punto de acceso API conocido (OpenAI, Apple). Sin servidor proxy de terceros. Sin almacenamiento intermedio. Tú controlas la clave API.
- Tier 2 — Proxificado por el proveedor (privacidad parcial): Tu audio viaja a través de los propios servidores del proveedor antes de llegar a un proveedor de transcripción. El proveedor puede ver tu audio, puede retenerlo y puede usarlo para mejorar su producto.
- Tier 3 — Nube propietaria (menos privado): El audio se procesa íntegramente en la infraestructura del proveedor. Los términos de servicio pueden permitir su uso para el entrenamiento de modelos. Los períodos de retención de datos suelen ser indefinidos o vagos.
La mayoría de personas asume que las aplicaciones por las que pagan una suscripción están en el Tier 1. La mayoría no lo están.
Análisis aplicación por aplicación
ParlaParla — Tier 1 (API directa)
ParlaParla utiliza un modelo bring-your-own-key (BYOK). Tú proporcionas tu propia clave API de OpenAI, almacenada localmente en las preferencias de la aplicación de tu Mac — no en ningún servidor. Cuando dictas, tu Mac envía el audio directamente a api.openai.com. Los servidores de ParlaParla nunca están en el camino porque no hay servidores de ParlaParla.
Esta arquitectura elimina toda una categoría de riesgos de privacidad. No existe una base de datos del proveedor con tu audio. No hay intermediario que pueda ser hackeado, citado judicialmente o adquirido. El camino de los datos es: tú → OpenAI. Punto final.
Política de manejo de datos de la API de OpenAI (a fecha de 2026): el audio enviado a través de la API no se usa para entrenar modelos por defecto, y se retiene hasta 30 días para monitorización de abusos antes de su eliminación. Puedes solicitar retención cero días contactando con su equipo enterprise. Esta es la política estándar de OpenAI, la misma que aplica cuando los desarrolladores llaman directamente a la API.
ParlaParla no recopila ningún dato analítico, ningún informe de fallos ni ningún dato de uso. La aplicación cumple con App Sandbox, lo que significa que su acceso al sistema de archivos y a la red está restringido a lo que permite el sandbox de Apple.
Apple Dictation (integrada) — Tier 1 (Directo Apple)
La dictación integrada de Apple tiene una funcionalidad de privacidad importante que la mayoría de usuarios pasan por alto: el modo Dictado mejorado. Cuando está activado en Configuración del Sistema → Teclado → Dictado, descarga un modelo de lenguaje a tu Mac y procesa todo localmente usando el Neural Engine. Ningún audio abandona jamás tu dispositivo.
La contrapartida es la precisión. El modelo en el dispositivo de Apple es excelente para prosa estándar y lenguaje cotidiano, pero queda por detrás de Whisper de OpenAI en vocabulario técnico, habla con acento e idiomas distintos al inglés. Para muchos usuarios — especialmente quienes dictan en inglés sin terminología especializada — es la opción más privada disponible sin coste alguno.
El modo nube envía el audio a los servidores de Apple. La política de privacidad de Apple es sólida: no venden datos ni los usan para publicidad, y el manejo de datos está regido por el marco de privacidad de Apple, que incluye el cumplimiento del RGPD para usuarios europeos. Pero el audio sí abandona tu dispositivo.
Wispr Flow — Tier 2 (Proxificado por el proveedor)
Wispr Flow es transparente en que el audio viaja a través de su infraestructura. De su política de privacidad: «Recopilamos grabaciones de audio y transcripciones para proporcionar nuestros servicios y podemos usar estos datos para mejorar nuestros productos.» Existe un mecanismo de opt-out para el uso de datos de entrenamiento, pero no es opt-in por defecto.
La aplicación enruta el audio a través de los servidores de Wispr, que realizan mejoras con IA y funciones de conciencia contextual. Estas funciones del lado del servidor — la «comprensión IA» de lo que estás haciendo en pantalla — requieren que tu audio sea procesado en su nube, no simplemente reenviado a una API de transcripción.
Wispr Flow se distribuye fuera del Mac App Store y no tiene la autorización App Sandbox. Esto significa que puede acceder a más partes de tu sistema de archivos y recursos del sistema que las aplicaciones con sandbox. Esto es necesario para algunas de sus funciones contextuales, pero vale la pena saberlo.
Nada de esto hace que Wispr Flow sea inseguro — es una startup bien financiada con una política de privacidad creíble. Pero estás confiando tu audio a un tercero, no solo a OpenAI.
Superwhisper — Tier 2 (Proxificado por el proveedor con opción local)
Superwhisper ofrece algo genuinamente valioso para los usuarios preocupados por la privacidad: un modo de procesamiento local. Si seleccionas uno de sus niveles de modelo Whisper en el dispositivo, tu audio nunca abandona tu Mac. La precisión y velocidad varían según el hardware de tu Mac — los Mac con chip M gestionan bien los modelos locales; los Mac Intel pueden encontrar la experiencia lenta.
El modo nube enruta a través de la infraestructura de Superwhisper, similar a Wispr Flow. Su política de privacidad permite usar los datos de transcripción para mejorar sus servicios a menos que te opongas explícitamente.
La opción de modelo local hace de Superwhisper la mejor elección para privacidad offline prioritaria, especialmente para usuarios que no desean ninguna dependencia de red para la transcripción.
Whisper Transcription — Tier 2 (API directa, parcial)
Whisper Transcription en el Mac App Store admite BYOK (bring your own key), lo que lo convierte en Tier 1 cuando se configura de esa manera. Si en cambio usas los créditos API integrados de la aplicación, estás usando la clave del desarrollador y el modelo de privacidad cambia: la cuenta del desarrollador ve tu audio, no solo OpenAI.
Vale la pena mencionar: Whisper Transcription es principalmente una grabadora de transcripción, no una herramienta de dictado push-to-talk para todo el sistema. Es excelente para transcribir grabaciones largas o archivos, pero no se integra en otras aplicaciones de la manera en que lo hacen ParlaParla o Wispr Flow.
Otter.ai — Tier 3 (Nube propietaria)
Otter.ai es un servicio de transcripción orientado a la colaboración, no una herramienta de dictado push-to-talk — pero aparece en suficientes búsquedas de «mejor app de dictado» como para justificar su inclusión. Todo el audio se procesa en la infraestructura propietaria de Otter, y su modelo de negocio incluye ventas adicionales enterprise que dependen de que las transcripciones almacenadas sean buscables y compartibles.
Si tu caso de uso es la transcripción de reuniones donde quieres grabaciones almacenadas y accesibles, Otter es razonable. Para dictado privado en tiempo real de contenido sensible, el Tier 3 es la opción equivocada.
Las preguntas que vale la pena hacer antes de elegir
Antes de seleccionar una app de dictado, estas cinco preguntas te dirán la mayor parte de lo que necesitas saber sobre su postura en privacidad:
- ¿El audio abandona mi dispositivo y, si es así, adónde va? «Nuestros servidores» es menos informativo que «la API de OpenAI» o «los servidores de Apple». Cuanto más específica sea la respuesta, mejor.
- ¿Se usa mi audio para entrenar modelos? Busca un «no» explícito o un mecanismo de opt-out. El lenguaje vago como «mejorar nuestros productos» normalmente significa sí.
- ¿Cuánto tiempo se retiene el audio? Las ventanas cortas y definidas (30 días, luego se elimina) son mejores que la retención indefinida. «El tiempo que sea necesario» es una señal de alerta.
- ¿Está la aplicación en sandbox? Las aplicaciones del Mac App Store deben tener sandbox — su acceso a archivos y red está restringido. Las aplicaciones distribuidas fuera del App Store pueden tener acceso más amplio al sistema.
- ¿Qué pasa con mis datos si la empresa es adquirida? Las adquisiciones de startups incluyen rutinariamente activos de datos. Que tu biblioteca de audio forme parte de una adquisición es un riesgo real con cualquier servicio dependiente de la nube.
Tabla resumen
| App | Enrutamiento de audio | Opt-out entrenamiento | Opción local | Sandbox | Nivel de privacidad |
|---|---|---|---|---|---|
| ParlaParla | Mac → API OpenAI (directa) | OpenAI por defecto: sin entrenamiento | No | Sí (App Store) | Tier 1 |
| Apple Dictation (Mejorado) | Solo en el dispositivo | N/A — sin red | Sí (modo Mejorado) | Sí (sistema) | Tier 1 |
| Whisper Transcription (BYOK) | Mac → API OpenAI (directa) | OpenAI por defecto: sin entrenamiento | No | Sí (App Store) | Tier 1 |
| Superwhisper (modo local) | Solo en el dispositivo | N/A — sin red | Sí | No | Tier 1–2 |
| Wispr Flow | Mac → servidores Wispr → IA | Opt-out disponible | No | No | Tier 2 |
| Superwhisper (nube) | Mac → servidores Superwhisper | Opt-out disponible | Sí | No | Tier 2 |
| Otter.ai | Mac → nube de Otter | No claramente disponible | No | No evaluado | Tier 3 |
Lo que «Sin servidores ParlaParla» significa realmente
Queremos ser directos sobre algo: nosotros construimos ParlaParla, por lo que debes sopesar nuestras afirmaciones al respecto en consecuencia. Pero la arquitectura BYOK es verificable. Si tienes conocimientos técnicos, puedes monitorizar el tráfico de red de ParlaParla usando una herramienta como Little Snitch o Charles Proxy y confirmar que las conexiones salientes van únicamente a api.openai.com — sin otros hosts, sin puntos de análisis, sin balizas de telemetría.
El camino del código es: entrada del micrófono → búfer de audio local → HTTP POST a https://api.openai.com/v1/audio/transcriptions usando tu clave API. La respuesta vuelve como JSON con el texto de transcripción, que se inserta en tu cursor. Tu audio no se almacena localmente tras completarse la transcripción. No se almacena en caché. No se registra.
La arquitectura de privacidad no es una afirmación de marketing — es una consecuencia del modelo BYOK. No hay servidores de ParlaParla donde almacenar audio porque no hay servidores de ParlaParla en absoluto.
Elegir según tu modelo de amenaza
La privacidad no es binaria, y la elección correcta depende de lo que realmente te preocupa:
Si dictas contenido muy sensible (legal, médico, financiero, fuentes periodísticas), opta por el Tier 1 con BYOK, o usa el Dictado mejorado de Apple para un procesamiento completamente en el dispositivo. Nada abandona tu Mac.
Si eres un desarrollador que quiere dictado rápido, preciso y para todo el sistema y ya tienes una clave API de OpenAI, ParlaParla o Whisper Transcription (BYOK) son las opciones obvias. El mismo motor de transcripción que las apps de 15 $/mes, llamada API directa, compra única.
Si quieres cero dependencia de internet y tienes un Mac con chip M, el modo local de Superwhisper o el Dictado mejorado de Apple son tus mejores opciones. Ambos ejecutan modelos en el dispositivo usando el Neural Engine.
Si la privacidad es una preocupación secundaria y quieres el conjunto de funciones más rico con conciencia contextual de IA, Wispr Flow ofrece eso — pero entiende que tu audio fluye a través de su infraestructura y su modelo de negocio depende de ese acuerdo.
La mejor app de dictado para la privacidad es aquella cuya arquitectura se corresponde con lo que estás dispuesto a confiar.
ParlaParla es la app de dictado para Mac creada en torno al acceso API directo — tu voz va desde tu Mac a OpenAI, en ningún otro lugar. Compra única, configuración en 2 minutos, sin suscripción.
Saber más sobre ParlaParla →