Confidentialité des apps de dictée Mac : Où va vraiment votre voix ?
Chaque fois que vous utilisez une application de dictée vocale, vous envoyez un enregistrement audio de votre voix — vos mots, vos réunions, vos messages privés — quelque part. La question que la plupart des gens ne posent jamais est : où, exactement ? Qui le traite ? Combien de temps est-il conservé ? Pourrait-il être utilisé pour entraîner des modèles ?
Ce ne sont pas des préoccupations hypothétiques. Elles déterminent si vos notes médicales dictées, vos projets juridiques ou vos messages privés restent privés. Nous avons passé en revue les politiques de confidentialité, la documentation sur le comportement réseau et les divulgations d'architecture de chaque grande application de dictée Mac en 2026. Voici ce que nous avons trouvé.
Les trois niveaux de confidentialité
Après analyse de chaque application, elles se répartissent en trois catégories distinctes selon la façon dont elles traitent vos données audio :
- Tier 1 — API directe (le plus privé) : Votre audio va de votre Mac directement vers un seul point de terminaison API connu (OpenAI, Apple). Pas de serveur proxy tiers. Pas de stockage intermédiaire. Vous contrôlez la clé API.
- Tier 2 — Proxifié par le fournisseur (confidentialité partielle) : Votre audio transite par les propres serveurs du fournisseur avant d'atteindre un prestataire de transcription. Le fournisseur peut voir votre audio, peut le conserver et peut l'utiliser pour améliorer son produit.
- Tier 3 — Cloud propriétaire (le moins privé) : L'audio est entièrement traité sur l'infrastructure du fournisseur. Les conditions d'utilisation peuvent autoriser son utilisation pour l'entraînement de modèles. Les durées de conservation des données sont souvent indéfinies ou vagues.
La plupart des gens supposent que les applications pour lesquelles ils paient un abonnement se situent au Tier 1. La plupart ne le sont pas.
Analyse application par application
ParlaParla — Tier 1 (API directe)
ParlaParla utilise un modèle bring-your-own-key (BYOK). Vous fournissez votre propre clé API OpenAI, stockée localement dans les préférences de l'application sur votre Mac — pas sur un serveur. Lorsque vous dictez, votre Mac envoie l'audio directement à api.openai.com. Les serveurs de ParlaParla ne sont jamais dans le chemin parce qu'il n'y a pas de serveurs ParlaParla.
Cette architecture élimine toute une catégorie de risques pour la vie privée. Il n'y a pas de base de données fournisseur de votre audio. Il n'y a pas d'intermédiaire qui pourrait être piraté, assigné à comparaître ou racheté. Le chemin des données est : vous → OpenAI. Un point c'est tout.
Politique de traitement des données API d'OpenAI (en date de 2026) : l'audio soumis via l'API n'est pas utilisé pour entraîner des modèles par défaut, et est conservé jusqu'à 30 jours pour la surveillance des abus avant suppression. Vous pouvez demander une conservation zéro jour en contactant leur équipe enterprise. Il s'agit de la politique standard d'OpenAI, la même qui s'applique lorsque les développeurs appellent l'API directement.
ParlaParla ne collecte aucune donnée analytique, aucun rapport de plantage et aucune donnée d'utilisation. L'application est conforme à l'App Sandbox, ce qui signifie que son accès au système de fichiers et au réseau est limité à ce qu'autorise le bac à sable d'Apple.
Apple Dictation (intégré) — Tier 1 (Direct Apple)
La dictée intégrée d'Apple dispose d'une fonctionnalité de confidentialité importante que la plupart des utilisateurs négligent : le mode Dictée améliorée. Lorsqu'il est activé dans Réglages Système → Clavier → Dictée, il télécharge un modèle de langage sur votre Mac et traite tout localement en utilisant le Neural Engine. Aucun audio ne quitte jamais votre appareil.
La contrepartie est la précision. Le modèle sur l'appareil d'Apple est excellent pour la prose standard et le langage quotidien, mais est en retrait par rapport à Whisper d'OpenAI sur le vocabulaire technique, la parole accentuée et les langues autres que l'anglais. Pour de nombreux utilisateurs — en particulier ceux qui dictent en anglais sans terminologie spécialisée — c'est l'option la plus privée disponible gratuitement.
Le mode cloud envoie l'audio aux serveurs d'Apple. La politique de confidentialité d'Apple est solide : ils ne vendent pas de données et ne les utilisent pas pour la publicité, et le traitement des données est régi par le cadre de confidentialité d'Apple, qui inclut la conformité au RGPD pour les utilisateurs européens. Mais l'audio quitte votre appareil.
Wispr Flow — Tier 2 (Proxifié par le fournisseur)
Wispr Flow indique de manière transparente que l'audio transite par leur infrastructure. Extrait de leur politique de confidentialité : « Nous collectons des enregistrements audio et des transcriptions pour fournir nos services et pouvons utiliser ces données pour améliorer nos produits. » Il existe un mécanisme d'opt-out pour l'utilisation des données d'entraînement, mais il n'est pas activé par défaut.
L'application achemine l'audio via les serveurs de Wispr, qui effectuent des fonctionnalités d'amélioration par IA et de conscience contextuelle. Ces fonctionnalités côté serveur — la « compréhension IA » de ce que vous faites à l'écran — nécessitent que votre audio soit traité dans leur cloud, pas seulement transmis à une API de transcription.
Wispr Flow est distribué en dehors du Mac App Store et ne dispose pas d'une autorisation App Sandbox. Cela signifie qu'il peut accéder à davantage de votre système de fichiers et de vos ressources système que les applications en bac à sable. Cela est nécessaire pour certaines de ses fonctionnalités contextuelles, mais il est utile de le savoir.
Rien de tout cela ne rend Wispr Flow non sécurisé — c'est une startup bien financée avec une politique de confidentialité crédible. Mais vous faites confiance à un tiers avec votre audio, pas seulement à OpenAI.
Superwhisper — Tier 2 (Proxifié par le fournisseur avec option locale)
Superwhisper offre quelque chose de réellement précieux pour les utilisateurs soucieux de leur vie privée : un mode de traitement local. Si vous sélectionnez l'un de leurs niveaux de modèle Whisper sur l'appareil, votre audio ne quitte jamais votre Mac. La précision et la vitesse varient selon le matériel de votre Mac — les Mac à puce M gèrent bien les modèles locaux ; les Mac Intel peuvent trouver l'expérience lente.
Le mode cloud transite par l'infrastructure de Superwhisper, similaire à Wispr Flow. Leur politique de confidentialité permet d'utiliser les données de transcription pour améliorer leurs services, sauf si vous vous y opposez explicitement.
L'option de modèle local fait de Superwhisper le meilleur choix pour une confidentialité hors ligne en priorité, en particulier pour les utilisateurs qui ne souhaitent aucune dépendance réseau pour la transcription.
Whisper Transcription — Tier 2 (API directe, partielle)
Whisper Transcription sur le Mac App Store prend en charge BYOK (bring your own key), ce qui en fait un Tier 1 lorsqu'il est configuré de cette façon. Si vous utilisez plutôt les crédits API intégrés de l'application, vous utilisez la clé du développeur et le modèle de confidentialité change : le compte du développeur voit votre audio, pas seulement OpenAI.
À noter : Whisper Transcription est principalement un enregistreur de transcription, pas un outil de dictée push-to-talk à l'échelle du système. Il est excellent pour transcrire de longs enregistrements ou des fichiers, mais ne s'intègre pas aux autres applications comme le font ParlaParla ou Wispr Flow.
Otter.ai — Tier 3 (Cloud propriétaire)
Otter.ai est un service de transcription axé sur la collaboration, pas un outil de dictée push-to-talk — mais il apparaît dans suffisamment de recherches « meilleure application de dictée » pour justifier son inclusion. Tout l'audio est traité sur l'infrastructure propriétaire d'Otter, et leur modèle commercial inclut des ventes additionnelles enterprise qui dépendent du fait que les transcriptions stockées soient consultables et partageables.
Si votre cas d'usage est la transcription de réunions où vous souhaitez que les enregistrements soient stockés et accessibles, Otter est raisonnable. Pour une dictée privée en temps réel de contenu sensible, le Tier 3 est le mauvais choix.
Les questions à poser avant de choisir
Avant de sélectionner une application de dictée, ces cinq questions vous diront l'essentiel de ce que vous devez savoir sur sa posture en matière de confidentialité :
- L'audio quitte-t-il mon appareil, et si oui, où va-t-il ? « Nos serveurs » est moins informatif que « l'API d'OpenAI » ou « les serveurs d'Apple ». Plus la réponse est précise, mieux c'est.
- Mon audio est-il utilisé pour entraîner des modèles ? Recherchez un « non » explicite ou un mécanisme d'opt-out. Un langage vague comme « améliorer nos produits » signifie généralement oui.
- Combien de temps l'audio est-il conservé ? Des fenêtres courtes et définies (30 jours, puis supprimé) sont préférables à une conservation indéfinie. « Aussi longtemps que nécessaire » est un signal d'alarme.
- L'application est-elle en bac à sable ? Les applications du Mac App Store doivent être en bac à sable — leur accès aux fichiers et au réseau est limité. Les applications distribuées en dehors de l'App Store peuvent avoir un accès système plus large.
- Qu'arrive-t-il à mes données si l'entreprise est rachetée ? Les acquisitions de startups incluent régulièrement les actifs de données. Votre bibliothèque audio devenant partie d'une acquisition est un risque réel avec tout service dépendant du cloud.
Tableau récapitulatif
| Application | Routage audio | Opt-out entraînement | Option locale | Bac à sable | Niveau de confidentialité |
|---|---|---|---|---|---|
| ParlaParla | Mac → API OpenAI (direct) | OpenAI par défaut : pas d'entraînement | Non | Oui (App Store) | Tier 1 |
| Apple Dictation (Améliorée) | Sur l'appareil uniquement | N/A — pas de réseau | Oui (mode Amélioré) | Oui (système) | Tier 1 |
| Whisper Transcription (BYOK) | Mac → API OpenAI (direct) | OpenAI par défaut : pas d'entraînement | Non | Oui (App Store) | Tier 1 |
| Superwhisper (mode local) | Sur l'appareil uniquement | N/A — pas de réseau | Oui | Non | Tier 1–2 |
| Wispr Flow | Mac → serveurs Wispr → IA | Opt-out disponible | Non | Non | Tier 2 |
| Superwhisper (cloud) | Mac → serveurs Superwhisper | Opt-out disponible | Oui | Non | Tier 2 |
| Otter.ai | Mac → cloud Otter | Pas clairement disponible | Non | Non évalué | Tier 3 |
Ce que « Pas de serveurs ParlaParla » signifie vraiment
Nous souhaitons être directs sur quelque chose : nous avons construit ParlaParla, vous devriez donc peser nos affirmations à ce sujet en conséquence. Mais l'architecture BYOK est vérifiable. Si vous êtes techniquement compétent, vous pouvez surveiller le trafic réseau de ParlaParla en utilisant un outil comme Little Snitch ou Charles Proxy et confirmer que les connexions sortantes vont uniquement vers api.openai.com — pas d'autres hôtes, pas de points de terminaison analytiques, pas de balises de télémétrie.
Le chemin du code est : entrée microphone → tampon audio local → HTTP POST vers https://api.openai.com/v1/audio/transcriptions en utilisant votre clé API. La réponse revient sous forme de JSON avec le texte de transcription, qui est inséré à votre curseur. Votre audio n'est pas stocké localement après la transcription. Il n'est pas mis en cache. Il n'est pas journalisé.
L'architecture de confidentialité n'est pas une affirmation marketing — c'est une conséquence du modèle BYOK. Il n'y a pas de serveurs ParlaParla sur lesquels stocker de l'audio parce qu'il n'y a tout simplement pas de serveurs ParlaParla.
Choisir en fonction de votre modèle de menace
La confidentialité n'est pas binaire, et le bon choix dépend de ce qui vous préoccupe réellement :
Si vous dictez du contenu très sensible (juridique, médical, financier, sources journalistiques), optez pour le Tier 1 avec BYOK, ou utilisez la Dictée améliorée d'Apple pour un traitement entièrement sur l'appareil. Rien ne quitte votre Mac.
Si vous êtes un développeur qui souhaite une dictée rapide, précise et à l'échelle du système et que vous avez déjà une clé API OpenAI, ParlaParla ou Whisper Transcription (BYOK) sont les choix évidents. Le même moteur de transcription que les applications à 15 $/mois, appel API direct, achat unique.
Si vous voulez zéro dépendance internet et que vous avez un Mac à puce M, le mode local de Superwhisper ou la Dictée améliorée d'Apple sont vos meilleures options. Les deux exécutent des modèles sur l'appareil en utilisant le Neural Engine.
Si la confidentialité est une préoccupation secondaire et que vous souhaitez l'ensemble de fonctionnalités le plus riche avec une conscience contextuelle IA, Wispr Flow l'offre — mais comprenez que votre audio transite par leur infrastructure, et leur modèle commercial dépend de cet arrangement.
La meilleure application de dictée pour la confidentialité est celle dont l'architecture correspond à ce que vous êtes prêt à faire confiance.
ParlaParla est l'application de dictée Mac conçue autour d'un accès API direct — votre voix va de votre Mac à OpenAI, nulle part ailleurs. Achat unique, configuration en 2 minutes, sans abonnement.
En savoir plus sur ParlaParla →