Datenschutz bei Mac-Diktier-Apps: Wohin geht Ihre Stimme wirklich?
Jedes Mal, wenn Sie eine Spracheingabe-App nutzen, senden Sie Audioaufnahmen Ihrer Stimme — Ihre Worte, Ihre Meetings, Ihre privaten Nachrichten — irgendwohin. Die Frage, die die meisten Menschen nie stellen, lautet: Wohin genau? Wer verarbeitet das? Wie lange wird es gespeichert? Könnte es zum Training von Modellen verwendet werden?
Das sind keine hypothetischen Bedenken. Sie entscheiden darüber, ob Ihre diktierten Arztnotizen, Rechtsentwürfe oder privaten Nachrichten wirklich privat bleiben. Wir haben die Datenschutzrichtlinien, Dokumentationen zum Netzwerkverhalten und Architekturoffenlegungen jeder wichtigen Mac-Diktier-App im Jahr 2026 durchforstet. Das haben wir herausgefunden.
Die drei Datenschutz-Stufen
Nach der Analyse jeder App lassen sie sich anhand ihres Umgangs mit Ihren Audiodaten in drei unterschiedliche Kategorien einteilen:
- Tier 1 — Direkte API (privateste Option): Ihre Audiodaten gehen von Ihrem Mac direkt an einen einzigen bekannten API-Endpunkt (OpenAI, Apple). Kein Drittanbieter-Proxyserver. Keine Zwischenspeicherung. Sie kontrollieren den API-Schlüssel.
- Tier 2 — Anbieter-Proxy (teilweise Privatsphäre): Ihre Audiodaten laufen über die eigenen Server des Anbieters, bevor sie einen Transkriptionsdienstleister erreichen. Der Anbieter kann Ihre Audiodaten einsehen, sie möglicherweise speichern und zur Produktverbesserung nutzen.
- Tier 3 — Proprietäre Cloud (am wenigsten privat): Audio wird vollständig auf der Infrastruktur des Anbieters verarbeitet. Die Nutzungsbedingungen können die Verwendung zum Modelltraining erlauben. Aufbewahrungsfristen sind oft unbegrenzt oder vage formuliert.
Die meisten Menschen gehen davon aus, dass die Apps, für die sie ein Abonnement bezahlen, in Tier 1 liegen. Die meisten tun es nicht.
App-für-App-Analyse
ParlaParla — Tier 1 (Direkte API)
ParlaParla verwendet ein Bring-your-own-key (BYOK)-Modell. Sie stellen Ihren eigenen OpenAI API-Schlüssel bereit, der lokal in den App-Einstellungen Ihres Macs gespeichert wird — nicht auf einem Server. Wenn Sie diktieren, sendet Ihr Mac Audiodaten direkt an api.openai.com. ParlaParlas Server sind nie im Übertragungsweg, weil es keine ParlaParla-Server gibt.
Diese Architektur eliminiert eine ganze Klasse von Datenschutzrisiken. Es gibt keine Anbieter-Datenbank mit Ihren Audiodaten. Es gibt keinen Mittelsmann, der gehackt, vorgeladen oder übernommen werden könnte. Der Datenpfad lautet: Sie → OpenAI. Punkt.
OpenAIs API-Datenverarbeitungsrichtlinie (Stand 2026): Über die API übermittelte Audiodaten werden standardmäßig nicht zum Modelltraining verwendet und werden bis zu 30 Tage zur Missbrauchsüberwachung gespeichert, bevor sie gelöscht werden. Sie können eine Null-Tage-Aufbewahrung beantragen, indem Sie das Enterprise-Team kontaktieren. Dies ist OpenAIs Standardrichtlinie, dieselbe, die gilt, wenn Entwickler die API direkt aufrufen.
ParlaParla sammelt keine Analysedaten, keine Absturzberichte und keine Nutzungsdaten. Die App ist App Sandbox-konform, was bedeutet, dass ihr Dateisystem- und Netzwerkzugriff auf das beschränkt ist, was Apples Sandbox erlaubt.
Apple Dictation (integriert) — Tier 1 (Direkt Apple)
Apples integrierte Diktierfunktion hat eine wichtige Datenschutzfunktion, die die meisten Nutzer übersehen: den Modus „Erweiterte Diktierfunktion". Wenn er in Systemeinstellungen → Tastatur → Diktierfunktion aktiviert ist, lädt er ein Sprachmodell auf Ihren Mac herunter und verarbeitet alles lokal mit der Neural Engine. Keine Audiodaten verlassen jemals Ihr Gerät.
Der Kompromiss ist die Genauigkeit. Apples On-Device-Modell ist ausgezeichnet für Standardprosa und alltägliche Sprache, liegt aber beim technischen Vokabular, akzentbehafteter Sprache und Nicht-Englisch-Sprachen hinter OpenAIs Whisper zurück. Für viele Nutzer — besonders für diejenigen, die auf Englisch ohne Fachterminologie diktieren — ist es die privateste Option zum Nulltarif.
Der Cloud-Modus sendet Audiodaten an Apples Server. Apples Datenschutzrichtlinie ist stark: Sie verkaufen keine Daten und verwenden sie nicht für Werbung, und die Datenverarbeitung unterliegt Apples Datenschutzrahmen, der die DSGVO-Konformität für europäische Nutzer einschließt. Aber die Audiodaten verlassen Ihr Gerät.
Wispr Flow — Tier 2 (Anbieter-Proxy)
Wispr Flow gibt transparent an, dass Audiodaten ihre Infrastruktur durchlaufen. Aus ihrer Datenschutzrichtlinie: „Wir sammeln Audioaufnahmen und Transkriptionen, um unsere Dienste bereitzustellen, und können diese Daten zur Verbesserung unserer Produkte verwenden." Es gibt einen Opt-out-Mechanismus für die Nutzung von Trainingsdaten, aber er ist standardmäßig nicht opt-in.
Die App leitet Audiodaten über Wisprs Server, die KI-Verbesserungs- und Kontextbewusstseinsfunktionen durchführen. Diese serverseitigen Funktionen — das „KI-Verständnis" dessen, was Sie auf dem Bildschirm tun — erfordern, dass Ihre Audiodaten in ihrer Cloud verarbeitet werden, anstatt nur an eine Transkriptions-API weitergeleitet zu werden.
Wispr Flow wird außerhalb des Mac App Stores vertrieben und verfügt nicht über eine App Sandbox-Berechtigung. Das bedeutet, dass es auf mehr Ihres Dateisystems und Ihrer Systemressourcen zugreifen kann als sandbox-geschützte Apps. Dies ist für einige seiner kontextbewussten Funktionen notwendig, aber es ist gut zu wissen.
All das macht Wispr Flow nicht unsicher — es handelt sich um ein gut finanziertes Startup mit einer glaubwürdigen Datenschutzrichtlinie. Aber Sie vertrauen einem Dritten Ihre Audiodaten an, nicht nur OpenAI.
Superwhisper — Tier 2 (Anbieter-Proxy mit lokaler Option)
Superwhisper bietet etwas wirklich Wertvolles für datenschutzbewusste Nutzer: einen lokalen Verarbeitungsmodus. Wenn Sie eine ihrer On-Device Whisper-Modell-Stufen auswählen, verlassen Ihre Audiodaten niemals Ihren Mac. Genauigkeit und Geschwindigkeit variieren je nach Hardware Ihres Macs — M-Chip-Macs verarbeiten lokale Modelle gut; Intel-Macs könnten die Erfahrung als träge empfinden.
Der Cloud-Modus läuft über Superwhispers Infrastruktur, ähnlich wie Wispr Flow. Ihre Datenschutzrichtlinie erlaubt die Verwendung von Transkriptionsdaten zur Verbesserung ihrer Dienste, sofern Sie nicht ausdrücklich widersprechen.
Die lokale Modell-Option macht Superwhisper zur stärksten Wahl für Offline-First-Datenschutz, insbesondere für Nutzer, die keine Netzwerkabhängigkeit für die Transkription wünschen.
Whisper Transcription — Tier 2 (Direkte API, teilweise)
Whisper Transcription im Mac App Store unterstützt BYOK (Bring-your-own-key), was es bei dieser Konfiguration zu Tier 1 macht. Wenn Sie stattdessen die integrierten API-Credits der App verwenden, nutzen Sie den Schlüssel des Entwicklers, und das Datenschutzmodell verschiebt sich: Das Konto des Entwicklers sieht Ihre Audiodaten, nicht nur OpenAI.
Erwähnenswert: Whisper Transcription ist in erster Linie ein Transkriptionsrekorder, kein systemweites Push-to-Talk-Diktierwerkzeug. Es eignet sich hervorragend zum Transkribieren langer Aufnahmen oder Dateien, lässt sich aber nicht so in andere Apps integrieren wie ParlaParla oder Wispr Flow.
Otter.ai — Tier 3 (Proprietäre Cloud)
Otter.ai ist ein kollaborationsorientierter Transkriptionsdienst, kein Push-to-Talk-Diktierwerkzeug — erscheint aber in genug „beste Diktier-App"-Suchen, um eine Aufnahme zu rechtfertigen. Alle Audiodaten werden auf Otters proprietärer Infrastruktur verarbeitet, und ihr Geschäftsmodell umfasst Enterprise-Upsells, die darauf angewiesen sind, dass gespeicherte Transkriptionen durchsuchbar und teilbar sind.
Wenn Ihr Anwendungsfall die Meeting-Transkription ist, bei der Sie Aufnahmen gespeichert und zugänglich haben möchten, ist Otter vernünftig. Für privates, Echtzeit-Diktieren sensibler Inhalte ist Tier 3 die falsche Wahl.
Die Fragen, die Sie stellen sollten, bevor Sie wählen
Vor der Wahl einer Diktier-App werden Ihnen diese fünf Fragen das meiste darüber verraten, wie es mit dem Datenschutz bestellt ist:
- Verlässt Audio mein Gerät, und wenn ja, wohin geht es? „Unsere Server" ist weniger informativ als „OpenAIs API" oder „Apples Server". Je spezifischer die Antwort, desto besser.
- Werden meine Audiodaten zum Training von Modellen verwendet? Suchen Sie nach einem ausdrücklichen „Nein" oder einem Opt-out-Mechanismus. Vage Formulierungen wie „unsere Produkte verbessern" bedeuten in der Regel ja.
- Wie lange werden Audiodaten aufbewahrt? Kurze, definierte Zeiträume (30 Tage, dann gelöscht) sind besser als unbefristete Aufbewahrung. „Solange notwendig" ist ein Warnsignal.
- Ist die App sandbox-geschützt? Mac App Store-Apps müssen sandbox-geschützt sein — ihr Datei- und Netzwerkzugriff ist eingeschränkt. Außerhalb des App Stores vertriebene Apps können einen breiteren Systemzugriff haben.
- Was passiert mit meinen Daten, wenn das Unternehmen übernommen wird? Startup-Übernahmen schließen routinemäßig Datenbestände ein. Dass Ihre Audiobibliothek Teil einer Übernahme wird, ist ein reales Risiko bei jedem cloudabhängigen Dienst.
Übersichtstabelle
| App | Audio-Routing | Training Opt-out | Lokale Option | Sandbox | Datenschutz-Stufe |
|---|---|---|---|---|---|
| ParlaParla | Mac → OpenAI API (direkt) | OpenAI-Standard: kein Training | Nein | Ja (App Store) | Tier 1 |
| Apple Dictation (Erweitert) | Nur auf dem Gerät | Nicht verfügbar — kein Netzwerk | Ja (Erweiterter Modus) | Ja (System) | Tier 1 |
| Whisper Transcription (BYOK) | Mac → OpenAI API (direkt) | OpenAI-Standard: kein Training | Nein | Ja (App Store) | Tier 1 |
| Superwhisper (lokaler Modus) | Nur auf dem Gerät | Nicht verfügbar — kein Netzwerk | Ja | Nein | Tier 1–2 |
| Wispr Flow | Mac → Wispr-Server → KI | Opt-out verfügbar | Nein | Nein | Tier 2 |
| Superwhisper (Cloud) | Mac → Superwhisper-Server | Opt-out verfügbar | Ja | Nein | Tier 2 |
| Otter.ai | Mac → Otter Cloud | Nicht klar verfügbar | Nein | Nicht bewertet | Tier 3 |
Was „Keine ParlaParla-Server" wirklich bedeutet
Wir möchten offen über etwas sein: Wir haben ParlaParla entwickelt, also sollten Sie unsere diesbezüglichen Aussagen entsprechend gewichten. Aber die BYOK-Architektur ist überprüfbar. Wenn Sie technisch versiert sind, können Sie den Netzwerkverkehr von ParlaParla mit einem Tool wie Little Snitch oder Charles Proxy überwachen und bestätigen, dass ausgehende Verbindungen nur zu api.openai.com gehen — keine anderen Hosts, keine Analyse-Endpunkte, keine Telemetrie-Beacons.
Der Code-Pfad lautet: Mikrofoneingabe → lokaler Audio-Puffer → HTTP POST an https://api.openai.com/v1/audio/transcriptions mit Ihrem API-Schlüssel. Die Antwort kommt als JSON mit dem Transkriptionstext zurück, der an Ihrem Cursor eingefügt wird. Ihre Audiodaten werden nach Abschluss der Transkription nicht lokal gespeichert. Sie werden nicht zwischengespeichert. Sie werden nicht protokolliert.
Die Datenschutzarchitektur ist kein Marketingversprechen — sie ist eine Konsequenz des BYOK-Modells. Es gibt keine ParlaParla-Server, auf denen Audiodaten gespeichert werden könnten, weil es überhaupt keine ParlaParla-Server gibt.
Auswahl basierend auf Ihrem Bedrohungsmodell
Datenschutz ist nicht binär, und die richtige Wahl hängt davon ab, worüber Sie sich wirklich Sorgen machen:
Wenn Sie hochsensible Inhalte diktieren (rechtliche, medizinische, finanzielle, journalistische Quellen), gehen Sie zu Tier 1 mit BYOK oder verwenden Sie Apples Erweiterte Diktierfunktion für vollständige On-Device-Verarbeitung. Nichts verlässt Ihren Mac.
Wenn Sie ein Entwickler sind, der schnelle, genaue, systemweite Diktierfunktionen möchte und bereits über einen OpenAI API-Schlüssel verfügen, sind ParlaParla oder Whisper Transcription (BYOK) die naheliegenden Optionen. Dieselbe Transkriptions-Engine wie bei den 15-$/Monat-Apps, direkter API-Aufruf, Einmalkauf.
Wenn Sie keine Internetabhängigkeit wünschen und einen M-Chip-Mac besitzen, sind Superwhispers lokaler Modus oder Apples Erweiterte Diktierfunktion Ihre besten Optionen. Beide führen Modelle auf dem Gerät mit der Neural Engine aus.
Wenn Datenschutz ein nachrangiges Anliegen ist und Sie den reichsten Funktionsumfang mit KI-Kontextbewusstsein wünschen, bietet Wispr Flow das — aber verstehen Sie, dass Ihre Audiodaten durch ihre Infrastruktur fließen und ihr Geschäftsmodell von dieser Vereinbarung abhängt.
Die beste Diktier-App für den Datenschutz ist die, deren Architektur dem entspricht, dem Sie zu vertrauen bereit sind.
ParlaParla ist die Mac-Diktier-App, die auf direktem API-Zugriff basiert — Ihre Stimme geht von Ihrem Mac zu OpenAI, nirgendwo sonst. Einmalkauf, 2-Minuten-Einrichtung, kein Abonnement.
Mehr über ParlaParla erfahren →