Integritet för dikteringsappar på Mac: Var tar din röst egentligen vägen?
Varje gång du använder en röstdikteringsapp skickar du ljudinspelningar av din röst — dina ord, dina möten, dina privata meddelanden — någonstans. Frågan de flesta aldrig ställer är: exakt vart? Vem behandlar det? Hur länge sparas det? Kan det användas för att träna modeller?
Det här är inte hypotetiska bekymmer. De avgör om dina dikterade medicinska anteckningar, juridiska utkast eller privata meddelanden förblir privata. Vi gick igenom integritetspolicyer, dokumentation av nätverksbeteende och arkitekturavslöjanden för alla större Mac-dikteringsappar 2026. Här är vad vi hittade.
De tre integritetsnivåerna
Efter att ha analyserat varje app faller de in i tre distinkta kategorier baserat på hur de hanterar ditt ljud:
- Tier 1 — Direkt API (mest privat): Ditt ljud går från din Mac direkt till en enda känd API-slutpunkt (OpenAI, Apple). Ingen tredjeparts proxyserver. Ingen mellanliggande lagring. Du kontrollerar API-nyckeln.
- Tier 2 — Leverantörs-proxied (delvis integritet): Ditt ljud reser genom leverantörens egna servrar innan det når en transkriptionsleverantör. Leverantören kan se ditt ljud, kan lagra det och kan använda det för att förbättra sin produkt.
- Tier 3 — Proprietärt moln (minst privat): Ljud behandlas helt på leverantörens infrastruktur. Användarvillkor kan tillåta användning för modellträning. Datalagringsperioder är ofta obestämda eller vaga.
De flesta antar att apparna de betalar prenumeration för befinner sig i Tier 1. De flesta gör det inte.
App-för-app-analys
ParlaParla — Tier 1 (Direkt API)
ParlaParla använder en bring-your-own-key (BYOK)-modell. Du anger din egen OpenAI API-nyckel, som lagras lokalt i din Mac-apps inställningar — inte på någon server. När du dikterar skickar din Mac ljud direkt till api.openai.com. ParlaParlas servrar är aldrig i vägen eftersom det inte finns några ParlaParla-servrar.
Den här arkitekturen eliminerar en hel klass av integritetsrisker. Det finns ingen leverantörsdatabas över ditt ljud. Det finns ingen mellanhand som kan hackas, stämmas eller förvärvas. Datasökvägen är: du → OpenAI. Punkt.
OpenAIs API-datahanteringspolicy (per 2026): ljud som skickas via API:et används inte för att träna modeller som standard och lagras i upp till 30 dagar för missbruksövervakning innan radering. Du kan begära noll dagars lagring genom att kontakta deras enterprise-team. Det här är OpenAIs standardpolicy, samma som gäller när utvecklare anropar API:et direkt.
ParlaParla samlar inte in analysdata, kraschrapporter eller användningsdata. Appen är App Sandbox-kompatibel, vilket innebär att dess fil- och nätverksåtkomst är begränsad till vad Apples sandlåda tillåter.
Apple Dictation (inbyggd) — Tier 1 (Direkt Apple)
Apples inbyggda diktering har en viktig integritetsfunktion som de flesta användare missar: Enhanced Dictation-läge. När det aktiveras i Systeminställningar → Tangentbord → Diktering laddas en språkmodell ned till din Mac och allt behandlas lokalt med Neural Engine. Inget ljud lämnar någonsin din enhet.
Avvägningen är noggrannhet. Apples on-device-modell är utmärkt för standardprosa och vardagsspråk men halkar efter OpenAIs Whisper på tekniskt ordförråd, accentuerat tal och icke-engelska språk. För många användare — särskilt de som dikterar på engelska utan specialiserad terminologi — är det det mest privata alternativet tillgängligt till noll kostnad.
Molnläge skickar ljud till Apples servrar. Apples integritetspolicy är stark: de säljer inte data eller använder det för annonsering, och datahanteringen styrs av Apples integritetsramverk, som inkluderar GDPR-efterlevnad för europeiska användare. Men ljudet lämnar din enhet.
Wispr Flow — Tier 2 (Leverantörs-proxied)
Wispr Flow är öppen med att ljud reser genom deras infrastruktur. Från deras integritetspolicy: "Vi samlar in ljudinspelningar och transkriptioner för att tillhandahålla våra tjänster och kan använda dessa data för att förbättra våra produkter." Det finns en avanmälningsmekanism för användning av träningsdata, men det är inte anmälan som standard.
Appen dirigerar ljud genom Wisprs servrar, som utför AI-förbättring och kontextmedvetna funktioner. Dessa server-side-funktioner — AI-"förståelsen" av vad du gör på skärmen — kräver att ditt ljud behandlas i deras moln, inte bara vidarebefordras till ett transkriptions-API.
Wispr Flow distribueras utanför Mac App Store och har inte App Sandbox-behörighet. Det innebär att den kan komma åt mer av ditt filsystem och systemresurser än sandlådade appar. Detta är nödvändigt för några av dess kontextmedvetna funktioner, men det är värt att känna till.
Inget av detta gör Wispr Flow osäker — de är ett välfinansierat startup med en trovärdig integritetspolicy. Men du litar på en tredje part med ditt ljud, inte bara OpenAI.
Superwhisper — Tier 2 (Leverantörs-proxied med lokalt alternativ)
Superwhisper erbjuder något genuint värdefullt för integritetsmedvetna användare: ett lokalt bearbetningsläge. Om du väljer ett av deras on-device Whisper-modellnivåer lämnar ditt ljud aldrig din Mac. Noggrannhet och hastighet varierar med din Macs hårdvara — M-serie Macs hanterar lokala modeller bra; Intel-Macs kan uppleva en trög upplevelse.
Molnläge dirigeras genom Superwhispers infrastruktur, liknande Wispr Flow. Deras integritetspolicy tillåter användning av transkriptionsdata för att förbättra deras tjänster om du inte uttryckligen väljer bort det.
Det lokala modellalternativet gör Superwhisper till det starkaste valet för offline-först integritet, särskilt för användare som inte vill ha något nätverksberoende för transkription.
Whisper Transcription — Tier 2 (Direkt API, delvis)
Whisper Transcription på Mac App Store stöder BYOK (bring your own key), vilket gör det till Tier 1 när det är konfigurerat på det sättet. Om du använder appens inbyggda API-krediter istället är du på utvecklarens nyckel och integritetsmodellen skiftar: utvecklarens konto ser ditt ljud, inte bara OpenAI.
Värt att notera: Whisper Transcription är primärt ett transkriptionsinspelningsverktyg, inte ett systemomfattande push-to-talk-dikteringsverktyg. Det är utmärkt för att transkribera långa inspelningar eller filer, men integrerar inte i andra appar på samma sätt som ParlaParla eller Wispr Flow.
Otter.ai — Tier 3 (Proprietärt moln)
Otter.ai är en samarbetsfokuserad transkriptionstjänst, inte ett push-to-talk-dikteringsverktyg — men det dyker upp i tillräckligt många "bästa dikteringsapp"-sökningar för att motivera inkludering. Allt ljud behandlas på Otters proprietära infrastruktur, och deras affärsmodell inkluderar enterprise-upsells som är beroende av att lagrade transkriptioner kan sökas och delas.
Om ditt användningsfall är mötessammanfattning där du vill ha inspelningar lagrade och tillgängliga är Otter rimligt. För privat, realtidsdiktering av känsligt innehåll är Tier 3 fel val.
Frågorna värda att ställa innan du väljer
Innan du väljer en dikteringsapp kommer dessa fem frågor att berätta det mesta av vad du behöver veta om dess integritetssituation:
- Lämnar ljud min enhet, och om så är fallet, vart tar det vägen? "Våra servrar" är mindre informativt än "OpenAIs API" eller "Apples servrar." Ju mer specifikt svaret är, desto bättre.
- Används mitt ljud för att träna modeller? Leta efter ett explicit "nej" eller en avanmälningsmekanism. Vagt språk som "förbättra våra produkter" innebär vanligtvis ja.
- Hur länge lagras ljud? Korta, definierade fönster (30 dagar, sedan raderat) är bättre än obestämd lagring. "Så länge det behövs" är en varningssignal.
- Är appen sandlådad? Mac App Store-appar måste vara sandlådade — deras fil- och nätverksåtkomst är begränsad. Appar distribuerade utanför App Store kan ha bredare systemåtkomst.
- Vad händer med mina data om företaget förvärvas? Startup-förvärv inkluderar rutinmässigt datatillgångar. Att ditt ljudbibliotek blir en del av ett förvärv är en verklig risk med alla molnberoende tjänster.
Sammanfattningstabell
| App | Ljuddirigering | Avanmälan från träning | Lokalt alternativ | Sandlådad | Integritetsnivå |
|---|---|---|---|---|---|
| ParlaParla | Mac → OpenAI API (direkt) | OpenAI standard: ingen träning | Nej | Ja (App Store) | Tier 1 |
| Apple Dictation (Enhanced) | Endast on-device | Ej tillämpligt — inget nätverk | Ja (Enhanced-läge) | Ja (system) | Tier 1 |
| Whisper Transcription (BYOK) | Mac → OpenAI API (direkt) | OpenAI standard: ingen träning | Nej | Ja (App Store) | Tier 1 |
| Superwhisper (lokalt läge) | Endast on-device | Ej tillämpligt — inget nätverk | Ja | Nej | Tier 1–2 |
| Wispr Flow | Mac → Wispr-servrar → AI | Avanmälan möjlig | Nej | Nej | Tier 2 |
| Superwhisper (moln) | Mac → Superwhisper-servrar | Avanmälan möjlig | Ja | Nej | Tier 2 |
| Otter.ai | Mac → Otter moln | Inte tydligt tillgänglig | Nej | Inte bedömd | Tier 3 |
Vad "inga ParlaParla-servrar" faktiskt betyder
Vi vill vara direkta om något: vi byggde ParlaParla, så du bör väga våra påståenden om det därefter. Men BYOK-arkitekturen är verifierbar. Om du är tekniskt lagd kan du övervaka nätverkstrafik från ParlaParla med ett verktyg som Little Snitch eller Charles Proxy och bekräfta att utgående anslutningar endast går till api.openai.com — inga andra värdar, inga analysslutpunkter, inga telemetrisignaler.
Kodsökvägen är: mikrofoninmatning → lokal ljudbuffer → HTTP POST till https://api.openai.com/v1/audio/transcriptions med din API-nyckel. Svaret kommer tillbaka som JSON med transkriptionstexten, som infogas vid din markör. Ditt ljud lagras inte lokalt efter att transkriptionen slutförts. Det cachas inte. Det loggas inte.
Integritetsarkitekturen är inte ett marknadsföringspåstående — det är en konsekvens av BYOK-modellen. Det finns inga ParlaParla-servrar att lagra ljud på eftersom det inte finns några ParlaParla-servrar överhuvudtaget.
Välja baserat på din hotmodell
Integritet är inte binärt, och rätt val beror på vad du faktiskt oroar dig för:
Om du dikterar mycket känsligt innehåll (juridiskt, medicinskt, finansiellt, journalistiska källor) väljer du Tier 1 med BYOK, eller använder Apples Enhanced Dictation för fullständig on-device-behandling. Ingenting lämnar din Mac.
Om du är en utvecklare som vill ha snabb, korrekt, systemomfattande diktering och du redan har en OpenAI API-nyckel är ParlaParla eller Whisper Transcription (BYOK) de uppenbara valen. Samma transkriptionsmotor som appar till 150 kr/månaden, direkt API-anrop, engångsköp.
Om du vill ha noll internetberoende och du har en M-serie Mac är Superwhispers lokala läge eller Apples Enhanced Dictation dina bästa alternativ. Båda kör modeller on-device med Neural Engine.
Om integritet är ett sekundärt bekymmer och du vill ha den rikaste funktionsuppsättningen med AI-kontextmedvetenhet levererar Wispr Flow det — men förstå att ditt ljud flödar genom deras infrastruktur och deras affärsmodell är beroende av den ordningen.
Den bästa dikteringsappen för integritet är den vars arkitektur matchar vad du är villig att lita på.
ParlaParla är Mac-dikteringsappen byggd kring direkt API-åtkomst — din röst går från din Mac till OpenAI, ingenstans annars. Engångsköp, 2-minuters installation, inget abonnemang.
Läs mer om ParlaParla →