Wie schneidet Vocateca im Vergleich zu anderen Transkriptions-Apps ab?
Vocateca ist für eine bestimmte Aufgabe gebaut: die Podcasts, YouTube-Kanäle und lokalen Aufnahmen, die du bereits abonniert hast, in lokalen, LLM-tauglichen Text zu verwandeln — nicht für Echtzeit-Diktat beim Tippen und nicht als vollständige Audio-/Video-Schnittsoftware. MacWhisper, superwhisper, Descript, Otter.ai und Aiko lösen jeweils benachbarte, aber andere Probleme. Die Tabelle unten vergleicht alle sechs Produkte direkt, Merkmal für Merkmal — belegt ausschließlich mit den eigenen Websites, der Dokumentation und den App-Store-Einträgen der jeweiligen Anbieter, nicht aus dem Gedächtnis oder aus Rezensionen aus zweiter Hand.
Suchst du gezielt YouTube-Transkription? Zur eigenen Seite →Funktionsvergleich, Stand Juli 2026
Preise Stand Juli 2026.| Merkmal | Vocateca | MacWhisper | superwhisper | Descript | Otter.ai | Aiko |
|---|---|---|---|---|---|---|
| Plattformen | macOS [1] | macOS (App selbst); die separate Schwester-App „Whisper Transcription“ deckt iOS/iPadOS/visionOS ab [4][5][6] | macOS, Windows, iOS/visionOS [12][13] | macOS, Windows, Web (Chromium); kein nativer mobiler Editor [20] | Web, macOS, Windows, iOS, Android, Chrome-Erweiterung [30][37] | macOS, iOS, visionOS [38][39] |
| Verarbeitung (On-Device / Cloud) | Vollständig on-device (Parakeet-TDT, Whisper als Fallback); keine Cloud, kein Konto, keine Audiodaten verlassen jemals das Gerät [1] | Standardmäßig on-device (lokale Whisper-/WhisperKit-Modelle); optionale BYOK-Cloud-Anbieter (OpenAI, Anthropic, Deepgram, ElevenLabs u. a.) [4][7] | Standardmäßig lokale On-Device-Modelle; optionale Cloud-/BYOK-Anbieter; das separate kostenlose Web-Tool ist ein reines Cloud-Tool [14][15][16] | Cloud-basiert — Transkription startet erst nach abgeschlossenem Upload; keine On-Device-Option gefunden [21] | In keiner gefundenen Quelle explizit als Cloud bezeichnet; impliziert durch den Upload-dann-Transkribieren-Workflow und SOC-2-Verschlüsselungssprache; keine On-Device-Aussage gefunden [36] | Vollständig on-device (lokales Whisper large-v3 auf dem Mac, medium/small auf iOS); nichts verlässt das Gerät [38][39] |
| Preise | Für immer kostenlos (alle Quellen, Exporte, Suche); Pro €4,90/Monat oder €49/Jahr; kein Konto für beide Stufen erforderlich [1][2] | Kostenlose Stufe (kleinere Modelle); Pro ist ein einmaliger Kauf für €64 (lebenslange Updates); die iOS-Schwester-App ist abo-basiert [4][6] | Kostenlose Stufe (einfaches Diktat/Transkription); Pro $8,49/Monat, $84,99/Jahr oder $249,99 einmalig lebenslang [13][17] | Kostenlos: 60 Min./Monat Obergrenze; Hobbyist $16–24/Monat, Creator $24–35/Monat, Business $50–65/Monat, Enterprise auf Anfrage; keine Einmalzahlung [22] | Kostenlos „Basic“: 300 Min./Monat, 3 lebenslange Importe; Pro $8,33–16,99/Nutzer/Monat; Business $19,99–30/Nutzer/Monat; nur im Abo [31] | Einmaliger Kauf für $24, kein Abo, kein In-App-Kauf; 14-tägige Vollversions-Testphase [38][39] |
| Exportformate | Markdown, Klartext, SRT, HTML, OKF; JSON wird auf den offiziellen Seiten nicht genannt [2][3] | Kostenlos: SRT/VTT/TXT; Pro ergänzt MD/PDF/HTML/DOCX [4] | — / nicht verifiziert — auf keiner abgerufenen Doku-Seite wurde eine Liste der Exportformate gefunden | HTML, MD, DOCX, TXT, RTF (Transkript); SRT, VTT (Untertitel) [23][24] | TXT, DOCX, PDF, SRT; kostenlose Stufe Berichten zufolge auf TXT beschränkt (nicht verifiziert — Hilfeseite blockiert) [34] | JSON, CSV und Untertitel (SRT) [38] |
| Feed-Auto-Import | Kostenlose Stufe: manuelle Transkription jeder Quelle (Podcast, YouTube, Instagram-experimentell); Pro ergänzt einen täglichen Scheduler, Auto-Download pro Show und lokale Ordnerüberwachung [2][3] | Batch-Transkription lokaler Dateien unterstützt; Pro „Watch Folders“ (Beta) überwacht ausschließlich lokale Mac-Ordner — kein Podcast-RSS oder YouTube-Kanal-Abo gefunden [4][8] | Nur Einzeldatei-Transkription; kein Batch, keine Ordnerüberwachung, kein Feed-Import gefunden [18] | Manueller Import pro Datei (Computer, Zoom, Google Drive oder URL); kein Batch-Upload oder RSS-/YouTube-Abo gefunden [25] | Manueller Upload/Import pro Episode; ein Dropbox-Ordner-Auto-Transkript existiert, ist aber auf Business/Enterprise beschränkt und überwacht einen Dropbox-Ordner, kein RSS-/YouTube-Feed [33][35] | Kein integriertes Batch (die Website schlägt Shortcuts als Workaround vor); YouTube-Import laut Nutzungsbedingungen ausdrücklich ausgeschlossen; kein Feed-Abo [38] |
| Sprechererkennung | Ja — Sprecher-Labels und Zeitstempel, on-device [3] | Ja (seit MacWhisper 12); on-device mit lokalen Modellen, cloud-basiert bei Nutzung von ElevenLabs/Deepgram; nicht verfügbar für Diktat oder „Transcribe Podcast“ [10] | Ja, über einen „Identify Speakers“-Schalter; nur in Pro [17][19] | Ja, automatische Sprecher-Kennzeichnung bei der Transkription [26] | Ja, als Funktion der kostenlosen/Basic-Stufe gelistet; App-Store-Text deutet eher auf tagging-unterstützt als vollautomatisch hin [31][37] | Nein — ausdrücklich nicht unterstützt („würden es gerne unterstützen, ist aber noch nicht möglich“) [38][39] |
| Open Source | Ja — Transkriptions-Engine, CLI und MCP-Server sind Open Source (die App selbst nicht) [1][3] | — / nicht verifiziert — nur als bezahltes/lizenziertes kommerzielles Produkt vertrieben; keine ausdrückliche Open- oder Closed-Source-Aussage gefunden | — / nicht verifiziert — auf keiner abgerufenen offiziellen Seite eine Open-Source-Aussage gefunden | Nein — die Nutzungsbedingungen verbieten ausdrücklich Reverse-Engineering und Dekompilierung [27] | — / nicht verifiziert — auf keiner abgerufenen offiziellen Seite eine Open-Source-Aussage gefunden | — / nicht verifiziert — kein öffentliches GitHub-Repository für die App gefunden (github.com/sindresorhus/Aiko liefert 404); keine Lizenzangabe auf der offiziellen Seite [38] |
| Konto erforderlich | Nein — „kein Konto nötig“, für Free und Pro gleichermaßen [1][2] | Kein Kontosystem gefunden; Pro nutzt einen gekauften Lizenzschlüssel (kein Login), weich begrenzt auf 3 Geräte [11] | — / nicht verifiziert — keine abgerufene Seite bestätigt oder verneint ein verpflichtendes Konto für die lokale Kernnutzung | Faktisch ja — Startseite und Preisseite führen per CTA zu einem Registrierungs-Flow, und ein eigener Hilfeartikel „Create your Descript Account“ existiert (nicht wörtlich als für jede Nutzung verpflichtend bestätigt) [22][28] | Ja — „Log in“ / „Start for free“ sind die einzigen gefundenen Einstiegspunkte; kein kontofreier Nutzungsweg gefunden [30][31] | Kein Kontosystem gefunden; Kauf ausschließlich über Apple-ID/App Store; die Datenschutzerklärung besagt, dass keine persönlichen Daten erhoben werden [40] |
MacWhisper, superwhisper, Descript, Otter.ai und Aiko sind Marken ihrer jeweiligen Inhaber. Dieser Vergleich ist unabhängig und nicht mit ihnen verbunden; jede Aussage zu einem Wettbewerber ist unten mit einer abgerufenen Primärquelle belegt.
Wo Vocateca gewinnt
- Feed-Level-Auto-Import. Vocateca Pro lädt neue Episoden automatisch direkt von einem abonnierten Podcast oder YouTube-Kanal herunter [2][3]. Keiner der fünf untersuchten Wettbewerber bietet das: MacWhispers Watch Folders überwachen nur einen lokalen Dateisystem-Ordner, keinen Feed [8]; superwhisper, Descript und Aiko haben überhaupt keinen Batch- oder Feed-Mechanismus [18][25][38]; Otters nächstes Äquivalent ist eine Dropbox-Ordner-Überwachung auf Business-/Enterprise-Plänen — immer noch kein RSS-/YouTube-Abo [33].
- Open-Core. Vocateca veröffentlicht Transkriptions-Engine, CLI und MCP-Server als Open Source [1][3]. Von den Wettbewerbern ist nur Descripts Status abschließend bestätigt (geschlossen, AGB verbieten Reverse-Engineering) [27]; keiner der anderen macht auf seinen offiziellen Seiten eine Open-Source-Aussage.
- On-device ohne Konto, auf jeder Stufe. Vocateca verlangt weder für Free noch für Pro ein Konto [1][2]. Otter verlangt schon für den Einstieg in die kostenlose Stufe ein Login [30][31], und Descripts registrierungspflichtiger CTA legt dasselbe nahe [22][28]. MacWhisper und Aiko kommen ebenfalls ohne Konto aus, sind aber weder Feed-Abo- noch Open-Core-Produkte — diese Kombination (on-device + kein Konto + Open-Core + Feed-Auto-Import) findet sich bei keinem einzigen hier untersuchten Wettbewerber.
Wo andere gewinnen
- Descript ist eine vollständige Produktions-Suite, kein reiner Transkriptor. Descripts eigene Positionierung lautet „bearbeite dein Video, indem du den Text bearbeitest“, mit Multitrack-Audioschnitt, Bildschirmaufnahme und integrierten KI-Videotools [29] — ein deutlich breiteres (und cloud-abhängiges, abo-finanziertes) Produkt als Vocatecas Fokus auf Transkription und Bibliothek. Vocateca tritt bewusst nicht in den Wettbewerb um Videoschnitt.
- Echtzeit-Diktat und Live-Meeting-Transkription. superwhisper ist um Echtzeit-Sprache-zu-Text-Diktat herum gebaut [12][14], und Otter ist um Live-Meeting-Transkription mit Echtzeit-Sprecherkennzeichnung herum gebaut [31][37]. Vocatecas eigene Website positioniert das Produkt rund um bestehende Quellen — Podcasts, YouTube, lokale Dateien — statt Live-Aufnahme [1]; Echtzeit-Transkription ist eine Lücke auf Vocateca-Seite, keine Konkurrenzaussage, die wir bestreiten.
Häufige Fragen
Ist Vocateca Open Source?
Ja — die Transkriptions-Engine, das CLI und der MCP-Server sind Open Source. Die macOS-App selbst ist nicht Open Source. [1][3]
Lädt Vocateca meine Audiodaten in die Cloud hoch?
Nein. Vocateca verarbeitet Audio vollständig on-device mit Parakeet-TDT und Whisper als Fallback — keine Cloud, kein Konto, und es verlassen niemals Audiodaten das Gerät. [1]
Brauche ich ein Konto, um Vocateca zu nutzen?
Nein. Weder für die Free- noch für die Pro-Stufe ist ein Konto erforderlich. [1][2]
Was kostet Vocateca?
Vocateca ist für alle Quellen, Exporte und die Suche für immer kostenlos. Pro kostet €4,90/Monat oder €49/Jahr, ohne Kontopflicht für beide Stufen. Preise Stand Juli 2026. [1][2]
Warum nutzt Vocateca nicht Apples eingebaute Spracherkennung?
Apples On-Device-SpeechAnalyzer, neu in macOS 26, ist wirklich gut — aber Vocateca unterstützt macOS 15 und neuer, ihn zu nutzen würde also jeden Mac ausschließen, der noch nicht auf macOS 26 ist. Zudem lädt er pro Sprache ein eigenes Modell, während Vocatecas Parakeet-TDT-Engine ein einziges multilinguales Modell ist, das sich über macOS-Versionen hinweg identisch verhält. In eigenen Tests war Parakeet mindestens so genau und schneller, daher bleibt er Standard — Apples Engine könnten wir später als optionalen, leichtgewichtigen Fallback auf macOS 26 anbieten, sobald ihre Praxisqualität über Sprachen hinweg belegt ist.
Quellen
- [1]Vocateca — Startseite: Plattformen/Quellen, On-Device-Verarbeitungsaussage, Free-/Pro-Zusammenfassung, „kein Konto“, Open-Core-Umfang. https://vocateca.com Abgerufen am 11.07.2026.
- [2]Vocateca — genaue Free-/Pro-Preise, Pro-Feature-Gating (Scheduler, Auto-Download, Ordnerüberwachung, Mehrgeräte), „kein Konto nötig“, Liste der Exportformate. https://vocateca.com/ Abgerufen am 11.07.2026.
- [3]Vocateca — Liste der Exportformate, CLI/MCP-Beispiele, Sprecher-Label-Aussage, Open-Source-Umfangsaussage. https://vocateca.com/export-formats Abgerufen am 11.07.2026.
- [4]MacWhisper — Plattform, Preise (Free/€64 einmalig Pro), Exportformate, On-Device-Standard + BYOK-Cloud-Anbieter. https://www.macwhisper.com/ Abgerufen am 11.07.2026.
- [5]MacWhisper — klärt MacWhisper (macOS) vs. die separate App „Whisper Transcription“. https://docs.macwhisper.com/article/40-macwhisper-whisper-transcription-difference Abgerufen am 11.07.2026.
- [6]MacWhisper — Plattformliste der Schwester-App (iOS/iPadOS/visionOS) und Abo-Preise. https://apps.apple.com/us/app/whisper-transcription/id1668083311 Abgerufen am 11.07.2026.
- [7]MacWhisper — „keine Daten verlassen dein Gerät“ außer Lizenzvalidierungs-Analytics. https://www.macwhisper.com/legal/privacy-policy Abgerufen am 11.07.2026.
- [8]MacWhisper — Watch-Folders-Funktion ist rein lokales Dateisystem, Pro, Beta. https://docs.macwhisper.com/article/35-automatically-transcribing-files-in-watch-folders Abgerufen am 11.07.2026.
- [9]MacWhisper — gebündeltes `mw`-CLI, steuert die laufende App lokal. https://docs.macwhisper.com/article/57-macwhisper-command-line-tool Abgerufen am 11.07.2026.
- [10]MacWhisper — Sprechererkennungs-Unterstützung und deren On-Device-/Cloud-Aufteilung. https://docs.macwhisper.com/article/32-automatic-speaker-recognition-in-macwhisper Abgerufen am 11.07.2026.
- [11]MacWhisper — Lizenzschlüssel-Aktivierungsmodell (kein Login/Konto), weiche 3-Geräte-Grenze. https://docs.macwhisper.com/article/39-licensing Abgerufen am 11.07.2026.
- [12]superwhisper — „Verfügbar für Mac, Windows und iOS.“ https://superwhisper.com/ Abgerufen am 11.07.2026.
- [13]superwhisper — iOS/visionOS-Plattformanforderung, Pro-IAP-Preise. https://apps.apple.com/us/app/superwhisper/id6471464415 Abgerufen am 11.07.2026.
- [14]superwhisper — On-Device-Verarbeitungsaussage mit lokalen Modellen. https://superwhisper.com/offline-transcription Abgerufen am 11.07.2026.
- [15]superwhisper — optionale Cloud-/BYOK-Modellanbieter. https://superwhisper.com/docs/get-started/introduction Abgerufen am 11.07.2026.
- [16]superwhisper — separates kostenloses Web-Tool ist reines Cloud-Einzeldatei-Tool. https://superwhisper.com/transcribe Abgerufen am 11.07.2026.
- [17]superwhisper — Preisstufen, Pro-gated Features inkl. Sprechertrennung. https://superwhisper.com/docs/get-started/sw-pro Abgerufen am 11.07.2026.
- [18]superwhisper — reiner Einzeldatei-Workflow, kein Batch-/Ordner-/Feed-Mechanismus. https://superwhisper.com/docs/get-started/transcribe-files Abgerufen am 11.07.2026.
- [19]superwhisper — „Identify Speakers“-Sprechererkennungs-Schalter. https://superwhisper.com/docs/modes/speaker-separated-meetings Abgerufen am 11.07.2026.
- [20]Descript — macOS-/Windows-/Web-Plattformunterstützung, kein nativer mobiler Editor. https://help.descript.com/hc/en-us/articles/10503411779213-Descript-system-requirements Abgerufen am 11.07.2026.
- [21]Descript — Transkription beginnt erst nach abgeschlossenem Cloud-Upload. https://help.descript.com/hc/en-us/articles/10249424286477-Automatic-transcription Abgerufen am 11.07.2026.
- [22]Descript — genaue Free-/Hobbyist-/Creator-/Business-/Enterprise-Preise und -Limits. https://www.descript.com/pricing Abgerufen am 11.07.2026.
- [23]Descript — HTML/MD/DOCX/TXT/RTF-Transkript-Export. https://help.descript.com/hc/en-us/articles/360042211032-Exporting-a-transcript-as-Text Abgerufen am 11.07.2026.
- [24]Descript — SRT/VTT-Untertitel-Export. https://help.descript.com/hc/en-us/articles/10255811669773-Export-subtitles Abgerufen am 11.07.2026.
- [25]Descript — nur manuelle Import-Methoden pro Datei, kein Batch/RSS/YouTube-Abo. https://help.descript.com/hc/en-us/articles/10119645307789-Importing-and-transcribing-media-files Abgerufen am 11.07.2026.
- [26]Descript — automatische Sprecher-Kennzeichnung. https://help.descript.com/hc/en-us/articles/10164803814285-Speakers Abgerufen am 11.07.2026.
- [27]Descript — AGB verbieten Reverse-Engineering/Dekompilierung; Closed-Source-Lizenzbedingungen. https://www.descript.com/terms Abgerufen am 11.07.2026.
- [28]Descript — Konto-Erstellungs-Flow. https://help.descript.com/hc/en-us/articles/10502792493069-Create-your-Descript-Account Abgerufen am 11.07.2026.
- [29]Descript — „Editing video in Descript is as easy as using docs and slides“; Multitrack-Audio, Bildschirmaufnahme, KI-Videotools. https://www.descript.com/ Abgerufen am 11.07.2026.
- [30]Otter.ai — Plattformliste, „Log in“/„Start for free“ als einzige Einstiegspunkte. https://otter.ai Abgerufen am 11.07.2026.
- [31]Otter.ai — genaue Free-/Pro-/Business-Preise und Minutenlimits; Sprechererkennung auf kostenloser Stufe gelistet. https://otter.ai/pricing Abgerufen am 11.07.2026.
- [32]Otter.ai — keine Open-Source-Aussage gefunden. https://otter.ai/features Abgerufen am 11.07.2026.
- [33]Otter.ai — Dropbox-Ordner-Auto-Transkript, nur Business/Enterprise. https://otter.ai/transcription Abgerufen am 11.07.2026.
- [34]Otter.ai — TXT/DOCX/PDF/SRT-Export-Aussage. https://otter.ai/free-ai-transcription Abgerufen am 11.07.2026.
- [35]Otter.ai — manueller Upload-/Import-Workflow für Podcasts, kein RSS-Abo. https://otter.ai/podcast-transcription Abgerufen am 11.07.2026.
- [36]Otter.ai — Upload-dann-Transkribieren-Formulierung (Cloud-Implikation). https://otter.ai/audio-to-text Abgerufen am 11.07.2026.
- [37]Otter.ai — iOS-Plattform, Beschreibung der Sprecher-Kennzeichnung. https://apps.apple.com/us/app/otter-transcribe-voice-notes/id1276437113 Abgerufen am 11.07.2026.
- [38]Aiko — Plattformen, On-Device-Whisper-Aussage, Preise/Testphase, Exportformate, kein Batch (Shortcuts-Workaround), kein YouTube (AGB), Sprechererkennung noch nicht unterstützt. https://sindresorhus.com/aiko Abgerufen am 11.07.2026.
- [39]Aiko — Plattform-/OS-Anforderungen, $24 Einmalpreis, On-Device-Aussage, „does not currently have speaker detection“, aktiver Eintrag. https://apps.apple.com/us/app/aiko/id1672085276 Abgerufen am 11.07.2026.
- [40]Aiko — „no data or personal information is collected“, kein Kontosystem impliziert. https://github.com/sindresorhus/privacy-policy/blob/main/aiko.md Abgerufen am 11.07.2026.
- [41]Aiko — liefert 404; kein öffentliches Quell-Repository für die App gefunden. https://github.com/sindresorhus/Aiko Abgerufen am 11.07.2026.