Der Transkriptionsprogramm zeichnet Audio auf oder importiert es, transkribiert es, identifiziert die Sprecher und hilft Ihnen – optional – dabei, das Gesprochene in verwertbare Notizen umzuwandeln. Alle sensiblen Daten bleiben auf Ihrem Gerät.
Von Anfang bis Ende auf Ihrem Gerät. Die Audiodaten verlassen Ihr Smartphone nie. Die Transkription basiert lokal auf den Open-Source-Whisper-Modellen. Die Sprecheridentifizierung nutzt Pyannote-Diarisierung und 3D-Speaker-Embedding-Modelle – ebenfalls lokal.
Sie können den Transkriptionsprogramm im Flugmodus verwenden; die einzige Netzwerkverbindung wird für den einmaligen Modell-Download benötigt.
Lernt Stimmen, nicht nur Geräusche. Benennen Sie eine Sprecherin einmal – „Das ist meine Kollegin Dana“ – und der Transkriptionsprogramm kennzeichnet sie automatisch in jeder zukünftigen Aufnahme, in der sie spricht. Sprachprofile werden ausschließlich auf Ihrem Gerät gespeichert und niemals hochgeladen.
Wählen Sie Ihre Qualitätsstufe. Drei Transkriptionsstufen stehen zur Verfügung: Schnell (Whisper Base, ca. 200 MB), Ausgewogen (Whisper Small, ca. 600 MB) und Genau (Whisper Medium, ca. 1,5 GB). Legen Sie eine globale Präferenz fest oder
transkribieren Sie jede einzelne Aufnahme mit einem Fingertipp in einer anderen Stufe neu.
Erstellen Sie Ihre eigenen Regeln. Wandeln Sie gesprochene Sätze in strukturierte Extraktionskarten um, die Sie später bearbeiten können. Sagen Sie „Streichel die Katze“ und erhalten Sie eine Aufgabenliste. Sagen Sie „Lass uns Dienstag um 15 Uhr treffen“ und erhalten Sie einen Kalendereintrag. Zwei
Matching-Modi:
- Offline (wörtliche Sätze) – deterministisch, kein API-Schlüssel erforderlich, läuft vollständig auf dem Gerät.
- KI (semantische Beschreibungen) – mit einem konfigurierten LLM werden Paraphrasen in natürlicher Sprache automatisch erkannt.
Optionale KI, eigener Schlüssel erforderlich. Für Dokumentenklassifizierung, Zusammenfassungen und die intelligente Extraktion von Aufgaben, Kalenderereignissen, Erinnerungen, Entscheidungen, Fragen und Notizen verbinden Sie einen der drei Anbieter:
- Anthropic (Claude)
- OpenAI (ChatGPT)
- Google (Gemini)
Sie benötigen den API-Schlüssel. Dieser wird sicher auf Ihrem Gerät gespeichert – niemals auf unseren Servern oder in Backups. Die Einwilligung ist freiwillig und kann jederzeit widerrufen werden. Es werden ausschließlich Texttranskripte an Ihren Anbieter gesendet
– niemals Audio oder Sprecherdaten. Monatliche Nutzungsdaten und Token-Anzahlen pro Aufnahme werden direkt in der App angezeigt, sodass Sie Ihre Kosten stets im Blick haben.
Jede Extraktion enthält eine Quellenangabe. Tippen Sie auf eine Aufgabe, ein Kalenderereignis oder eine Erinnerungskarte, um direkt zu der Stelle im Audio zu springen, an der die Information vorlag. Die Extraktionen enthalten das wörtliche Zitat und verlinken zurück zum Quellabschnitt,
damit Sie die Information vor dem Handeln überprüfen können.
Wofür Transcriptinator gut ist
- Besprechungsnotizen mit 2–6 Sprechern
- Längere Interviews, Vorträge, Predigten
- Sprachmemos, die echte Transkripte und nicht nur Aufnahmen benötigen
- Import von Field-Recordern (WAV inkl. IMA ADPCM, MP3, M4A, OGG, FLAC)
Erstellung eigener Workflows mit benutzerdefinierten Regeln
Was es nicht kann
- Live-Untertitelung während eines Anrufs – alles wird nach der Aufnahme verarbeitet
- Sprecherverifizierung aus Sicherheitsgründen – die Stimmerkennung dient der Kennzeichnung, nicht der Authentifizierung
- Cloud-Synchronisierung – bewusst. Ihre Aufnahmen bleiben auf Ihrem Smartphone
Kostenlos, keine Werbung, keine Zusatzangebote. Transcriptinator ist und bleibt kostenlos. Keine Werbung, keine In-App-Käufe, keine Premium-Version. Die KI-Funktionen sind optional – die App funktioniert vollständig ohne externe Dienste.
Herausgeber: Cherry Blossom Development, LLC
Sprache von beliebigen Aufnahmegeräten transkribieren, Sprecher identifizieren und kategorisieren
Aktualisiert am
04.09.2026