So funktioniert es
1. Datei hineinziehen (MP3, M4A, WAV, OGG — auch WhatsApp-Sprachnachrichten) oder einen YouTube-/Podcast-Link einfügen.
2. Die Sprache wird automatisch erkannt; auch österreichisches und Schweizer Hochdeutsch. Das Transkript ist in etwa einer Minute pro halber Stunde Audio fertig.
3. Vorschau sofort lesen — ganz ohne Konto. Mit einem kostenlosen Konto (60 Minuten inklusive) laden Sie das vollständige Transkript als TXT, DOCX, SRT oder VTT herunter.
Kein Abo, keine automatische Verlängerung
Keine Monatsgebühr und kein Testzeitraum, der sich still in ein Abo verwandelt. Sie kaufen ein einmaliges Minutenpaket — 4 US-Dollar für 300 Minuten oder 12 US-Dollar für 2.000 Minuten — und das Guthaben verfällt nie.
Was enthalten ist
Sprechererkennung
Interviews und Meetings kommen mit getrennten, beschrifteten Sprechern zurück.
Zeitstempel pro Wort
Die Grundlage für exakte SRT/VTT-Untertitel.
Zusammengesetzte Wörter
Lange Komposita werden korrekt als ein Wort geschrieben — inklusive Groß- und Kleinschreibung.
Echter Datenschutz
Die Verarbeitung läuft auf eigenen Servern; Ihre Aufnahmen werden nie zum KI-Training verwendet.
Häufige Fragen
Brauche ich ein Konto zum Ausprobieren?
Nein — die Transkription läuft und die Vorschau erscheint ganz ohne Registrierung. Das kostenlose Konto (60 Minuten inklusive) schaltet das vollständige Transkript und die Downloads frei.
Was kostet es, Audio in Text umzuwandeln?
Einmalige Pakete: 4 US-Dollar für 300 Minuten oder 12 US-Dollar für 2.000 Minuten — etwa 0,36 US-Dollar pro Audiostunde. Kein Abo, das Guthaben verfällt nie.
Funktioniert es mit WhatsApp-Sprachnachrichten?
Ja — Sprachnachrichten (OGG/Opus) können direkt hochgeladen werden, ohne Umwandlung.
Erkennt es, wer spricht?
Ja, die Sprechertrennung (Diarisierung) ist enthalten — jede Wortmeldung wird einem Sprecher zugeordnet.
Kann ich Untertitel erzeugen?
Ja: SRT und VTT mit wortgenauen Zeitstempeln, fertig für YouTube oder jeden Player.