Transkribieren Sie Ihre Audioaufnahmen ganz einfach.
oder ziehen, einfügen oder aus der Cloud wählen
Die automatische Erkennung verarbeitet die meisten Aufnahmen. Sie können die Sprache aber auch selbst aus über 90 Optionen auswählen. So verhindern Sie, dass ein kurzer oder verrauschter Clip in der falschen Sprache erkannt wird.
Laden Sie das Transkript als TXT-Datei herunter, um es in ein Dokument einzufügen. Oder nehmen Sie eine SRT-Datei mit Zeitstempeln, die ein Videoplayer als Untertitel laden kann.
Der Konverter läuft in Ihrem Browser auf jedem Gerät. Übertragungen werden verschlüsselt und Ihre Aufnahmen werden mit niemandem geteilt.
Lade deine Audio-Aufnahme hoch.
Wähle die passende Sprache für den gesprochenen Inhalt deiner Audiodatei.
Klicke auf die Schaltfläche "START", um mit dem Umwandlungsprozess zu beginnen.
Laden Sie die Textdatei herunter.
Sprache-in-Text ist ein kostenloses Online-Tool, das gesprochene Wörter aus deinen Audioaufnahmen automatisch in geschriebenen Text umwandelt. Diese Funktion erspart dir stundenlange manuelle Schreibarbeiten und ist daher ideal für Journalisten, Wissenschaftler, Studenten und Geschäftsleute. Ganz egal, ob du ein Interview, eine Vorlesung oder eine Besprechung protokollieren musst, mit unserer Sprache-in-Text-Funktion geht das einfach und vor allem schnell.
Es wird auch Spracherkennung, automatische Transkription oder einfach Audio-zu-Text genannt. Ein Erkennungsmodell hört die Aufnahme ab und teilt sie in kleine Klangeinheiten auf. Diese werden mit Mustern abgeglichen, die aus Tausenden Stunden aufgezeichneter Sprache gelernt wurden.
Das Ergebnis ist ein Transkript, das Sie lesen, durchsuchen, zitieren und bearbeiten können. Nichts wird von Hand getippt, daher dauert ein einstündiges Interview Minuten statt eines ganzen Nachmittags.
Die Genauigkeit hängt vor allem von der Aufnahme selbst ab. Klare Sprache, jeweils nur eine sprechende Person und wenig Hintergrundgeräusche liefern das beste Transkript. Eine Telefonaufnahme quer durch einen vollen Raum ist immer schwerer zu lesen als eine Headset-Aufnahme.
Die gesprochene Sprache statt Auto-Erkennung zu setzen, ist der einfachste Verbesserungshebel. Die Erkennung kann sich bei einem kurzen Clip, bei starkem Akzent oder wenn 2 Sprachen in derselben Datei vorkommen, leicht irren. Ein falscher Treffer wirkt sich auf jede folgende Zeile aus.
Eine Einstellung für die Verarbeitungsgeschwindigkeit steuert den Rest des Kompromisses. Schnellere Modelle liefern das Ergebnis früher, während langsamere Modelle das Audio genauer lesen und mehr Wörter richtig erfassen. Wählen Sie ein langsameres Modell, wenn die Aufnahme lang, leise oder fachlich ist.
Gängige Audioformate funktionieren, darunter MP3, WAV, M4A, FLAC, OGG und AAC. Stapelverarbeitung wird unterstützt, sodass Sie mehrere Aufnahmen auf einmal hinzufügen und für jede ein separates Transkript erhalten können.
Es sind zwei Ausgabeformate verfügbar. TXT ist Klartext, bereit zum Einfügen in ein Dokument oder eine Notizen-App. SRT teilt denselben Text in zeitgesteuerte Untertitelzeilen auf, was dem Format entspricht, das Videoplayer und -editoren erwarten.
Es werden mehr als 90 gesprochene Sprachen abgedeckt. Darunter Arabisch, Chinesisch, Niederländisch, Französisch, Deutsch, Hindi, Italienisch, Japanisch, Koreanisch, Polnisch, Portugiesisch, Russisch, Spanisch, Türkisch, Ukrainisch und Vietnamesisch.
Ja. Laden Sie eine Aufnahme hoch, starten Sie die Umwandlung und laden Sie das Transkript herunter, ohne zu bezahlen und ohne ein Konto zu erstellen. Ein Abonnement ist nur für lange Aufnahmen und hohes tägliches Volumen relevant.
Es hängt davon ab, wo sich Ihr Audio befindet. Diktier-Apps tippen das, was Sie live ins Mikrofon sprechen. Diese Seite übernimmt die andere Aufgabe: Sie verarbeitet eine vorhandene Aufnahme und gibt eine Textdatei zurück. Wenn das Audio bereits als Datei vorliegt, ist ein Konverter wie dieser der schnellere Weg.
Google Cloud Speech-to-Text ist eine API für Entwickler, und Google Docs bietet Spracheingabe für Live-Diktat. Keines von beiden erlaubt es, eine bestehende Audiodatei in eine Browserseite zu ziehen und ein Transkript herunterzuladen. Dieser Konverter schon, ganz ohne Code und ohne Konto.
Klare Sprache, eine einzelne sprechende Person und wenig Hintergrundgeräusche liefern die besten Ergebnisse. Die gesprochene Sprache statt Auto-Erkennung auszuwählen, beseitigt eine häufige Fehlerquelle, und die langsameren Verarbeitungsgeschwindigkeiten lesen das Audio genauer. Rechnen Sie damit, Namen, Fachbegriffe und Zahlen zu prüfen.
Mehr als 90, darunter Arabisch, Chinesisch, Niederländisch, Französisch, Deutsch, Hindi, Italienisch, Japanisch, Koreanisch, Polnisch, Portugiesisch, Russisch, Spanisch, Türkisch, Ukrainisch und Vietnamesisch. Lassen Sie die Einstellung auf Automatik und die Sprache wird aus dem Audio erkannt.
Gängige Audioformate funktionieren, darunter MP3, WAV, M4A, FLAC, OGG und AAC. Mehrere Dateien können auf einmal hochgeladen werden, und jede wird als eigenes Transkript zurückgegeben.
Ja. Wählen Sie SRT als Ausgabeformat und das Transkript wird als zeitgesteuerte Untertitelzeilen zurückgegeben, die ein Videoplayer oder -editor direkt laden kann. Wählen Sie TXT für eine Klartextdatei.
Ja. Öffnen Sie diese Seite in einem mobilen Browser und wählen Sie die Aufnahme von Ihrem Handy oder aus der Cloud. Es ist keine App-Installation nötig, und die Schritte sind dieselben wie am Computer.
Alles läuft im Browser, ohne Installation und ohne Anmeldung.