KOSTENLOSES TOOL · AUF DEINEM GERÄT
Audio und Video kostenlos in Text transkribieren
Verwandle das Gesagte in einer Audio- oder Videodatei in Text: eine Sprachnachricht, ein Interview, eine Vorlesung oder eine Podcast-Folge. Die Transkription läuft mit Whisper auf deinem Gerät; prüfe den Text, kopiere ihn oder lade ihn als TXT (in Absätzen oder mit Zeitstempeln) oder SRT herunter.
- Kostenlos, kostenloses Konto erforderlich
- TXT und SRT
- Dein Audio verlässt nie dein Gerät
- Audio oder Video hinzufügen
- Transkribieren
- Prüfen und herunterladen
SO NUTZT DU ES
Drei Schritte.
Audio oder Video hinzufügen
MP3, WAV, M4A, OGG, MP4, WebM oder MOV mit Sprache, bis zu 10 Minuten. Wähle die Sprache: Spanisch, Englisch oder automatisch erkennen.
Transkribieren
Drücke „In Text transkribieren“. Beim ersten Mal wird das Modell heruntergeladen; danach dauert es auf einem aktuellen Computer ungefähr so lange wie das Audio.
Prüfen und herunterladen
Korrigiere den Text, kopiere ihn oder lade die TXT in Absätzen oder mit Zeitstempeln herunter, und die SRT satzweise.
NÄCHSTER SCHRITT
Mach weiter mit diesen Tools
In Text transkribieren: häufige Fragen
Wie genau ist die Transkription?
Bei klarer Sprache und wenig Rauschen erkennt es meist die meisten Wörter richtig. Bei Namen, Hintergrundmusik, starken Akzenten oder sich überlagernden Stimmen kann es danebenliegen, und es unterscheidet keine Sprecher. Prüfe den Text, bevor du ihn verwendest.
Funktioniert es mit WhatsApp-Sprachnachrichten?
Ja, wenn dein Browser die Datei abspielen kann (Sprachnachrichten sind meist OGG oder OPUS, die Chrome, Edge und Firefox lesen). Speichere sie auf deinem Gerät und füge sie hier hinzu.
Was, wenn mein Audio länger als 10 Minuten ist?
Teile es in Abschnitte von bis zu 10 Minuten und transkribiere sie nacheinander. Eine Audiodatei bis 15 Minuten kannst du gleich hier mit unserem MP3-Cutter schneiden; schneide ein Video oder eine längere Audiodatei in der Galerie deines Handys oder in deinem Editor (auch Video schneiden stoppt bei 10 Minuten). Das Limit sorgt dafür, dass es auch auf Handys gut funktioniert.
Was transkribiert das Tool?
Whisper (das Spracherkennungsmodell von OpenAI, Gewichte unter MIT-Lizenz), ausgeführt von transformers.js (Apache-2.0-Lizenz) in deinem Browser, dasselbe, das auch unser Tool Auto-Untertitel verwendet. Beim ersten Mal wird das Modell heruntergeladen (etwa 77 MB bei „Normal“ und etwa 250 MB bei „Hoch“) und von deinem Browser gespeichert.
Wird mein Audio auf einen Server hochgeladen?
Nein. Das Audio wird in deinem Browser gelesen und transkribiert und weder an Cocuyo noch an Dritte gesendet. Nur das Sprachmodell wird einmalig von unseren Servern heruntergeladen.
Ist es wirklich kostenlos?
Ja. Du kannst es vor der Registrierung ausprobieren; um es weiter zu nutzen, bitten wir dich um ein kostenloses Konto, ohne Abo. Es verbraucht keine Credits und zählt nicht zu deinen 30 Willkommensnutzungen: Die Nutzung ist unbegrenzt.
Welche Limits gibt es?
Eine Audio- oder Videodatei bis 300 MB und 10 Minuten, die dein Browser abspielen kann. Die Transkription läuft auf dem Gerät: Auf einem Handy kann sie viel länger dauern als auf einem Computer.
Erfahre, wie du…
WEITERE KOSTENLOSE TOOLS
Weitere Audio-Tools
Alle kostenlosen Tools
WENN DU ERSTELLEN MÖCHTEST
Erstelle Stimmen und Vertonung mit KI.
Das Studio von Cocuyo vereint über 30 KI-Modelle für Bild, Video und Stimme. Du siehst die Credit-Kosten, bevor du generierst, und Credits verfallen nie.