Untertitel-Generator
Wandelt Sprache in Text um und erstellt eine Untertiteldatei.
Dieses Tool benötigt JavaScript. Aktiviere JavaScript in deinem Browser und lade die Seite neu.
MACH AUS SPRACHE UNTERTITEL.
Der Untertitel-Generator wandelt die Sprache in einer Video- oder Audiodatei in Text um und gibt sie als zeitgenaue Untertiteldatei aus. Die SRT-Ausgabe wird in Playern, beim Hochladen zu YouTube und in Schnittprogrammen genutzt; die VTT-Ausgabe in Web-Playern (HTML5). Für die Spracherkennung läuft OpenAIs offenes Whisper-Modell auf dem Server; 16 Sprachen einschließlich Türkisch sind wählbar, oder die Sprache wird automatisch erkannt. Die Untertitel werden lesbar aufgeteilt: höchstens zwei Zeilen, höchstens 42 Zeichen je Zeile, höchstens 6 Sekunden, geschnitten an Satzenden.
Die Aufnahme stammt nur aus der Datei, die du hochlädst; ein Feld zum Einfügen eines Links oder einer Videoadresse gibt es nicht. Der Ton wird mit einem Whisper-Modell auf dem Server transkribiert; er wird nie an einen fremden Dienst geschickt und nach dem Auftrag gelöscht. Wähle die Sprache, wenn du sie kennst: Die automatische Erkennung schaut auf die ersten 30 Sekunden und kann bei gemischten oder verrauschten Aufnahmen danebenliegen. Das Modell „Ausgewogen“ reicht für die meisten Aufnahmen, und der Auftrag dauert etwa so lange wie die Aufnahme; das Modell „Beste“ erfasst Namen und Fachbegriffe genauer, ist aber 3–4-mal langsamer und wird für Aufnahmen bis 10 Minuten verwendet. Eine Aufnahme darf höchstens 30 Minuten lang sein; ist sie länger, teile sie zuerst mit „Video schneiden“ oder „Audio schneiden“. Das Ergebnis erscheint auf dem Bildschirm, lässt sich kopieren und wird als Datei heruntergeladen; lies es vor der Veröffentlichung unbedingt und korrigiere es — Eigennamen, Fachbegriffe und verrauschte Stellen sind die häufigsten Fehlerquellen.
Von Anfang bis Ende
- Lade deine Video- oder Audiodatei hoch. MP4, MOV, MKV, WebM, MP3, WAV, M4A, FLAC… Die Dauer wird gelesen.
- Sprache und Format wählen. Wähle die Sprache, wenn du sie kennst; SRT für die meisten Zwecke, VTT für Web-Player. Modell: Ausgewogen.
- Untertitel herunterladen. Die Cues erscheinen auf dem Bildschirm und lassen sich kopieren; die Datei wird heruntergeladen. Lesen, korrigieren, dann veröffentlichen.
Häufige Fragen
SRT oder VTT?
SRT ist das verbreitetste Format: VLC, YouTube, Premiere, DaVinci Resolve und die meisten Player lesen es. VTT ist das Format, das das HTML5-Video-Tag im Browser erwartet; wähle VTT, wenn du die Untertitel in eine Website einbettest. Der Inhalt ist derselbe, nur die Schreibweise unterscheidet sich.
Kann ich einen YouTube- oder anderen Link angeben?
Nein. Das Werkzeug arbeitet nur mit der Datei, die du hochlädst; ein Feld zum Einfügen eines Links gibt es bewusst nicht. Inhalte eines anderen Dienstes herunterzuladen verstößt gegen dessen Nutzungsbedingungen.
Wie genau ist es?
Bei einer sauberen Aufnahme (ein Sprecher, nahes Mikrofon) trifft das Modell „Ausgewogen“ die große Mehrheit der Wörter; Eigennamen, Abkürzungen und Fachbegriffe können durcheinandergeraten. Störgeräusche, ein entferntes Mikrofon und Durcheinanderreden erhöhen die Fehlerquote. Das Modell „Beste“ ist deutlich genauer, aber langsamer. Betrachte die Ausgabe als Entwurf und lies sie vor der Veröffentlichung.
Bleibt meine Datei auf dem Server?
Nein. Deine Datei kommt nur zur Verarbeitung auf den Server und wird gelöscht, sobald der Auftrag fertig ist; auch das Ergebnis wird gelöscht, wenn du es heruntergeladen und das Werkzeug verlassen hast. Du brauchst kein Konto, keinen Namen und keine E-Mail-Adresse, und deine Dateien werden an keinen Drittanbieter gesendet. Die Nutzung ist kostenlos: Es gibt kein stündliches oder tägliches Kontingent für die Anzahl der Vorgänge, vor der Verarbeitung musst du keine Werbung ansehen, und wir fügen der Ausgabe kein Wasserzeichen hinzu.
Weitere Audio-Tools
RUPO Studio