MediaScribe
🇩🇪Deutsch
Zu Chrome hinzufügen

Umwandeln · VTT → Text

VTT to TXT converter — WebVTT in reinen Text umwandeln

Zoom und Teams liefern nach jedem Meeting eine Untertitelspur statt einer lesbaren Seite, und ein VTT to TXT converter schließt genau diese Lücke: die Kopfzeile WEBVTT, alle Cue-Einstellungen und jeder Zeitstempel fallen weg, übrig bleibt das Gespräch als zusammenhängender Text. Was verschwindet, woher solche Spuren stammen, wofür der reine Text taugt und was der Konverter nicht kann, folgen in dieser Reihenfolge.

Aktualisiert am

VTT→TXTläuft im Browser · nichts wird hochgeladen

Eingabe — VTT

Ergebnis — TXT

WebVTT-Datei in Text umwandeln

Zieh deine .vtt-Datei in das Feld oben, oder füge ihren Inhalt ein — lesbarer Text erscheint rechts. Kein Upload, kein Konto, keine Obergrenze bei der Anzahl: Die Seite erledigt die Arbeit im Browser und vergisst sie, sobald der Tab schließt. Ein 45-minütiges Meeting läuft meist auf 700 bis 800 Cues hinaus, und alle sind fertig, bevor du die Maus loslässt. Kopiere das Ergebnis, oder lade eine .txt für deine Notizen-App herunter.

Liegt stattdessen SRT statt WebVTT vor? Dieselbe Umwandlung für eine SubRip-Datei funktioniert identisch.

Was entfernt wird

WebVTT umhüllt den Dialog mit Gerüst, und jeder Teil davon liest niemand:

  • die einleitende Zeile WEBVTT samt Kopf-Metadaten danach;
  • Cue-Kennungen — das optionale Etikett über einer Zeitzeile;
  • Zeitzeilen wie 00:07:02.400 --> 00:07:05.960, samt Einstellungen wie line:, position: und align:;
  • NOTE-Kommentare und STYLE-Blöcke, geschrieben für den Player, nie für die Leserin.

Übrig bleibt der Wortlaut, in seiner ursprünglichen Reihenfolge. Sollen die Cue-Grenzen bleiben und sich nur das Format ändern? Die Zeiten behalten und zu SubRip wechseln macht genau das.

Woher diese Spuren meist stammen

Die meisten Menschen begegnen WebVTT, ohne danach gefragt zu haben. Zoom schreibt eine Datei zu jeder transkribierten Cloud-Aufzeichnung; Microsoft Teams bietet denselben Download neben jedem Meeting an; automatische Untertitelungsdienste und Streaming-Plattformen liefern eine .vtt, weil es das Format ist, das ihre Auslieferung ohnehin schon spricht. Vorlesungsaufzeichnungen und Podcast-Hoster kommen dazu, und keiner von ihnen bietet nebenbei eine lesbare Fassung an. So landen Leute hier mit einer Untertitelspur in der Hand, obwohl sie eigentlich das Gespräch wollten — ein Stand-up, ein Webinar, ein Kundenanruf. Zoom und Teams schreiben Sprechernamen direkt in den Cue-Text, deshalb wandern sie beim Entfernen automatisch in den fertigen Fließtext mit.

Wofür der Wortlaut gut ist

Reiner Text geht dorthin, wo Untertitel nicht hinkommen: in einen Suchindex, ein Zitat im Bericht, einen Absatz im Protokoll, ein Glossar der Begriffe aus einem Webinar, oder an einen Assistenten, der eine Zusammenfassung schreiben soll. Es ist der günstigste Input für alles Automatisierte, weil der genaue Wortlaut keine Deutung braucht, und Wortzahl, Lesezeit und Begriffshäufigkeit werden berechenbar, sobald die Zeitcodes weg sind. Ein Vorbehalt lohnt sich einzuplanen: Maschinelle Untertitel kommen ohne verlässliche Satzzeichen und oft ohne Großbuchstaben an, also eine Minute Nacharbeit einplanen, bevor der Text vor Publikum geht. Arbeitest du lieber von einem Link statt von einem Download, verwandelt sich ein YouTube-Video ganz ohne Datei in Text.

Die Grenzen, offen gesagt

Der Konverter entfernt Auszeichnung und sonst nichts: keine Übersetzung des eingefügten Texts, keine Medien-Uploads, keine Sprechertrennung, keine automatische Zeichensetzung. Cues werden in der Reihenfolge verbunden, in der sie stehen, deshalb liest sich ein Paar überlappender Live-Untertitel weiterhin als Überlappung, und zwei gleichzeitig sprechende Personen bleiben auf der Seite genauso verknotet wie im Raum. Alles läuft nur in eine Richtung — sichere das Original, bevor du es entfernst, falls später doch eine getimte Fassung gebraucht wird. Startest du von einem Skript statt einer Aufnahme? Ein WebVTT-Gerüst aus reinen Zeilen bauen geht den umgekehrten Weg.

Häufige Fragen

Wie mache ich aus VTT Text?

Zieh deine .vtt-Datei in das Feld oben oder füge sie als Text ein — Kopfzeile und Zeitstempel werden entfernt, saubere Zeilen bleiben rechts stehen. Kopiere sie oder lade eine .txt-Datei herunter. Kostenlos, ohne Konto.

Werden die Zeitstempel entfernt?

Ja, das ist der Zweck: Cue-Grenzen und Positionierung fallen weg, der Wortlaut bleibt. Hebe die Originaldatei auf, falls eine getimte Fassung später wieder gebraucht wird.

Wie lese ich ein Zoom-Transkript als reinen Text?

Eine Cloud-Aufzeichnung liefert eine .vtt-Datei. Füge sie ein, und das Gespräch kommt als zusammenhängender Text zurück, mit den Sprechernamen, die die Aufzeichnung in den Cue-Text geschrieben hat.

Wird dabei etwas hochgeladen?

Nein. Die Seite liest die Spur lokal, deshalb verlässt ein vertrauliches Meeting-Protokoll nie deinen Rechner — und es gibt kein Limit für die Anzahl der Meetings, die du so bearbeitest.