MediaScribe
🇳🇱Nederlands

Video transcriberen

Video transcriberen: upload het bestand en krijg het transcript

Video transcriberen draait hier alleen om het geluidsspoor: upload een MP4, MOV, MKV of WEBM en de spraak wordt van het beeld gescheiden, door Whisper herkend en regel voor regel uitgeschreven met tijdcodes, klaar voor TXT, SRT of VTT; je eerste opname is gratis en zonder account, tot 10 minuten. Daarna kost elke minuut opname één minuut saldo.

Bijgewerkt op

Zonder account: bestanden tot 100 MB; je eerste transcriptie is volledig gratis tot 10 min, daarna een kort gratis fragment. Na aanmelden: tot 500 MB en 4 uur. · 1 min saldo per minuut opname
MP3 · M4A · WAV · FLAC · OGG · MP4 · MOV · MKV · WEBM · AVI · SRT · VTT
Op deze pagina

Video transcriberen: het geluidsspoor telt, niet het beeld

Een video transcriberen is spraakherkenning op het geluidsspoor van een video: ffmpeg, het opensource-mediaprogramma, kopieert het eerste audiospoor van het bestand zonder het beeld te decoderen, maakt er een MP3 van 16 kHz mono van en geeft die aan het Whisper-model van OpenAI; daardoor maakt de beeldcodec, H.264 of HEVC, geen verschil.

  • Het beeld wordt genegeerd. Dia's, ingebrande ondertitels en andere tekst in beeld worden niet gelezen; alleen wat er gezegd wordt, komt in de transcriptie.
  • Geen geluid, geen tekst. Een schermopname zonder microfoon en zonder systeemgeluid wordt geweigerd met de melding "Dit bestand heeft geen geluid."
  • Eén spoor. Heeft een bestand meerdere audiosporen, zoals een film met twee nasynchronisaties, dan wordt het eerste gebruikt.
  • Te groot? Upload alleen het geluid: QuickTime Player bewaart een clip ook als alleen audio, en de M4A die daaruit komt, wordt net zo uitgeschreven als een spraakmemo. De tekst blijft gelijk, de upload slinkt tot een fractie.

Omdat de weg dezelfde is, kost een minuut beeld evenveel als een minuut geluid, en wie een opname zonder beeld naar tekst omzet, zoals de MP3 van een podcast of een memo uit de Dictafoon-app, volgt precies deze route.

Een videobestand transcriberen in vier stappen

Vier stappen brengen een clip van je computer of telefoon naar een transcriptie die je kunt downloaden, en meer is er niet: niets te installeren, niet terugspoelen om op te schrijven wat er gezegd is.

  1. Kies de video. Sleep een MP4, MOV, MKV, WEBM of ander videobestand in het uploadvak, of klik erop om er een te kiezen. Je browser controleert type en grootte voordat er iets wordt verstuurd.
  2. Start de transcriptie. De eerste opname van een gast start meteen en gratis: helemaal tot 10 minuten, bij een langere opname de eerste 10 minuten. Na het inloggen zie je hoeveel minuten het bestand gebruikt, en er draait niets voordat je op "Transcriberen" klikt.
  3. Kijk en lees naast elkaar. De video speelt af vanaf je eigen apparaat, naast de transcriptie; klik op een tijdcode en de speler springt naar dat moment.
  4. Download tekst of ondertitels. Bewaar TXT of Markdown om te lezen en te bewerken, SRT of VTT als ondertitels.

De spraakherkenning draait op onze server, dus de pagina vraagt geen extensie of desktopprogramma. Een lange opname toont de voortgang in verwerkte minuten: bij een webinar van 90 minuten zie je waar het staat, in plaats van naar een draaiend rondje te kijken. Op een groter scherm kun je de werkruimte openen met je bestand, waar speler, transcriptie en AI-tools naast elkaar staan.

Videoformaten en groottegrenzen

Om video naar tekst om te zetten neemt de pagina de containers aan die telefoons, camera's, vergaderapps en schermrecorders opslaan; alleen grootte en duur hebben een harde grens.

FormaatWaar het meestal vandaan komt
MP4Android-camera's, video's uit WhatsApp, lokale Zoom-opnames, gedownloade opnames uit Teams en Google Meet, Loom; lees hoe je een MP4 transcribeert als het bestand van een telefoon of een vergadering komt
MOVde camera van de iPhone, schermopnames op de Mac, QuickTime Player
MKV, WEBMOBS Studio, schermrecorders die in de browser draaien
AVI, WMV, MPEG, TSoudere camera's en Windows-programma's, tv-opnames

Grootte en duur hangen ervan af of je bent ingelogd:

  • Zonder account: bestanden tot 100 MB; je eerste opname wordt gratis uitgeschreven, helemaal tot 10 minuten, daarna volgen korte gratis fragmenten.
  • Na het inloggen: bestanden tot 500 MB en tot 4 uur lang.
  • Duurt een opname langer dan 4 uur, knip haar dan eerst in delen.

Beeld weegt veel meer dan spraak: een uur schermopname in 1080p kan boven de 500 MB uitkomen, terwijl hetzelfde uur alleen geluid enkele tientallen megabytes beslaat. De extensie is maar een eerste controle; de server leest de echte container met ffprobe en weigert alles wat geen media is, nog voordat er een prijs verschijnt.

Welke video's goed te transcriberen zijn

Video's waarin één persoon in de camera praat, colleges, interviews, webinars en ingesproken schermopnames worden het nauwkeurigst tekst, omdat een heldere stem dan dicht bij de microfoon zit.

  • Goed: een dasspeldmicrofoon of headset, een stille ruimte, één persoon tegelijk aan het woord.
  • Minder goed: muziek onder de stem, geroezemoes van publiek, mensen die elkaar onderbreken, wind op een telefoon die buiten filmt.
  • Muziekclips: gezongen tekst komt minder nauwkeurig uit dan spraak.

OpenAI trainde Whisper op 680.000 uur audio van het web, zoals het artikel "Robust Speech Recognition via Large-Scale Weak Supervision" uit 2022 beschrijft; accenten en spreektaal horen dus bij waarvoor het model is gemaakt, terwijl stemmen die over elkaar heen praten en muziek onder de spraak de gebruikelijke bronnen van fouten blijven. We publiceren geen nauwkeurigheidspercentage: dat hangt veel meer af van de opname dan van de software. Je gratis eerste opname is de eerlijke test op je eigen beelden, en de tijdcode naast een verminkte regel brengt je meteen naar het stuk om terug te luisteren.

Voorbeeld van een videotranscriptie

Een videotranscriptie komt terug als één regel per gesproken zin, en elke regel begint met de minuut en seconde waarop die zin start.

Voorbeeldtekst in het exacte TXT-formaat, geen echte opname:

[0:00] Hoi allemaal, dit is de demo van het nieuwe verkoopdashboard.
[0:06] Links zie je de filters die we vorige week hebben toegevoegd.
[0:13] Ik open het verkooprapport, want daar kwamen de meeste vragen over.
[0:21] Let op: de totalen worden nu bijgewerkt zonder de pagina te herladen.

Leestekens en hoofdletters komen van Whisper, en de gesproken taal wordt vanzelf herkend: je stelt vooraf niets in. Na het eerste uur krijgt de tijdcode er een veld voor de uren bij, zoals [1:04:10]. Elke tijdcode markeert het begin van een zin, niet van elk woord.

Na de transcriptie: ondertitels, export, AI

Een klare videotranscriptie download je in vier formaten die al bij de prijs horen, en twee daarvan zijn ondertitelbestanden.

  • TXT en Markdown om te lezen, aantekeningen te maken en te bewerken, met of zonder de [m:ss]-tijdcodes.
  • SRT voor Premiere Pro, DaVinci Resolve en YouTube Studio; VTT voor HTML5-spelers.

Ondertitels omzetten of de tijdcodes weghalen doen de ondertitelconverters die in je browser draaien, voor SRT, VTT en platte tekst. Heeft Teams of Zoom tijdens de vergadering zelf al een transcript als VTT gemaakt, dan is spraakherkenning niet nodig: zet dat VTT-bestand om naar leesbare tekst, gratis en in je browser.

De AI-acties vertrekken vanuit de klare transcriptie: samenvatting, uitgebreide notities, kernmomenten, hoofdstukken en tijdcodes, een artikel, een social post, een opgeschoond Pro Transcript, chat met de video of een eigen prompt. Ze zijn inbegrepen bij de uitgeschreven opname, zonder tweede afrekening: je betaalt voor minuten spraakherkenning, niet per knop.

Video transcriberen gratis, en wanneer minuten meetellen

Video transcriberen is gratis voor je eerste opname zonder account, helemaal tot 10 minuten en de eerste 10 minuten van een langere; daarna kost een volledig bestand één minuut saldo per minuut opname, vanaf $0.033 per minuut.

WatKostenVoorwaarden
Eerste opnamegratiszonder account; helemaal tot 10 minuten, de eerste 10 minuten van een langere; op een gedeeld netwerk een daglimiet per netwerk
Volgende video's zonder accountgratis fragmenteen kort fragment vanaf het begin; de hele video na het inloggen
Export en AI-analysesinbegrepenTXT, MD, SRT, VTT en elke AI-analyse van een uitgeschreven opname, zonder tweede afrekening
Cadeau bij registratie10 minutenéén keer per account, worden als eerste gebruikt, vervallen na 7 dagen
Volledig bestand1 minuut saldo per minuut opnamenaar boven afgerond op hele minuten; de prijs staat er vóór de start; afgeschreven na een geslaagde transcriptie
Pakketten1 uur voor $2.99 · 3 uur voor $7.99 · 10 uur voor $19.99 · 30 uur voor $58.99eenmalige betaling, geen abonnement; gekochte minuten vervallen niet; geld terug binnen 14 dagen

In de praktijk dekt het cadeau een schermopname van 10 minuten of een kort interview. Een college van 75 minuten vraagt daarnaast een pakket, en de pagina meldt dat vóór elke afschrijving. De "eerste opname" bestaat één keer per gast: een YouTube-video zonder ondertitels die je al hebt laten uitschrijven, telt ook als die opname.

Staat de video al op YouTube: moet je het bestand dan uploaden?

Nee: de meeste YouTube-video's hebben ondertitels, en hun tekst wordt direct gelezen, zonder upload en zonder spraakherkenning.

Het transcript van een YouTube-video met ondertitels komt uit het ondertitelspoor, gratis, zonder registratie en zonder limiet, en ook de AI-analyses van die tekst zijn gratis. Spraakherkenning, en dus minuten, komt pas in beeld als er geen tekst is om mee te beginnen: bij je eigen bestand, of bij een YouTube-video zonder ondertitels.

Waar je video naartoe gaat

Alleen de tekst blijft over als je hier een video transcribeert: het videobestand zelf wordt van onze server verwijderd zodra het geluid eruit is gehaald.

  • Het uitgehaalde geluid gaat naar Whisper van OpenAI voor de herkenning; de stukjes worden verwijderd zodra de transcriptie klaar is.
  • Zonder account wordt de transcriptie niet op de server bewaard: de server houdt haar ongeveer een uur vast tot de pagina haar ophaalt, daarna bestaat ze alleen in je browser.
  • Een upload die nooit start, bijvoorbeeld terwijl je minuten aanvult, verdwijnt na ongeveer een uur.
  • Na het inloggen wordt de transcriptie in je account bewaard.
  • De speler speelt de clip af vanaf je eigen apparaat. Na het herladen van de pagina kies je hem opnieuw om te kijken; de tekst is al bewaard.
  • Kies je op deze pagina een bestand, dan houdt je browser een tijdelijke kopie vast om het aan de werkruimte door te geven, en wist die zodra ze is opgehaald, uiterlijk na een uur.

Alle regels staan in ons privacybeleid.

Wat video transcriberen hier niet doet

Tekst in beeld valt buiten deze videotranscriptie: ze zet spraak om in tekst en leest het beeld niet.

  • Geen sprekerlabels; één doorlopende reeks regels met tijdcodes.
  • Geen ondertitels in het beeld gebrand; je krijgt SRT- of VTT-bestanden voor je montageprogramma of speler.
  • Geen ondertitelsporen die al in een MKV of MP4 zitten; de tekst ontstaat uit de spraak.
  • Geen links naar Google Drive, Dropbox, Vimeo of TikTok; download de clip eerst naar je apparaat.
  • Bestanden boven 500 MB of langer dan 4 uur worden geweigerd; upload alleen het geluid of knip de opname.
  • Alleen het eerste audiospoor wordt gebruikt.

Waar je op kunt rekenen als je je eigen video naar tekst omzet: de prijs staat er vóór de start, minuten worden pas na een geslaagde transcriptie afgeschreven, en de export van een klaar transcript is inbegrepen.

Gidsen per formaat: MP4 to text

Veelgestelde vragen

Kan ik een video gratis transcriberen?

Ja, je eerste opname: zonder account wordt die gratis uitgeschreven, helemaal als ze tot 10 minuten duurt en de eerste 10 minuten als ze langer is. Daarna krijgt een gast een kort gratis fragment; het hele bestand gebruikt minuten van je saldo, en bij registratie krijg je er 10 cadeau.

Heb ik een account nodig?

Nee voor je eerste opname en voor korte gratis fragmenten. Ja voor hele bestanden daarna: je logt in via een link in je e-mail, zonder wachtwoord aan te maken.

Welke videoformaten en bestandsgroottes kan ik uploaden?

MP4, MOV, MKV, WEBM, AVI, MPEG, TS en WMV, plus audiobestanden zoals MP3, M4A en WAV. Tot 100 MB zonder account; tot 500 MB en 4 uur na het inloggen.

Mijn video is te groot. Wat nu?

Upload alleen het geluid. Exporteer het audiospoor, bijvoorbeeld als M4A uit QuickTime Player, en upload dat: de transcriptie blijft gelijk, want alleen het geluid wordt herkend, en de upload weegt een fractie van de video.

Wordt mijn video op jullie server bewaard?

Nee. De video wordt van de server verwijderd zodra het geluid eruit is gehaald, of na ongeveer een uur als de transcriptie nooit start, en de audiostukjes verdwijnen na de herkenning. De tekst blijft in je browser, of in je account als je bent ingelogd.

Leest het tekst in beeld of ingebrande ondertitels?

Nee. Alleen gesproken woorden worden tekst. Dia's, ondertitels die in het beeld zijn gebrand en andere tekst op het scherm worden niet gelezen.

Herkent het wie er spreekt?

Nee. Er zijn geen sprekerlabels: de transcriptie is één reeks regels met tijdcodes, wie er ook aan het woord is.

Haal nu het transcript op

Sleep een videobestand in het uploadvak bovenaan de pagina om het te transcriberen: je eerste opname komt gratis terug, helemaal tot 10 minuten, en daarna kost een heel bestand één minuut saldo per minuut.