Audio naar tekst
Audio naar tekst: upload de opname en krijg tekst met tijdcodes
Audio naar tekst omzetten kost hier geen enkele getypte letter: sleep een MP3, M4A, WAV, FLAC of OGG in het uploadvak en Whisper-spraakherkenning schrijft elke gesproken zin uit met een tijdcode ervoor, klaar om als TXT, SRT of VTT te downloaden; je eerste opname is gratis en zonder account, tot 10 minuten. Daarna kost een bestand één minuut saldo per minuut audio, en het origineel wordt verwijderd.
Bijgewerkt op
Op deze pagina
Audio naar tekst in vier stappen
Vier stappen brengen een opname van je telefoon of computer naar een transcriptie die je kunt downloaden, zonder iets te installeren en zonder steeds terug te spoelen om mee te typen.
- Kies het bestand. Sleep een MP3, M4A, WAV of ander audiobestand in het uploadvak, of klik erop om er een te kiezen. Je browser controleert type en grootte voordat er iets wordt verstuurd.
- Bekijk de prijs en klik op Transcriberen. De eerste opname van een gast wordt meteen en gratis uitgeschreven: helemaal tot 10 minuten, bij een langere opname de eerste 10 minuten. Na het inloggen zie je hoeveel minuten de opname kost, en er start niets voordat je op "Transcriberen" klikt.
- Vergelijk de tekst met het geluid. De opname speelt af vanaf je eigen apparaat, naast de transcriptie; klik op een tijdcode en de speler springt naar die regel.
- Download de transcriptie. Bewaar haar als TXT of Markdown om te lezen, of als SRT of VTT voor ondertitels.
Voor audio naar tekst komt er geen transcriptiesoftware op je computer: de spraakherkenning draait op onze server, en de pagina stuurt alleen de opname door. Een lange opname toont de voortgang in verwerkte minuten van het totaal, zodat je bij een gesprek van een uur ziet hoe ver het is in plaats van naar een draaiend rondje te kijken. Werk je liever op een groter scherm, dan kun je de opname in de werkruimte openen, waar transcriptie, speler en AI-tools naast elkaar staan.
Welke audiobestanden je kunt uploaden, en de grenzen
Audio transcriberen werkt hier met de formaten die telefoons en dictafoons opslaan en die programma's als Audacity exporteren; alleen grootte en duur hebben een harde grens.
| Formaat | Waar het meestal vandaan komt |
|---|---|
| MP3 | podcastafleveringen, dictafoons, gedownloade colleges |
| M4A (AAC of ALAC erin) | de Dictafoon-app op de iPhone, Zoom-opnames met alleen geluid, exports uit QuickTime |
| WAV, AIFF | veldrecorders, studiosoftware, ongecomprimeerde exports |
| FLAC | verliesvrije archieven |
| OGG, Opus, AAC | spraakberichten bewaard uit WhatsApp of Telegram, opnames in de browser |
| MP4, MOV, MKV, WEBM, AVI, MPEG, TS, WMV | videobestanden: het geluidsspoor wordt eruit gehaald, het beeld genegeerd; voor Teams of Zoom, zie hoe je een vergadering in MP4 transcribeert |
Grootte en duur hangen ervan af of je bent ingelogd:
- Zonder account: bestanden tot 100 MB; je eerste opname wordt gratis uitgeschreven, helemaal tot 10 minuten, daarna volgen korte gratis fragmenten.
- Na het inloggen: bestanden tot 500 MB en tot 4 uur lang.
- Een opname tussen 100 en 500 MB hoef je niet te comprimeren: log in, en dezelfde upload gaat door.
- Een opname van meer dan 4 uur knip je eerst in delen.
Elk formaat volgt dezelfde weg, dus een MP3 omzetten naar tekst kost evenveel als een WAV van dezelfde lengte. Voor het geluid van een video upload je de video zelf; de pagina over videobestanden en hun geluidsspoor behandelt MP4, MOV en de groottegrenzen.
De extensie is maar een eerste controle: voordat een audiobestand wordt uitgeschreven, leest de server de echte container met ffprobe, en een verkeerd benoemd bestand krijgt een duidelijke weigering nog voordat er een prijs verschijnt.
Voorbeeld: zo ziet een transcriptie van audio eruit
Een transcript van een audiobestand komt terug als één regel per gesproken zin, en elke regel begint met het moment waarop die zin start, in minuten en seconden.
Voorbeeldtekst in het exacte TXT-formaat, geen echte opname:
[0:00] Fijn dat je er bent. Vandaag lopen we het eerste kwartaal door.
[0:05] De omzet groeide in alle regio's behalve het noorden, waar twee winkels dichtgingen.
[0:12] We beginnen bij de webwinkel, want daar kwam de meeste verandering vandaan.
[0:19] Er kwamen ongeveer een vijfde meer bestellingen binnen dan in dezelfde maanden vorig jaar.Leestekens en hoofdletters zet Whisper zelf, en de gesproken taal wordt automatisch herkend: vooraf kies je geen taal. Na het eerste uur krijgt de tijdcode er een veld voor de uren bij, zoals [1:02:15]. Een tijdcode markeert het begin van een zin, niet van elk woord.
Welke opnames goed te transcriberen zijn
Spraakherkenning is het nauwkeurigst bij één heldere stem dicht bij de microfoon, en ze mist woorden overal waar andere geluiden met de spraak concurreren.
- Helpt: een telefoon of microfoon dicht bij de spreker, een stille kamer, spraak zonder muziek eronder.
- Hindert: twee mensen die door elkaar praten, achtergrondmuziek, verkeer, wind, de galm van een grote zaal.
- Liedjes: songteksten komen als woorden op papier, maar zang over instrumenten komt ruwer uit dan spraak.
- Afstand: een telefoon op de katheder vangt meer op dan een telefoon op de achterste rij van de collegezaal.
Klinkt een passage verminkt, dan brengt de tijdcode ernaast je meteen naar die plek, zodat je opnieuw luistert en die ene regel met de hand verbetert.
We publiceren geen nauwkeurigheidspercentage, want dat hangt veel meer af van de opname dan van de software. Je gratis eerste opname is de eerlijke test van audio naar tekst: die laat zien hoe jouw eigen geluid wordt herkend voordat je iets uitgeeft.
Een interview transcriberen voor je scriptie of artikel
Een interview transcriberen gaat hier precies zoals elke andere opname, en het resultaat is wat een bijlage of methodehoofdstuk vraagt: een volledige tekst waarin elke uitspraak aan een tijdstip vastzit.
- Leg de telefoon in het midden, tussen jou en de geïnterviewde: de zachtste stem bepaalt hoeveel woorden wegvallen.
- Upload het bestand zoals het is, als M4A uit de Dictafoon-app of als MP3 van een recorder.
- Zet zelf "I:" en "R:" voor de regels, want sprekerlabels komen er niet uit; de tijdcodes helpen je elke wissel terug te vinden.
- Lees na tegen het geluid en citeer met de tijdcode erbij, zodat een begeleider of redacteur de passage kan terugluisteren.
Een gesprek van 45 minuten is langer dan de gratis eerste opname: de eerste 10 minuten krijg je gratis te zien, en de hele opname kost 45 minuten saldo, de 10 cadeauminuten plus 35 minuten uit een pakket. Met de hand uitschrijven betekent pauzeren, typen en terugspoelen bij elke zin; hier besteed je die tijd aan nalezen.
Na de transcriptie: export, ondertitels, AI
Een transcript maken van audio is pas het begin: het klare transcript download je zonder meerprijs in vier formaten, en de AI-tools die erop werken kosten ook niets extra.
- TXT: platte tekst, met of zonder de
[m:ss]-tijdcodes; een schakelaar bij de transcriptie zet ze aan en uit. - Markdown: dezelfde regels, klaar voor notitie-apps zoals Obsidian.
- SRT: een ondertitelbestand met begin- en eindtijden, dat Premiere Pro als ondertitelspoor importeert; hoe zo'n bestand in elkaar zit, lees je bij wat een SRT-bestand is.
- VTT: WebVTT-ondertitels voor HTML5-videospelers.
Wil je de ondertitels in een ander formaat, of alleen de woorden zonder timing? De gratis ondertitelconverters in je browser zetten SRT om naar VTT of naar platte tekst, op je eigen apparaat.
De AI-acties werken op de klare transcriptie: samenvatting, uitgebreide notities, kernmomenten, een artikel, een social post, een opgeschoond Pro Transcript, een chat over de opname of een eigen prompt. Ze zijn inbegrepen bij de uitgeschreven opname, zonder tweede afrekening: je betaalt voor minuten spraakherkenning, niet per knop. Elke actie start pas als je erop klikt, en het resultaat bewaar je als PDF of DOCX.
Audio naar tekst gratis: wat niets kost en wat minuten kost
Je eerste opname is gratis zonder account, helemaal tot 10 minuten en de eerste 10 minuten van een langere; daarna kost een volledig audiobestand één minuut saldo per minuut geluid, vanaf $0.033 per minuut.
| Wat | Kosten | Voorwaarden |
|---|---|---|
| Eerste opname | gratis | zonder account; helemaal tot 10 minuten, de eerste 10 minuten van een langere; op een gedeeld netwerk een daglimiet per netwerk |
| Volgende opnames zonder account | gratis fragment | een kort fragment vanaf het begin; de hele opname na het inloggen |
| AI-analyses | inbegrepen | elke AI-analyse van een uitgeschreven opname, zonder tweede afrekening |
| Cadeau bij registratie | 10 minuten | één keer per account, worden als eerste gebruikt, vervallen na 7 dagen |
| Volledig bestand | 1 minuut saldo per minuut audio | naar boven afgerond op hele minuten; de prijs staat er vóór de start; afgeschreven na een geslaagde transcriptie |
| Pakketten | 1 uur voor $2.99 · 3 uur voor $7.99 · 10 uur voor $19.99 · 30 uur voor $58.99 | eenmalige betaling, geen abonnement; gekochte minuten vervallen niet; geld terug binnen 14 dagen |
Na je eerste opname is audio omzetten naar tekst alleen gratis als kort fragment. Het cadeau dekt een opname van hooguit 10 minuten, zoals een kort interview of een deel van een college. Een vergadering van 75 minuten vraagt daarnaast een pakket, en de pagina zegt dat voordat er iets wordt afgeschreven.
De tekst van een YouTube-video die al ondertitels heeft is een ander geval: die blijft voorgoed gratis, zonder registratie en zonder limiet, omdat hij uit de ondertitels komt die de video al meedraagt en niet uit spraakherkenning.
Waar je bestand naartoe gaat
Van audio transcriberen blijft hier alleen de tekst over: je originele bestand wordt van onze server verwijderd zodra het geluid eruit is gehaald.
- Het uitgehaalde geluid (MP3, 16 kHz, mono) gaat naar Whisper van OpenAI voor de herkenning; de stukjes worden verwijderd zodra de transcriptie klaar is.
- Zonder account wordt de transcriptie niet op de server bewaard: de server houdt haar ongeveer een uur vast tot de pagina haar ophaalt, daarna bestaat ze alleen in je browser.
- Een upload die nooit start, bijvoorbeeld terwijl je minuten aanvult, verdwijnt na ongeveer een uur van de server.
- Na het inloggen wordt de transcriptie in je account bewaard.
- De speler speelt het bestand af vanaf je apparaat. Na het herladen van de pagina kies je het opnieuw om te luisteren; de tekst is al bewaard.
- Kies je op deze pagina een bestand, dan houdt je browser een tijdelijke kopie vast om het aan de werkruimte door te geven, en wist die zodra ze is opgehaald, uiterlijk na een uur.
De volledige regels staan in het privacybeleid; lees het voordat je een interview met persoonsgegevens uploadt.
Wat het niet doet
Sprekerlabels zijn het belangrijkste wat deze transcriptie niet levert: de tekst is één doorlopende reeks regels met tijdcodes, wie er ook praat.
- Geen tijdcode per woord en geen tijdcodes op vaste intervallen: één per zin.
- Geen ondertitels in een video gebrand; je krijgt SRT- of VTT-bestanden om in een montageprogramma te laden.
- Geen opname via de microfoon en geen live spraak naar tekst of dicteren; upload een opname die al klaar is.
- Geen links naar Google Drive, Dropbox of Spotify; download het bestand eerst en upload het dan hier.
- Bestanden boven 500 MB of langer dan 4 uur worden geweigerd; knip ze eerst.
- Alleen het eerste audiospoor wordt gebruikt. Een opname met een apart spoor per persoon vraagt om een gemixt spoor, of om elk spoor apart.
Waar je wel op kunt rekenen als je hier audio naar tekst omzet: de prijs staat er vóór de start, minuten worden pas na een geslaagde transcriptie afgeschreven, en de export van een klaar transcript is inbegrepen.
Veelgestelde vragen
Kan ik audio gratis naar tekst omzetten?
Ja, je eerste opname: zonder account wordt die gratis uitgeschreven, helemaal als ze tot 10 minuten duurt en de eerste 10 minuten als ze langer is. Daarna krijgt een gast een kort gratis fragment; de hele opname gebruikt minuten van je saldo, en bij registratie krijg je er 10 cadeau.
Heb ik een account nodig?
Nee voor je eerste opname en voor korte gratis fragmenten. Ja voor hele bestanden daarna: je logt in via een link in je e-mail, zonder wachtwoord aan te maken.
Welke audioformaten en bestandsgroottes kan ik uploaden?
MP3, M4A, WAV, FLAC, OGG, Opus, AAC en AIFF, plus videobestanden zoals MP4, MOV en MKV. Tot 100 MB zonder account; tot 500 MB en 4 uur na het inloggen.
Kan ik een spraakbericht uit WhatsApp transcriberen?
Ja, als je het eerst als bestand bewaart. Een spraakbericht uit WhatsApp is een Opus-bestand, en dat upload je hier zoals elke andere opname.
Wordt mijn audiobestand bewaard?
Nee. Het origineel wordt van de server verwijderd zodra het geluid eruit is gehaald, of na ongeveer een uur als de transcriptie nooit start, en de audiostukjes verdwijnen na de herkenning. De tekst blijft in je browser, of in je account als je bent ingelogd.
Herkent het wie er spreekt?
Nee. Er zijn geen sprekerlabels: de transcriptie is één reeks regels met tijdcodes, wie er ook aan het woord is.
Wat als gratis transcriberen niet beschikbaar is?
Op een gedeeld netwerk, zoals op kantoor of bij een mobiele provider, geldt voor gratis transcriberen een daglimiet per netwerk, en de pagina meldt het zodra die bereikt is. Je krijgt dan een kort fragment, en de hele opname na het inloggen, met de 10 cadeauminuten.