Da audio a testo
Trascrizione audio: carica la registrazione e ricevi il testo con i timestamp
La trascrizione audio comincia da un file: trascina qui sotto un MP3, M4A, WAV, FLAC o OGG e il riconoscimento vocale Whisper scrive ogni frase pronunciata con il suo timestamp, in un testo pronto per TXT, SRT o VTT; la prima registrazione è gratis e senza account, fino a 10 minuti. Dopo, un file costa un minuto di saldo per minuto di audio e l’originale viene eliminato.
Aggiornato il
In questa pagina
Come fare la trascrizione audio in quattro passaggi
Quattro passaggi portano una registrazione dal tuo dispositivo a un testo da scaricare, senza installare nulla né fermare e riavvolgere l’audio per scriverlo a mano.
- Scegli il file. Trascina un MP3, un M4A, un WAV o un altro file audio nell’area di caricamento, oppure fai clic per sceglierlo. Il browser controlla tipo e dimensione prima di inviare qualsiasi cosa.
- Guarda il prezzo e premi Trascrivi. La prima registrazione di un ospite parte subito ed è gratis: completa fino a 10 minuti, solo i primi 10 minuti se dura di più. Dopo l’accesso la pagina mostra quanti minuti userà il file, e nulla parte finché non premi Trascrivi.
- Controlla il testo ascoltando. L’audio suona dal tuo dispositivo accanto alla trascrizione: un clic su un timestamp porta il player a quella riga.
- Scarica la trascrizione. Salvala in TXT o Markdown per leggerla, in SRT o VTT per i sottotitoli.
Sul computer non va installato nessun programma di trascrizione: il riconoscimento vocale gira sul nostro server, e la pagina si limita a caricare il file. Una registrazione lunga mostra l’avanzamento in minuti fatti sul totale, così un’intervista di un’ora dice a che punto è invece di lasciarti davanti a una rotellina. Se preferisci uno schermo più ampio, apri l’area di lavoro con la tua registrazione: trascrizione, player e strumenti IA stanno uno accanto all’altro.
Quali file audio accetta, e con quali limiti
Il convertitore da audio a testo accetta i formati che salvano telefoni, registratori vocali e programmi come Audacity, e gli unici limiti rigidi sono il peso e la durata.
| Formato | Da dove arriva di solito |
|---|---|
| MP3 | puntate di podcast, registratori portatili, lezioni scaricate |
| M4A (dentro AAC o ALAC) | Memo Vocali di iPhone, registrazioni solo audio di Zoom, esportazioni da QuickTime |
| WAV, AIFF | registratori da presa diretta, software da studio, esportazioni non compresse |
| FLAC | archivi senza perdita di qualità |
| OGG, Opus, AAC | vocali di WhatsApp e Telegram salvati come file, registrazioni fatte nel browser |
| MP4, MOV, MKV, WEBM, AVI, MPEG, TS, WMV | file video: si estrae la traccia sonora, l’immagine viene ignorata |
Peso e durata dipendono dall’accesso:
- Senza account: file fino a 100 MB; la prima registrazione è trascritta gratis, per intero fino a 10 minuti, poi arrivano brevi estratti gratuiti.
- Dopo l’accesso: file fino a 500 MB e fino a 4 ore.
- Tra 100 e 500 MB non serve comprimere: accedi, e lo stesso caricamento passa.
- Oltre le 4 ore conviene dividere l’audio in parti.
Ogni formato segue la stessa strada: un MP3 e un WAV si trascrivono allo stesso modo e allo stesso prezzo. Anche un filmato si carica così com’è, e la guida per trascrivere l’audio di un file video spiega MP4, MOV e i limiti di peso.
L’estensione è solo un primo controllo: prima di mostrarti un prezzo, il server legge il contenitore reale con ffprobe e rifiuta con un messaggio chiaro ciò che non è audio né video.
Un esempio di trascrizione da audio a testo
Il testo torna come una riga per ogni frase detta, e ogni riga si apre con il minuto e il secondo in cui quella frase comincia.
Testo illustrativo nel formato TXT esatto, non una registrazione reale:
[0:00] Buongiorno a tutti. Oggi chiudiamo il capitolo sulla Costituzione.
[0:06] Partiamo dall’articolo 1, perché da lì discende tutto il resto.
[0:13] «L’Italia è una Repubblica democratica, fondata sul lavoro.»
[0:19] Notate che la sovranità appartiene al popolo, che la esercita nelle forme previste.Punteggiatura e maiuscole le mette Whisper, e la lingua parlata viene riconosciuta da sola: prima di iniziare non c’è nessuna lingua da scegliere. Oltre la prima ora il timestamp guadagna il campo delle ore, come in [1:02:15]. Ogni segno marca l’inizio di una frase, non di ogni parola, e nell’esportazione lo tieni o lo togli con un interruttore.
Cosa rende una registrazione facile da trascrivere
Il riconoscimento vocale è più preciso con una voce chiara vicina al microfono, e perde parole ovunque altri suoni si sovrappongono al parlato.
- Aiuta: un telefono o un microfono vicino a chi parla, una stanza silenziosa, la voce senza musica sotto.
- Peggiora: due persone che parlano insieme, musica di sottofondo, traffico, vento, l’eco di un’aula grande.
- Canzoni: i versi cantati vengono trascritti, ma sopra gli strumenti escono più grezzi del parlato.
- Distanza: uno smartphone sulla cattedra capta più di uno lasciato in ultima fila.
Se un passaggio esce confuso, il timestamp accanto ti porta al punto giusto: riascolti e correggi quella riga a mano. Non pubblichiamo percentuali di precisione, perché dipendono dalla registrazione molto più che dal software. La prima registrazione gratuita è la prova onesta: mostra come viene trascritta la tua voce prima di spendere qualcosa.
Sbobinare una lezione registrata
Sbobinare una lezione vuol dire trasformarne l’audio in testo scritto, e qui lo sbobinato arriva già diviso in frasi con i tempi, invece di essere battuto a mano ascoltando e riascoltando ogni passaggio.
- Registra vicino: lo smartphone sul banco delle prime file, non in fondo all’aula.
- Calcola i minuti: il regalo di 10 minuti copre una parte di lezione; per una lezione di 90 minuti serve un pacchetto, e la pagina lo dice prima di qualsiasi addebito.
- Studia sul testo: a trascrizione finita, le azioni IA preparano appunti dettagliati, quiz, flashcard e una mappa mentale dalla stessa lezione.
- Lezione già online? Se è su YouTube con i sottotitoli, non va caricata: la trascrizione di una videolezione pubblicata su YouTube non usa minuti.
Quando un passaggio degli appunti non torna, un clic sul suo timestamp riporta il player al secondo esatto in cui il docente l’ha detto.
Dopo la trascrizione: esportazione, Word, sottotitoli, IA
Una trascrizione finita si scarica in quattro formati senza costi aggiuntivi, e anche gli strumenti IA che lavorano sul testo sono compresi.
- TXT: testo semplice, con o senza i segni
[m:ss]; un interruttore li accende e li spegne. - Markdown: le stesse righe, pronte per app di appunti come Obsidian o Notion.
- SRT: file di sottotitoli con inizio e fine di ogni battuta, quello che Premiere Pro importa come traccia; com’è fatto dentro lo mostra la guida cos’è un file SRT.
- VTT: sottotitoli WebVTT per i player HTML5.
Per lavorare in Word basta il TXT: si apre direttamente in Microsoft Word, LibreOffice o Google Documenti, con o senza i tempi. Il DOCX, insieme al PDF, è previsto per i risultati IA.
Ti serve un altro formato di sottotitoli? I convertitori di sottotitoli gratuiti nel browser passano da SRT a VTT o a testo semplice sul tuo computer, e se un programma di montaggio rifiuta la traccia c’è la conversione da VTT a SRT per il montaggio.
Le azioni IA lavorano sulla trascrizione finita: riassunto, appunti dettagliati, articolo, post social, Pro Transcript ripulito, traduzione del testo, chat sulla registrazione o un prompt tuo. Sono già comprese: paghi i minuti di riconoscimento vocale, non i singoli pulsanti. Ognuna parte solo quando la premi, e il risultato si salva in PDF o DOCX.
Trascrizione audio in testo gratis: cosa è gratis e cosa usa i minuti
La trascrizione audio in testo è gratis per la prima registrazione senza account, per intero fino a 10 minuti e per i primi 10 minuti se dura di più; poi un file intero costa un minuto di saldo per minuto di audio, da $0.033 al minuto.
| Cosa | Costo | Condizioni |
|---|---|---|
| Prima registrazione | gratis | senza account; per intero fino a 10 minuti, i primi 10 se è più lunga; su una rete condivisa vale un limite giornaliero per rete |
| Registrazioni successive senza account | estratto gratuito | un breve estratto dall’inizio; la registrazione intera dopo l’accesso |
| Esportazione e analisi IA | incluse | TXT, MD, SRT, VTT e ogni analisi IA di una registrazione trascritta, nessun secondo addebito |
| Regalo all’iscrizione | 10 minuti | una volta per account, usati per primi, scadono dopo 7 giorni |
| File intero | 1 minuto di saldo per minuto di audio | arrotondato al minuto successivo; prezzo mostrato prima di iniziare; addebito dopo una trascrizione riuscita |
| Pacchetti | 1 h per $2.99 · 3 h per $7.99 · 10 h per $19.99 · 30 h per $58.99 | pagamento una tantum, nessun abbonamento; i minuti acquistati non scadono; rimborso entro 14 giorni |
Il regalo basta per un audio fino a 10 minuti, come un’intervista breve o un pezzo di lezione. Una riunione di 45 minuti richiede un pacchetto in aggiunta, e la pagina lo dice prima di addebitare qualcosa. Il diritto alla prima registrazione gratuita è uno per ospite, e lo consuma anche un video YouTube senza sottotitoli trascritto prima. Chi sbobina molte ore ogni mese trova nel confronto dei prezzi con TurboScribe la soglia oltre la quale un abbonamento costa meno.
Il testo di un video YouTube che ha già i sottotitoli è un caso diverso: resta gratis per sempre, senza registrazione né limiti, perché legge i sottotitoli già presenti invece di riconoscere il parlato.
Dove finisce il tuo file
Della registrazione resta solo il testo: il file originale viene eliminato dal nostro server appena ne è stato estratto il suono.
- Il suono estratto (MP3, 16 kHz, mono) va a Whisper di OpenAI per il riconoscimento; i suoi pezzi vengono eliminati quando la trascrizione è pronta.
- Senza account la trascrizione non resta sul server: è conservata per circa un’ora finché la pagina non la ritira, poi vive solo nel tuo browser.
- Un caricamento che non parte, per esempio mentre ricarichi i minuti, viene eliminato dopo circa un’ora.
- Dopo l’accesso la trascrizione si salva nel tuo account.
- Il player riproduce l’audio dal tuo dispositivo. Se ricarichi la pagina, scegli di nuovo il file per ascoltarlo; il testo è già salvato.
- Quando scegli un file su questa pagina, il browser ne tiene una copia temporanea per passarlo all’area di lavoro e la cancella appena è stata ritirata, al massimo dopo un’ora.
Le regole complete sono nell’informativa sulla privacy, collegata in fondo a ogni pagina.
Cosa non fa
Il limite principale di questa trascrizione audio è che non distingue chi parla: il risultato è un unico flusso di righe con timestamp, chiunque sia la voce.
- Niente segni per ogni parola né a intervalli fissi: uno per frase.
- Non è un trascrittore vocale in tempo reale: niente dettatura dal microfono, si carica una registrazione finita.
- Niente sottotitoli impressi nel video; ricevi file SRT o VTT da caricare in un editor.
- Niente link a Google Drive, Dropbox o Spotify: scarica il file, poi caricalo qui.
- File oltre 500 MB o più lunghi di 4 ore vengono rifiutati: dividili prima.
- Si usa solo la prima traccia audio. Un audio con tracce separate per persona richiede una traccia mixata, oppure ogni traccia caricata da sola.
Su cosa puoi contare invece: il prezzo compare prima dell’avvio, i minuti si scalano solo dopo una trascrizione riuscita e l’esportazione del testo finito è inclusa.
Domande frequenti
Si può fare la trascrizione audio gratis?
Sì, la prima registrazione: senza account viene trascritta gratis, per intero se dura fino a 10 minuti, solo i primi 10 minuti se è più lunga. In seguito un ospite riceve un breve estratto gratuito; la registrazione intera usa i minuti del saldo, e l’iscrizione ne regala 10.
Serve un account?
No per la prima registrazione e per i brevi estratti gratuiti. Sì per i file interi successivi: l’accesso avviene con un link inviato alla tua email, senza password da creare.
Quali formati e dimensioni posso caricare?
MP3, M4A, WAV, FLAC, OGG, Opus, AAC e AIFF, più file video come MP4, MOV e MKV. Fino a 100 MB senza account; fino a 500 MB e 4 ore dopo l’accesso.
Il mio file audio viene conservato?
No. L’originale viene eliminato dal server subito dopo l’estrazione del suono, oppure dopo circa un’ora se la trascrizione non parte, e i pezzi audio spariscono dopo il riconoscimento. Il testo resta nel tuo browser, o nel tuo account se hai fatto l’accesso.
Posso aprire la trascrizione in Word?
Sì: scarica il TXT e aprilo in Microsoft Word, LibreOffice o Google Documenti. Il file DOCX è previsto per i risultati IA, come riassunti e appunti.
Distingue chi parla?
No. Non ci sono etichette per gli interlocutori: la trascrizione è un unico flusso di righe con timestamp, chiunque stia parlando.
Cosa succede se la trascrizione gratuita non è disponibile?
Su una rete condivisa, come quella di un ufficio o di un operatore mobile, la trascrizione gratuita ha un limite giornaliero per rete, e la pagina lo segnala quando è raggiunto. In quel caso ricevi un breve estratto, e il file intero dopo l’accesso, con i 10 minuti in regalo.