Da voce a testo

Un’intervista, una lezione, un messaggio vocale che preferiresti leggere invece di riascoltare. La registrazione resta su questo dispositivo: è il modello a raggiungerla, non il contrario. Costa circa 68 MB al primo avvio, e il numero è scritto sul pulsante, non nascosto dietro.

Audio o video — la traccia sonora il browser la prende da sé.

La registrazione non viene caricata da nessuna parte: il modello si scarica nel tuo browser e ascolta lì. Dopo il primo avvio funziona anche con la rete spenta.

Qui accanto: Registratore vocale · Da video a MP3 · Convertitore audio · Blocco note online

Come si usa

  1. Scegli la registrazione — audio o video, la traccia sonora viene estratta per te.
  2. Indica la lingua parlata. Al primo avvio il modello viene scaricato una volta sola.
  3. Premi il pulsante, leggi la trascrizione e scaricala come testo o come sottotitoli.

Da sapere

Cosa sente bene e cosa no

Su un inglese parlato pulito il modello leggero sbaglia circa una parola su venti: una trascrizione che leggi e correggi in un minuto. Su russo, giapponese o coreano sbaglia circa un terzo delle parole anche con un audio da studio, perché il modello leggero è l’unico che stia dentro un browser. La pagina dice in quale dei due casi ti trovi prima che tu spenda il download, non dopo.

Perché 68 MB e nessun server

Ogni servizio che trascrive «all’istante» manda la tua registrazione sulla macchina di qualcun altro. Interviste, visite mediche, messaggi vocali di famiglia: è molto da consegnare in cambio di una comodità. Qui è il modello ad andare verso il file: un download, poi funziona offline, e la registrazione non diventa il dataset di nessuno. Il prezzo di quella scelta è il download, ed è dichiarato in anticipo.

Domande frequenti

La mia registrazione viene caricata?

No. Il modello viene scaricato nel tuo browser e gira lì. Dopo il primo avvio la pagina funziona con la rete spenta.

Perché la trascrizione in russo è così approssimativa?

Perché il modello leggero ci va male: circa un terzo delle parole esce sbagliato anche su un parlato pulito. Esistono modelli più forti, ma sono quattro volte più pesanti e in un browser non si caricano. La pagina ti avvisa prima che tu scarichi qualsiasi cosa.

Posso ottenere i sottotitoli?

Sì: insieme al testo semplice esce un file SRT con i tempi. La sincronizzazione è per finestre di trenta secondi, che è ciò che il modello conosce davvero.

Quanto può durare una registrazione?

Fino a un’ora. I file più lunghi non entrano nella memoria del browser in un pezzo solo; dividili prima.

Strumenti correlati