Da testo a voce

Incolla il testo, scegli una voce e premi il pulsante. Tutto viene sintetizzato dentro il browser: la voce di sistema parte all'istante, la voce neurale richiede un download una tantum ma suona uguale su ogni dispositivo e può essere salvata come file.

  • 0Caratteri
  • 0Durata approssimativa
  • 0Voci disponibili

La voce di sistema non si può salvare: il browser la manda dritta alla scheda audio senza dare alla pagina un flusso sonoro. La voce neurale nasce sul tuo dispositivo, perciò si può scaricare come file WAV.

Come si usa

  1. Incolla o scrivi il testo da leggere.
  2. Per una voce uguale su qualunque dispositivo — e per un file da conservare — attiva la voce neurale: il modello si scarica una volta e resta nel browser.
  3. Scegli una voce: la lista viene dalle lingue installate sul tuo dispositivo.
  4. Regola velocità e tono se la lettura predefinita è troppo veloce o troppo piatta.
  5. Premi «Leggi ad alta voce»; puoi mettere in pausa e riprendere dallo stesso punto.

Da sapere

Da dove arrivano le voci

Il browser non ha voci proprie: le chiede al sistema operativo. Per questo la lista cambia da macchina a macchina: un telefono di solito ha più voci per lingua, un desktop Linux può non averne nessuna finché non si installa un pacchetto vocale. Significa anche che non ci sono limiti di caratteri né abbonamenti: il lavoro lo fa un software che possiedi già.

Tre voci, tre compromessi

La voce di sistema non costa nulla per iniziare: è già installata e parla nel momento in cui premi il pulsante — ma come suona dipende dalla macchina, e su un desktop Linux spoglio può non esserci alcuna voce. Le voci neurali sono modelli scaricati che girano sul tuo dispositivo: Kokoro, con i suoi ottantotto megabyte, è la più viva e copre questa lingua; Piper è più leggero, sessanta megabyte, e conosce tutte le lingue del sito. In entrambi i casi il testo resta da te e il risultato può essere salvato in WAV.

I testi lunghi vengono letti a pezzi

Ricevuto un articolo intero, il motore vocale si arrende a metà strada: Chrome si ferma dopo circa quindici secondi se la coda non viene sollecitata, e Safari lascia cadere tutto ciò che va oltre le prime centinaia di caratteri. Perciò il testo viene tagliato ai confini delle frasi e messo in coda una frase alla volta. Tagliare a conteggio di caratteri metterebbe invece l'interruzione dentro una parola, e si sentirebbe come un'esitazione.

Domande frequenti

Posso scaricare l'audio come file?

Sì, con la voce neurale: costruisce l'audio nella pagina stessa, quindi accanto al lettore compare un pulsante «Scarica WAV». La voce di sistema non si può salvare: il browser la manda direttamente alla scheda audio senza dare alla pagina un flusso sonoro, quindi non c'è nulla con cui comporre un file.

Nella lista non ci sono voci. Che faccio?

Il sistema non ne ha installate. Su Windows si aggiungono dalle impostazioni della lingua, su Android e iOS dalle impostazioni di accessibilità, su Linux installando un pacchetto vocale per speech-dispatcher. Poi ricarica la pagina: la lista viene letta al caricamento.

Perché lo stesso testo suona diverso in un altro browser?

Perché la voce viene dal sistema, ma la scelta della voce predefinita, la gestione delle pause e il ritmo esatto appartengono al browser. Chrome può anche offrire voci di rete, che suonano più morbide e richiedono una connessione.

Il testo viene inviato a un server?

La pagina non invia testo da nessuna parte. La voce neurale scarica il suo modello da huggingface una volta e poi lavora offline; le parole che incolli non lasciano mai il dispositivo. Una voce di sistema marcata come voce di rete può invece chiedere l'audio al suo fornitore, ed è per questo che qui sono preferite le voci locali.

Strumenti correlati