Texto para voz

Cole o texto, escolha a voz e aperte o botão. Tudo é gerado dentro do navegador: a voz do sistema começa na hora, a neural precisa de um download único, mas soa igual em qualquer aparelho e pode ser salva como arquivo.

  • 0Caracteres
  • 0Duração aproximada
  • 0Vozes disponíveis

A voz do sistema não pode ser salva: o navegador a envia direto para a placa de som sem entregar um fluxo de áudio à página. Já a voz neural é gerada no seu aparelho e pode ser baixada em WAV.

Como usar

  1. Cole ou digite o texto a ser lido.
  2. Para uma voz uniforme em qualquer aparelho — e um arquivo para guardar — ligue a voz neural: o modelo é baixado uma vez e fica no navegador.
  3. Escolha uma voz — a lista vem dos idiomas instalados no seu aparelho.
  4. Ajuste velocidade e tom se a leitura padrão for rápida ou monótona demais.
  5. Aperte «Ler em voz alta»; dá para pausar e continuar do mesmo ponto.

Bom saber

De onde vêm as vozes

O navegador não traz vozes próprias — ele pede ao sistema operacional. Por isso a lista muda de aparelho para aparelho: um celular costuma ter várias vozes por idioma e um Linux de mesa pode não ter nenhuma até instalar um pacote de fala. Isso também significa: sem limite de caracteres e sem assinatura — quem trabalha é um software que você já tem.

Três vozes, três compromissos

A voz do sistema não custa nada para começar: já está instalada e fala assim que você aperta o botão — mas o timbre depende da máquina, e num Linux de mesa pode não haver nenhuma. As vozes neurais são modelos baixados que rodam no seu próprio aparelho: a Kokoro, de oitenta e oito megabytes, é a que soa mais viva e cobre este idioma; a Piper pesa sessenta e conhece todos os idiomas do site. De um jeito ou de outro o texto fica com você e o resultado pode ser salvo em WAV.

Texto longo é lido em pedaços

Se receber um artigo inteiro, o motor de fala desiste no meio: o Chrome para depois de uns quinze segundos se a fila não for empurrada, e o Safari descarta tudo além das primeiras centenas de caracteres. Por isso o texto é cortado nos limites das frases e enfileirado uma a uma. Cortar por número de caracteres colocaria a quebra no meio de uma palavra, e isso se ouve como gagueira.

Perguntas frequentes

Dá para baixar o áudio como arquivo?

Sim, com a voz neural: ela monta o áudio na própria página, por isso aparece o botão «Baixar WAV» ao lado do player. A voz do sistema não pode ser salva — o navegador a envia direto para a placa de som sem entregar um fluxo de áudio à página.

Não há vozes na lista. E agora?

O sistema não tem nenhuma instalada. No Windows elas são adicionadas nas configurações de Idioma, no Android e iOS em Acessibilidade, no Linux instalando um pacote de vozes do speech-dispatcher. Recarregue a página depois: a lista é lida no carregamento.

Por que o mesmo texto soa diferente em outro navegador?

Porque a voz vem do sistema, mas a escolha da voz padrão, o tratamento das pausas e o ritmo exato pertencem ao navegador. O Chrome ainda pode oferecer vozes de rede, que soam mais suaves e exigem conexão.

O texto é enviado a um servidor?

A página não envia texto algum. A voz neural baixa o modelo do huggingface uma única vez e depois trabalha sem rede; as palavras coladas nunca saem do aparelho. Já uma voz do sistema marcada como de rede pode pedir o áudio ao fabricante — por isso aqui as locais têm preferência.

Ferramentas relacionadas