Teks ke Suara

Tempelkan teksnya, pilih suara, lalu tekan tombolnya. Semua disintesis di dalam peramban: suara sistem langsung berbunyi, sedangkan suara neural perlu sekali unduh tetapi terdengar sama di setiap perangkat dan bisa disimpan sebagai berkas.

  • 0Karakter
  • 0Perkiraan durasi
  • 0Suara yang tersedia

Suara sistem tidak bisa disimpan: browser mengirimnya langsung ke kartu suara tanpa memberi halaman ini aliran audio. Suara neural dibentuk di perangkat Anda, jadi bisa diunduh sebagai file WAV.

Cara pakai

  1. Tempelkan atau ketik teks yang akan dibacakan.
  2. Untuk suara yang seragam di perangkat mana pun, dan berkas yang bisa Anda simpan, nyalakan suara neural: modelnya diunduh sekali lalu menetap di peramban.
  3. Pilih suaranya; daftarnya berasal dari bahasa-bahasa yang terpasang di perangkat Anda.
  4. Atur kecepatan dan nada kalau pembacaan bawaannya terlalu cepat atau terlalu datar.
  5. Tekan «Bacakan»; Anda bisa menjeda lalu melanjutkan dari titik yang sama.

Perlu diketahui

Dari mana suaranya berasal

Peramban tidak membawa suaranya sendiri, ia meminta kepada sistem operasi. Karena itulah daftarnya berbeda dari satu mesin ke mesin lain: ponsel biasanya punya beberapa suara per bahasa, sedangkan Linux desktop bisa saja tidak punya satu pun sampai paket suara dipasang. Artinya juga tidak ada batas jumlah karakter dan tidak ada langganan, sebab pekerjaannya dilakukan perangkat lunak yang sudah Anda miliki.

Tiga suara, tiga pertukaran

Suara sistem tidak menuntut biaya apa pun untuk mulai: ia sudah terpasang dan berbunyi begitu Anda menekan tombol, tetapi bunyinya bergantung pada mesinnya, dan di Linux desktop yang polos bisa jadi tidak ada suara sama sekali. Suara neural adalah model unduhan yang berjalan di perangkat Anda sendiri: Kokoro, dengan delapan puluh delapan megabyte, terdengar paling hidup dan mencakup bahasa ini; Piper lebih ringan dengan enam puluh megabyte dan menguasai semua bahasa di situs ini. Dengan cara mana pun, teksnya tetap bersama Anda dan hasilnya bisa disimpan sebagai WAV.

Teks panjang dibacakan sepotong-sepotong

Diberi satu artikel utuh, mesin pengucapnya menyerah di tengah jalan: Chrome berhenti setelah kira-kira lima belas detik kecuali antreannya disenggol, dan Safari membuang semua yang lewat dari beberapa ratus karakter pertama. Karena itu teksnya dipotong di batas kalimat lalu diantrekan satu frasa demi satu frasa. Memotong berdasarkan hitungan karakter justru akan menaruh jedanya di tengah kata, dan itu terdengar seperti tergagap.

Pertanyaan umum

Bisakah audionya diunduh sebagai berkas?

Bisa, dengan suara neural: audionya dibangun di halaman itu sendiri, jadi tombol «Unduh WAV» muncul di samping pemutarnya. Suara sistem tidak bisa disimpan, karena peramban mengirimkannya langsung ke kartu suara tanpa memberi halaman ini aliran audio, sehingga tidak ada bahan untuk menyusun berkasnya.

Daftar suaranya kosong. Sekarang bagaimana?

Berarti sistemnya belum punya suara terpasang. Di Windows suara ditambahkan lewat pengaturan Bahasa, di Android dan iOS lewat Aksesibilitas, di Linux dengan memasang paket suara speech-dispatcher. Setelah itu muat ulang halamannya, sebab daftarnya dibaca saat halaman dimuat.

Mengapa teks yang sama terdengar berbeda di peramban lain?

Karena suaranya datang dari sistem, tetapi pemilihan suara bawaan, penanganan jeda, dan tempo persisnya adalah urusan peramban. Chrome juga bisa menawarkan suara jaringan, yang terdengar lebih halus dan memerlukan koneksi.

Apakah teksnya dikirim ke server?

Halaman ini tidak mengirim teks ke mana pun. Suara neural mengunduh modelnya dari huggingface sekali saja lalu bekerja luring; kata-kata yang Anda tempelkan tidak pernah meninggalkan perangkat. Suara sistem yang ditandai sebagai suara jaringan bisa saja meminta audio ke penyedianya, dan itulah sebabnya suara lokal lebih diutamakan di sini.

Alat terkait