Озвучивание текста

Вставьте текст, выберите голос и нажмите кнопку. Речь собирается прямо в браузере: системный голос звучит сразу, нейросетевой требует одной загрузки, зато одинаков на любом устройстве и его можно скачать файлом.

  • 0Знаков
  • 0Примерно займёт
  • 0Доступно голосов

Системный голос сохранить нельзя: браузер отдаёт его сразу на звуковую карту, не давая странице аудиопоток. Нейроголос считается прямо на вашем устройстве, поэтому его можно скачать файлом WAV.

Как пользоваться

  1. Вставьте или наберите текст, который нужно прочитать.
  2. Нужен ровный голос на любом устройстве и файл на память — включите нейроголос: модель скачается один раз и останется в браузере.
  3. Выберите голос — список берётся из языков, установленных на устройстве.
  4. Подстройте скорость и высоту, если чтение по умолчанию слишком быстрое или ровное.
  5. Нажмите «Озвучить»; можно поставить на паузу и продолжить с того же места.

Полезно знать

Откуда берутся голоса

Своих голосов у браузера нет — он спрашивает их у операционной системы. Поэтому список на каждом устройстве свой: у телефона обычно несколько голосов на язык, а у настольного Linux их может не быть вовсе, пока не поставлен речевой пакет. Отсюда же и отсутствие лимита на знаки и подписки: работу делает программа, которая у вас уже есть.

Два голоса и разная плата за них

Системный голос ничего не стоит: он уже установлен и заговорит по нажатию — но как он звучит, зависит от машины, а на голом Linux его может не быть вовсе. Нейросетевой — скачанная модель, которая считает речь на вашем устройстве: для русского это Piper весом около шестидесяти мегабайт. Живее звучит Kokoro, но русского она не знает — её обучали на английском, испанском, французском, португальском, хинди и итальянском. В любом случае текст остаётся у вас, а результат сохраняется в WAV.

Длинный текст читается частями

Получив целую статью, синтезатор сдаётся на полпути: Chrome умолкает примерно через пятнадцать секунд, если не подталкивать очередь, а Safari теряет всё после первых нескольких сотен знаков. Поэтому текст режется по границам предложений и ставится в очередь по фразе. Резать по числу знаков нельзя: разрыв попадёт внутрь слова, и это слышно как заикание.

Частые вопросы

Можно ли скачать озвучку файлом?

Да, если включить нейроголос: он собирает звук прямо на странице, и рядом с плеером появляется кнопка «Скачать WAV». Системный голос сохранить нельзя — браузер отдаёт его сразу на звуковую карту, не давая странице аудиопоток, и собирать файл попросту не из чего.

В списке нет голосов. Что делать?

Значит, в системе не установлен ни один. В Windows их добавляют в параметрах языка, в Android и iOS — в специальных возможностях, в Linux — установкой речевого пакета для speech-dispatcher. После этого обновите страницу: список считывается при загрузке.

Почему один и тот же текст в другом браузере звучит иначе?

Голос берётся из системы, но выбор голоса по умолчанию, обработка пауз и точный темп принадлежат браузеру. Chrome вдобавок предлагает сетевые голоса — они звучат ровнее и требуют соединения.

Текст уходит на сервер?

Страница не отправляет текст никуда. Нейроголос один раз скачивает модель с huggingface и дальше работает без сети; вставленные слова устройство не покидают. Системный голос, помеченный как сетевой, звук у производителя запросить может — поэтому здесь предпочтение отдаётся локальным.

Похожие инструменты