텍스트 음성 변환

글을 붙여넣고 음성을 고른 뒤 버튼을 누르세요. 합성은 모두 브라우저 안에서 이루어집니다. 시스템 음성은 곧바로 말하고, 뉴럴 음성은 처음 한 번 내려받아야 하지만 어느 기기에서나 같은 소리가 나고 파일로도 저장됩니다.

  • 0글자 수
  • 0예상 길이
  • 0사용 가능한 음성

시스템 음성은 저장할 수 없습니다. 브라우저가 사운드 카드로 바로 보내고 페이지에는 오디오 스트림을 주지 않기 때문입니다. 뉴럴 음성은 기기에서 만들어지므로 WAV 파일로 내려받을 수 있습니다.

사용 방법

  1. 읽어 줄 글을 붙여넣거나 입력합니다.
  2. 어느 기기에서나 같은 소리를 원하거나 파일로 남기고 싶다면 뉴럴 음성을 켜세요. 모델은 한 번만 내려받고 이후에는 브라우저에 남습니다.
  3. 목소리를 고릅니다. 목록은 기기에 설치된 언어에서 나옵니다.
  4. 기본 낭독이 너무 빠르거나 밋밋하면 속도와 음높이를 조절합니다.
  5. 「읽어 주기」를 누릅니다. 잠시 멈췄다가 같은 자리에서 이어갈 수 있습니다.

알아두면 좋은 점

목소리는 어디서 오나

브라우저는 자체 음성을 갖고 있지 않고 운영체제에 요청합니다. 그래서 목록이 기기마다 다릅니다. 휴대폰은 보통 언어마다 여러 목소리를 갖고 있고, 데스크톱 리눅스는 음성 패키지를 설치하기 전까지 하나도 없을 수 있습니다. 동시에 이는 글자 수 제한도 구독료도 없다는 뜻입니다. 일하는 것은 이미 갖고 있는 소프트웨어니까요.

두 가지 음성, 서로 다른 대가

시스템 음성은 시작에 드는 비용이 없습니다. 이미 설치되어 있어 누르면 바로 말합니다. 다만 소리는 기기마다 다르고, 기본 상태의 리눅스 데스크톱에는 아예 없을 수도 있습니다. 뉴럴 음성은 내려받아 기기에서 계산하는 모델이며, 한국어에는 약 60메가바이트의 Piper를 씁니다. 어느 쪽이든 글은 기기에 남고 결과는 WAV로 저장됩니다.

긴 글은 나눠서 읽습니다

기사 전체를 한 번에 넘기면 음성 엔진은 도중에 포기합니다. Chrome은 큐를 밀어 주지 않으면 15초쯤에서 멈추고, Safari는 처음 수백 자 뒤를 버립니다. 그래서 문장 경계에서 잘라 한 문장씩 큐에 넣습니다. 글자 수로 자르면 단어 한가운데가 끊겨 말더듬처럼 들립니다.

자주 묻는 질문

음성을 파일로 내려받을 수 있나요?

뉴럴 음성이라면 됩니다. 소리를 페이지 안에서 만들기 때문에 재생기 옆에 「WAV 내려받기」 버튼이 나타납니다. 시스템 음성은 저장할 수 없습니다. 브라우저가 사운드 카드로 바로 보내고 페이지에는 오디오 스트림을 주지 않아, 파일로 묶을 것이 없습니다.

목록에 음성이 없습니다.

시스템에 하나도 설치되지 않은 것입니다. Windows는 언어 설정에서, Android와 iOS는 접근성에서, 리눅스는 speech-dispatcher 음성 패키지를 설치해 추가합니다. 그다음 페이지를 새로고침하세요. 목록은 불러올 때 읽습니다.

같은 글이 다른 브라우저에서 다르게 들립니다.

음성은 시스템의 것이지만, 기본 목소리 선택과 쉼 처리, 정확한 속도는 브라우저의 몫이기 때문입니다. Chrome은 네트워크 음성도 제공할 수 있는데, 더 매끄럽게 들리는 대신 연결이 필요합니다.

글이 서버로 전송되나요?

페이지는 글을 어디에도 보내지 않습니다. 뉴럴 음성은 huggingface에서 모델을 한 번만 내려받고 그 뒤에는 네트워크 없이 동작하며, 붙여넣은 말은 기기를 떠나지 않습니다. 네트워크 음성으로 표시된 시스템 음성은 제조사에 소리를 요청할 수 있어, 여기서는 기기 안의 음성을 먼저 고릅니다.

관련 도구