음성을 글로

인터뷰, 강의, 다시 듣기보다 읽는 편이 나은 음성 메시지. 녹음은 이 기기에 남고, 모델이 그쪽으로 옵니다. 반대가 아닙니다. 그 값은 첫 실행의 약 68 MB이고, 숫자는 버튼 위에 적혀 있습니다. 뒤에 숨기지 않았습니다.

오디오도 영상도 됩니다. 소리 트랙은 브라우저가 알아서 꺼냅니다.

녹음은 어디로도 올라가지 않습니다. 모델을 브라우저로 내려받아 그 안에서 듣습니다. 첫 실행 뒤에는 네트워크를 꺼도 됩니다.

가까운 도구: 온라인 음성 녹음 · 동영상을 MP3로 · 오디오 변환기 · 온라인 메모장

사용 방법

  1. 녹음을 고릅니다 — 오디오든 영상이든, 소리 트랙은 저희가 꺼냅니다.
  2. 말하는 언어를 고릅니다. 첫 실행에서 모델을 한 번 내려받습니다.
  3. 버튼을 누르고 전사본을 읽은 뒤 텍스트나 자막으로 내려받습니다.

알아두면 좋은 점

잘 듣는 것과 그렇지 못한 것

깨끗한 영어에서는 가벼운 모델이 스무 낱말에 하나쯤 틀립니다. 읽고 1분만 고치면 쓸 수 있는 전사본입니다. 러시아어·일본어·한국어에서는 스튜디오급 음성에서도 낱말의 3분의 1쯤을 틀립니다. 브라우저에 들어가는 것이 이 가벼운 모델뿐이기 때문입니다. 어느 경우인지는 데이터를 쓰기 전에 알려 드립니다. 쓴 다음이 아니라요.

왜 68 MB이고 왜 서버가 없나

“즉시 전사”를 내세우는 서비스는 당신의 녹음을 남의 기계로 보냅니다. 인터뷰, 진료, 가족의 음성 메시지 — 편의와 맞바꾸기에는 무거운 것들입니다. 여기서는 반대로 모델이 파일 쪽으로 옵니다. 한 번 내려받으면 이후에는 네트워크 없이 돌아가고, 녹음이 누군가의 데이터셋이 되지도 않습니다. 그 선택의 값이 미리 밝힌 그 용량입니다.

자주 묻는 질문

녹음이 업로드되나요?

아닙니다. 모델을 브라우저로 내려받아 거기서 돌립니다. 첫 실행 뒤에는 네트워크를 꺼도 페이지가 동작합니다.

한국어나 러시아어 전사가 거친 이유는?

가벼운 모델이 그 언어들에 약하기 때문입니다. 깨끗한 음성에서도 낱말의 3분의 1쯤이 틀립니다. 더 나은 모델은 네 배 무겁고 브라우저에 올라가지 않습니다. 페이지는 내려받기 전에 이를 알립니다.

자막도 받을 수 있나요?

있습니다. 일반 텍스트와 함께 시간이 붙은 SRT 파일이 나옵니다. 시간은 30초 단위인데, 그것이 모델이 실제로 아는 단위입니다.

얼마나 긴 녹음까지 되나요?

한 시간까지입니다. 그보다 길면 브라우저 메모리에 통째로 들어가지 않으니 먼저 잘라 주세요.

관련 도구