Распознать текст с картинки

Бросьте картинку, выберите язык надписи и нажмите кнопку. Скан или скриншот обычно выходит дословно; снимок с рук выходит почти верно и просит вычитки.

или перетащите их сюда

Картинка с текстом — скан, скриншот или фотография. JPG, PNG, WebP, HEIC, до 50 МБ

Распознанный текст отдаётся ровно таким, каким прочитался: ничего не исправляется автоматически, потому что правдоподобная правка цифры — это ошибка, которую вы уже не заметите. Вёрстка тоже не сохраняется: колонки, таблицы и колонтитулы выходят обычными строками. Движок и файл языка отдаёт этот сайт, а не чужой, и сама картинка никуда не загружается — сфотографированный на столе документ как раз из тех файлов, которым лучше никуда не ездить.

Как пользоваться

  1. Перетащите картинку в область ниже или нажмите «Выбрать файл» — JPG, PNG, WebP и HEIC с телефона.
  2. Выберите язык текста. Не тот язык — самая частая причина, по которой ничего не находится.
  3. Нажмите «Распознать текст», потом скопируйте его или сохраните в .txt.

Полезно знать

Насколько хорошо читает на самом деле — замерено, а не обещано

На чистом скане или скриншоте текст выходит символ в символ. На снимке с рук — чуть наклонённом, освещённом неровно, пережатом камерой — от одного до десяти символов из ста оказываются не теми, причём русский на том же кадре заметно хуже английского. Ошибки предсказуемые: «g» прочитано как «§», дефис стал тире, два слова слиплись. Поэтому страница говорит, в каком из двух случаев вы оказались, а не отдаёт текст с видом набранного на клавиатуре.

Ничего не исправляется, и это намеренно

Легко заметить, что «37-70» в чеке почти наверняка «37,70», и тихо поправить. Ровно этого страница не делает. Правдоподобная правка цифры — это ошибка, которую вы уже не выловите чтением, а на цифрах она дороже всего. Вы получаете то, что прочиталось. Вёрстка тоже не сохраняется: колонки, таблицы и колонтитулы возвращаются обычными строками, потому что в картинке нет сведений о том, что из них чем было.

Частые вопросы

Картинка куда-нибудь загружается?

Нет, как и всё остальное. Движок распознавания и файл языка отдаёт этот сайт, а не чужая раздача, — иначе о самом факте вашего захода знал бы кто-то ещё. Сама картинка не покидает браузер. Сфотографированный на столе документ как раз из тех файлов, которым лучше никуда не ездить.

Рукописный текст прочитает?

Толком нет. Движок обучен на печатном и наборном тексте; на прописях он выдаёт нечто похожее на слова и по большей части неверное. Очень ровные печатные буквы иногда проходят. Всё прочее — подбрасывание монетки, а монетка под видом результата хуже честного отказа.

Почему первый запуск качает три мегабайта?

Потому что распознавание идёт на вашем устройстве, а для этого нужны движок и модель языка. Вместе это около трёх мегабайт, и сказано об этом до кнопки, а не после. Браузер оставляет их у себя, так что вторая картинка начинается сразу — и работает с выключенной сетью.

У меня скан в PDF, а не картинка.

Переведите его в картинки страницей «PDF в JPG» и принесите их сюда. А если в PDF есть настоящий текстовый слой — у документов, сделанных на компьютере, он почти всегда есть, — то «PDF в Word» отдаст текст вообще без распознавания, а значит, и без его ошибок.

Похожие инструменты