图片转文字

放进一张图片,选好文字的语言,按下按钮。扫描件或截图通常能一字不差;手持拍摄的照片大致正确,值得通读一遍。

或拖放到这里

一张带文字的图片——扫描件、截图或照片。JPG、PNG、WebP、HEIC,最大 50 MB

识别出的文字原样交给你——不做任何自动更正,因为对数字看似合理的一处更正,正是你再也发现不了的错误。版式也不保留:分栏、表格和页眉都会变成普通行。引擎和语言包由本站提供,而不是别人的站点,图片本身也从不上传——放在桌上拍下的文件,恰恰是最不该外传的那一类。

使用方法

  1. 把图片拖到下面的区域,或点击「选择文件」——JPG、PNG、WebP 以及手机的 HEIC。
  2. 选择文字的语言。选错语言是「什么都没找到」最常见的原因。
  3. 点击「识别文字」,然后复制,或保存为 .txt 文件。

实用说明

它实际读得多准——实测,而非承诺

在干净的扫描件或截图上,文字能逐字还原。在手持拍摄的照片上——略微倾斜、光线不匀、被相机压缩过——每一百个字符里有一到十个是错的,而同一张图上俄文明显不如英文。错法是可预料的那些:把「g」读成「§」,连字符变成破折号,两个词粘在一起。所以本页会告诉你落在这两种情况的哪一种,而不是把结果当成打字稿交给你。

不做任何自动更正,这是有意的

很容易看出小票上的「37-70」几乎肯定是「37.70」,然后悄悄改掉。这恰恰是本页不做的事。对数字看似合理的一处更正,会变成你再也读不出来的错误——而数字上的代价最大。你拿到的是被读出来的东西。版式同样不保留:分栏、表格和页眉都会变成普通行,因为图片本身并不携带「哪一段是什么」的信息。

常见问题

我的图片会被上传吗?

不会,任何东西都不会。识别引擎和语言包由本站提供,而不是第三方 CDN——否则单是你来过这件事,就会被别人知道。图片本身从不离开浏览器。放在桌上拍下的文件,恰恰是最不该外传的那一类。

能识别手写吗?

没有实用价值。引擎是用印刷体和打字文本训练的;面对连笔字,它会给出看起来像词、但大多是错的东西。写得非常工整的印刷体大写字母有时能过。其余就是掷硬币,而伪装成结果的掷硬币比拒绝更糟。

为什么第一次要下载三兆?

因为识别在你的设备上进行,这需要一个引擎和一份语言模型。两者合计约三兆,这话说在按钮之前而不是之后。浏览器会把两者留下,所以第二张图片立刻开始,断网也照样能用。

我有的是扫描版 PDF,不是图片。

先用「PDF 转 JPG」页面把它变成图片,再拿到这里。如果 PDF 里有真正的文字层——电脑上做出来的文档大多有——那么「PDF 转 Word」会直接给你文字,完全不经过识别,也就没有识别的错误。

相关工具