图片转文字
放进一张图片,选好文字的语言,按下按钮。扫描件或截图通常能一字不差;手持拍摄的照片大致正确,值得通读一遍。
或拖放到这里
一张带文字的图片——扫描件、截图或照片。JPG、PNG、WebP、HEIC,最大 50 MB
识别出的文字原样交给你——不做任何自动更正,因为对数字看似合理的一处更正,正是你再也发现不了的错误。版式也不保留:分栏、表格和页眉都会变成普通行。引擎和语言包由本站提供,而不是别人的站点,图片本身也从不上传——放在桌上拍下的文件,恰恰是最不该外传的那一类。
- 免费
- 文件不会离开你的设备
- 无需注册
- 不限文件数量
使用方法
- 把图片拖到下面的区域,或点击「选择文件」——JPG、PNG、WebP 以及手机的 HEIC。
- 选择文字的语言。选错语言是「什么都没找到」最常见的原因。
- 点击「识别文字」,然后复制,或保存为 .txt 文件。
实用说明
它实际读得多准——实测,而非承诺
在干净的扫描件或截图上,文字能逐字还原。在手持拍摄的照片上——略微倾斜、光线不匀、被相机压缩过——每一百个字符里有一到十个是错的,而同一张图上俄文明显不如英文。错法是可预料的那些:把「g」读成「§」,连字符变成破折号,两个词粘在一起。所以本页会告诉你落在这两种情况的哪一种,而不是把结果当成打字稿交给你。
不做任何自动更正,这是有意的
很容易看出小票上的「37-70」几乎肯定是「37.70」,然后悄悄改掉。这恰恰是本页不做的事。对数字看似合理的一处更正,会变成你再也读不出来的错误——而数字上的代价最大。你拿到的是被读出来的东西。版式同样不保留:分栏、表格和页眉都会变成普通行,因为图片本身并不携带「哪一段是什么」的信息。
常见问题
我的图片会被上传吗?
不会,任何东西都不会。识别引擎和语言包由本站提供,而不是第三方 CDN——否则单是你来过这件事,就会被别人知道。图片本身从不离开浏览器。放在桌上拍下的文件,恰恰是最不该外传的那一类。
能识别手写吗?
没有实用价值。引擎是用印刷体和打字文本训练的;面对连笔字,它会给出看起来像词、但大多是错的东西。写得非常工整的印刷体大写字母有时能过。其余就是掷硬币,而伪装成结果的掷硬币比拒绝更糟。
为什么第一次要下载三兆?
因为识别在你的设备上进行,这需要一个引擎和一份语言模型。两者合计约三兆,这话说在按钮之前而不是之后。浏览器会把两者留下,所以第二张图片立刻开始,断网也照样能用。
我有的是扫描版 PDF,不是图片。
先用「PDF 转 JPG」页面把它变成图片,再拿到这里。如果 PDF 里有真正的文字层——电脑上做出来的文档大多有——那么「PDF 转 Word」会直接给你文字,完全不经过识别,也就没有识别的错误。
相关工具
- PDF 转 Word 拖入一个 PDF,得到可编辑的 .docx。哪些能带过来、哪些不能,我们直说:文字、段落和标题可以,页面版式不行。
- PDF 转 JPG 每一页都会变成单独的图片,可以逐个下载——通常你需要的只是一两页,而不是整份文档打包成一个文件。
- 照片编辑器 放进一张照片,需要的一切都在同一处:裁剪的选框、旋转的按钮、结果的宽度、三个调光滑块,以及一行可选的文字。屏幕上看到的样子,就是下载文件里的样子。
- 裁剪图片 做头像的正方形、证件用的 3:4、页头用的宽条,或者干脆把画面里多余的东西切掉。拖动选框,取走你要的那一块。
- 比较两段文本 合同的两个版本、同事改过的段落、昨天还能用的配置。把两份都粘进来,直接读出到底改了什么,而不是用眼睛去找。
- 字数统计 输入或粘贴文本,统计结果立即更新:词数、字符数、句子数、段落数以及预计阅读时间。
- PNG 转 JPG 把 PNG 文件拖进来,直接得到 JPG。全部在你的设备上完成,图片不会发送到任何服务器。
- 图片压缩 把图片拖进来,选择可以牺牲多少画质,然后下载更小的文件。压缩在你的设备上完成,图片不会上传。