把图片或 PDF 拖进来
或点击选择文件——可以一次选多个
识别语言
添加图片或 PDF 开始识别文字

提取图片和扫描 PDF 里的文字

拖进一张截图、一张拍下来的书页,或者一份扫描件 PDF,里面的文字就会变成可以选中、复制、编辑的内容。识别在你的浏览器里完成,文件不会离开你的设备。可以一次放多张图,PDF 会逐页读取。

这个工具能做什么

印刷体识别得很准

干净的截图和扫描件几乎能做到一字不差。光照不均、稍有透视的照片也扛得住,不过端正、光线均匀的照片总是比歪斜的读得更好。

九种语言

英文、简体中文、繁体中文、日文、韩文、德文、法文、西班牙文、意大利文。选非英文时会同时加载英文——真实文档里满是订单号、邮箱、金额这些拉丁字符。

扫描件 PDF 逐页读取

PDF 会被打开并逐页识别,多页扫描件不用你先自己导出成图片。

一次处理多个文件

一整个文件夹的截图丢进来会排队处理。其中一个失败了,其余的照常继续——单个坏文件不会拖垮整批。

什么都不会上传

识别引擎在这个页面里运行,你的图片和 PDF 不会被送到任何地方。处理发票、合同这类带个人信息的文件时,这一点尤其重要。

复制或下载

结果可以直接复制到剪贴板,也可以下载成 .txt 文件。多个文件时每份结果都带文件名,不会混在一起。

怎么提取图片里的文字

1

添加文件

拖入图片或 PDF,或者点击选择。支持 JPG、PNG、WebP、GIF、BMP 和 PDF,单个不超过 50MB。

2

选择识别语言

选图片里那些字的语言,不是这个页面的语言。这一步对准确率的影响比其他任何因素都大。

3

复制或下载文字

每个文件识别完就会出结果。可以整体复制到剪贴板,也可以下载成 .txt。

什么时候用得上

困在截图里的文字

别人发来一张报错信息、地址或代码的截图。与其照着敲一遍,不如把文字提出来直接粘贴。

搜不了的扫描文档

扫描的合同或收据,在电脑看来只是一张图。把文字读出来,它才变成能搜索、能引用的内容。

拍下来的书页

书上的一页,或者散会后拍的白板。不用一个字一个字敲,直接把内容拿回来。

发票和收据

提取单号和金额,不用对着照片眯着眼一位一位地抄。

归档的旧资料

一箱箱纸质材料扫描之后仍然只是图片。把文字提取出来,这份档案日后才真正可用。

在学的外语材料

把字变成文本才能去查词典——锁在图片里的时候什么都查不了。

怎么识别得更准

先把语言选对

这是影响最大的一项。用英文模型去识别中文,图片再清晰也只会得到一堆乱码。

裁掉文字以外的部分

拍书页往往连桌面、手、半个房间一起拍进去。裁到只剩纸面,引擎要分辨的干扰就少了。

光线均匀比光线强更重要

一道阴影横穿半页纸,比整张照片偏暗的危害大得多。换个位置让光均匀,比开更亮的灯有用。

让文字保持水平

斜着的文字识别明显更差。上传前把照片转正,值得花那几秒。

用原图,别用二次截图

截图的截图、在几个聊天软件里转发过的照片,每传一次就压缩一次。原始文件永远更清晰。

印刷体可以,手写不行

这个工具针对的是印刷体和电脑排版的文字。手写识别是另一个问题,在这里得到的结果会让你失望。

为什么用这个

你的文件仍然属于你

多数在线转换网站会把文件传到它们的服务器。这个不会——全程在浏览器里跑,事后没有任何东西需要删除。

免费,无需注册,没有水印

不限页数,不会做到一半弹出登录墙,也不会在看结果前先推销。本站免费,而且会一直免费。

加载一次之后可离线用

识别引擎第一次下载后会被浏览器缓存。之后再进来是秒开的,断网也照样能用。

批量和 PDF 都包含在内

多图批量和多页 PDF 是免费工具的一部分,不是藏在付费档位后面的功能。

中日韩是认真做的

识别引擎通常会在每个汉字之间塞满空格,让结果没法直接用。这里做了清理,但中文和英文之间的空格会保留——那些是真实存在的。

手机也能用

整个工具都在移动浏览器里运行,可以直接识别相册里的照片。

图片转文字常见问题

是的。OCR(光学字符识别)是「把图片里的印刷文字读出来」这件事的统称,这个工具做的正是它。与多数 OCR 网站的区别在于运行位置:识别引擎是下载到你的浏览器里跑的,而不是把你的文件传到别人的服务器上。
干净的印刷体——截图、质量好的扫描件——基本能做到一字不差。我们自己的测试里,英文印刷体是完全正确的,中文印刷体大约 98%。光照不均或稍有透视的照片在 94–95% 左右。建议把结果快速过一遍,尤其是数字部分,不要盲目相信。
不能,这一点值得说清楚。这个引擎针对的是印刷体和电脑排版的文字。手写识别是另一类问题,需要完全不同的模型,在这里尝试只会浪费时间。
不能。表格里的文字会被读出来,但行列结构不会保留——你得到的是文字,不是表格。引擎根本不识别表格结构,所以没有办法从中导出可用的 Excel。
不会。识别引擎会被下载到你的浏览器里运行,图片和 PDF 都是直接从你的设备读取的,不会发送到任何地方。这也是为什么页面加载完之后,中途断网它仍然能继续工作。
第一次使用时浏览器要下载识别引擎和语言数据,总共约 6MB。之后浏览器会缓存下来,再用就是秒开,每张图片的识别耗时远不到一秒。
选图片里文字的语言,不是这个页面的语言。选错的话,即使图片再清晰,输出也会是乱码。选非英文时会同时加载英文,所以夹杂订单号和邮箱的混合文档也能正确识别。
可以。每一页会被逐页渲染并识别,结果也逐页显示。超长文档限制在前 100 页,超出时会明确告诉你,而不是悄悄丢掉。
会显示「未识别到文字」而不是报错,因为一张没有可读文字的图片本身是正常结果。通常意味着图片太模糊、文字太小,或者语言选错了。
因为本来就不该有。识别引擎会把每个汉字当作独立的词,在它们之间全都插上空格,导致结果很难直接使用。这里把那些空格清掉了——但中文与英文、数字之间的空格会保留,那些是真实的。
可以。想放多少张图都行,它们会排队处理,每个完成一个就显示一个结果。其中一个失败不影响其余的,你也可以随时停止,已经识别出来的内容不会丢。
图片转文字 - 提取图片和扫描 PDF 里的文字,免费在线