把图片或 PDF 拖进来
或点击选择文件——可以一次选多个或按 Ctrl+V 粘贴
识别语言
添加图片或 PDF 开始识别文字

图片转文字 - 提取图片和扫描 PDF 里的文字,免费在线

把截图、照片、扫描件 PDF 里的文字提取出来。识别在浏览器里完成,图片不会上传。支持一次处理多个文件。免费,无需注册。

这个工具能做什么

印刷体识别得很准

识别准确率取决于清晰度、语言、排版和光照。请对照原图检查结果,尤其是姓名、日期和数字。

九种语言

英文、简体中文、繁体中文、日文、韩文、德文、法文、西班牙文、意大利文。选非英文时会同时加载英文——真实文档里满是订单号、邮箱、金额这些拉丁字符。

扫描件 PDF 逐页读取

PDF 会被打开并逐页识别,多页扫描件不用你先自己导出成图片。

一次处理多个文件

一整个文件夹的截图丢进来会排队处理。其中一个失败了,其余的照常继续——单个坏文件不会拖垮整批。

复制或下载

结果可以直接复制到剪贴板,也可以下载成.txt 文件。多个文件时每份结果都带文件名,不会混在一起。

怎么提取图片里的文字

1

添加文件

拖入图片或 PDF,或者点击选择。支持 JPG、PNG、WebP、GIF、BMP 和 PDF,单个不超过 50MB。

2

选择识别语言

选图片里那些字的语言,不是这个页面的语言。这一步对准确率的影响比其他任何因素都大。

3

复制或下载文字

每个文件识别完就会出结果。可以整体复制到剪贴板,也可以下载成.txt。

原图
2026 / 09 / 221,250.00
结果
2026 / 09 / 221,250.00
图片转文字 - 提取图片和扫描 PDF 里的文字,免费在线 · 功能示意示例用于说明操作,具体结果取决于文件与设置。

怎么识别得更准

先把语言选对

这是影响最大的一项。用英文模型去识别中文,图片再清晰也只会得到一堆乱码。

裁掉文字以外的部分

拍书页往往连桌面、手、半个房间一起拍进去。裁到只剩纸面,引擎要分辨的干扰就少了。

光线均匀比光线强更重要

一道阴影横穿半页纸,比整张照片偏暗的危害大得多。换个位置让光均匀,比开更亮的灯有用。

让文字保持水平

斜着的文字识别明显更差。上传前把照片转正,值得花那几秒。

用原图,别用二次截图

截图的截图、在几个聊天软件里转发过的照片,每传一次就压缩一次。原始文件永远更清晰。

印刷体可以,手写不行

这个工具针对的是印刷体和电脑排版的文字。手写识别是另一个问题,在这里得到的结果会让你失望。

图片转文字常见问题

是的。OCR(光学字符识别)是「把图片里的印刷文字读出来」这件事的统称,这个工具做的正是它。与多数 OCR 网站的区别在于运行位置:识别引擎是下载到你的浏览器里跑的,而不是把你的文件传到别人的服务器上。
识别准确率取决于清晰度、语言、排版和光照。请对照原图检查结果,尤其是姓名、日期和数字。
不能,这一点值得说清楚。这个引擎针对的是印刷体和电脑排版的文字。手写识别是另一类问题,需要完全不同的模型,在这里尝试只会浪费时间。
不能。表格里的文字会被读出来,但行列结构不会保留——你得到的是文字,不是表格。引擎根本不识别表格结构,所以没有办法从中导出可用的 Excel。
所选文件的内容在浏览器中处理,不会发送到应用的上传接口。加载网站、字体或处理库仍可能需要网络请求。
请先联网打开页面。已加载的标签页可能继续处理,但刷新页面、加载外部资源或尚未缓存的引擎和模型仍需联网。
选图片里文字的语言,不是这个页面的语言。选错的话,即使图片再清晰,输出也会是乱码。选非英文时会同时加载英文,所以夹杂订单号和邮箱的混合文档也能正确识别。
可以。每一页会被逐页渲染并识别,结果也逐页显示。超长文档限制在前 100 页,超出时会明确告诉你,而不是悄悄丢掉。
会显示「未识别到文字」而不是报错,因为一张没有可读文字的图片本身是正常结果。通常意味着图片太模糊、文字太小,或者语言选错了。
因为本来就不该有。识别引擎会把每个汉字当作独立的词,在它们之间全都插上空格,导致结果很难直接使用。这里把那些空格清掉了——但中文与英文、数字之间的空格会保留,那些是真实的。
可以。想放多少张图都行,它们会排队处理,每个完成一个就显示一个结果。其中一个失败不影响其余的,你也可以随时停止,已经识别出来的内容不会丢。