提取图片和扫描 PDF 里的文字
拖进一张截图、一张拍下来的书页,或者一份扫描件 PDF,里面的文字就会变成可以选中、复制、编辑的内容。识别在你的浏览器里完成,文件不会离开你的设备。可以一次放多张图,PDF 会逐页读取。
这个工具能做什么
印刷体识别得很准
干净的截图和扫描件几乎能做到一字不差。光照不均、稍有透视的照片也扛得住,不过端正、光线均匀的照片总是比歪斜的读得更好。
九种语言
英文、简体中文、繁体中文、日文、韩文、德文、法文、西班牙文、意大利文。选非英文时会同时加载英文——真实文档里满是订单号、邮箱、金额这些拉丁字符。
扫描件 PDF 逐页读取
PDF 会被打开并逐页识别,多页扫描件不用你先自己导出成图片。
一次处理多个文件
一整个文件夹的截图丢进来会排队处理。其中一个失败了,其余的照常继续——单个坏文件不会拖垮整批。
什么都不会上传
识别引擎在这个页面里运行,你的图片和 PDF 不会被送到任何地方。处理发票、合同这类带个人信息的文件时,这一点尤其重要。
复制或下载
结果可以直接复制到剪贴板,也可以下载成 .txt 文件。多个文件时每份结果都带文件名,不会混在一起。
怎么提取图片里的文字
添加文件
拖入图片或 PDF,或者点击选择。支持 JPG、PNG、WebP、GIF、BMP 和 PDF,单个不超过 50MB。
选择识别语言
选图片里那些字的语言,不是这个页面的语言。这一步对准确率的影响比其他任何因素都大。
复制或下载文字
每个文件识别完就会出结果。可以整体复制到剪贴板,也可以下载成 .txt。
什么时候用得上
困在截图里的文字
别人发来一张报错信息、地址或代码的截图。与其照着敲一遍,不如把文字提出来直接粘贴。
搜不了的扫描文档
扫描的合同或收据,在电脑看来只是一张图。把文字读出来,它才变成能搜索、能引用的内容。
拍下来的书页
书上的一页,或者散会后拍的白板。不用一个字一个字敲,直接把内容拿回来。
发票和收据
提取单号和金额,不用对着照片眯着眼一位一位地抄。
归档的旧资料
一箱箱纸质材料扫描之后仍然只是图片。把文字提取出来,这份档案日后才真正可用。
在学的外语材料
把字变成文本才能去查词典——锁在图片里的时候什么都查不了。
怎么识别得更准
先把语言选对
这是影响最大的一项。用英文模型去识别中文,图片再清晰也只会得到一堆乱码。
裁掉文字以外的部分
拍书页往往连桌面、手、半个房间一起拍进去。裁到只剩纸面,引擎要分辨的干扰就少了。
光线均匀比光线强更重要
一道阴影横穿半页纸,比整张照片偏暗的危害大得多。换个位置让光均匀,比开更亮的灯有用。
让文字保持水平
斜着的文字识别明显更差。上传前把照片转正,值得花那几秒。
用原图,别用二次截图
截图的截图、在几个聊天软件里转发过的照片,每传一次就压缩一次。原始文件永远更清晰。
印刷体可以,手写不行
这个工具针对的是印刷体和电脑排版的文字。手写识别是另一个问题,在这里得到的结果会让你失望。
为什么用这个
你的文件仍然属于你
多数在线转换网站会把文件传到它们的服务器。这个不会——全程在浏览器里跑,事后没有任何东西需要删除。
免费,无需注册,没有水印
不限页数,不会做到一半弹出登录墙,也不会在看结果前先推销。本站免费,而且会一直免费。
加载一次之后可离线用
识别引擎第一次下载后会被浏览器缓存。之后再进来是秒开的,断网也照样能用。
批量和 PDF 都包含在内
多图批量和多页 PDF 是免费工具的一部分,不是藏在付费档位后面的功能。
中日韩是认真做的
识别引擎通常会在每个汉字之间塞满空格,让结果没法直接用。这里做了清理,但中文和英文之间的空格会保留——那些是真实存在的。
手机也能用
整个工具都在移动浏览器里运行,可以直接识别相册里的照片。
