擷取圖片與掃描 PDF 裡的文字
拖進一張截圖、一張拍下來的書頁,或是一份掃描檔 PDF,裡面的文字就會變成可以選取、複製、編輯的內容。辨識在你的瀏覽器裡完成,檔案不會離開你的裝置。可以一次放多張圖,PDF 會逐頁讀取。
這個工具能做什麼
印刷體辨識得很準
乾淨的截圖與掃描檔幾乎能做到一字不差。光線不均、稍有透視的照片也撐得住,不過端正、光線均勻的照片總是比歪斜的讀得更好。
九種語言
英文、簡體中文、繁體中文、日文、韓文、德文、法文、西班牙文、義大利文。選非英文時會同時載入英文——真實文件裡滿是訂單編號、電子郵件、金額這些拉丁字元。
掃描檔 PDF 逐頁讀取
PDF 會被開啟並逐頁辨識,多頁掃描檔不必你先自己匯出成圖片。
一次處理多個檔案
一整個資料夾的截圖丟進來會排隊處理。其中一個失敗了,其餘的照常繼續——單一壞檔不會拖垮整批。
什麼都不會上傳
辨識引擎在這個頁面裡執行,你的圖片與 PDF 不會被送到任何地方。處理發票、合約這類帶個人資料的檔案時,這一點特別重要。
複製或下載
結果可以直接複製到剪貼簿,也可以下載成 .txt 檔。多個檔案時每份結果都帶檔名,不會混在一起。
怎麼擷取圖片裡的文字
加入檔案
拖入圖片或 PDF,或者點擊選擇。支援 JPG、PNG、WebP、GIF、BMP 與 PDF,單一檔案不超過 50MB。
選擇辨識語言
選圖片裡那些字的語言,不是這個頁面的語言。這一步對準確率的影響比其他任何因素都大。
複製或下載文字
每個檔案辨識完就會出結果。可以整體複製到剪貼簿,也可以下載成 .txt。
什麼時候用得上
困在截圖裡的文字
別人傳來一張錯誤訊息、地址或程式碼的截圖。與其照著打一遍,不如把文字擷取出來直接貼上。
搜尋不到的掃描文件
掃描的合約或收據,在電腦看來只是一張圖。把文字讀出來,它才變成能搜尋、能引用的內容。
拍下來的書頁
書上的一頁,或是散會後拍的白板。不必一個字一個字打,直接把內容拿回來。
發票與收據
擷取單號與金額,不必對著照片瞇著眼一位一位地抄。
歸檔的舊資料
一箱箱紙本資料掃描之後仍然只是圖片。把文字擷取出來,這份檔案日後才真正可用。
正在學的外語材料
把字變成文字才能查字典——鎖在圖片裡的時候什麼都查不了。
怎麼辨識得更準
先把語言選對
這是影響最大的一項。用英文模型去辨識中文,圖片再清晰也只會得到一堆亂碼。
裁掉文字以外的部分
拍書頁往往連桌面、手、半個房間一起拍進去。裁到只剩紙面,引擎要分辨的干擾就少了。
光線均勻比光線強更重要
一道陰影橫穿半頁紙,比整張照片偏暗的危害大得多。換個位置讓光均勻,比開更亮的燈有用。
讓文字保持水平
斜著的文字辨識明顯更差。上傳前把照片轉正,值得花那幾秒。
用原檔,別用二次截圖
截圖的截圖、在幾個通訊軟體裡轉傳過的照片,每傳一次就壓縮一次。原始檔案永遠更清晰。
印刷體可以,手寫不行
這個工具針對的是印刷體與電腦排版的文字。手寫辨識是另一個問題,在這裡得到的結果會讓你失望。
為什麼用這個
你的檔案仍然屬於你
多數線上轉換網站會把檔案傳到它們的伺服器。這個不會——全程在瀏覽器裡跑,事後沒有任何東西需要刪除。
免費,免註冊,沒有浮水印
不限頁數,不會做到一半跳出登入牆,也不會在看結果前先推銷。本站免費,而且會一直免費。
載入一次之後可離線使用
辨識引擎第一次下載後會被瀏覽器快取。之後再進來是秒開的,斷網也照樣能用。
批次與 PDF 都包含在內
多圖批次與多頁 PDF 是免費工具的一部分,不是藏在付費方案後面的功能。
中日韓是認真做的
辨識引擎通常會在每個漢字之間塞滿空格,讓結果沒法直接使用。這裡做了清理,但中文與英文之間的空格會保留——那些是真實存在的。
手機也能用
整個工具都在行動瀏覽器裡執行,可以直接辨識相簿裡的照片。
