把圖片或 PDF 拖進來
或點擊選擇檔案——可以一次選多個
辨識語言
加入圖片或 PDF 開始辨識文字

擷取圖片與掃描 PDF 裡的文字

拖進一張截圖、一張拍下來的書頁,或是一份掃描檔 PDF,裡面的文字就會變成可以選取、複製、編輯的內容。辨識在你的瀏覽器裡完成,檔案不會離開你的裝置。可以一次放多張圖,PDF 會逐頁讀取。

這個工具能做什麼

印刷體辨識得很準

乾淨的截圖與掃描檔幾乎能做到一字不差。光線不均、稍有透視的照片也撐得住,不過端正、光線均勻的照片總是比歪斜的讀得更好。

九種語言

英文、簡體中文、繁體中文、日文、韓文、德文、法文、西班牙文、義大利文。選非英文時會同時載入英文——真實文件裡滿是訂單編號、電子郵件、金額這些拉丁字元。

掃描檔 PDF 逐頁讀取

PDF 會被開啟並逐頁辨識,多頁掃描檔不必你先自己匯出成圖片。

一次處理多個檔案

一整個資料夾的截圖丟進來會排隊處理。其中一個失敗了,其餘的照常繼續——單一壞檔不會拖垮整批。

什麼都不會上傳

辨識引擎在這個頁面裡執行,你的圖片與 PDF 不會被送到任何地方。處理發票、合約這類帶個人資料的檔案時,這一點特別重要。

複製或下載

結果可以直接複製到剪貼簿,也可以下載成 .txt 檔。多個檔案時每份結果都帶檔名,不會混在一起。

怎麼擷取圖片裡的文字

1

加入檔案

拖入圖片或 PDF,或者點擊選擇。支援 JPG、PNG、WebP、GIF、BMP 與 PDF,單一檔案不超過 50MB。

2

選擇辨識語言

選圖片裡那些字的語言,不是這個頁面的語言。這一步對準確率的影響比其他任何因素都大。

3

複製或下載文字

每個檔案辨識完就會出結果。可以整體複製到剪貼簿,也可以下載成 .txt。

什麼時候用得上

困在截圖裡的文字

別人傳來一張錯誤訊息、地址或程式碼的截圖。與其照著打一遍,不如把文字擷取出來直接貼上。

搜尋不到的掃描文件

掃描的合約或收據,在電腦看來只是一張圖。把文字讀出來,它才變成能搜尋、能引用的內容。

拍下來的書頁

書上的一頁,或是散會後拍的白板。不必一個字一個字打,直接把內容拿回來。

發票與收據

擷取單號與金額,不必對著照片瞇著眼一位一位地抄。

歸檔的舊資料

一箱箱紙本資料掃描之後仍然只是圖片。把文字擷取出來,這份檔案日後才真正可用。

正在學的外語材料

把字變成文字才能查字典——鎖在圖片裡的時候什麼都查不了。

怎麼辨識得更準

先把語言選對

這是影響最大的一項。用英文模型去辨識中文,圖片再清晰也只會得到一堆亂碼。

裁掉文字以外的部分

拍書頁往往連桌面、手、半個房間一起拍進去。裁到只剩紙面,引擎要分辨的干擾就少了。

光線均勻比光線強更重要

一道陰影橫穿半頁紙,比整張照片偏暗的危害大得多。換個位置讓光均勻,比開更亮的燈有用。

讓文字保持水平

斜著的文字辨識明顯更差。上傳前把照片轉正,值得花那幾秒。

用原檔,別用二次截圖

截圖的截圖、在幾個通訊軟體裡轉傳過的照片,每傳一次就壓縮一次。原始檔案永遠更清晰。

印刷體可以,手寫不行

這個工具針對的是印刷體與電腦排版的文字。手寫辨識是另一個問題,在這裡得到的結果會讓你失望。

為什麼用這個

你的檔案仍然屬於你

多數線上轉換網站會把檔案傳到它們的伺服器。這個不會——全程在瀏覽器裡跑,事後沒有任何東西需要刪除。

免費,免註冊,沒有浮水印

不限頁數,不會做到一半跳出登入牆,也不會在看結果前先推銷。本站免費,而且會一直免費。

載入一次之後可離線使用

辨識引擎第一次下載後會被瀏覽器快取。之後再進來是秒開的,斷網也照樣能用。

批次與 PDF 都包含在內

多圖批次與多頁 PDF 是免費工具的一部分,不是藏在付費方案後面的功能。

中日韓是認真做的

辨識引擎通常會在每個漢字之間塞滿空格,讓結果沒法直接使用。這裡做了清理,但中文與英文之間的空格會保留——那些是真實存在的。

手機也能用

整個工具都在行動瀏覽器裡執行,可以直接辨識相簿裡的照片。

圖片轉文字常見問題

是的。OCR(光學字元辨識)是「把圖片裡的印刷文字讀出來」這件事的統稱,這個工具做的正是它。與多數 OCR 網站的差別在於執行位置:辨識引擎是下載到你的瀏覽器裡跑的,而不是把你的檔案傳到別人的伺服器上。
乾淨的印刷體——截圖、品質好的掃描檔——基本能做到一字不差。我們自己的測試裡,英文印刷體完全正確,中文印刷體大約 98%。光線不均或稍有透視的照片在 94–95% 左右。建議把結果快速看過一遍,尤其是數字部分,不要盲目相信。
不能,這一點值得說清楚。這個引擎針對的是印刷體與電腦排版的文字。手寫辨識是另一類問題,需要完全不同的模型,在這裡嘗試只會浪費時間。
不能。表格裡的文字會被讀出來,但列與欄的結構不會保留——你得到的是文字,不是表格。引擎根本不辨識表格結構,所以沒有辦法從中匯出可用的 Excel。
不會。辨識引擎會被下載到你的瀏覽器裡執行,圖片與 PDF 都是直接從你的裝置讀取的,不會傳送到任何地方。這也是為什麼頁面載入完之後,中途斷網它仍然能繼續運作。
第一次使用時瀏覽器要下載辨識引擎與語言資料,總共約 6MB。之後瀏覽器會快取起來,再用就是秒開,每張圖片的辨識耗時遠不到一秒。
選圖片裡文字的語言,不是這個頁面的語言。選錯的話,即使圖片再清晰,輸出也會是亂碼。選非英文時會同時載入英文,所以夾雜訂單編號與電子郵件的混合文件也能正確辨識。
可以。每一頁會被逐頁算繪並辨識,結果也逐頁顯示。超長文件限制在前 100 頁,超出時會明確告訴你,而不是悄悄丟掉。
會顯示「未辨識到文字」而不是報錯,因為一張沒有可讀文字的圖片本身是正常結果。通常代表圖片太模糊、文字太小,或者語言選錯了。
因為本來就不該有。辨識引擎會把每個漢字當作獨立的詞,在它們之間全都插上空格,導致結果很難直接使用。這裡把那些空格清掉了——但中文與英文、數字之間的空格會保留,那些是真實的。
可以。想放多少張圖都行,它們會排隊處理,每完成一個就顯示一個結果。其中一個失敗不影響其餘的,你也可以隨時停止,已經辨識出來的內容不會遺失。
圖片轉文字 - 擷取圖片與掃描 PDF 裡的文字,免費線上