画像または PDF をドロップ
またはクリックしてファイルを選択(複数まとめて選べます)または Ctrl+V で貼り付け
認識する言語
画像または PDF を追加すると読み取りが始まります

画像から文字を抽出

スクリーンショット・写真・スキャンしたPDFから文字を抽出します。認識はブラウザ内で行われ、画像はアップロードされません。複数ファイルの一括処理に対応。

このツールでできること

活字はよく読めます

認識精度は画像の鮮明さ、言語、レイアウト、照明によって変わります。特に名前・日付・数字は原本と照合してください。

9 言語に対応

英語、中国語(簡体字・繁体字)、日本語、韓国語、ドイツ語、フランス語、スペイン語、イタリア語。英語以外を選ぶと英語も一緒に読み込みます。実際の書類は注文番号やメールアドレスなど、ラテン文字だらけだからです。

スキャン PDF をページごとに

PDF を開いて 1 ページずつ読み取るので、複数ページのスキャンでも、あらかじめ画像に書き出しておく必要はありません。

複数ファイルをまとめて

フォルダ一式のスクリーンショットをドロップすれば順番に処理されます。1 つが失敗しても残りは続くので、1 件の不良ファイルで全体が止まることはありません。

コピーまたはダウンロード

結果はそのままクリップボードへコピーできますし、.txt ファイルとして保存もできます。複数ファイルの場合はファイル名が付くので、結果が混ざりません。

画像から文字を抽出する手順

1

ファイルを追加

画像や PDF をドラッグするか、クリックして選択します。JPG・PNG・WebP・GIF・BMP・PDF に対応、1 ファイル 50MB までです。

2

言語を選ぶ

このページの言語ではなく、画像の中の文字の言語を選んでください。精度に最も影響するのがこの設定です。

3

テキストをコピー/ダウンロード

ファイルごとに終わり次第、結果が表示されます。まとめてコピーするか、.txt として保存してください。

実際の処理例

画像から文字を抽出 · 処理例 1

このツール、またはツールと共通の処理コードで作成した結果です。入力、設定、出力を比較し、ファイルをダウンロードして確認できます。

精度を上げるコツ

まず言語を正しく選ぶ

影響が最も大きいのがこれです。英語のモデルで日本語を読ませれば、どれだけ鮮明な画像でも意味不明な文字列にしかなりません。

文字の部分だけに切り抜く

ページを撮ると机や手、部屋の一部まで写り込みがちです。紙面だけに切り抜けば、エンジンが迷う要素が減ります。

明るさより「ムラのなさ」

紙の半分に影が落ちているほうが、全体的に少し暗いことより悪影響です。強い光を当てるより、光が均一になる位置へ移動してください。

文字を水平に保つ

斜めに走る文字は明らかに読み取りにくくなります。アップロード前に写真をまっすぐにする数秒は、十分に見合います。

スクリーンショットより元ファイル

スクリーンショットのスクリーンショットや、複数のアプリを経由して転送された写真は、そのたびに圧縮されています。元のファイルのほうが常に鮮明です。

活字は可、手書きは不可

対象は活字と、パソコンで組まれた文字です。手書きの認識はまったく別の問題で、ここで試しても期待には応えられません。

実際の処理例

画像から文字を抽出 · その他の処理例

このツール、またはツールと共通の処理コードで作成した結果です。入力、設定、出力を比較し、ファイルをダウンロードして確認できます。

画像の文字抽出についてのご質問

はい。OCR(光学文字認識)は「画像の中の活字を読み取る」ことの総称で、このツールが行っているのはまさにそれです。多くの OCR サイトとの違いは実行場所にあります。エンジンをあなたのブラウザにダウンロードして動かすため、ファイルを他社のサーバーへ送る必要がありません。
認識精度は画像の鮮明さ、言語、レイアウト、照明によって変わります。特に名前・日付・数字は原本と照合してください。
読めません。この点ははっきりお伝えしておきます。このエンジンは活字と組版された文字を対象としています。手書き認識は別の問題で、別のモデルが必要です。ここで試しても時間を無駄にするだけです。
できません。表の中の文字は読み取れますが、行と列の構造は保持されません。得られるのは文字であって表ではありません。エンジンが表の構造をそもそも検出しないため、そこから使える Excel を書き出す方法はありません。
選択したファイルの内容はブラウザーで処理し、アプリのアップロード先へ送信しません。ただし、サイト、フォント、処理ライブラリーの読み込みには通信が必要な場合があります。
最初にオンラインでページを開いてください。読み込み済みのタブでは処理を続けられる場合がありますが、再読み込みや外部素材、未取得の処理エンジン・モデルには接続が必要です。
このページの言語ではなく、画像の中の文字の言語です。間違えると、どれだけ鮮明な画像でも意味不明な出力になります。英語以外を選ぶと英語も一緒に読み込むので、注文番号やメールアドレスが混ざった書類でも正しく読めます。
読めます。各ページを順に描画して読み取り、結果もページごとに表示されます。非常に長い文書は最初の 100 ページまでとし、その場合は黙って切り捨てるのではなく、その旨をお知らせします。
エラーではなく「文字が見つかりません」と表示されます。読み取れる文字のない画像は、異常ではなく正常な結果だからです。多くの場合、画像がぼやけている、文字が小さすぎる、あるいは言語の選択が違っています。
本来あるべきものではないからです。認識エンジンは漢字を 1 文字ずつ独立した語として扱い、そのすべての間に空白を入れるため、そのままでは使いにくい結果になります。ここではその空白を取り除いています。ただし漢字とラテン文字の間の空白は、実際に存在するものなので残します。
できます。何枚でもドロップすれば順番待ちになり、終わったものから結果が表示されます。1 つが失敗しても残りは続き、途中で停止しても、すでに読み取れた分は失われません。