名刺・ポスター・スクリーンショットをドロップ
またはクリックして選択(1 枚ずつ)または Ctrl+V で貼り付け
認識する言語
画像を追加すると連絡先の抽出が始まります

画像から電話番号・メール・URLを抽出

名刺やポスター、チラシを撮るだけで、電話番号・メールアドレス・URL をテキストとして取り出します。認識はブラウザ内で行われ、画像はアップロードされません。

このツールでできること

注文番号を拾わずに電話番号だけを取り出します

書類はどれも数字だらけです。請求書番号、日付、価格、伝票番号。素朴な検索ではそれらもすべて返ってきてしまいます。このツールは本当に電話番号らしい並びだけを受け付けます——国番号、括弧付きの市外局番、フリーダイヤル、あるいは既知の携帯番号帯です。

扱いにくいメールアドレスにも対応

プラス記号付き、ドットやアンダースコア入り、サブドメインや国別ドメインのアドレスも正しく読み取り、すぐ隣にある句読点は含めません。

URL はクエリ文字列ごと

完全な URL も www から始まるアドレスも読み取り、クエリ文字列も残します。末尾の句読点は取り除くので、文末のリンクに句点がくっついてくることはありません。

認識した文字は全部残ります

抽出という処理は本質的に取りこぼしが起こりえます。だから認識できた文字の全文を結果のすぐ下に置いています。足りないと感じたとき、元々書かれていなかったのか抽出が拾わなかったのかがすぐ分かります。

種類ごとにも、まとめてもコピー

電話番号だけ、メールだけ、あるいは全部を一度に。3 種類が分かれているので、貼り付け先に合わせてそのまま使えます。

画像から連絡先を取り出す手順

1

画像を追加

写真やスクリーンショットをドラッグするか、クリックして選択します。JPG・PNG・WebP・GIF・BMP に対応、上限は 50MB です。

2

言語を選ぶ

画像の中の文字の言語を選んでください。電話番号やメールは言語に依存しませんが、正しく選ぶと周囲の文字の認識精度が上がります。

3

必要なものをコピー

結果は種類ごとに分かれて表示されます。1 種類だけでも全部でもコピーでき、見落としを確認したいときは全文を展開してください。

実際の処理例

画像から電話番号・メール・URLを抽出 · 処理例 1

このツール、またはツールと共通の処理コードで作成した結果です。入力、設定、出力を比較し、ファイルをダウンロードして確認できます。

確実に読み取るために

必要な部分だけに切り抜く

名刺を撮ると机や手、部屋の一部まで写り込みがちです。名刺だけに切り抜けば、エンジンが迷う要素が大きく減ります。

明るさより「ムラのなさ」

名刺の半分に影が落ちているほうが、全体的に少し暗いことより悪影響です。

まっすぐ撮る

斜めに走る文字は明らかに読み取りにくくなります。構図をまっすぐ整える数秒は十分に見合います。

転送された写真ではなく元の写真を

複数のアプリを経由した写真はそのたびに再圧縮されています。その劣化が最も響くのが URL です。頼れる辞書がないからです。

短縮 URL は必ず確認を

bit.ly/3xKp9Lm のようなリンクはランダムな文字列です。1 文字違うだけで開けなくなり、しかもそれを自動で検出する方法はありません。実在する単語でできたドメイン名のほうがはるかに確実です。

足りないと感じたら全文を開く

結果のすぐ下に認識できた文字の全文があります。元々なかったのか、読めてはいたが連絡先と判定されなかったのかが一目で分かります。

実際の処理例

画像から電話番号・メール・URLを抽出 · その他の処理例

このツール、またはツールと共通の処理コードで作成した結果です。入力、設定、出力を比較し、ファイルをダウンロードして確認できます。

連絡先の抽出についてのご質問

鮮明な写真やスクリーンショットであれば、当方のテストでは電話番号・メール・URL のいずれも正しく読み取れました。小さく何度も圧縮された画像——複数のチャットアプリを転送されてきたようなもの——では、電話番号は読み取れたものの URL は約 3 分の 1 が不完全でした。3 種類の中では電話番号が最も安定しています。
それこそがこのツールが避けようとしている問題であり、だからこそ数字だけの並びは一律に受け付けません。国番号(+81 など)、括弧付きの市外局番、フリーダイヤル、既知の携帯番号帯——こうした電話番号らしい特徴を備えている場合にのみ受け付けます。テストでは請求書番号、身分証番号、日付、IP アドレス、価格、ページ番号、バージョン番号がすべて正しく除外されました。
bit.ly/3xKp9Lm のようなリンクがランダムな文字列だからです。通常の単語なら、ある文字が曖昧でも言語モデルが正しい方へ引き戻せます。ランダムな文字列にはその手がかりがありません。実在する単語でできたドメイン名のほうがずっと確実です。短縮 URL は使う前に必ずご確認ください。
いいえ。認識エンジンがブラウザへダウンロードされ、そこで動作します。画像は端末から直接読み込まれ、どこにも送信されません。名刺には他人の個人情報が載っているため、この点は多くのツール以上に重要です。
いいえ、意図的に対応していません。それらは機微な識別情報であり、写真から大量に抜き出せる道具は悪用を招きます。ここで抽出するのは電話番号・メールアドレス・URL のみです。
初めて使うとき、ブラウザが認識エンジンと言語データをダウンロードします。合計で約 6MB です。その後はキャッシュされ、次回からはすぐに始まります。
見つからなかった旨が表示され、認識できた文字の全文が自動的に展開されます。元々連絡先が書かれていなかったのか、読めてはいたが連絡先と判定されなかったのかが一目で分かります。
対応しています。国番号付きの番号はどの国のものでも認識でき、括弧付きの市外局番やハイフン区切りの形式も扱えます。既知の制限が一つあります。区切り記号も国番号もない 10 桁の数字だけの番号は対象外です。その形を受け付けると、10 桁の請求書番号もすべて通してしまうためです。
ここでは 1 枚ずつです。名刺 1 枚、ポスター 1 枚というのが通常の使い方だからです。多数の画像から文字そのものが必要な場合は、画像文字認識ツールが一括処理と複数ページ PDF に対応しています。