Déposez des images ou un PDF ici
ou cliquez pour parcourir — plusieurs fichiers à la fois sont acceptésou collez avec Ctrl+V
Langue
Ajoutez une image ou un PDF pour commencer la lecture

Extraire le texte d'une image et d'un PDF

Récupérez le texte de vos captures d'écran, photos et PDF scannés. La reconnaissance a lieu dans votre navigateur, rien n'est envoyé en ligne. Plusieurs fichiers à la fois.

Ce que fait cet outil

Le texte imprimé est bien reconnu

La précision dépend de la netteté, de la langue, de la mise en page et de l’éclairage. Comparez le texte à l’original, surtout les noms, dates et nombres.

Neuf langues

Anglais, chinois (simplifié et traditionnel), japonais, coréen, allemand, français, espagnol et italien. Les langues autres que l'anglais chargent aussi l'anglais, car les vrais documents regorgent de numéros de commande, d'adresses e-mail et de montants en caractères latins.

PDF scannés, page par page

Le PDF est ouvert et chaque page lue à son tour : vous n'avez pas à exporter les pages en images au préalable.

Plusieurs fichiers à la fois

Déposez un dossier entier de captures, elles se mettent en file. Si l'une échoue, les autres continuent — un fichier défectueux n'arrête pas le lot.

Copier ou télécharger

Envoyez le résultat directement dans le presse-papiers, ou téléchargez-le en.txt. Avec plusieurs fichiers, chaque résultat est identifié pour ne rien mélanger.

Comment extraire le texte d'une image

1

Ajoutez vos fichiers

Glissez des images ou un PDF, ou cliquez pour parcourir. JPG, PNG, WebP, GIF, BMP et PDF fonctionnent, jusqu'à 50 Mo par fichier.

2

Choisissez la langue

Celle du texte dans l'image, pas celle de cette page. C'est le réglage qui pèse le plus sur la précision.

3

Copiez ou téléchargez le texte

Les résultats apparaissent au fur et à mesure. Copiez l'ensemble dans le presse-papiers ou enregistrez-le en.txt.

Exemples réels

Extraire le texte d'une image et d'un PDF · Exemple 1

Ces fichiers ont été traités avec cet outil ou le même code de traitement. Comparez les sources, les réglages et les résultats à télécharger.

Pour de meilleurs résultats

Réglez d'abord la langue

C'est de loin le facteur le plus important. Lire du chinois avec le modèle anglais donnera n'importe quoi, aussi nette soit l'image.

Recadrez sur le texte

Les photos de pages incluent souvent le bureau, une main, un bout de la pièce. En ne gardant que le papier, la reconnaissance a moins de quoi se troubler.

Un éclairage régulier vaut mieux qu'un éclairage fort

Une ombre en travers de la page nuit davantage qu'une photo un peu sombre dans l'ensemble. Déplacez-vous pour que la lumière soit régulière plutôt que puissante.

Gardez les lignes horizontales

Un texte de biais est nettement moins bien lu. Redresser la photo avant de l'envoyer vaut largement les quelques secondes.

Utilisez le fichier d'origine

Une capture de capture, ou une photo passée par plusieurs messageries, a été recompressée à chaque fois. L'original est toujours plus net.

Texte imprimé oui, écriture manuscrite non

L'outil vise le texte imprimé et composé. L'écriture manuscrite est un tout autre problème et le résultat vous décevra.

Exemples réels

Extraire le texte d'une image et d'un PDF · Autres exemples

Ces fichiers ont été traités avec cet outil ou le même code de traitement. Comparez les sources, les réglages et les résultats à télécharger.

Questions sur l'extraction de texte

Oui. L'OCR — reconnaissance optique de caractères — désigne le fait de lire du texte imprimé dans une image, et c'est exactement ce qui se passe ici. La différence avec la plupart des sites d'OCR tient au lieu d'exécution : le moteur est téléchargé dans votre navigateur au lieu que votre fichier parte sur le serveur de quelqu'un.
La précision dépend de la netteté, de la langue, de la mise en page et de l’éclairage. Comparez le texte à l’original, surtout les noms, dates et nombres.
Non, et autant le dire clairement. Le moteur est conçu pour du texte imprimé et composé. La reconnaissance d'écriture manuscrite est un autre problème, qui demande d'autres modèles : essayer ici ne fera que vous faire perdre du temps.
Non. Le texte contenu dans un tableau sera lu, mais la structure en lignes et colonnes n'est pas conservée — vous obtenez les mots, pas une grille. Le moteur ne détecte pas du tout la structure des tableaux, il n'y a donc aucun moyen d'en tirer un Excel exploitable.
Le contenu des fichiers sélectionnés est traité dans le navigateur, sans envoi à un service de téléversement de l’application. Le site, les polices et les bibliothèques de traitement peuvent néanmoins nécessiter des requêtes réseau.
Ouvrez la page avec une connexion. Le traitement peut continuer dans l’onglet chargé, mais le rechargement, les ressources externes et les modules non mis en cache nécessitent Internet.
Celle du texte dans l'image, pas celle de cette page. En cas d'erreur, même une image nette donnera du charabia. Les choix non anglophones chargent aussi l'anglais, pour que les documents mêlant numéros de commande et adresses e-mail soient lus correctement.
Oui. Chaque page est rendue et lue à son tour, et les résultats apparaissent page après page. Les documents très longs sont limités aux 100 premières pages, et vous en êtes informé au lieu d'avoir à le deviner.
Vous verrez « Aucun texte trouvé » plutôt qu'une erreur, car une image sans texte lisible est un résultat normal. En général cela signifie que l'image est trop floue, le texte trop petit, ou que la langue choisie n'est pas la bonne.
Parce qu'il ne devrait pas en avoir. Les moteurs de reconnaissance traitent chaque caractère chinois comme un mot distinct et insèrent des espaces partout, ce qui rend le résultat pénible à utiliser. Ces espaces sont retirés ici — mais ceux entre caractères chinois et latins sont conservés, car ils sont réels.
Oui. Déposez autant d'images que vous voulez, elles se mettent en file et les résultats apparaissent à mesure. Si un fichier échoue, les autres continuent, et vous pouvez arrêter à tout moment sans perdre ce qui a déjà été lu.