Déposez des images ou un PDF ici
ou cliquez pour parcourir — plusieurs fichiers à la fois sont acceptés
Langue
Ajoutez une image ou un PDF pour commencer la lecture

Extraire le texte d'images et de PDF scannés

Déposez une capture d'écran, la photo d'une page ou un PDF scanné, et le texte qu'il contient revient sous une forme que vous pouvez sélectionner, copier et modifier. La reconnaissance se fait dans votre navigateur : le fichier ne quitte pas votre appareil. Plusieurs images à la fois sont acceptées, et un PDF est lu page par page.

Ce que fait cet outil

Le texte imprimé est bien reconnu

Sur des captures d'écran nettes et de bons scans, la reconnaissance est quasi exacte. Elle tient aussi sur des photos à l'éclairage inégal ou légèrement de biais, même si une prise de vue droite et bien éclairée donnera toujours un meilleur résultat.

Neuf langues

Anglais, chinois (simplifié et traditionnel), japonais, coréen, allemand, français, espagnol et italien. Les langues autres que l'anglais chargent aussi l'anglais, car les vrais documents regorgent de numéros de commande, d'adresses e-mail et de montants en caractères latins.

PDF scannés, page par page

Le PDF est ouvert et chaque page lue à son tour : vous n'avez pas à exporter les pages en images au préalable.

Plusieurs fichiers à la fois

Déposez un dossier entier de captures, elles se mettent en file. Si l'une échoue, les autres continuent — un fichier défectueux n'arrête pas le lot.

Rien n'est envoyé en ligne

Le moteur de reconnaissance tourne sur la page elle-même. Vos images et PDF ne partent nulle part, ce qui compte quand il s'agit d'une facture, d'un contrat ou de tout document contenant des données personnelles.

Copier ou télécharger

Envoyez le résultat directement dans le presse-papiers, ou téléchargez-le en .txt. Avec plusieurs fichiers, chaque résultat est identifié pour ne rien mélanger.

Comment extraire le texte d'une image

1

Ajoutez vos fichiers

Glissez des images ou un PDF, ou cliquez pour parcourir. JPG, PNG, WebP, GIF, BMP et PDF fonctionnent, jusqu'à 50 Mo par fichier.

2

Choisissez la langue

Celle du texte dans l'image, pas celle de cette page. C'est le réglage qui pèse le plus sur la précision.

3

Copiez ou téléchargez le texte

Les résultats apparaissent au fur et à mesure. Copiez l'ensemble dans le presse-papiers ou enregistrez-le en .txt.

Quand cela sert

Du texte prisonnier d'une capture d'écran

On vous envoie la capture d'un message d'erreur, d'une adresse ou d'un extrait de code. Plutôt que de retaper, récupérez le texte et collez-le.

Des documents scannés impossibles à chercher

Un contrat scanné n'est qu'une image pour votre ordinateur. C'est en extrayant le texte qu'il devient consultable et citable.

Des pages photographiées

Une page de livre, ou le tableau blanc après une réunion. Vous récupérez les mots sans les recopier.

Factures et reçus

Récupérez références et montants sans plisser les yeux sur une photo pour recopier chiffre par chiffre.

Des archives papier numérisées

Quand des cartons de papier passent au scanner, on obtient des images. C'est le texte extrait qui rend l'archive réellement exploitable ensuite.

Un support dans une langue que vous apprenez

Une fois les caractères en texte, vous pouvez les chercher dans un dictionnaire — impossible tant qu'ils sont enfermés dans une image.

Pour de meilleurs résultats

Réglez d'abord la langue

C'est de loin le facteur le plus important. Lire du chinois avec le modèle anglais donnera n'importe quoi, aussi nette soit l'image.

Recadrez sur le texte

Les photos de pages incluent souvent le bureau, une main, un bout de la pièce. En ne gardant que le papier, la reconnaissance a moins de quoi se troubler.

Un éclairage régulier vaut mieux qu'un éclairage fort

Une ombre en travers de la page nuit davantage qu'une photo un peu sombre dans l'ensemble. Déplacez-vous pour que la lumière soit régulière plutôt que puissante.

Gardez les lignes horizontales

Un texte de biais est nettement moins bien lu. Redresser la photo avant de l'envoyer vaut largement les quelques secondes.

Utilisez le fichier d'origine

Une capture de capture, ou une photo passée par plusieurs messageries, a été recompressée à chaque fois. L'original est toujours plus net.

Texte imprimé oui, écriture manuscrite non

L'outil vise le texte imprimé et composé. L'écriture manuscrite est un tout autre problème et le résultat vous décevra.

Pourquoi cet outil

Vos documents restent les vôtres

La plupart des convertisseurs en ligne envoient votre fichier sur leur serveur. Pas celui-ci : tout se passe dans le navigateur, il n'y a donc rien à supprimer ensuite.

Gratuit, sans compte, sans filigrane

Pas de limite de pages, pas d'inscription imposée à mi-parcours, pas d'offre payante avant de voir le résultat. Le site est gratuit et le restera.

Hors ligne une fois chargé

Après le premier téléchargement, votre navigateur conserve le moteur. Les visites suivantes démarrent aussitôt et fonctionnent sans connexion.

Le lot et le PDF sont inclus

Plusieurs images à la fois et les PDF multipages font partie de l'outil gratuit, pas d'une formule payante.

Le chinois, le japonais et le coréen ne sont pas bâclés

Les moteurs de reconnaissance sèment habituellement des espaces entre tous les caractères, rendant le résultat pénible à utiliser. Ils sont nettoyés ici — mais les espaces entre caractères CJK et latins sont conservés, car ceux-là sont réels.

Fonctionne sur téléphone

Tout tourne dans le navigateur mobile : vous pouvez lire une photo directement depuis votre galerie.

Questions sur l'extraction de texte

Oui. L'OCR — reconnaissance optique de caractères — désigne le fait de lire du texte imprimé dans une image, et c'est exactement ce qui se passe ici. La différence avec la plupart des sites d'OCR tient au lieu d'exécution : le moteur est téléchargé dans votre navigateur au lieu que votre fichier parte sur le serveur de quelqu'un.
Sur du texte imprimé propre — captures d'écran, bons scans — c'est quasi exact. Sur nos propres tests, le texte imprimé anglais est revenu parfait et le chinois autour de 98 %. Les photos à l'éclairage inégal ou légèrement de biais tournaient autour de 94–95 %. Parcourez le résultat plutôt que de le croire aveuglément, surtout pour les chiffres.
Non, et autant le dire clairement. Le moteur est conçu pour du texte imprimé et composé. La reconnaissance d'écriture manuscrite est un autre problème, qui demande d'autres modèles : essayer ici ne fera que vous faire perdre du temps.
Non. Le texte contenu dans un tableau sera lu, mais la structure en lignes et colonnes n'est pas conservée — vous obtenez les mots, pas une grille. Le moteur ne détecte pas du tout la structure des tableaux, il n'y a donc aucun moyen d'en tirer un Excel exploitable.
Non. Le moteur de reconnaissance est téléchargé dans votre navigateur et s'exécute là. Vos images et PDF sont lus directement depuis votre appareil et ne partent nulle part. C'est aussi pourquoi l'outil continue de fonctionner si la connexion tombe une fois la page chargée.
La première fois, le navigateur télécharge le moteur et les données de langue — environ 6 Mo au total. Ensuite il les conserve en cache : les utilisations suivantes démarrent immédiatement et chaque image prend bien moins d'une seconde.
Celle du texte dans l'image, pas celle de cette page. En cas d'erreur, même une image parfaitement nette donnera du charabia. Les choix non anglophones chargent aussi l'anglais, pour que les documents mêlant numéros de commande et adresses e-mail soient lus correctement.
Oui. Chaque page est rendue et lue à son tour, et les résultats apparaissent page après page. Les documents très longs sont limités aux 100 premières pages, et vous en êtes informé au lieu d'avoir à le deviner.
Vous verrez « Aucun texte trouvé » plutôt qu'une erreur, car une image sans texte lisible est un résultat normal. En général cela signifie que l'image est trop floue, le texte trop petit, ou que la langue choisie n'est pas la bonne.
Parce qu'il ne devrait pas en avoir. Les moteurs de reconnaissance traitent chaque caractère chinois comme un mot distinct et insèrent des espaces partout, ce qui rend le résultat pénible à utiliser. Ces espaces sont retirés ici — mais ceux entre caractères chinois et latins sont conservés, car ils sont réels.
Oui. Déposez autant d'images que vous voulez, elles se mettent en file et les résultats apparaissent à mesure. Si un fichier échoue, les autres continuent, et vous pouvez arrêter à tout moment sans perdre ce qui a déjà été lu.