Trascina qui immagini o un PDF
oppure clicca per scegliere — puoi selezionarne più di unooppure incolla con Ctrl+V
Lingua
Aggiungi un'immagine o un PDF per iniziare la lettura

Estrarre testo da immagine e PDF

Recupera il testo da screenshot, foto e PDF scansionati. Il riconoscimento avviene nel browser, non viene caricato nulla. Più file alla volta.

Cosa fa questo strumento

Legge bene il testo stampato

La precisione dipende da nitidezza, lingua, impaginazione e luce. Confronta il testo estratto con l’originale, soprattutto nomi, date e numeri.

Nove lingue

Inglese, cinese (semplificato e tradizionale), giapponese, coreano, tedesco, francese, spagnolo e italiano. Le lingue diverse dall'inglese caricano anche l'inglese, perché i documenti reali sono pieni di numeri d'ordine, indirizzi e-mail e importi in caratteri latini.

PDF scansionati, pagina per pagina

Il PDF viene aperto e ogni pagina letta a turno, così non devi esportare prima le pagine come immagini.

Più file alla volta

Trascina un'intera cartella di screenshot e si mettono in coda. Se uno fallisce gli altri proseguono — un file difettoso non blocca l'intero gruppo.

Copia o scarica

Porta il risultato direttamente negli appunti, oppure scaricalo come file.txt. Con più file ogni risultato è etichettato, così non si confondono.

Come estrarre il testo da un'immagine

1

Aggiungi i file

Trascina immagini o un PDF, oppure clicca per sceglierli. Vanno bene JPG, PNG, WebP, GIF, BMP e PDF, fino a 50 MB ciascuno.

2

Scegli la lingua

Quella del testo nell'immagine, non quella di questa pagina. Per la precisione questa impostazione conta più di ogni altra cosa.

3

Copia o scarica il testo

I risultati compaiono man mano che i file finiscono. Copia tutto negli appunti o salvalo come.txt.

Esempi reali

Estrarre testo da immagine e PDF · Esempio 1

Questi file sono stati elaborati con questo strumento o con lo stesso codice. Confronta gli originali, le impostazioni e i risultati scaricabili.

Per risultati migliori

Imposta prima la lingua

È di gran lunga il fattore più importante. Leggere testo cinese con il modello inglese produrrà accozzaglie, per quanto nitida sia l'immagine.

Ritaglia lasciando solo il testo

Le foto di pagine includono spesso la scrivania, una mano, un pezzo di stanza. Lasciando solo il foglio, il motore ha meno elementi che lo confondono.

Meglio luce uniforme che luce forte

Un'ombra che attraversa metà pagina danneggia più di una foto complessivamente un po' scura. Spostati perché la luce sia uniforme, invece di renderla più intensa.

Tieni le righe orizzontali

Il testo inclinato si legge sensibilmente peggio. Raddrizzare la foto prima di caricarla vale quei pochi secondi.

Usa il file originale

Uno screenshot di uno screenshot, o una foto inoltrata attraverso più app di messaggistica, è stata ricompressa ogni volta. L'originale è sempre più nitido.

Testo stampato sì, scrittura a mano no

Lo strumento è pensato per testo stampato e composto. La scrittura a mano è un problema davvero diverso e il risultato ti deluderà.

Esempi reali

Estrarre testo da immagine e PDF · Altri esempi

Questi file sono stati elaborati con questo strumento o con lo stesso codice. Confronta gli originali, le impostazioni e i risultati scaricabili.

Domande sull'estrazione del testo

Sì. OCR — riconoscimento ottico dei caratteri — è il nome generale per leggere testo stampato da un'immagine, ed è esattamente ciò che accade qui. La differenza rispetto alla maggior parte dei siti di OCR sta in dove viene eseguito: il motore viene scaricato nel tuo browser invece di caricare il tuo file sul server di qualcun altro.
La precisione dipende da nitidezza, lingua, impaginazione e luce. Confronta il testo estratto con l’originale, soprattutto nomi, date e numeri.
No, ed è bene dirlo chiaramente. Il motore è costruito per testo stampato e composto. Il riconoscimento della scrittura a mano è un problema diverso che richiede modelli diversi: provarci qui ti farà solo perdere tempo.
No. Il testo dentro la tabella verrà letto, ma la struttura di righe e colonne non viene conservata: ottieni le parole, non una griglia. Il motore non rileva affatto la struttura delle tabelle, quindi non c'è modo di esportarne un Excel utilizzabile.
Il contenuto dei file selezionati viene elaborato nel browser, senza inviarlo a un servizio di caricamento dell’applicazione. Il sito, i font e le librerie di elaborazione possono comunque richiedere connessioni di rete.
Apri la pagina con una connessione. L’elaborazione può proseguire nella scheda caricata; ricaricare la pagina o scaricare risorse e modelli richiede Internet.
Quella del testo nell'immagine, non quella di questa pagina. Se sbagli, il risultato sarà incomprensibile anche partendo da un'immagine nitida. Le scelte diverse dall'inglese caricano anche l'inglese, così i documenti misti con numeri d'ordine e indirizzi e-mail vengono letti correttamente.
Sì. Ogni pagina viene disegnata e letta a turno, e i risultati compaiono pagina per pagina. I documenti molto lunghi si fermano alle prime 100 pagine, e te lo diciamo invece di lasciartelo scoprire.
Vedrai «Nessun testo trovato» invece di un errore, perché un'immagine senza testo leggibile è un risultato normale. Di solito significa che l'immagine è troppo sfocata, il testo troppo piccolo, o che la lingua scelta è sbagliata.
Perché non dovrebbe averne. I motori di riconoscimento trattano ogni carattere cinese come una parola a sé e inseriscono spazi ovunque, rendendo il risultato scomodo. Qui vengono rimossi — ma gli spazi tra caratteri cinesi e latini restano, perché quelli sono reali.
Sì. Trascina tutte le immagini che vuoi: si mettono in coda e i risultati compaiono man mano. Se un file fallisce gli altri proseguono, e puoi fermarti in qualsiasi momento senza perdere ciò che è già stato letto.