Bilder oder PDF hier ablegen
oder klicken zum Auswählen — mehrere Dateien gleichzeitig sind möglich
Sprache
Bild oder PDF hinzufügen, um mit dem Auslesen zu beginnen

Text aus Bildern und gescannten PDFs herausholen

Legen Sie einen Screenshot, das Foto einer Seite oder ein gescanntes PDF ab, und der Text darin kommt als etwas zurück, das Sie markieren, kopieren und bearbeiten können. Die Erkennung passiert im Browser — die Datei verlässt Ihr Gerät nicht. Mehrere Bilder gleichzeitig sind möglich, ein PDF wird Seite für Seite gelesen.

Was dieses Werkzeug leistet

Gedruckter Text wird zuverlässig erkannt

Bei sauberen Screenshots und Scans stimmt praktisch jedes Zeichen. Auch Fotos mit ungleichmäßigem Licht oder leichter Perspektive hält es aus, wobei eine gerade, gut ausgeleuchtete Aufnahme immer besser gelesen wird als eine schiefe.

Neun Sprachen

Englisch, Chinesisch (vereinfacht und traditionell), Japanisch, Koreanisch, Deutsch, Französisch, Spanisch und Italienisch. Bei nicht-englischen Sprachen wird Englisch mitgeladen, denn echte Dokumente stecken voller Bestellnummern, E-Mail-Adressen und Beträge in lateinischer Schrift.

Gescannte PDFs, Seite für Seite

Ein PDF wird geöffnet und jede Seite der Reihe nach gelesen. Sie müssen die Seiten also nicht vorher selbst als Bilder exportieren.

Mehrere Dateien auf einmal

Legen Sie einen ganzen Ordner voller Screenshots ab, sie reihen sich auf. Schlägt eine fehl, laufen die übrigen weiter — eine defekte Datei stoppt nicht den ganzen Stapel.

Es wird nichts hochgeladen

Das Erkennungsmodul läuft auf der Seite selbst. Ihre Bilder und PDFs werden nirgendwohin gesendet — was zählt, wenn es um Rechnungen, Verträge oder anderes mit persönlichen Daten geht.

Kopieren oder herunterladen

Das Ergebnis geht direkt in die Zwischenablage oder als .txt-Datei auf die Festplatte. Bei mehreren Dateien ist jedes Ergebnis beschriftet, damit nichts durcheinandergerät.

So holen Sie Text aus einem Bild

1

Dateien hinzufügen

Bilder oder ein PDF hineinziehen oder zum Auswählen klicken. JPG, PNG, WebP, GIF, BMP und PDF funktionieren, bis 50 MB je Datei.

2

Sprache wählen

Die Sprache des Textes im Bild, nicht die dieser Seite. Für die Genauigkeit zählt diese Einstellung mehr als alles andere.

3

Text kopieren oder herunterladen

Die Ergebnisse erscheinen, sobald eine Datei fertig ist. Alles in die Zwischenablage kopieren oder als .txt speichern.

Wann das nützlich ist

Text, der in einem Screenshot feststeckt

Jemand schickt den Screenshot einer Fehlermeldung, einer Adresse oder eines Code-Ausschnitts. Statt abzutippen, holen Sie den Text heraus und fügen ihn ein.

Gescannte Dokumente, die sich nicht durchsuchen lassen

Ein gescannter Vertrag ist für den Rechner nur ein Bild. Erst wenn der Text ausgelesen ist, lässt sich darin suchen und daraus zitieren.

Abfotografierte Seiten

Eine Buchseite oder das Whiteboard nach einer Besprechung. Sie bekommen die Wörter zurück, ohne sie abzuschreiben.

Rechnungen und Belege

Referenznummern und Beträge herausziehen, statt auf ein Foto zu starren und Ziffer für Ziffer zu übertragen.

Altbestände, die archiviert werden

Wenn kistenweise Papier gescannt wird, entstehen Bilder. Erst der extrahierte Text macht das Archiv später überhaupt brauchbar.

Material in einer Sprache, die Sie lernen

Als Text lassen sich die Zeichen nachschlagen — solange sie im Bild stecken, geht das nicht.

Für bessere Ergebnisse

Zuerst die Sprache richtig einstellen

Der mit Abstand wichtigste Punkt. Chinesischen Text mit dem englischen Modell zu lesen ergibt Unsinn, egal wie scharf das Bild ist.

Auf den Text zuschneiden

Fotos von Seiten zeigen meist auch den Schreibtisch, eine Hand, einen Teil des Raums. Beschränkt aufs Papier hat die Erkennung weniger, woran sie sich stören kann.

Gleichmäßiges Licht schlägt helles Licht

Ein Schatten quer über der halben Seite schadet mehr als eine insgesamt etwas dunkle Aufnahme. Stellen Sie sich so, dass das Licht gleichmäßig fällt, statt es heller zu machen.

Zeilen waagerecht halten

Schräg verlaufender Text wird spürbar schlechter gelesen. Das Foto vor dem Hochladen geradezurücken lohnt die paar Sekunden.

Die Originaldatei verwenden

Ein Screenshot vom Screenshot oder ein durch mehrere Messenger geschicktes Foto wurde jedes Mal neu komprimiert. Das Original ist immer schärfer.

Gedrucktes ja, Handschrift nein

Das Werkzeug ist für gedruckten und gesetzten Text gemacht. Handschrift ist ein grundlegend anderes Problem, und das Ergebnis wird Sie enttäuschen.

Warum dieses Werkzeug

Ihre Dokumente bleiben Ihre

Die meisten Online-Konverter laden Ihre Datei auf ihren Server. Dieses hier nicht — alles läuft im Browser, es gibt hinterher nichts zu löschen.

Kostenlos, ohne Konto, ohne Wasserzeichen

Keine Seitenbegrenzung, keine Anmeldeschranke auf halbem Weg, keine Kaufaufforderung, bevor Sie das Ergebnis sehen. Die Seite ist kostenlos und bleibt es.

Nach dem ersten Laden auch offline

Ist das Erkennungsmodul einmal geladen, behält Ihr Browser es. Spätere Besuche starten sofort und funktionieren ohne Verbindung.

Stapel und PDF inklusive

Mehrere Bilder auf einmal und mehrseitige PDFs gehören zum kostenlosen Werkzeug, nicht hinter eine Bezahlstufe.

Chinesisch, Japanisch und Koreanisch ernst genommen

Erkennungsmodule streuen üblicherweise Leerzeichen zwischen alle Zeichen, was das Ergebnis unbrauchbar macht. Hier werden sie entfernt — Leerzeichen zwischen CJK und lateinischer Schrift bleiben aber stehen, denn die gehören dorthin.

Funktioniert auf dem Handy

Alles läuft im mobilen Browser, Sie können ein Foto direkt aus der Galerie auslesen.

Fragen zur Texterkennung

Ja. OCR — optische Zeichenerkennung — ist der Oberbegriff dafür, gedruckten Text aus einem Bild auszulesen, und genau das passiert hier. Der Unterschied zu den meisten OCR-Seiten liegt im Ort: Das Modul wird in Ihren Browser geladen, statt Ihre Datei auf einen fremden Server zu schicken.
Bei sauber gedrucktem Text — Screenshots, gute Scans — stimmt praktisch alles. In unseren eigenen Tests kam englischer Drucktext fehlerfrei zurück, chinesischer lag bei etwa 98 %. Fotos mit ungleichmäßigem Licht oder leichter Perspektive lagen bei 94–95 %. Überfliegen Sie das Ergebnis lieber, besonders bei Zahlen.
Nein, und das sollte klar gesagt sein. Das Modul ist für gedruckten und gesetzten Text gebaut. Handschrifterkennung ist ein anderes Problem mit anderen Modellen — der Versuch kostet Sie hier nur Zeit.
Nein. Der Text in einer Tabelle wird gelesen, die Struktur aus Zeilen und Spalten aber nicht bewahrt — Sie erhalten die Wörter, kein Raster. Das Modul erkennt Tabellenstrukturen überhaupt nicht, es gibt also keinen Weg zu brauchbarem Excel.
Nein. Das Erkennungsmodul wird in Ihren Browser geladen und läuft dort. Bilder und PDFs werden direkt von Ihrem Gerät gelesen und nirgendwohin gesendet. Deshalb läuft es auch weiter, wenn die Verbindung nach dem Laden der Seite abbricht.
Beim ersten Mal lädt der Browser das Erkennungsmodul und die Sprachdaten herunter — zusammen etwa 6 MB. Danach behält Ihr Browser beides, spätere Durchläufe starten sofort und ein Bild braucht deutlich weniger als eine Sekunde.
Die des Textes im Bild, nicht die dieser Seite. Bei falscher Wahl kommt selbst aus einem gestochen scharfen Bild Unsinn heraus. Nicht-englische Sprachen laden Englisch mit, damit gemischte Dokumente mit Bestellnummern und E-Mail-Adressen korrekt gelesen werden.
Ja. Jede Seite wird der Reihe nach gerendert und gelesen, die Ergebnisse erscheinen seitenweise. Sehr lange Dokumente werden bei den ersten 100 Seiten begrenzt, und Sie erfahren das, statt es selbst herausfinden zu müssen.
Dann steht dort „Kein Text gefunden" statt einer Fehlermeldung, denn ein Bild ohne lesbaren Text ist ein normales Ergebnis. Meist heißt es, dass das Bild zu unscharf ist, die Schrift zu klein oder die falsche Sprache eingestellt.
Weil dort keine hingehören. Erkennungsmodule behandeln jedes chinesische Zeichen als eigenes Wort und setzen überall Leerzeichen dazwischen, was das Ergebnis mühsam macht. Diese werden hier entfernt — Leerzeichen zwischen chinesischer und lateinischer Schrift bleiben jedoch, denn die sind echt.
Ja. Legen Sie beliebig viele Bilder ab, sie reihen sich auf und die Ergebnisse erscheinen nacheinander. Schlägt eine Datei fehl, laufen die übrigen weiter, und Sie können jederzeit stoppen, ohne das bereits Gelesene zu verlieren.
Bild in Text umwandeln - Text aus Bildern und PDFs, kostenlos