Bilder oder PDF hier ablegen
oder klicken zum Auswählen — mehrere Dateien gleichzeitig sind möglichoder mit Ctrl+V einfügen
Sprache
Bild oder PDF hinzufügen, um mit dem Auslesen zu beginnen

Bild in Text umwandeln

Holen Sie den Text aus Screenshots, Fotos und gescannten PDFs heraus. Die Erkennung läuft im Browser, es wird nichts hochgeladen. Mehrere Dateien auf einmal möglich.

Was dieses Werkzeug leistet

Gedruckter Text wird zuverlässig erkannt

Die Genauigkeit hängt von Schärfe, Sprache, Layout und Beleuchtung ab. Prüfen Sie den erkannten Text am Original, besonders Namen, Daten und Zahlen.

Neun Sprachen

Englisch, Chinesisch (vereinfacht und traditionell), Japanisch, Koreanisch, Deutsch, Französisch, Spanisch und Italienisch. Bei nicht-englischen Sprachen wird Englisch mitgeladen, denn echte Dokumente stecken voller Bestellnummern, E-Mail-Adressen und Beträge in lateinischer Schrift.

Gescannte PDFs, Seite für Seite

Ein PDF wird geöffnet und jede Seite der Reihe nach gelesen. Sie müssen die Seiten also nicht vorher selbst als Bilder exportieren.

Mehrere Dateien auf einmal

Legen Sie einen ganzen Ordner voller Screenshots ab, sie reihen sich auf. Schlägt eine fehl, laufen die übrigen weiter — eine defekte Datei stoppt nicht den ganzen Stapel.

Kopieren oder herunterladen

Das Ergebnis geht direkt in die Zwischenablage oder als.txt-Datei auf die Festplatte. Bei mehreren Dateien ist jedes Ergebnis beschriftet, damit nichts durcheinandergerät.

So holen Sie Text aus einem Bild

1

Dateien hinzufügen

Bilder oder ein PDF hineinziehen oder zum Auswählen klicken. JPG, PNG, WebP, GIF, BMP und PDF funktionieren, bis 50 MB je Datei.

2

Sprache wählen

Die Sprache des Textes im Bild, nicht die dieser Seite. Für die Genauigkeit zählt diese Einstellung mehr als alles andere.

3

Text kopieren oder herunterladen

Die Ergebnisse erscheinen, sobald eine Datei fertig ist. Alles in die Zwischenablage kopieren oder als.txt speichern.

Echte Beispiele

Bild in Text umwandeln · Beispiel 1

Diese Dateien wurden mit diesem Werkzeug oder dessen Verarbeitungscode erstellt. Vergleiche Originale, Einstellungen und herunterladbare Ergebnisse.

Für bessere Ergebnisse

Zuerst die Sprache richtig einstellen

Der mit Abstand wichtigste Punkt. Chinesischen Text mit dem englischen Modell zu lesen ergibt Unsinn, egal wie scharf das Bild ist.

Auf den Text zuschneiden

Fotos von Seiten zeigen meist auch den Schreibtisch, eine Hand, einen Teil des Raums. Beschränkt aufs Papier hat die Erkennung weniger, woran sie sich stören kann.

Gleichmäßiges Licht schlägt helles Licht

Ein Schatten quer über der halben Seite schadet mehr als eine insgesamt etwas dunkle Aufnahme. Stellen Sie sich so, dass das Licht gleichmäßig fällt, statt es heller zu machen.

Zeilen waagerecht halten

Schräg verlaufender Text wird spürbar schlechter gelesen. Das Foto vor dem Hochladen geradezurücken lohnt die paar Sekunden.

Die Originaldatei verwenden

Ein Screenshot vom Screenshot oder ein durch mehrere Messenger geschicktes Foto wurde jedes Mal neu komprimiert. Das Original ist immer schärfer.

Gedrucktes ja, Handschrift nein

Das Werkzeug ist für gedruckten und gesetzten Text gemacht. Handschrift ist ein grundlegend anderes Problem, und das Ergebnis wird Sie enttäuschen.

Echte Beispiele

Bild in Text umwandeln · Weitere Beispiele

Diese Dateien wurden mit diesem Werkzeug oder dessen Verarbeitungscode erstellt. Vergleiche Originale, Einstellungen und herunterladbare Ergebnisse.

Fragen zur Texterkennung

Ja. OCR — optische Zeichenerkennung — ist der Oberbegriff dafür, gedruckten Text aus einem Bild auszulesen, und genau das passiert hier. Der Unterschied zu den meisten OCR-Seiten liegt im Ort: Das Modul wird in Ihren Browser geladen, statt Ihre Datei auf einen fremden Server zu schicken.
Die Genauigkeit hängt von Schärfe, Sprache, Layout und Beleuchtung ab. Prüfen Sie den erkannten Text am Original, besonders Namen, Daten und Zahlen.
Nein, und das sollte klar gesagt sein. Das Modul ist für gedruckten und gesetzten Text gebaut. Handschrifterkennung ist ein anderes Problem mit anderen Modellen — der Versuch kostet Sie hier nur Zeit.
Nein. Der Text in einer Tabelle wird gelesen, die Struktur aus Zeilen und Spalten aber nicht bewahrt — Sie erhalten die Wörter, kein Raster. Das Modul erkennt Tabellenstrukturen überhaupt nicht, es gibt also keinen Weg zu brauchbarem Excel.
Der Inhalt ausgewählter Dateien wird im Browser verarbeitet und nicht an einen Upload-Endpunkt der Anwendung gesendet. Website, Schriften und Verarbeitungsbibliotheken können trotzdem Netzwerkzugriffe benötigen.
Öffnen Sie die Seite mit Internetverbindung. Die Verarbeitung kann im geladenen Tab weiterlaufen; Neuladen, externe Inhalte und nicht gespeicherte Module oder Modelle benötigen eine Verbindung.
Die des Textes im Bild, nicht die dieser Seite. Bei falscher Wahl kommt selbst aus einem gestochen scharfen Bild Unsinn heraus. Nicht-englische Sprachen laden Englisch mit, damit gemischte Dokumente mit Bestellnummern und E-Mail-Adressen korrekt gelesen werden.
Ja. Jede Seite wird der Reihe nach gerendert und gelesen, die Ergebnisse erscheinen seitenweise. Sehr lange Dokumente werden bei den ersten 100 Seiten begrenzt, und Sie erfahren das, statt es selbst herausfinden zu müssen.
Dann steht dort „Kein Text gefunden" statt einer Fehlermeldung, denn ein Bild ohne lesbaren Text ist ein normales Ergebnis. Meist heißt es, dass das Bild zu unscharf ist, die Schrift zu klein oder die falsche Sprache eingestellt.
Weil dort keine hingehören. Erkennungsmodule behandeln jedes chinesische Zeichen als eigenes Wort und setzen überall Leerzeichen dazwischen, was das Ergebnis mühsam macht. Diese werden hier entfernt — Leerzeichen zwischen chinesischer und lateinischer Schrift bleiben jedoch, denn die sind echt.
Ja. Legen Sie beliebig viele Bilder ab, sie reihen sich auf und die Ergebnisse erscheinen nacheinander. Schlägt eine Datei fehl, laufen die übrigen weiter, und Sie können jederzeit stoppen, ohne das bereits Gelesene zu verlieren.