Bild zu Text (OCR)

Kostenlose Online-OCR: Text aus Bildern, Screenshots, Fotos und gescannten PDFs in 24 Sprachen extrahieren. Läuft im Browser, nichts wird hochgeladen.

Sie können Dateien auch hierher ziehen oder einen Screenshot mit Ctrl+V einfügen (⌘+V auf dem Mac). Der Text wird von Ihrem Browser erkannt. Dateien werden nirgendwohin gesendet: kein Upload, keine Speicherung.
Jede Sprache wird einmal heruntergeladen (1 bis 3 MB) und bleibt dann in Ihrem Browser gespeichert. Fügen Sie Englisch als zweite Sprache hinzu, wenn der Text Wörter in lateinischer Schrift enthält.

Was er macht


Dieses Tool nutzt OCR (optische Zeichenerkennung), um den Text in einem Bild in Text zu verwandeln, den Sie kopieren, bearbeiten und durchsuchen können. Es funktioniert mit Screenshots, Fotos von Dokumenten, gescannten Seiten und PDFs, die nur aus Bildern bestehen. Die Erkennung übernimmt Tesseract, eine Open-Source-OCR-Engine, die direkt in Ihrem Browser läuft – die Dateien verlassen Ihr Gerät also nie. Kleiner Text wird vor dem Lesen automatisch vergrößert, was Fehler spürbar reduziert.

So wird er benutzt


  1. Wählen Sie ein oder mehrere Bilder oder ein PDF aus, ziehen Sie sie hierher oder fügen Sie einen Screenshot ein.
  2. Prüfen Sie die Sprache des Textes. Das Lesen beginnt automatisch; wenn Sie die Sprache ändern, klicken Sie erneut auf Text extrahieren.
  3. Prüfen Sie das Ergebnis, korrigieren Sie falsch Erkanntes und kopieren Sie es dann oder laden Sie es als .txt-Datei herunter.

Häufige Fragen


Werden meine Bilder hochgeladen?
Nein. Die Erkennungs-Engine und die Sprachdaten werden in Ihren Browser heruntergeladen, und die Bilder und PDFs werden dort verarbeitet. Nichts wird an einen Server gesendet, daher ist die Nutzung auch mit vertraulichen Dokumenten sicher.

Wie genau ist es?
Bei klarem gedrucktem Text werden in Sprachen mit lateinischer Schrift meist über 99 % der Zeichen richtig erkannt, bei anderen Schriften typischerweise zwischen 93 % und 99 %. Die Genauigkeit sinkt bei unscharfen Fotos, geringem Kontrast, gewölbten Seiten, Zierschriften und Handschrift. Für das beste Ergebnis verwenden Sie ein scharfes, gut beleuchtetes und gerades Bild und wählen die richtige Sprache.

Welche Sprachen werden unterstützt?
24 Sprachen: Englisch, Portugiesisch, Spanisch, Französisch, Deutsch, Italienisch, Schwedisch, Afrikaans, Türkisch, Indonesisch, Malaiisch, Filipino, Vietnamesisch, Russisch, Arabisch, Urdu, Hindi, Tamil, Thai, Khmer, Japanisch, Koreanisch sowie vereinfachtes und traditionelles Chinesisch. Sie können zwei Sprachen kombinieren, wenn ein Text sie mischt.

Kann es Handschrift lesen?
Nur schlecht. Die Engine ist auf gedruckten Text trainiert: Saubere Druckbuchstaben funktionieren manchmal, verbundene Schreibschrift wird aber meist falsch erkannt.

Funktioniert es mit gescannten PDFs?
Ja. Jede Seite wird in hoher Auflösung gerendert und der Reihe nach gelesen, und Sie können markieren, wo jede Seite beginnt. Wenn das PDF bereits auswählbaren Text enthält, ist das Tool „PDF in Text umwandeln“ schneller und exakt.

Wikipedia — Optical character recognition
Wikipedia — Tesseract (software)