Text aus Bildern und PDFs Extrahieren (OCR)

Text aus einem Bild oder PDF per OCR im Browser extrahieren

Dateien hier ablegen oder klicken, um eine oder mehrere auszuwählen — PNG, JPG, JPEG, WEBP, PDF

Wird vollständig in deinem Browser mit einem Web Worker verarbeitet. Es wird nichts hochgeladen.

So funktioniert es

  1. Wähle ein Bild oder ein PDF.
  2. Warte, während der Text erkannt wird — ein Fortschrittsbalken zeigt den Status.
  3. Überprüfe den extrahierten Text.
  4. Kopiere ihn oder lade ihn als .txt-Datei herunter.

Unterstützte Formate

Gängige Bildformate (JPG, PNG, WebP) oder ein PDF — bei einem PDF wird nur die erste Seite gescannt.

Funktionen

  • Führt eine echte OCR-Engine (Tesseract) vollständig auf deinem Gerät aus
  • Zeigt den Erkennungsfortschritt live an
  • Kopieren in die Zwischenablage mit einem Klick, oder Download als Klartext

Was mit deiner Datei passiert

Es gelten keine Dateimetadaten — das Ergebnis ist einfacher erkannter Text, keine Datei mit eingebetteten Metadaten.

Bekannte Einschränkungen

  • Erkennt nur englischen Text — andere Sprachen werden derzeit nicht unterstützt.
  • Optimiert für gedruckten Text; Handschrifterkennung ist unzuverlässig.
  • Bei einem PDF wird nur die erste Seite verarbeitet — mehrseitige OCR wird noch nicht unterstützt.
  • Die Erkennungsgenauigkeit sinkt bei niedrig aufgelösten, unscharfen oder kontrastarmen Bildern.

Typische Anwendungsfälle

  • Text aus einem Screenshot extrahieren
  • Eine gescannte gedruckte Seite digitalisieren
  • Ein Zitat oder einen Absatz aus einem Dokumentfoto extrahieren

Fragen.

Wird meine Datei irgendwohin hochgeladen?

Nein. Bild zu Text (OCR) läuft vollständig in deinem Browser über einen Web Worker — die Datei verlässt dein Gerät nie.

Welche Dateitypen werden akzeptiert?

Bild zu Text (OCR) akzeptiert PNG, JPG, JPEG, WEBP, PDF-Dateien.

Werden andere Sprachen als Englisch unterstützt?

Derzeit nicht — die Erkennung ist nur auf Englisch.

Kann ich jede Seite eines mehrseitigen PDFs per OCR erfassen?

Noch nicht — nur die erste Seite eines PDFs wird verarbeitet. Für mehrere Seiten konvertiere das PDF zuerst in Bilder und führe OCR auf jedem einzeln aus.

Probleme mit diesem Werkzeug? Problem melden →