Text aus Bildern und PDFs Extrahieren (OCR)
Text aus einem Bild oder PDF per OCR im Browser extrahieren
Wird vollständig in deinem Browser mit einem Web Worker verarbeitet. Es wird nichts hochgeladen.
So funktioniert es
- Wähle ein Bild oder ein PDF.
- Warte, während der Text erkannt wird — ein Fortschrittsbalken zeigt den Status.
- Überprüfe den extrahierten Text.
- Kopiere ihn oder lade ihn als .txt-Datei herunter.
Unterstützte Formate
Gängige Bildformate (JPG, PNG, WebP) oder ein PDF — bei einem PDF wird nur die erste Seite gescannt.
Funktionen
- Führt eine echte OCR-Engine (Tesseract) vollständig auf deinem Gerät aus
- Zeigt den Erkennungsfortschritt live an
- Kopieren in die Zwischenablage mit einem Klick, oder Download als Klartext
Was mit deiner Datei passiert
Es gelten keine Dateimetadaten — das Ergebnis ist einfacher erkannter Text, keine Datei mit eingebetteten Metadaten.
Bekannte Einschränkungen
- Erkennt nur englischen Text — andere Sprachen werden derzeit nicht unterstützt.
- Optimiert für gedruckten Text; Handschrifterkennung ist unzuverlässig.
- Bei einem PDF wird nur die erste Seite verarbeitet — mehrseitige OCR wird noch nicht unterstützt.
- Die Erkennungsgenauigkeit sinkt bei niedrig aufgelösten, unscharfen oder kontrastarmen Bildern.
Typische Anwendungsfälle
- Text aus einem Screenshot extrahieren
- Eine gescannte gedruckte Seite digitalisieren
- Ein Zitat oder einen Absatz aus einem Dokumentfoto extrahieren
Verwandte Werkzeuge
Datenformat-Konverter
Convert between CSV, JSON and YAML, entirely in your browser
Bilder zu PDF
PNG- oder JPEG-Bilder im Browser zu einem PDF zusammenführen
Office zu PDF
Convert Word, Excel, PowerPoint and OpenDocument files to PDF.
PDF zu Bildern
Jede Seite eines PDFs im Browser als Bild rendern, gezippt
Fragen.
Wird meine Datei irgendwohin hochgeladen?
Nein. Bild zu Text (OCR) läuft vollständig in deinem Browser über einen Web Worker — die Datei verlässt dein Gerät nie.
Welche Dateitypen werden akzeptiert?
Bild zu Text (OCR) akzeptiert PNG, JPG, JPEG, WEBP, PDF-Dateien.
Werden andere Sprachen als Englisch unterstützt?
Derzeit nicht — die Erkennung ist nur auf Englisch.
Kann ich jede Seite eines mehrseitigen PDFs per OCR erfassen?
Noch nicht — nur die erste Seite eines PDFs wird verarbeitet. Für mehrere Seiten konvertiere das PDF zuerst in Bilder und führe OCR auf jedem einzeln aus.
Probleme mit diesem Werkzeug? Problem melden →