Blog
OCR im Browser: Text aus Bildern und gescannten PDFs extrahieren
OCR wandelt Text in Bildern und gescannten Dokumenten in echten, kopierbaren Text um — vollständig im Browser, ohne Upload auf einen fremden Server.
Ein Foto von einer Rechnung, ein Screenshot mit einer Telefonnummer, ein eingescanntes Formular ohne durchsuchbaren Text — in allen drei Fällen ist der Text sichtbar, aber nicht auswählbar. OCR (Optical Character Recognition) löst genau dieses Problem: Sie erkennt Buchstaben in einem Bild und wandelt sie in echten, kopierbaren Text um.
Wofür OCR tatsächlich gebraucht wird
- Gescannte Dokumente durchsuchbar machen. Ein eingescanntes PDF ist für den Computer nur ein Bild — keine Volltextsuche, kein Kopieren einzelner Sätze. OCR extrahiert den zugrunde liegenden Text.
- Text aus Screenshots übernehmen. Eine Fehlermeldung, ein Zitat aus einem Video, eine Telefonnummer auf einem Foto — statt abzutippen, extrahiert OCR den Text direkt.
- Papierformulare digitalisieren. Handschriftliche Formulare sind schwieriger, aber gedruckte Formulare, Quittungen und Rechnungen lassen sich zuverlässig in Text umwandeln.
- Alte Dokumente archivieren. Wer einen Stapel alter, nur gescannter Unterlagen hat, kann sie per OCR in durchsuchbaren Text verwandeln, statt jede Seite manuell durchzulesen.
Warum der Browser hier der richtige Ort ist
Viele Online-OCR-Dienste funktionieren so: Bild hochladen, auf einem Server verarbeiten lassen, Text zurückbekommen. Für ein öffentliches Dokument ist das unproblematisch. Für eine Gehaltsabrechnung, einen Ausweis oder einen Vertrag ist es das nicht — das Bild verlässt Ihr Gerät und landet auf einem fremden Server, mit allem, was darauf zu lesen ist.
ByteRivets OCR-Werkzeug erkennt den Text vollständig im Browser, mit derselben Open-Source-Engine (Tesseract), die auch Desktop-Anwendungen nutzen — nur eben clientseitig statt auf einem Server. Das Bild wird nie hochgeladen; die gesamte Texterkennung läuft lokal auf Ihrem Gerät ab.
Was die Genauigkeit beeinflusst
OCR ist nicht bei jedem Bild gleich zuverlässig. Ein paar Faktoren, die einen echten Unterschied machen:
- Auflösung. Ein scharfes, gut beleuchtetes Foto liefert deutlich bessere Ergebnisse als ein unscharfes oder stark komprimiertes.
- Kontrast. Schwarzer Text auf weißem Hintergrund ist der Idealfall; niedriger Kontrast (graue Schrift, bunte Hintergründe) erschwert die Erkennung.
- Ausrichtung. Gerade, nicht gedrehte oder perspektivisch verzerrte Bilder werden zuverlässiger erkannt.
- Schriftart. Gedruckter Text funktioniert zuverlässig, Handschrift deutlich unzuverlässiger — das ist eine grundsätzliche Grenze der Technologie, kein Software-Problem.
Anwendung
Bild oder gescanntes PDF auf der OCR-Seite auswählen, Sprache angeben, und den erkannten Text direkt kopieren oder als Datei herunterladen — ohne dass das Original irgendwo hochgeladen wird.
