Browser-OCR

Bild-zu-Text-OCR

Extrahieren Sie Text aus Fotos, Screenshots und gescannten Dokumenten direkt im Browser. Kostenlos, unbegrenzt und vollständig privat — Ihre Bilder verlassen Ihr Gerät nie.

Bilder hier ablegen

JPG, PNG, WebP, BMP, HEIC bis zu 100 MB pro Datei

Ihre Bilder werden lokal verarbeitet und verlassen diesen Browser nicht.

Fügen Sie oben ein oder mehrere Bilder hinzu, um zu starten. Wählen Sie zuerst die Sprache für die genauesten Ergebnisse.

Bild-zu-Text-OCR — Häufig gestellte Fragen

Werden meine Bilder auf einen Server hochgeladen?

Nein. Die gesamte OCR-Verarbeitung läuft im Browser über WebAssembly. Die einzige Netzwerkanfrage ist ein einmaliger Download der OCR-Engine und des gewählten Sprachmodells — beides wird von FormatFuse bereitgestellt und anschließend von Ihrem Browser zwischengespeichert. Sie können das im Netzwerk-Tab Ihres Browsers prüfen: Nach dem ersten Laden erzeugt die OCR-Auswertung eines neuen Bildes keinen ausgehenden Datenverkehr.

Kann das Werkzeug Handschrift lesen?

Nicht zuverlässig. Tesseract ist auf Druckschrift trainiert — gut geformte, einzelne Druckbuchstaben funktionieren manchmal, doch Schreibschrift, hastig hingeworfene Notizen oder stilisierte Handschrift liefern schwache Ergebnisse. Für handgeschriebene Inhalte erzielen spezialisierte Modelle deutlich bessere Resultate als generisches OCR. Behandeln Sie jede Handschrift-Ausgabe als Entwurf, der manuell korrigiert werden muss.

Welche Bildqualität brauche ich für gute Ergebnisse?

Streben Sie 300 dpi oder mehr an, mit scharfer Schärfe, gleichmäßigem Licht und gutem Kontrast zwischen Text und Hintergrund. Vermeiden Sie schräge Winkel, Schatten, Spiegelungen und aggressive JPG-Kompression. Wenn der Text nur einen kleinen Teil des Bildes einnimmt, schneiden Sie vor dem Hochladen auf den Textbereich zu. Screenshots und gescannte Dokumente liefern in der Regel bessere Ergebnisse als Handyfotos eines Dokuments.

Welche Sprachen funktionieren am besten?

Englisch liefert die beständigsten Ergebnisse, weil es das größte Trainingskorpus hat. Andere Sprachen mit lateinischer Schrift (Spanisch, Französisch, Deutsch) sind ebenfalls solide. Chinesisch, Japanisch, Hindi und Arabisch funktionieren mit klar gedrucktem Text gut, reagieren aber empfindlicher auf Auflösung und Bildrauschen. Wenn Ihr Dokument Sprachen mischt, wählen Sie die häufigere — mehrsprachiges OCR in einem einzigen Durchgang ist in diesem Werkzeug nicht vorgesehen.

Warum ist der erste Lauf langsam?

Beim ersten OCR-Lauf in einer Sprache lädt Ihr Browser die Tesseract-Engine (etwa 3 MB) und die sprachspezifischen Trainingsdaten (je nach Sprache 2 bis 15 MB). Dieser Download fällt einmal pro Sprache an, wird vom Browser zwischengespeichert und sorgt dafür, dass jeder weitere Lauf sofort startet. Der Wechsel zu einer neuen Sprache löst einen weiteren Download für deren Daten aus, die anschließend ebenfalls im Cache liegen.

Welche Bildformate kann ich verwenden?

JPG, PNG, WebP, BMP und HEIC werden unterstützt. iPhone-HEIC-Dateien werden vor der OCR-Auswertung im Browser dekodiert. Für gescannte PDFs wandeln Sie die Seiten zunächst mit unseren Werkzeugen PDF zu JPG oder PDF zu PNG in Bilder um und führen dann das OCR über die Bilder aus.