So funktioniert OCR · Bild/PDF zu Text
OCR wandelt ein gescanntes Bild oder ein bildbasiertes PDF in Text um, den Sie kopieren, durchsuchen und bearbeiten können - mit tesseract.js, das vollständig in Ihrem Browser läuft. Sie wählen die Dokumentsprache aus dem Selektor, das entsprechende Sprachmodell wird einmalig in Ihren Browser heruntergeladen, und alle weiteren Erkennungen laufen offline aus diesem zwischengespeicherten Modell. Ihre gescannten Dateien werden während der Konvertierung nie an einen Server übertragen.
Die Erkennungsgenauigkeit hängt stark von der Scanqualität ab. Saubere, kontrastreiche Scans mit mindestens 200 DPI, minimalem Hintergrundrauschen und gerader Seitenausrichtung liefern die besten Ergebnisse. Unscharfe, niedrig aufgelöste oder stark komprimierte JPEGs, Seiten mit Spalten oder komplexen Layouts sowie handgeschriebener Text verringern die Genauigkeit. Das Werkzeug gibt einen einfachen Textblock aus; für strukturierte Ausgabe wie beibehaltene Tabellen oder mehrspaltige Layouts ist Nachbearbeitung erforderlich. Das Ausführen des PDF-Entzerrungs-Werkzeugs bei schiefen Scans vor der OCR verbessert die Erkennungsrate typischerweise.