PDF OCR – Text in gescannten PDFs erkennen

Füge deinem Scan eine unsichtbare Textebene hinzu, damit du Text suchen, markieren und kopieren kannst – direkt in deinem Browser.

  • Kein Upload – Dateien bleiben auf deinem Gerät
  • Keine Limits bei Größe oder Anzahl
  • Keine Anmeldung nötig
  • Kein Wasserzeichen

So funktioniert PDF OCR

  1. 1Ziehe dein gescanntes PDF in das Feld oder wähle es per Klick aus.
  2. 2Wähle die Sprache des Dokuments (z. B. Deutsch oder Englisch).
  3. 3Klicke auf „Text erkennen“ und warte, bis alle Seiten verarbeitet sind.
  4. 4Das durchsuchbare PDF wird automatisch heruntergeladen.

Warum pdfdots?

Maximale Privatsphäre

Alle Dateien werden lokal in deinem Browser verarbeitet. Nichts wird auf einen Server hochgeladen – ideal für Verträge, Zeugnisse und Rechnungen.

Schnell ohne Warten

Da kein Upload und kein Download vom Server nötig ist, bekommst du dein Ergebnis in Sekunden – auch bei großen Dateien.

Keine Limits

Keine Tageslimits, keine Größenbeschränkung, kein Premium-Abo. Verarbeite so viele PDFs, wie du möchtest.

Funktioniert überall

Windows, Mac, Linux, iPhone oder Android: Du brauchst nur einen aktuellen Browser – keine Installation, keine Anmeldung.

Gescannte PDFs durchsuchbar machen: so funktioniert OCR

Ein eingescanntes Dokument ist für den Computer nur ein Bild: Du kannst darin nicht nach Wörtern suchen, keinen Text markieren und nichts kopieren. OCR (optische Zeichenerkennung) löst dieses Problem. Das Tool erkennt die Buchstaben auf jeder Seite und legt eine unsichtbare Textebene über das Bild. Optisch bleibt die Seite gleich, aber du kannst danach mit Strg+F suchen, Passagen kopieren und das PDF in Dokumentenarchiven oder Cloud-Speichern per Volltextsuche wiederfinden.

Die Texterkennung läuft vollständig in deinem Browser mit der Open-Source-Engine Tesseract. Deine Datei wird nicht hochgeladen. Nur das Sprachmodell für die gewählte Sprache (etwa 10 bis 20 MB) wird beim ersten Mal heruntergeladen und danach wiederverwendet. Zur Auswahl stehen Deutsch, Englisch, Türkisch, Spanisch, Portugiesisch und Französisch. Wähle immer die Sprache, in der das Dokument geschrieben ist – Umlaute und ß werden sonst schlechter erkannt.

Ein paar ehrliche Hinweise: Die Genauigkeit hängt stark von der Scanqualität ab. Gerade ausgerichtete, kontrastreiche Scans mit mindestens 300 DPI liefern die besten Ergebnisse, schiefe Handyfotos oder blasse Kopien deutlich schlechtere. Handschrift wird nicht zuverlässig erkannt. Die Seiten werden mit etwa 200 DPI neu gerendert, deshalb kann das Ergebnis größer sein als das Original – bei Bedarf hilft danach „PDF verkleinern“. Und weil dein Gerät die ganze Arbeit leistet, dauert jede Seite einige Sekunden; bei langen Dokumenten solltest du etwas Geduld mitbringen.

Unsere Einschätzung

Wir nutzen OCR, wenn ein eingescannter Vertrag oder eine alte Rechnung durchsuchbar werden soll, damit wir später per Suchfunktion nach einer Kundennummer oder einem Datum suchen können.

Entscheidend ist die richtige Sprache des Dokuments: Für deutsche Texte stellen wir Deutsch ein, damit Umlaute und ß korrekt erkannt werden. Das Sprachmodell wird einmalig geladen, danach läuft die Erkennung komplett in deinem Browser, ohne Upload.

Unsere Erfahrung: Schiefe, dunkle oder unscharfe Handyfotos liefern holprige Ergebnisse, und Handschrift wird kaum erkannt. Scanne lieber gerade und mit 300 DPI. Brauchst du den Text anschließend bearbeitbar, geht es danach mit „PDF in Word“ weiter.

Ähnliche Tools

Häufige Fragen

Wird mein PDF hochgeladen?+

Nein. Die Texterkennung läuft komplett in deinem Browser. Nur das Sprachmodell wird einmalig heruntergeladen.

Welche Sprachen werden unterstützt?+

Deutsch, Englisch, Türkisch, Spanisch, Portugiesisch und Französisch.

Wie genau ist die Texterkennung?+

Das hängt von der Scanqualität ab. Saubere, gerade Scans werden sehr gut erkannt, unscharfe Fotos oder blasse Kopien schlechter.

Kann das Tool Handschrift erkennen?+

Nicht zuverlässig. Tesseract ist für gedruckten Text optimiert.

Warum ist das Ergebnis größer als das Original?+

Die Seiten werden mit etwa 200 DPI neu gerendert. Mit „PDF verkleinern“ kannst du die Datei danach komprimieren.

Warum dauert es so lange?+

Die Erkennung läuft auf deinem Gerät und braucht einige Sekunden pro Seite. Bei langen Dokumenten summiert sich das.