OCR PDF

Gescannte PDFs mit Texterkennung durchsuchbar machen

Das OCR-Tool von pdfty macht aus bildbasierten PDFs (Scans, abfotografierte Dokumente) durchsuchbaren, kopierbaren Text. Wir verwenden Tesseract 5 mit optimierten Modellen für Deutsch, Englisch, Russisch, Französisch und Spanisch — inklusive Umlauten, Akzenten und Kyrillisch.

Nach dem OCR sieht Ihr PDF unverändert aus, aber Sie können jetzt Text kopieren, darin suchen und es mit erhaltenem Layout in Word umwandeln. Nützlich für gescannte Verträge, Archivdokumente, abfotografierte Whiteboards oder Faxe.

Bis zu 50 Seiten und 20 MB kostenlos. Pro hebt die Limits auf. Seiten mit gemischten Schriften funktionieren — OCR erkennt die Schrift pro Bereich. Wir trainieren niemals Modelle mit Ihren Daten.

So funktioniert's

  1. 1

    Scan hochladen

    Ein gescanntes oder rein bildbasiertes PDF ablegen. Bis 20 MB kostenlos.

  2. 2

    Sprachen wählen

    Eine oder mehrere aus Deutsch, Englisch, Russisch, Französisch, Spanisch auswählen.

  3. 3

    OCR starten

    Tesseract verarbeitet jede Seite. Typischerweise 1–3 Sekunden pro Seite.

  4. 4

    Durchsuchbares PDF herunterladen

    Gleiches Aussehen, mit unsichtbarer Textebene. Jetzt können Sie kopieren, suchen, konvertieren.

  5. 5

    Fertig

    Dateien werden innerhalb von 1 Stunde gelöscht.

Häufige Fragen

Bei sauberen 300-DPI-Scans über 98 % für lateinische Schriften und über 95 % für Kyrillisch. Niedrigere Auflösung oder verrauschte Scans senken die Genauigkeit.

Ähnliche Tools

Anleitungen & Tutorials