OCR PDF

Maak gescande PDF's doorzoekbaar met tekstherkenning

De OCR-tool van pdfty maakt van PDF's op basis van afbeeldingen (scans, foto's van documenten) doorzoekbare, kopieerbare tekst. We gebruiken Tesseract 5 met geoptimaliseerde modellen voor Engels, Russisch, Frans, Duits en Spaans — inclusief cyrillische en geaccentueerde tekens.

Na OCR ziet je PDF er visueel hetzelfde uit, maar kun je tekst kopiëren, zoeken en converteren naar Word met behoud van de originele lay-out. Handig voor gescande contracten, archiefstukken, gefotografeerde whiteboards of faxen.

Tot 50 pagina's en 20 MB op het gratis plan. Pro heft de limieten op. Pagina's met gemengde schriften werken — OCR detecteert het schrift per gebied. We trainen nooit modellen op je gegevens.

Hoe het werkt

  1. 1

    Upload de scan

    Sleep een gescande of afbeeldings-PDF hierheen. Tot 20 MB gratis.

  2. 2

    Kies de talen

    Kies er een of meer uit Engels, Russisch, Frans, Duits en Spaans.

  3. 3

    Start OCR

    Tesseract verwerkt elke pagina. Doorgaans 1-3 seconden per pagina.

  4. 4

    Download de doorzoekbare PDF

    Zelfde uiterlijk, met een verborgen tekstlaag. Nu kun je kopiëren, zoeken en converteren.

  5. 5

    Klaar

    Bestanden worden binnen 1 uur verwijderd.

Veelgestelde vragen

Op schone scans van 300 DPI: 98%+ voor Latijns schrift en 95%+ voor cyrillisch. Lagere DPI of ruis in de scan verlaagt de nauwkeurigheid.

Gerelateerde tools

Gidsen & tutorials