OCR PDF

Spraw, by zeskanowane pliki PDF były przeszukiwalne dzięki rozpoznawaniu tekstu

Narzędzie OCR od pdfty zamienia PDF-y obrazkowe (skany, zdjęcia dokumentów) w przeszukiwalny tekst, który można kopiować. Używamy Tesseract 5 ze zoptymalizowanymi modelami dla angielskiego, rosyjskiego, francuskiego, niemieckiego i hiszpańskiego — łącznie z cyrylicą i znakami diakrytycznymi.

Po OCR twój PDF wygląda tak samo, ale możesz już kopiować tekst, przeszukiwać go i konwertować na Word z zachowaniem oryginalnego układu. Przydatne przy zeskanowanych umowach, dokumentach archiwalnych, sfotografowanych tablicach czy faksach.

Do 50 stron i 20 MB za darmo. Pro znosi limity. Strony z mieszanymi pismami działają — OCR wykrywa pismo dla każdego obszaru. Nigdy nie trenujemy modeli na twoich danych.

Jak to działa

  1. 1

    Prześlij skan

    Upuść zeskanowany lub obrazkowy PDF. Do 20 MB za darmo.

  2. 2

    Wybierz języki

    Wybierz jeden lub więcej z: angielski, rosyjski, francuski, niemiecki, hiszpański.

  3. 3

    Uruchom OCR

    Tesseract przetwarza każdą stronę. Zwykle 1–3 sekundy na stronę.

  4. 4

    Pobierz przeszukiwalny PDF

    Ten sam wygląd, plus ukryta warstwa tekstowa. Teraz możesz kopiować, wyszukiwać, konwertować.

  5. 5

    Gotowe

    Pliki są usuwane w ciągu 1 godziny.

Częste pytania

Na czystych skanach 300 DPI: ponad 98% dla alfabetu łacińskiego i ponad 95% dla cyrylicy. Niższe DPI lub zaszumione skany obniżają dokładność.

Powiązane narzędzia

Poradniki i instrukcje