OCR PDF

Haz que los PDFs escaneados sean buscables con reconocimiento de texto

La herramienta OCR de pdfty convierte PDF basados en imágenes (escaneos, fotos de documentos) en texto que se puede buscar y copiar. Usamos Tesseract 5 con modelos optimizados para inglés, ruso, francés, alemán y español — incluyendo caracteres cirílicos y acentuados.

Tras el OCR, tu PDF se ve igual visualmente, pero ya puedes copiar texto, buscar y convertir a Word conservando el diseño original. Útil para contratos escaneados, documentos de archivo, pizarras fotografiadas o faxes.

Hasta 50 páginas y 20 MB en el plan gratuito. Pro elimina los límites. Las páginas con varios alfabetos funcionan — el OCR detecta el alfabeto por regiones. Nunca entrenamos modelos con tus datos.

Cómo funciona

  1. 1

    Sube el escaneo

    Suelta un PDF escaneado o de solo imágenes. Hasta 20 MB en el plan gratuito.

  2. 2

    Elige los idiomas

    Selecciona uno o varios entre español, inglés, francés, alemán y ruso.

  3. 3

    Ejecuta el OCR

    Tesseract procesa cada página. Normalmente tarda 1-3 segundos por página.

  4. 4

    Descarga el PDF con búsqueda

    El mismo aspecto, con una capa de texto oculta. Ya puedes copiar, buscar y convertir.

  5. 5

    Listo

    Los archivos se eliminan en 1 hora.

Preguntas frecuentes

En escaneos limpios a 300 DPI, más del 98% para alfabetos latinos y más del 95% para cirílico. Un DPI bajo o escaneos con ruido reducen la precisión.

Herramientas relacionadas

Guías y tutoriales