OCR PDF

Taranmış PDF'leri metin tanıma ile aranabilir yapın

pdfty'nin OCR aracı, görüntü tabanlı PDF'leri (taramalar, belge fotoğrafları) aranabilir ve kopyalanabilir metne dönüştürür. İngilizce, Rusça, Fransızca, Almanca ve İspanyolca için optimize edilmiş modellerle Tesseract 5 kullanıyoruz — Kiril ve aksanlı karakterler dahil.

OCR'dan sonra PDF'iniz görsel olarak aynı görünür, ancak artık metni kopyalayabilir, arama yapabilir ve orijinal düzen korunarak Word'e dönüştürebilirsiniz. Taranmış sözleşmeler, arşiv belgeleri, fotoğraflanmış tahtalar veya faks çıktıları için kullanışlıdır.

Ücretsiz planda 50 sayfa ve 20 MB'a kadar. Pro limitleri kaldırır. Karışık alfabeli sayfalar çalışır — OCR alfabeyi bölge bölge algılar. Verilerinizle asla model eğitmeyiz.

Nasıl çalışır

  1. 1

    Taramayı yükleyin

    Taranmış veya yalnızca görüntü içeren bir PDF bırakın. Ücretsiz planda 20 MB'a kadar.

  2. 2

    Dilleri seçin

    İngilizce, Rusça, Fransızca, Almanca, İspanyolca arasından bir veya birkaçını seçin.

  3. 3

    OCR'ı çalıştırın

    Tesseract her sayfayı işler. Genellikle sayfa başına 1-3 saniye sürer.

  4. 4

    Aranabilir PDF'i indirin

    Aynı görünüm, artı gizli bir metin katmanı. Artık kopyalayabilir, arayabilir, dönüştürebilirsiniz.

  5. 5

    Bitti

    Dosyalar 1 saat içinde silinir.

Sık sorulan sorular

Temiz 300 DPI taramalarda Latin alfabesi için %98+, Kiril için %95+. Düşük DPI veya gürültülü taramalar doğruluğu düşürür.

İlgili araçlar

Rehberler ve eğitimler