OCR PDF

اجعل ملفات PDF الممسوحة قابلة للبحث بالتعرف على النص

أداة OCR من pdfty تحوّل ملفات PDF المكوّنة من صور (مسح ضوئي، صور مستندات) إلى نص قابل للبحث والنسخ. نستخدم Tesseract 5 بنماذج محسّنة للإنجليزية والروسية والفرنسية والألمانية والإسبانية — بما في ذلك الحروف السيريلية والحروف ذات العلامات.

بعد OCR يبدو ملفك كما هو بصرياً لكن يمكنك الآن نسخ النص والبحث فيه والتحويل إلى Word مع الحفاظ على التخطيط الأصلي. مفيد للعقود الممسوحة ضوئياً والمستندات المؤرشفة وصور السبورات ومخرجات الفاكس.

حتى 50 صفحة و20 ميغابايت على الخطة المجانية. Pro يرفع الحدود. الصفحات ذات النصوص المختلطة تعمل — يكتشف OCR نوع الكتابة في كل منطقة. لا ندرّب النماذج على بياناتك أبداً.

كيف يعمل

  1. 1

    ارفع المسح الضوئي

    أفلِت ملف PDF ممسوحاً ضوئياً أو مكوّناً من صور. حتى 20 ميغابايت مجاناً.

  2. 2

    اختر اللغات

    اختر لغة أو أكثر من الإنجليزية والروسية والفرنسية والألمانية والإسبانية.

  3. 3

    شغّل OCR

    يعالج Tesseract كل صفحة. عادةً من ثانية إلى 3 ثوانٍ لكل صفحة.

  4. 4

    نزّل ملف PDF القابل للبحث

    نفس المظهر مع طبقة نصية مخفية. الآن يمكنك النسخ والبحث والتحويل.

  5. 5

    تم

    تُحذَف الملفات خلال ساعة واحدة.

الأسئلة الشائعة

على مسح نظيف بدقة 300 نقطة في البوصة: أكثر من 98٪ للحروف اللاتينية وأكثر من 95٪ للسيريلية. الدقة المنخفضة أو المسح المشوّش يقللان الدقة.

أدوات ذات صلة

أدلة ودروس