OCR PDF

स्कैन की गई PDF को टेक्स्ट पहचान से खोजने योग्य बनाएं

pdfty का OCR टूल इमेज-आधारित PDF (स्कैन, डॉक्यूमेंट की फोटो) को सर्च और कॉपी करने लायक टेक्स्ट वाली PDF बना देता है। हम Tesseract 5 इस्तेमाल करते हैं, जिसमें अंग्रेज़ी, रूसी, फ़्रेंच, जर्मन और स्पैनिश के लिए ऑप्टिमाइज़्ड मॉडल हैं — सिरिलिक और एक्सेंट वाले अक्षरों समेत।

OCR के बाद PDF देखने में वैसी ही रहती है, पर अब आप टेक्स्ट कॉपी कर सकते हैं, सर्च कर सकते हैं और मूल लेआउट बनाए रखते हुए Word में बदल सकते हैं। स्कैन किए कॉन्ट्रैक्ट, आर्काइव डॉक्यूमेंट, व्हाइटबोर्ड की फोटो या फ़ैक्स के लिए उपयोगी।

मुफ़्त में 50 पेज और 20 MB तक। Pro लिमिट हटा देता है। मिश्रित स्क्रिप्ट वाले पेज भी चलते हैं — OCR हर क्षेत्र की स्क्रिप्ट खुद पहचानता है। हम आपके डेटा पर कभी मॉडल ट्रेन नहीं करते।

यह कैसे काम करता है

  1. 1

    स्कैन अपलोड करें

    स्कैन की हुई या सिर्फ़ इमेज वाली PDF डालें। मुफ़्त में 20 MB तक।

  2. 2

    भाषाएँ चुनें

    अंग्रेज़ी, रूसी, फ़्रेंच, जर्मन, स्पैनिश में से एक या ज़्यादा चुनें।

  3. 3

    OCR चलाएँ

    Tesseract हर पेज को प्रोसेस करता है। आमतौर पर प्रति पेज 1-3 सेकंड।

  4. 4

    सर्च करने लायक PDF डाउनलोड करें

    दिखने में वही, पर अंदर छिपी टेक्स्ट-लेयर के साथ। अब कॉपी, सर्च, कन्वर्ट — सब हो सकता है।

  5. 5

    हो गया

    फ़ाइलें 1 घंटे के भीतर हट जाती हैं।

अक्सर पूछे जाने वाले प्रश्न

साफ़ 300 DPI स्कैन पर लैटिन स्क्रिप्ट के लिए 98%+ और सिरिलिक के लिए 95%+। कम DPI या शोर वाले स्कैन में सटीकता घटती है।

संबंधित टूल

गाइड और ट्यूटोरियल