guide·pdfty टीम··8 मिनट में पढ़ें

PDF से Excel कैसे बनाएँ — मुफ़्त (टेबलें जो सच में काम करें)

PDF को मुफ़्त में Excel में बदलें और असली लाइनें-कॉलम पाएँ, गड़बड़ नहीं। टेक्स्ट बनाम स्कैन PDF, बैंक स्टेटमेंट, OCR और कन्वर्ज़न के बाद की सफ़ाई के टिप्स।

PDF की टेबलों को मुफ़्त में Excel स्प्रेडशीट में बदलना
लॉक्ड PDF टेबल से असली लाइनों-कॉलमों तक, जिन्हें आप जोड़ सकें

आपके पास PDF में क़ैद एक टेबल है — बैंक स्टेटमेंट, इनवॉइस, प्राइस लिस्ट, 30 पेज की रिपोर्ट का अपेंडिक्स — और उसे दोबारा टाइप करने में घंटा लगेगा और ग़लतियाँ भी घुसेंगी। PDF को मुफ़्त में Excel में बदलने में क़रीब 30 सेकंड लगते हैं और आपको असली लाइनें-कॉलम मिलते हैं, जिन्हें आप सॉर्ट, फ़िल्टर और SUM कर सकते हैं। पेच यह है: टेबलों के लिए PDF सचमुच एक दुश्मन फ़ॉर्मैट है, इसलिए सही तरीक़ा इस पर निर्भर है कि आपके हाथ में किस तरह की PDF है। पूरी तस्वीर यह रही।

PDF टेबलों में इतनी बुरी क्यों है

PDF में टेबल होती ही नहीं। उसमें ऐसे निर्देश होते हैं — 'x=412, y=305 पर 1,240.50 लिखो' — सैकड़ों जमाए हुए टेक्स्ट टुकड़े और कुछ लकीरें। जो लाइनें, कॉलम और सेल आपको दिखते हैं, वे सिर्फ़ आपके दिमाग़ में हैं। फ़ाइल में कॉपी करने लायक कोई टेबल-संरचना नहीं है — इसीलिए PDF व्यूअर में टेबल सिलेक्ट करके Excel में पेस्ट करने पर सब कुछ एक कॉलम में ढेर हो जाता है।

कन्वर्टर को ग्रिड रिवर्स-इंजीनियर करना पड़ता है: y-कोऑर्डिनेट से टुकड़ों को लाइनों में बाँटना, x-पोज़िशन और खिंची लकीरों से कॉलम की सीमाएँ पकड़ना, और सेल दोबारा बनाना। साफ़ टेबलों पर आधुनिक extraction यह अच्छे से कर लेता है — पर यह अनुमान है, कॉपी नहीं, इसलिए आउटपुट को मूल से मिलाकर देखना हमेशा काम का हिस्सा है।

ब्राउज़र में PDF टेबल को Excel में बदलें

1

कन्वर्टर खोलें

किसी भी ब्राउज़र में PDF to Excel पर जाएँ — बिना इंस्टॉल, बिना अकाउंट।

Drop PDF here
2

PDF अपलोड करें

20 MB और 50 पेज तक मुफ़्त — साल भर के मासिक स्टेटमेंट आराम से समा जाते हैं।

Drop PDF here
3

कन्वर्ट करें

टेबलें पहचानी जाती हैं और स्प्रेडशीट सेल के रूप में दोबारा बनती हैं। आम स्टेटमेंट के लिए 10-40 सेकंड।

Compressing…69%~2 seconds remaining
4

.xlsx डाउनलोड करें

Excel, Google Sheets या LibreOffice में खुलती है। फ़ाइलें 1 घंटे बाद हमारे सर्वर से अपने-आप हट जाती हैं।

contract_draft.pdfDownload
5

नंबरों की जाँच करें

जिस कॉलम का टोटल आपको पता है, उसे SUM करके PDF से मिलाएँ। मिल गया, तो extraction भरोसेमंद है।

All done — file readyAuto-deleted in 1 hour

मुफ़्त प्लान में दिन के 10 ऑपरेशन मिलते हैं; स्टेटमेंट थोक में प्रोसेस करते हों तो Pro ($9/mo) सारी लिमिट हटा देता है।

टेक्स्ट PDF बनाम स्कैन PDF — 5 सेकंड की जाँच

आगे का सब कुछ इस पर निर्भर है कि आपके पास कौन-सी है। PDF खोलें और कर्सर से टेक्स्ट सिलेक्ट करके देखें:

  • टेक्स्ट सिलेक्ट होता है → born-digital PDF (सॉफ़्टवेयर से एक्सपोर्ट हुई)। सीधे बदलें; नंबर लगभग परफ़ेक्ट आएँगे।
  • कुछ सिलेक्ट नहीं होता → स्कैन PDF (काग़ज़ की फोटो)। फ़ाइल में अभी सचमुच कोई टेक्स्ट नहीं है — सीधे बदलेंगे तो खाली या कचरा शीट मिलेगी।

स्कैन के लिए — छपकर दोबारा स्कैन हुए बैंक स्टेटमेंट, रसीदें और पुराने रिकॉर्ड ज़्यादातर यही होते हैं — पाइपलाइन यह है:

  1. फ़ाइल को OCR PDF से गुज़ारें, ताकि छपे अक्षर पहचाने जाएँ और असली टेक्स्ट-लेयर जुड़े।
  2. OCR हुई PDF को PDF to Excel में डालें।
  3. टोटल जाँचें। साफ़ प्रिंट पर OCR 95-99% सटीक होता है, और उसकी क्लासिक ग़लतियाँ ठीक वही हैं जो हिसाब-किताब में चुभती हैं: 0↔8, 1↔7, 5↔6। कॉलम के जोड़ को स्टेटमेंट के अपने छपे टोटल से मिलाना लगभग सारी ग़लतियाँ पकड़ लेता है।

कन्वर्ज़न के बाद स्प्रेडशीट की सफ़ाई

अच्छा कन्वर्ज़न भी निशान छोड़ता है। आम मुजरिम और उनके फटाफट फ़िक्स:

समस्याक्या दिखता हैफ़िक्स
Merge हुए सेलकई-लाइन वाले PDF सेल merge ब्लॉक बनते हैं और सॉर्टिंग तोड़ते हैंसब सिलेक्ट → Home → Merge & Center → Unmerge Cells, फिर ख़ाली जगहें भरें
टेक्स्ट बने नंबरबाएँ-अलाइन नंबर, SUM का जवाब 0कॉलम सिलेक्ट → Data → Text to Columns → Finish से दोबारा parse होते हैं
चिपके करेंसी सिंबल'$1,240.50' एक ही टेक्स्ट स्ट्रिंग हैFind & Replace से सिंबल हटाएँ, फिर Currency फ़ॉर्मैट लगाएँ
(123.45) जैसे निगेटिव अमाउंटकोष्ठक टेक्स्ट की तरह पढ़े जाते हैंText to Columns ज़्यादातर locale में इन्हें निगेटिव बना देता है
दोहराए गए पेज-हेडरकॉलम के टाइटल हर 40 लाइनों पर फिर आते हैंकिसी एक कॉलम में हेडर-टेक्स्ट फ़िल्टर करें → दिखी लाइनें हटाएँ
टूटे या खिसके कॉलमएक PDF कॉलम दो बन गया, या लाइनें खिसक गईंआमतौर पर जटिल लेआउट — मूल से मिलाएँ, हाथ से जोड़ें

इनमें से दो याद रखने लायक हैं, क्योंकि वे हर जगह काम आते हैं: Text to Columns (Data टैब) Excel का यूनिवर्सल 'इस कॉलम को ठीक से दोबारा पढ़ो' बटन है, और unmerge करके भरना दिखने-में-सुंदर पर बेकार लेआउट को सॉर्ट होने वाले डेटासेट में बदल देता है।

विकल्प: Excel का अपना 'Get Data from PDF' (Windows)

Windows पर Microsoft 365 है, तो Excel में इम्पोर्टर बना-बनाया है: Data → Get Data → From File → From PDF। वह फ़ाइल में Power Query को मिली हर टेबल की लिस्ट दिखाता है; आप एक चुनते हैं, चाहें तो Power Query एडिटर में साफ़ करते हैं, और शीट पर लोड कर देते हैं।

यह कहाँ चमकता है: बार-बार के इम्पोर्ट। मासिक स्टेटमेंट के लिए query एक बार सेट करें, अगले महीने नई फ़ाइल पर बस Data → Refresh। कहाँ नहीं: यह सिर्फ़ Windows पर है (Mac वर्ज़न इस फ़ीचर में हमेशा पीछे रहा है), स्कैन बिल्कुल नहीं पढ़ सकता — OCR नहीं है — और पेजों में फैली टेबलें उसकी पकड़ से dedicated कन्वर्टरों के मुक़ाबले ज़्यादा छूटती हैं। एक बार के extraction के लिए, या Mac या Chromebook पर, ब्राउज़र टूल छोटा रास्ता है।

10-40 सेकंड
PDF से Excel का आम कन्वर्ज़न समय
20 MB / 50 पेज
pdfty की मुफ़्त लिमिट — बिना साइन-अप, बिना वॉटरमार्क
95-99%
साफ़ छपे स्कैन पर OCR की सटीकता
1 घंटा
फ़ाइलें सर्वर से अपने-आप हटने तक का समय

अक्सर पूछे जाने वाले प्रश्न

क्या PDF to Excel सच में मुफ़्त है?

pdfty पर हाँ — हर फ़ाइल 20 MB और 50 पेज तक मुफ़्त, दिन में 10 ऑपरेशन, बिना साइन-अप, बिना वॉटरमार्क। Pro ($9/mo) लिमिट हटा देता है। दोनों हालत में फ़ाइलें 1 घंटे बाद सर्वर से हट जाती हैं।

मेरी बदली हुई स्प्रेडशीट खाली या कचरा क्यों दिखा रही है?

आपकी PDF लगभग पक्का स्कैन है — बिना टेक्स्ट-लेयर वाली पेज की फोटो। पहले उसे OCR PDF से गुज़ारें, फिर नतीजे को बदलें। अगर PDF में टेक्स्ट सिलेक्ट होता है पर आउटपुट फिर भी गड़बड़ है, तो लेआउट जटिल है — सिर्फ़ टेबल वाले पेजों को बदलकर देखें।

क्या स्कैन किया बैंक स्टेटमेंट Excel में बदल सकता हूँ?

हाँ, दो स्टेप में: पहले OCR PDF, फिर PDF to Excel। फिर जाँचें — हर अमाउंट कॉलम को SUM करके स्टेटमेंट पर छपे टोटल से मिलाएँ।

Excel मेरी बदली हुई PDF के नंबर SUM क्यों नहीं कर रहा?

वे टेक्स्ट की तरह इम्पोर्ट हुए हैं। कॉलम सिलेक्ट करें, फिर Data → Text to Columns → Finish — इससे Excel वैल्यू को नंबर की तरह दोबारा parse करता है। करेंसी सिंबल वैल्यू से चिपके हों तो पहले Find & Replace से हटा दें।

क्या कई पेजों में फैली टेबल एक टेबल बनकर निकलती है?

पेजों में जारी रहने वाली टेबलें पेज-दर-पेज निकलती हैं; हर पेज-ब्रेक पर हेडर लाइन दोहराई दिख सकती है। हेडर-टेक्स्ट को फ़िल्टर करके वे लाइनें हटा दें — 20 सेकंड — और डेटा एक लगातार टेबल में जुड़ जाता है।

क्या मूल स्प्रेडशीट के फ़ॉर्मूले वापस आएँगे?

नहीं। PDF में सिर्फ़ छपी वैल्यू होती हैं — फ़ॉर्मूले उसी पल खो गए थे जब फ़ाइल PDF में एक्सपोर्ट हुई। आपको नंबर मिलते हैं; जो थोड़े फ़ॉर्मूले चाहिए, दोबारा बना लें।

क्या बैंक स्टेटमेंट अपलोड करना सुरक्षित है?

pdfty पर फ़ाइलें HTTPS से ट्रांसफ़र होती हैं, न कभी वॉटरमार्क लगता है न शेयर होती हैं, और 1 घंटे बाद सर्वर से अपने-आप हट जाती हैं। अकाउंट नहीं, तो आपसे जुड़ी कोई संग्रहित हिस्ट्री भी नहीं। जो डॉक्यूमेंट कहीं अपलोड ही नहीं हो सकते, उनके लिए Excel का बिल्ट-इन Get Data From PDF (Windows) सब कुछ लोकल रखता है।

क्या PDF से टेबल सीधे कॉपी-पेस्ट नहीं कर सकता?

कोशिश कर सकते हैं — छोटी, सीधी टेबल पर कभी-कभी चल भी जाता है। पर PDF में असली टेबल-संरचना नहीं होती, इसलिए पेस्ट करने पर सब कुछ आमतौर पर एक कॉलम में गिर जाता है। कुछ लाइनों से बड़ी किसी भी चीज़ के लिए ग्रिड दोबारा बनाने वाला कन्वर्टर आपको हाथ से बाँटने की मेहनत बचा देता है।

pdfty टीम

pdfty टीम प्राइवेसी-फर्स्ट ऑनलाइन PDF टूल बनाती है — कंप्रेस, कन्वर्ट, OCR, साइन और प्रोटेक्ट। फ़ाइलें 1 घंटे में हट जाती हैं। हमारे बारे में →

संबंधित लेख