guide·pdfty टीम··7 मिनट में पढ़ें

PDF से Metadata कैसे हटाएँ (Author, सॉफ़्टवेयर, तारीख़ें)

शेयर करने से पहले PDF का छिपा metadata हटाइए — author के नाम, सॉफ़्टवेयर के निशान, timestamps। फ्री और तेज़, साथ में यह भी कि metadata हटाना क्या नहीं कर सकता।

PDF दस्तावेज़ से छिपे नाम-टैग और timestamps हटाए जाते हुए
जो डेटा दिखता नहीं, वह भी डेटा है

किसी भी PDF की properties खोलिए (ज़्यादातर व्यूअर में File → Properties) और देखिए वह आपके बारे में क्या कहती है। Word से एक्सपोर्ट हुआ रिज़्यूमे अक्सर उस लैपटॉप के अकाउंट का नाम बता देता है जिस पर वह बना। कॉन्ट्रैक्ट आख़िरी एडिट का ठीक-ठीक मिनट खोल देता है — अटपटा, अगर आपने दावा किया था कि वह "पिछले हफ़्ते तैयार था"। टेंडर दस्तावेज़ के Author फ़ील्ड में कंसल्टेंट की फ़र्म दिखती है। "स्कैन की हुई" चिट्ठी अपने Producer फ़ील्ड से राज़ खोल देती है कि उसने स्कैनर कभी देखा ही नहीं।

इसमें से कुछ भी पेज पर नहीं दिखता — और लीक ठीक इसीलिए होता है: लोग पेज देखते हैं और send दबा देते हैं। यहाँ बताया है इसे ठीक से कैसे हटाएँ, और — उतना ही ज़रूरी — metadata हटाना आपको किससे नहीं बचाता।

अंदर छिपा क्या है

फ़ील्डआम मानक्यों काट सकता है
Authorअसली नाम या Windows/Mac loginउस इंसान की पहचान खोलता है जिसे आप बाहर रखना चाहते थे
Creator / Producerइस्तेमाल हुआ सॉफ़्टवेयर, वर्ज़न समेतआपकी toolchain खोलता है — या यह कि 'स्कैन' generate हुआ था
Created / Modified datesसटीक timestampsबातचीत या फ़ाइलिंग में बताई समय-रेखा से टकराता है
Title / Subject / Keywordsअक्सर किसी पुराने ड्राफ़्ट का नाम'contract_v7_FINAL_lawyer_edits' आपकी चाहत से ज़्यादा कह देता है
XMP metadataऊपर का सब दोहराता XML ब्लॉकउन फ़ाइलों में बचा रहता है जहाँ सिर्फ़ दिखते फ़ील्ड खाली किए गए

आख़िरी पंक्ति पर ज़ोर ज़रूरी है। PDF metadata दो जगह रखती है: document info dictionary (जो व्यूअर "properties" दिखाते हैं) और एम्बेडेड XMP packet। ढेरों लोग एडिटर में दिखते फ़ील्ड खाली कर ऐसी फ़ाइल भेज देते हैं जिसका XMP अब भी उनका नाम लिए बैठा है। ठीक सफ़ाई दोनों हटाती है — pdfty का टूल यही करता है।

PDF metadata कैसे हटाएँ — स्टेप बाय स्टेप

1

टूल खोलिए

pdfty.com/tools/remove-metadata पर जाइए। 20 MB और 50 पेज तक फ्री, दिन में 10 ऑपरेशन, कोई अकाउंट नहीं चाहिए।

Drop PDF here
2

PDF अपलोड कीजिए

जो फ़ाइल शेयर करने वाले हैं वह डालिए — रिज़्यूमे, कॉन्ट्रैक्ट, रिपोर्ट।

Drop PDF here
3

Metadata हटाइए

Info dictionary और XMP packet दोनों एक पास में हट जाते हैं। कुछ सेकंड लगते हैं।

Compressing…69%~2 seconds remaining
4

साफ़ फ़ाइल डाउनलोड कीजिए

पेज, टेक्स्ट और इमेज अनछुए हैं — गए सिर्फ़ छिपे गुण। फ़ाइलें 1 घंटे बाद हमारे सर्वर से डिलीट हो जाती हैं।

contract_draft.pdfDownload
5

तसदीक़ कीजिए

नतीजा खोलकर File → Properties देखिए: Author, Creator, Producer और तारीख़ें अब खाली होनी चाहिए। भरोसा कीजिए, पर जाँचकर।

All done — file readyAuto-deleted in 1 hour
🔒 pdfty.com/en/tools/remove-metadata
pdfty का Remove metadata टूल
अपलोड, Info dictionary और XMP हटाइए, डाउनलोड — पेज ख़ुद अनछुए रहते हैं।

Metadata हटाना क्या नहीं करता

यह टूल से भी ज़्यादा मायने रखता है, इसलिए साफ़-साफ़:

  • यह दिखते कंटेंट को नहीं छूता। लेटरहेड में टाइप हुआ नाम, फ़ुटर का ईमेल पता, हस्ताक्षर की इमेज — सब वहीं हैं, क्योंकि वे पेज हैं, उसके गुण नहीं। दिखती जानकारी को स्थायी रूप से काला करने के लिए Redact इस्तेमाल कीजिए।
  • यह comments और annotations नहीं हटाता। Sticky notes और markup अपने author नाम ख़ुद ढो सकते हैं। Flatten annotations को पेज में मिला देता है (स्थायी पर नाम-रहित दिखने वाला) — flatten दिखावट के लिए है, redaction हटाने के लिए।
  • यह फ़ाइल के अंदर की फ़ाइलें साफ़ नहीं करता। PDF में एम्बेडेड अटैचमेंट अपना metadata रखते हैं।
  • यह भेजने के तरीक़े को anonymous नहीं बनाता। आपका फ़ाइलनेम ("JSmith_counteroffer.pdf"), ईमेल अकाउंट और अपलोड timestamps PDF के बाहर रहते हैं।

फ्री लोकल विकल्प

  • ExifTool (फ्री, सब प्लैटफ़ॉर्म) क्लासिक है: exiftool -all:all= cleaned.pdf। एक जानने लायक़ चेतावनी: PDF पर ExifTool का डिफ़ॉल्ट एडिट पलटा जा सकता है — पुराने मान फ़ाइल में तब तक रहते हैं जब तक आप exiftool -PDF:all= ... के साथ linearize करती री-सेव भी न चलाएँ या उसके दर्ज क़दम न अपनाएँ। बारीक़ी से ग़लत होना आसान है।
  • qpdf / pikepdf (फ्री, ओपन सोर्स): pikepdf की छोटी Python स्क्रिप्ट docinfo साफ़ कर XMP हटा सकती है — pdfty सर्वर पर ठीक यही चलाता है।
  • LibreOffice: मूल स्रोत दस्तावेज़ से "apply user data" हटाकर ताज़ी PDF एक्सपोर्ट करना साफ़ फ़ाइल देता है — तभी चलता है जब स्रोत अब भी आपके पास हो, मिली हुई PDF पर नहीं।
  • macOS Preview में metadata एडिटर है ही नहीं — Preview से एक्सपोर्ट Producer बदल देता है पर author डेटा भरोसे से खाली नहीं करता। उस पर मत टिकिए।

व्यावहारिक पेच

  • हर अगले एडिट के बाद जाँचिए। PDF को दोबारा सेव करने वाला कोई भी टूल उसमें अपना Producer और ताज़े timestamps ठोक सकता है। metadata हटाना शेयर करने से पहले का आख़िरी क़दम रखिए।
  • डिजिटली sign की हुई PDF: metadata हटाना फ़ाइल दोबारा लिखता है और cryptographic हस्ताक्षर अमान्य कर देगा। पहले साफ़ कीजिए, आख़िर में sign।
  • स्कैन किए दस्तावेज़ के Producer में आमतौर पर स्कैनर/फ़ोन सॉफ़्टवेयर के निशान होते हैं — हटाने लायक़, पर याद रखिए स्कैन की इमेज किसी भी metadata से ज़्यादा दिखा सकती है (लेटरहेड, हस्तलेख, परछाइयाँ)।
  • Hyperlinks अपने target रखते हैं। लिंक का दिखता टेक्स्ट साफ़ लग सकता है जबकि वह किसी अंदरूनी SharePoint path की ओर इशारा करता हो। Metadata हटाना लिंक दोबारा नहीं लिखता।

अक्सर पूछे जाने वाले प्रश्न

pdfty ठीक-ठीक क्या हटाता है?

Document information dictionary (Author, Title, Subject, Keywords, Creator, Producer, बनाने/बदलने की तारीख़ें) और एम्बेडेड XMP metadata packet। दोनों भंडार, एक पास।

क्या PDF के दिखने में फ़र्क़ आता है?

नहीं। पेज, फ़ॉन्ट, इमेज, लिंक और फ़ॉर्म फ़ील्ड अनछुए हैं — साफ़ होते हैं सिर्फ़ छिपे गुण। फ़ाइल साइज़ लगभग वही रहता है।

पेज पर लिखा मेरा नाम भी हटेगा?

नहीं, और यही सबसे अहम सीमा है: पेज का टेक्स्ट कंटेंट है, metadata नहीं। दिखते टेक्स्ट को स्थायी रूप से हटाने के लिए Redact इस्तेमाल कीजिए — एडिटर में काला आयत खींचना काफ़ी नहीं, नीचे टेक्स्ट चुनने लायक़ बचा रहता है।

क्या comments और sticky notes भी साफ़ होते हैं?

उनके author फ़ील्ड annotations में रहते हैं, जिन्हें यह टूल छोड़ देता है। फ़ाइल में markup है, तो पहले उसे flatten कीजिए या व्यूअर में comments मिटाइए, फिर metadata हटाइए।

हटाने के बाद कोई metadata वापस निकाल सकता है?

pdfty की दी फ़ाइल से नहीं — entries हटाई जाती हैं, खाली नहीं की जातीं। पर फ़ाइल की हर पहले वाली कॉपी (ईमेल अटैचमेंट, साझा ड्राइव, version history) अपना metadata रखती है। ताज़ी कॉपी साफ़ करना पुरानी वापस नहीं बुलाता।

क्या मेरी फ़ाइल अपलोड करना सुरक्षित है?

फ़ाइलें अपने आप प्रोसेस होती हैं, कोई इंसान उन्हें नहीं पढ़ता, और 1 घंटे बाद स्टोरेज से डिलीट हो जाती हैं। बिना साइन-अप, बिना वॉटरमार्क। फ्री टियर दिन में 10 ऑपरेशन, 20 MB और 50 पेज तक देता है; Pro ($9/माह) लिमिट हटा देता है।

क्या हर भेजी जाने वाली PDF से metadata हटाऊँ?

किसी भी संवेदनशील चीज़ के सार्वजनिक या बाहरी शेयर के लिए — एजेंसियों से गुज़रते रिज़्यूमे, कॉन्ट्रैक्ट, अंदरूनी authors वाली रिपोर्टें — यह सस्ती आदत है जिसका फ़ायदा असली है। आम अंदरूनी फ़ाइलों में Author फ़ील्ड शायद ही राज़ हो।

PDF में अभी कौन सा metadata है, कैसे देखूँ?

किसी भी व्यूअर में खोलकर File → Properties (या Document Properties) देखिए। XMP समेत गहरी झलक के लिए exiftool file.pdf सब कुछ सूचीबद्ध करता है। अपनी एक्सपोर्ट की फ़ाइलों पर एक बार कर देखिए — आमतौर पर आँखें खोल देता है।

pdfty टीम

pdfty टीम प्राइवेसी-फर्स्ट ऑनलाइन PDF टूल बनाती है — कंप्रेस, कन्वर्ट, OCR, साइन और प्रोटेक्ट। फ़ाइलें 1 घंटे में हट जाती हैं। हमारे बारे में →

संबंधित लेख