PDF रिडैक्ट करें
नाम, नंबर और हर वह चीज़ हटाएं जो पढ़ी नहीं जानी चाहिए — ढककर नहीं, डॉक्यूमेंट से ही डिलीट करके। कुछ भी स्टोर नहीं किया जाता।
- कभी स्टोर नहीं होती
- न कतार, न इंतज़ार
- साइनअप नहीं, वॉटरमार्क नहीं
यह कैसे काम करता है
अपनी PDF जोड़ें
डॉक्यूमेंट यहां छोड़ें। हर पेज इतना बड़ा दिखता है कि आप एक-एक शब्द पर निशाना लगा सकें।
जो हटाना है उस पर ड्रैग करें
टेक्स्ट के हर हिस्से पर एक बॉक्स बनाएं। पहले जैसा करें और साफ़ करें बस एक क्लिक दूर हैं, और सेव करने तक कुछ नहीं बदलता।
रिडैक्ट करें और डाउनलोड करें
ढका हुआ टेक्स्ट फ़ाइल से डिलीट किया जाता है, फिर उसके ऊपर काले बॉक्स बनाए जाते हैं।
काला आयत रिडैक्शन क्यों नहीं है
यही वह ग़लती है जिसने करियर ख़त्म किए हैं और मुक़दमे हरवाए हैं, इसलिए इसे सीधे शब्दों में कहना ज़रूरी है: PDF में टेक्स्ट के ऊपर काला बॉक्स बनाने से कुछ नहीं छिपता। कैरेक्टर आयत के नीचे, पेज की कंटेंट स्ट्रीम में बने रहते हैं, और कोई भी लगभग चार सेकंड में उन्हें सिलेक्ट, कॉपी या किसी मुफ़्त टूल से बाहर निकाल सकता है। रिडैक्शन की हर नाकामी जिसके बारे में आपने पढ़ा है — समझौते की रक़में, गवाहों के नाम, बिना रिडैक्ट किए दाख़िल काग़ज़ात — ऐसा डॉक्यूमेंट था जहां किसी ने एक आकृति बनाई और मान लिया कि काम हो गया।
यहां उल्टे क्रम में काम होता है। आपके आयत के अंदर का टेक्स्ट पहले कंटेंट स्ट्रीम से डिलीट किया जाता है, और बॉक्स बाद में सिर्फ़ यह दिखाने के लिए बनाया जाता है कि वहां कुछ था। रिडैक्ट किया हुआ हिस्सा कॉपी करें तो कुछ नहीं मिलता, क्योंकि वहां कुछ है ही नहीं; पेज का टेक्स्ट निकालें तो शब्द वहां नहीं होते। हटाए गए हिस्सों की गिनती आपको दिखाई जाती है, ताकि जो रिडैक्शन चुपचाप किसी चीज़ से मेल न खाए, वह मान लेने के बजाय साफ़ दिखे।
आर्टवर्क एक अलग समस्या है और उसका जवाब भी अलग है। स्कैन किए गए पेज के अंदर का नाम, या किसी रिपोर्ट में चिपकाए गए स्क्रीनशॉट का नाम, टेक्स्ट होता ही नहीं — वह पिक्सेल है, और टेक्स्ट डिलीट करने से उस पर कोई असर नहीं पड़ता। आर्टवर्क वाला विकल्प चालू करने पर वे पेज रिडैक्शन के साथ नए सिरे से रेंडर होते हैं, ताकि नीचे के पिक्सेल ढके नहीं, सच में मिट जाएं। इसकी क़ीमत असली है और साफ़ बताई जाती है: वे पेज तस्वीर बन जाते हैं, इसलिए उन पर का कोई भी टेक्स्ट सिलेक्ट नहीं हो पाता, और फ़ाइल बड़ी हो जाती है।
PDF नामों को पेज के अलावा और भी जगहों पर रखती है, और बाक़ी जगहों को यहां छुआ नहीं जाता। बुकमार्क की रूपरेखा, फ़ॉर्म फ़ील्ड की वैल्यू, फ़ाइल अटैचमेंट, डॉक्यूमेंट इंफ़ॉर्मेशन, XMP मेटाडेटा पैकेट और ख़ुद फ़ाइल का नाम — सब अलग-अलग भंडार हैं, और इनमें से किसी में भी मौजूद नाम पेज के बेहतरीन रिडैक्शन के बाद भी बचा रहता है। अगर डॉक्यूमेंट इंक्रीमेंटल तरीक़े से सेव हुआ था, तो उसका पुराना वर्शन भी बचा रहता है। रिडैक्ट की हुई फ़ाइल किसी अहम जगह भेजने से पहले डॉक्यूमेंट प्रॉपर्टीज़ खोलकर देखें, और नतीजे को ऐसे रीबिल्ड से गुज़ारें जो वह सब हटा दे जिस तक पेज अब नहीं पहुंचते।
जब आपको कुछ और चाहिए
जब मामला क़ानूनी हो, तो उसी स्तर के लिए बना सॉफ़्टवेयर इस्तेमाल करें। Adobe Acrobat Pro का रिडैक्शन यही पहले-डिलीट-फिर-निशान वाला तरीक़ा अपनाता है और वह चीज़ जोड़ता है जो यह पेज किसी तरह नहीं दे सकता: एक sanitise स्टेप, जो मेटाडेटा, अटैचमेंट, छिपी लेयर, स्क्रिप्ट और पहले सेव किए गए रिविज़न एक ही बार में हटा देता है। कोर्ट में दाख़िल होने वाले काग़ज़ के लिए यह स्टेप ज़रूरी है।
मुफ़्त विकल्प दो कमांड की पाइपलाइन है, और यह सचमुच पूरी तरह काम करती है। qpdf --qdf --object-streams=disable in.pdf out.pdf डॉक्यूमेंट की संरचना को पढ़ने लायक टेक्स्ट के रूप में खोल देता है ताकि आप अपनी आंखों से पक्का कर सकें कि नाम हट गया है, और exiftool -all:all= out.pdf मेटाडेटा साफ़ कर देता है। इनके बाद gs -sDEVICE=pdfwrite -o final.pdf out.pdf फ़ाइल को सिर्फ़ उसी से दोबारा बनाता है जिसे पेज असल में इस्तेमाल करते हैं, और बेकार पड़े ऑब्जेक्ट हटा देता है। जांच करना वह हिस्सा है जिसे लोग छोड़ देते हैं, और वही सबसे ज़रूरी है।
अक्सर पूछे जाने वाले सवाल
क्या यह काला आयत बनाने से अलग है?
पूरी तरह अलग, और यही तो असली बात है। PDF एडिटर में बनाया गया काला आयत कुछ नहीं छिपाता: कैरेक्टर फ़ाइल में बने रहते हैं, और कोई भी उन्हें सिलेक्ट कर सकता है, कॉपी कर सकता है, या मुफ़्त टूल से निकाल सकता है। अख़बारों और सरकारी विभागों की जानकारी ठीक इसी तरह लीक हुई है। यहां पहले टेक्स्ट को पेज की कंटेंट स्ट्रीम से हटाया जाता है, और बॉक्स उसके बाद बनाया जाता है — किसी भी रीडर में काला हिस्सा सिलेक्ट करें, कॉपी करने को कुछ नहीं मिलेगा।
क्या मेरा डॉक्यूमेंट कहीं स्टोर होता है?
नहीं। रिडैक्शन में कुछ भी स्टोर नहीं होता, और यह किसी भी दूसरे टूल से ज़्यादा यहां मायने रखता है: लोग जिन डॉक्यूमेंट को रिडैक्ट करते हैं, वही वे होते हैं जिन्हें वे किसी वेबसाइट को सबसे कम सौंपना चाहते हैं।
बॉक्स के नीचे की फ़ोटो और स्कैन का क्या?
टेक्स्ट कंटेंट स्ट्रीम से डिलीट हो जाता है, पर इमेज के पिक्सेल अलग मामला हैं। “नीचे की आर्टवर्क भी मिटाएं” चालू करें, तो प्रभावित पेज फ़्लैटन की हुई इमेज के रूप में दोबारा बनाए जाते हैं, ताकि बॉक्स के नीचे जो था वह फ़ाइल में रहे ही नहीं। इससे उन पेजों की टेक्स्ट लेयर चली जाती है, इसीलिए यह डिफ़ॉल्ट नहीं, आपकी पसंद है।
क्या मैं जांच सकता हूं कि यह काम कर गया?
हां, और करना भी चाहिए। नतीजा खोलें और रिडैक्ट किया हुआ हिस्सा सिलेक्ट करने की कोशिश करें, या उसे PDF को टेक्स्ट में बदलें से चलाएं — शब्द ग़ायब होने चाहिए। भेजने से पहले रिडैक्शन की जांच करना अच्छी आदत है, टूल चाहे कोई भी इस्तेमाल किया हो।
क्या यह मेटाडेटा भी हटाता है?
अभी नहीं। लेखक के नाम और टाइटल पेज में नहीं, डॉक्यूमेंट इंफ़ॉर्मेशन में रहते हैं। कुछ भी संवेदनशील पब्लिश करने से पहले उन्हें अलग से जांच लें।
ध्यान दें: टेक्स्ट पेज के कंटेंट से हटाया जाता है; अगर कोई नाम बुकमार्क, फ़ॉर्म फ़ील्ड, अटैचमेंट या डॉक्यूमेंट मेटाडेटा में भी है, तो वे अलग जगहें हैं और उन्हें छुआ नहीं जाता। स्कैन की हुई इमेज के अंदर का टेक्स्ट रिडैक्ट करने के लिए आर्टवर्क वाला विकल्प चाहिए, जो उन पेजों को फ़्लैटन करता है और उनकी टेक्स्ट लेयर हटा देता है।
यह टूल अपनी वेबसाइट पर लगाएं
किसी भी ब्लॉग, क्लास पेज या हेल्प आर्टिकल के लिए मुफ़्त। एक स्निपेट पेस्ट करें और आपके विज़िटर इसे सीधे आपके पेज पर इस्तेमाल कर सकेंगे।
और PDF टूल्स
PDF पर पासवर्ड लगाएं
पासवर्ड से एन्क्रिप्ट करें, AES-256
PDF फ़्लैटन करें
फ़ॉर्म फ़ील्ड और कमेंट को स्थायी बनाएं
PDF एडिट करें
मौजूदा टेक्स्ट बदलें, जोड़ें, ड्रॉ करें और साइन करें
PDF रिपेयर करें
न खुलने वाली फ़ाइल को वापस पाएं
PDF OCR करें
स्कैन को सर्च करने लायक बनाएं
PDF को प्रिंट के लिए तैयार करें
एक जैसा साइज़, ब्लीड और क्रॉप मार्क