ट्यूटोरियल
PDF को इस तरह रिडैक्ट करें कि टेक्स्ट असल में गायब हो जाए
PDF एडिटर में किसी नाम या अकाउंट नंबर पर काला रेक्टेंगल बनाना अक्सर सिर्फ़ पेज के ऊपर एक शेप जोड़ता है: वह शेप हटाए जाने या नज़रअंदाज़ होने पर मूल टेक्स्ट अब भी सिलेक्ट, कॉपी या किसी दूसरे रीडर में खोजा जा सकता है। असली रिडैक्शन का मतलब है कि संवेदनशील टेक्स्ट अब दस्तावेज़ का हिस्सा ही नहीं रहता। यह गाइड पेज को एक तस्वीर में बदलती है और सीधे पिक्सल में संवेदनशील एरिया काला करती है, फिर रिडैक्ट की गई इमेज से एक PDF दोबारा बनाती है, तीन टूल जोड़कर जो हर एक आपके ब्राउज़र में चलता है।
चरण दर चरण
- PDF to image टूल खोलें और अपना दस्तावेज़ कन्वर्ट करें। JPEG की बजाय PNG चुनें ताकि काला बॉक्स कंप्रेशन आर्टिफ़ैक्ट्स की बजाय साफ़, ठोस किनारों के साथ आए, और 300 DPI चुनें ताकि पेज के बाकी हिस्से पढ़ने लायक रहें। हर पेज अलग इमेज फ़ाइल के रूप में डाउनलोड होता है।
- जिस भी पेज में कुछ छिपाना है, उस इमेज को Image Redact टूल में खोलें, संवेदनशील टेक्स्ट पर रेक्टेंगल बनाएं, और मोड को Black box सेट करें। रिडैक्ट की गई इमेज डाउनलोड करें। जिस भी पेज को इसकी ज़रूरत हो, उसके लिए दोहराएं; जिस पेज में कुछ रिडैक्ट नहीं करना, उसे स्टेप 1 से आए रूप में ही इस्तेमाल किया जा सकता है।
- हर पेज इमेज, रिडैक्ट की हुई और बिना छुई, उनके मूल क्रम में Images to PDF टूल में ड्रॉप करें। टूल हर पेज पर एक इमेज रखता है और एक ही PDF दोबारा बनाता है।
- दोबारा बनाई गई PDF कन्वर्ट करें और डाउनलोड करें। इसे खोलें और रिडैक्ट किए गए पेजों पर पहले दिखने वाला टेक्स्ट सिलेक्ट या सर्च करके देखें: कुछ भी सिलेक्ट करने को नहीं मिलेगा, क्योंकि अब पेज एक तस्वीर है, टेक्स्ट नहीं।
PDF एडिटर में काला रेक्टेंगल अक्सर काफ़ी क्यों नहीं होता
कई PDF एडिटर एक पैराग्राफ़ पर ओपेक शेप बनाने देते हैं और उसे रिडैक्ट बता देते हैं, लेकिन वह शेप आमतौर पर पेज कंटेंट के ऊपर बैठा एक अलग ऑब्जेक्ट होता है, टेक्स्ट में कोई बदलाव नहीं। मूल कैरेक्टर अभी भी नीचे मौजूद हो सकते हैं: एरिया सिलेक्ट करना, Select All चलाना, फ़ाइल किसी दूसरे व्यूअर में खोलना, या एनोटेशन हटाना छिपा हुआ टेक्स्ट वापस ला सकता है। चूंकि सामान्य यूज़र के पास यह जांचने का भरोसेमंद तरीका नहीं है कि कोई एडिटर असल में अंडरलाइंग टेक्स्ट डिलीट करता है या सिर्फ़ उसके ऊपर पेंट करता है, इसलिए ज़्यादा सुरक्षित तरीका है कि काला बॉक्स बनाने से पहले टेक्स्ट लेयर को ही पूरी तरह हटा दिया जाए।
रिडैक्ट करने से पहले रास्टराइज़िंग टेक्स्ट लेयर हटा देती है
PDF to image टूल से PDF पेज को इमेज में बदलना PDF.js के ज़रिए पेज को एक कैनवस पर रेंडर करता है और पिक्सल को PNG या JPEG फ़ाइल के रूप में एक्सपोर्ट करता है। ऐसा होने के बाद, पेज पर कोई टेक्स्ट ऑब्जेक्ट बचता ही नहीं: यह पिक्सल रंगों का एक ग्रिड होता है। Image Redact टूल में Black box मोड से उस इमेज पर काला बॉक्स बनाना रेक्टेंगल के अंदर के पिक्सल वैल्यू को ठोस काले रंग से ओवरराइट कर देता है, पहले जो भी वहां था उसे हटाते हुए। नीचे रिकवर करने के लिए कोई टेक्स्ट नहीं बचता, क्योंकि अब फ़ाइल में कहीं भी टेक्स्ट है ही नहीं।
इमेज से PDF दोबारा बनाकर आप क्या छोड़ रहे हैं
Images to PDF टूल से पेज दोबारा जोड़ना पूरी तरह तस्वीरों से बना दस्तावेज़ बनाता है। रिडैक्ट किए गए पेजों के लिए यही मकसद है, लेकिन यह आपके शामिल किए हर पेज पर लागू होता है: फ़ाइनल PDF में कोई टेक्स्ट सिलेक्ट, सर्च या स्क्रीन रीडर से पढ़ने लायक नहीं रहता, उन पेजों पर भी नहीं जिनमें कुछ छिपाना नहीं था। फ़ाइल के मूल टेक्स्ट-आधारित PDF से काफ़ी बड़ी होने की भी उम्मीद रखें, क्योंकि इमेज उन वेक्टर टेक्स्ट और फ़ॉन्ट से ज़्यादा जगह लेती हैं जिनकी जगह वे लेती हैं। मूल PDF को निजी तौर पर सुरक्षित रखें और जिसे भी ज़रूरत हो, उसे सिर्फ़ रास्टराइज़्ड, रिडैक्ट की गई कॉपी ही शेयर करें।
इस गाइड में इस्तेमाल किए गए टूल
- PDF से छवियाँसीधे अपने ब्राउज़र में प्रत्येक PDF पृष्ठ को PNG या JPG में कन्वर्ट करें।
- इमेज क्षेत्रों को संपादित करेंसाझा करने से पहले अपनी इमेज के संवेदनशील हिस्सों को धुंधला या काले बॉक्स से ढकें, कोई अपलोड नहीं।
- छवियाँ PDF मेंएक या अधिक छवियों (JPG, PNG, WebP) को एक ही PDF में मिलाएं, सीधे अपने ब्राउज़र में।
अक्सर पूछे जाने वाले सवाल
क्या PDF एडिटर में सीधे काला बॉक्स बनाने से नीचे का टेक्स्ट डिलीट हो जाता है?
यह पूरी तरह एडिटर पर निर्भर करता है, और आमतौर पर आपके लिए इसे वेरिफ़ाई करने का कोई आसान तरीका नहीं होता। कुछ टूल फ़ाइल को फ़्लैटन या एक्सपोर्ट करते समय ढका हुआ कंटेंट सच में हटा देते हैं; कुछ मूल टेक्स्ट ऑब्जेक्ट को एक ओपेक शेप के नीचे उसी पेज में छोड़ देते हैं, जिसे कोई भी जानने वाला ढूंढ सकता है। चूंकि आप आसानी से नहीं बता सकते कि किसी PDF पर कौन सा मामला लागू होता है, इसलिए पहले पेज को रास्टराइज़ करके सीधे पिक्सल में काला करना यह अस्पष्टता हटा देता है: टेक्स्ट लेयर के जाते ही, रिकवर करने के लिए कुछ नहीं बचता।
क्या रिडैक्ट की गई PDF में कहीं भी अब भी सिलेक्ट या सर्च करने लायक टेक्स्ट रहेगा?
नहीं, दस्तावेज़ को इमेज से दोबारा बनाने के बाद किसी भी पेज पर नहीं। जिन पेजों को आप कन्वर्ट करते हैं, उनके लिए रास्टराइज़िंग एक ऑल-या-नथिंग ऑपरेशन है: जिन पेजों को रिडैक्ट करने की ज़रूरत नहीं थी, वे भी अपना सिलेक्ट करने लायक टेक्स्ट खो देते हैं। यह ट्रेड-ऑफ़ संवेदनशील कंटेंट को लेकर हर शक हटा देता है; अगर सिर्फ़ कुछ पेजों को इस ट्रीटमेंट की ज़रूरत हो, तो बाद में उन्हें मूल दस्तावेज़ के बिना छुए टेक्स्ट पेजों के साथ PDF merge टूल से जोड़ा जा सकता है, अगर कुछ पेजों को सर्चेबल रखना आपके लिए मायने रखता है।