PDF से पन्ने कैसे निकालें (Acrobat के बिना)
आपको पन्ना 7 चाहिए, और फ़ाइल में 300 पन्ने हैं. शायद यह साल के आख़िर वाले बंडल में से एक स्टेटमेंट है, किसी कॉन्ट्रैक्ट का हस्ताक्षर वाला पन्ना, यूटिलिटी कंपनी के लिए स्कैन किए गए लीज़ के दो पन्ने, या किसी मैनुअल का एक अकेला चैप्टर. पूरी फ़ाइल भेजना बेहतरीन स्थिति में भी अव्यवहारिक है और बदतर स्थिति में निजता की सेंध, क्योंकि बाकी 299 पन्नों से किसी और का कोई लेना-देना नहीं था. PDF से पन्ने निकालना सुनने में ऐसा लगता है जैसे इसके लिए Acrobat और एक सब्सक्रिप्शन चाहिए; असल में इनमें से किसी की ज़रूरत नहीं, और इसे करने का एक तरीका ऐसा भी है जिसमें दस्तावेज़ कभी आपके हाथ से बाहर ही नहीं जाता.
PDF के काम करने के तरीके की अच्छी बात
PDF किसी दस्तावेज़ की एक अखंड इमेज नहीं है, यह एक फ़ाइलिंग कैबिनेट के ज़्यादा करीब है. हर पन्ना अनुक्रमित और आत्म-वर्णनात्मक है, जो ठीक उसी टेक्स्ट, फ़ॉन्ट और इमेज की ओर इशारा करता है जिनकी उसे ज़रूरत है. इस संरचना का एक सुखद नतीजा है: पन्ने निकालना किसी तस्वीर को क्रॉप करने जैसा नहीं है, यह कैबिनेट से फ़ोल्डर उठाने जैसा है. निकाला गया पन्ना अपना चुनने-योग्य टेक्स्ट, अपनी वेक्टर तीक्ष्णता, अपने ठीक-ठीक फ़ॉन्ट, सब कुछ, बाइट दर बाइट बनाए रखता है. रास्ते में कुछ भी रेंडर, दोबारा स्कैन या दोबारा संपीड़ित नहीं होता, और यह ऑपरेशन 300 पन्नों वाले विशालकाय दस्तावेज़ पर भी तेज़ रहता है, क्योंकि बाकी 299 पन्नों को कभी छुआ ही नहीं जाता.
यही वजह है कि आपको किसी भी ऐसे टूल पर शक करना चाहिए जो आपका निकाला हुआ पन्ना मूल से धुँधला लौटाए, और यही वजह है कि “प्रिंट टू PDF” इस काम के लिए ग़लत टूल है: प्रिंट करना पन्ने को दोबारा रेंडर करता है और मूल संरचना को फेंक देता है. असली निकालना स्वभाव से ही बिना हानि वाला है.
रेंज: वह छोटी सी सिंटैक्स जो सब कुछ कर देती है
हर स्प्लिटिंग टास्क अंततः इस बात के वर्णन तक सिमट जाता है कि आपको कौन-से पन्ने चाहिए, और इसका व्याकरण संक्षिप्त है. 7 पन्ना सात लेता है. 2-5 एक रेंज लेता है. 1-3, 7, 12 दोनों को मिलाकर एक ही आउटपुट में देता है. 12- जैसी खुली रेंज का मतलब है “पन्ना 12 से आख़िर तक”, जो तब काम आता है जब आपको पता हो कि परिशिष्ट कहाँ से शुरू होता है पर यह न पता हो कि वह कितना लंबा है. इस साइट पर मौजूद स्प्लिट टूल ठीक इसी व्याकरण का पालन करता है और फ़ाइल छोड़ते ही पन्नों की गिनती दिखा देता है, इसलिए आपको यह अंदाज़ा ही नहीं लगाना पड़ता कि दस्तावेज़ कहाँ ख़त्म होता है.
फिर एक और मोड है: हर पन्ने को अपनी अलग फ़ाइल में बाँटना. यह सुनने में ज़्यादा लग सकता है, जब तक कि वह दिन न आए जब आपके पास एक स्कैन किया हुआ बैच हो, एक ही PDF में बारह रसीदें, या कोई ऐसा इनवॉइस का ढेर जिसे किसी ने एक ही बार में स्कैनर से गुज़ारा हो, और आपको उन्हें अलग-अलग दस्तावेज़ों के रूप में चाहिए हो. एक क्लिक में, हर पन्ना एक नंबर वाली फ़ाइल बन जाता है, और सब मिलकर एक ZIP के रूप में मिलते हैं.
लोग असल में कौन-से पन्ने निकालते हैं?
पैटर्न दोहराते रहते हैं. हस्ताक्षर वाला पन्ना, क्योंकि दूसरे पक्ष को सबूत चाहिए, पूरा समझौता नहीं. तिमाही बंडल में से एक महीने का स्टेटमेंट, क्योंकि लेंडर ने ख़ासतौर पर मार्च माँगा था. स्कैन किए गए पासपोर्ट का पहचान वाला पन्ना. ऑनबोर्डिंग पैकेट में से एक फ़ॉर्म. पैटर्न के भीतर के पैटर्न पर ग़ौर कीजिए: यह लगभग हमेशा संवेदनशील दस्तावेज़ होते हैं, और यह लगभग हमेशा एक चीज़ का कम हिस्सा साझा करने के बारे में होता है. पन्ने निकालना, अपने मूल में, एक निजता का कदम है. आप यह कम कर रहे हैं कि क्या बाहर जाता है.
यही बात मानक तरीक़े को सचमुच विडंबनापूर्ण बनाती है: एक पक्ष के साथ कम पन्ने साझा करने के लिए, लोग पूरा दस्तावेज़, सारे 300 पन्ने, हर स्टेटमेंट और हर हस्ताक्षर, किसी ऐसे सर्वर पर अपलोड कर देते हैं जिसे वे देख नहीं सकते, जिसे चलाने वाली कंपनी के बारे में उन्होंने कभी सुना तक नहीं. कम करने की प्रक्रिया आगे बढ़ने से पहले ही पीछे चली गई.
बिना अपलोड किए अलग करना
इस पेज के नीचे मौजूद टूल पूरा ऑपरेशन आपके ब्राउज़र के भीतर चलाता है. PDF आपके डिवाइस पर खुलता है, आपके माँगे गए पन्ने आपके डिवाइस पर ही निकाले जाते हैं, और नतीजे आपके डिवाइस से आपके ही डिवाइस पर डाउनलोड होते हैं. कुछ भी नेटवर्क पार नहीं करता, और यह सिर्फ़ एक वादा नहीं बल्कि जाँची जा सकने वाली बात है: पहले अपने लैपटॉप को एयरप्लेन मोड में डालें, और सब कुछ फिर भी काम करता रहेगा, जो कोई भी अपलोड करने वाला टूल नहीं कह सकता. अगर आप गहराई में जाना चाहें तो तकनीकी सबूत और भी आगे तक ले जाता है.
शुरू करने से पहले दो व्यावहारिक बातें. पासवर्ड से सुरक्षित PDF को कोई भी टूल अलग करने से पहले अनलॉक करना ज़रूरी है, इसलिए अगर आपका बैंक स्टेटमेंट लॉक करके भेजता है, तो पहले अपने PDF व्यूअर से उसकी अनलॉक्ड कॉपी निकाल लें. और अगर आपको असल में जो चाहिए वह एक पन्ना तस्वीर के रूप में है, किसी स्लाइड या चैट में चिपकाने के लिए, तो वह एक अलग ऑपरेशन है जिसका अपना टूल है: पन्ने को निकालने के बजाय चुनी गई रिज़ॉल्यूशन पर रास्टराइज़ करना.
सब कुछ जोड़कर देखें
PDF को नीचे दिए टूल में डालिए, पन्नों की गिनती पर एक नज़र डालिए, रेंज टाइप कीजिए या हर-पन्ना मोड पर पलटिए, और डाउनलोड कर लीजिए. आउटपुट सटीक होता है, मूल फ़ाइल पूरी बनी रहती है, और वे 299 पन्ने जिनके बारे में किसी ने पूछा ही नहीं था, ठीक वहीं रहते हैं जहाँ उन्हें रहना चाहिए: आपके पास. पन्ने निकाल लेने के बाद, मर्ज टूल उन्हें नए संयोजनों में फिर से जोड़ देता है, जो स्प्लिटिंग के साथ मिलकर वह लगभग सब कुछ पूरा कर देता है जिसके लिए लोग किसी PDF सुइट को पैसे देते हैं.