PDF शब्दावली: OCR, Flatten, Linearize, PDF/A और अन्य समझाया गया
अपडेट किया गया 13 जुलाई 2026
PDF की शब्दावली बिना ज़्यादा समझाए बहुत इस्तेमाल होती है। यहाँ सरल भाषा में बताया गया है कि आम शब्दों का असल में क्या मतलब है, साथ में हर एक को करने वाले HivePDF टूल का लिंक भी।
OCR (Optical Character Recognition)
स्कैन किए गए पेज में टेक्स्ट की तस्वीर को असली, चुनने योग्य टेक्स्ट में बदलता है, जो अदृश्य रूप से इमेज के नीचे लेयर होता है। इसके बिना, स्कैन की गई PDF बस एक फोटो होती है — आप इसे सर्च नहीं कर सकते, इससे कॉपी नहीं कर सकते, या इसे स्क्रीन रीडर से पढ़वा नहीं सकते। → OCR PDF
Flatten (फ्लैटन)
इंटरैक्टिव कंटेंट — फॉर्म फील्ड वैल्यू, एनोटेशन, लेयर — को सीधे स्टैटिक पेज कंटेंट में पका देता है, और इंटरैक्टिव एलिमेंट्स को खुद हटा देता है। एक फ्लैटन किए गए फॉर्म के जवाब बदले नहीं जा सकते; एक फ्लैटन किया गया एनोटेशन एक अलग एडिट करने योग्य ऑब्जेक्ट के बजाय पेज का हिस्सा बन जाता है। → Flatten PDF
Linearize (उर्फ “Fast Web View”)
PDF की आंतरिक संरचना को इस तरह पुनर्व्यवस्थित करता है कि पूरी फाइल डाउनलोड होने से पहले ही पहला पेज रेंडर होना शुरू हो जाए — यह बड़ी PDF के लिए उपयोगी है जिन्हें ब्राउज़र में देखा जाता है, जहाँ एक लीनियराइज़्ड फाइल पूरे डाउनलोड का इंतज़ार करने के बजाय लगभग तुरंत पेज 1 दिखा देती है।
PDF/A
PDF फॉर्मेट का एक आर्काइवल सबसेट जो दशकों बाद भी बिल्कुल एक जैसा रेंडर होने के लिए डिज़ाइन किया गया है — इसमें सभी फॉन्ट एम्बेड करना ज़रूरी है, बाहरी रेफरेंस मना हैं, और उन फीचर्स (जैसे एन्क्रिप्शन या JavaScript) से बचा जाता है जो समय के साथ काम करना बंद कर सकते हैं। कानूनी रिकॉर्ड, सरकारी फाइलिंग, और लंबी अवधि के रिटेंशन ज़रूरतों वाली किसी भी चीज़ के लिए इस्तेमाल होता है। ज़्यादातर रोज़मर्रा की PDF को इसकी ज़रूरत नहीं होती।
Redact (रिडैक्ट)
बस काली पट्टी से ढकने के बजाय संवेदनशील कंटेंट को स्थायी रूप से हटाता है — यह फर्क इसलिए मायने रखता है क्योंकि एक सादा काला आयत अक्सर नीचे मूल टेक्स्ट को बरकरार और निकालने योग्य छोड़ देता है। असली रिडैक्शन कंटेंट को खुद हटा देता है। → Redact PDF · यह भी देखें PDF को सुरक्षित तरीके से रिडैक्ट कैसे करें
Metadata (मेटाडेटा)
PDF से जुड़ी छुपी हुई जानकारी उसके दिखने वाले कंटेंट से परे — लेखक, टाइटल, बनाने की तारीख, वह सॉफ्टवेयर जिसने इसे बनाया, कभी-कभी एडिट हिस्ट्री भी। किसी डॉक्यूमेंट को सार्वजनिक रूप से शेयर करने से पहले इसे जाँचना (और कभी-कभी हटाना) उचित है। → Edit PDF Metadata
Encrypt / Protect (एन्क्रिप्ट / प्रोटेक्ट)
PDF खोलने के लिए एक पासवर्ड की ज़रूरत जोड़ता है (और वैकल्पिक रूप से पासवर्ड रखने वाले व्यक्ति के लिए भी प्रिंटिंग, कॉपी करना या एडिटिंग प्रतिबंधित करता है)। रिडैक्शन से अलग है — एन्क्रिप्शन यह नियंत्रित करता है कि फाइल को बिल्कुल खोल कौन सकता है, न कि खुलने के बाद क्या दिखता है। → Protect PDF
Compress (रास्टराइज़ बनाम री-एनकोड)
फाइल साइज़ को छोटा करना, आमतौर पर इमेज क्वालिटी या रिज़ॉल्यूशन घटाकर। रास्टराइज़िंग एक पेज को एक ही इमेज में बदल देती है (स्कैन किए गए पेजों के लिए आम); री-एनकोडिंग सिर्फ पेज पर मौजूद इमेज को दोबारा कंप्रेस करती है और असली टेक्स्ट को छोड़ देती है। यह फर्क इसलिए मायने रखता है क्योंकि टेक्स्ट पेज को रास्टराइज़ करना उसका चुनने योग्य टेक्स्ट नष्ट कर देता है — एक अच्छा कंप्रेसर (जैसे HivePDF का) सिर्फ उन पेजों को रास्टराइज़ करता है जो पहले से ही इमेज थे। → Compress PDF
Fillable form field (भरने योग्य फॉर्म फील्ड)
PDF में एक इंटरैक्टिव एलिमेंट — एक टेक्स्ट बॉक्स, चेकबॉक्स, या ड्रॉपडाउन — जिसे पाठक सीधे क्लिक करके टाइप कर सकता है, इसके उलट एक “फ्लैट” PDF जो फॉर्म जैसा दिखता है लेकिन जिस पर क्लिक करने के लिए कुछ नहीं होता। → Fill PDF Form
Client-side / in-browser processing (क्लाइंट-साइड / इन-ब्राउज़र प्रोसेसिंग)
ऐसा सॉफ्टवेयर जो सर्वर पर फाइल अपलोड करने के बजाय, WebAssembly का इस्तेमाल करके पूरी तरह आपके वेब ब्राउज़र के अंदर चलता है। इसकी पहचान करने वाली खासियत: पेज लोड होने के बाद यह बिना इंटरनेट कनेक्शन के भी काम करता रहता है, क्योंकि इसमें कोई सर्वर बीच में नहीं होता। → क्लाइंट-साइड PDF प्रोसेसिंग कैसे काम करती है