HivePDF
हिन्दी
← गाइड

PDF शब्दावली: OCR, Flatten, Linearize, PDF/A और अन्य समझाया गया

अपडेट किया गया 13 जुलाई 2026

PDF की शब्दावली बिना ज़्यादा समझाए बहुत इस्तेमाल होती है। यहाँ सरल भाषा में बताया गया है कि आम शब्दों का असल में क्या मतलब है, साथ में हर एक को करने वाले HivePDF टूल का लिंक भी।

OCR (Optical Character Recognition)

स्कैन किए गए पेज में टेक्स्ट की तस्वीर को असली, चुनने योग्य टेक्स्ट में बदलता है, जो अदृश्य रूप से इमेज के नीचे लेयर होता है। इसके बिना, स्कैन की गई PDF बस एक फोटो होती है — आप इसे सर्च नहीं कर सकते, इससे कॉपी नहीं कर सकते, या इसे स्क्रीन रीडर से पढ़वा नहीं सकते। → OCR PDF

Flatten (फ्लैटन)

इंटरैक्टिव कंटेंट — फॉर्म फील्ड वैल्यू, एनोटेशन, लेयर — को सीधे स्टैटिक पेज कंटेंट में पका देता है, और इंटरैक्टिव एलिमेंट्स को खुद हटा देता है। एक फ्लैटन किए गए फॉर्म के जवाब बदले नहीं जा सकते; एक फ्लैटन किया गया एनोटेशन एक अलग एडिट करने योग्य ऑब्जेक्ट के बजाय पेज का हिस्सा बन जाता है। → Flatten PDF

Linearize (उर्फ “Fast Web View”)

PDF की आंतरिक संरचना को इस तरह पुनर्व्यवस्थित करता है कि पूरी फाइल डाउनलोड होने से पहले ही पहला पेज रेंडर होना शुरू हो जाए — यह बड़ी PDF के लिए उपयोगी है जिन्हें ब्राउज़र में देखा जाता है, जहाँ एक लीनियराइज़्ड फाइल पूरे डाउनलोड का इंतज़ार करने के बजाय लगभग तुरंत पेज 1 दिखा देती है।

PDF/A

PDF फॉर्मेट का एक आर्काइवल सबसेट जो दशकों बाद भी बिल्कुल एक जैसा रेंडर होने के लिए डिज़ाइन किया गया है — इसमें सभी फॉन्ट एम्बेड करना ज़रूरी है, बाहरी रेफरेंस मना हैं, और उन फीचर्स (जैसे एन्क्रिप्शन या JavaScript) से बचा जाता है जो समय के साथ काम करना बंद कर सकते हैं। कानूनी रिकॉर्ड, सरकारी फाइलिंग, और लंबी अवधि के रिटेंशन ज़रूरतों वाली किसी भी चीज़ के लिए इस्तेमाल होता है। ज़्यादातर रोज़मर्रा की PDF को इसकी ज़रूरत नहीं होती।

Redact (रिडैक्ट)

बस काली पट्टी से ढकने के बजाय संवेदनशील कंटेंट को स्थायी रूप से हटाता है — यह फर्क इसलिए मायने रखता है क्योंकि एक सादा काला आयत अक्सर नीचे मूल टेक्स्ट को बरकरार और निकालने योग्य छोड़ देता है। असली रिडैक्शन कंटेंट को खुद हटा देता है। → Redact PDF · यह भी देखें PDF को सुरक्षित तरीके से रिडैक्ट कैसे करें

Metadata (मेटाडेटा)

PDF से जुड़ी छुपी हुई जानकारी उसके दिखने वाले कंटेंट से परे — लेखक, टाइटल, बनाने की तारीख, वह सॉफ्टवेयर जिसने इसे बनाया, कभी-कभी एडिट हिस्ट्री भी। किसी डॉक्यूमेंट को सार्वजनिक रूप से शेयर करने से पहले इसे जाँचना (और कभी-कभी हटाना) उचित है। → Edit PDF Metadata

Encrypt / Protect (एन्क्रिप्ट / प्रोटेक्ट)

PDF खोलने के लिए एक पासवर्ड की ज़रूरत जोड़ता है (और वैकल्पिक रूप से पासवर्ड रखने वाले व्यक्ति के लिए भी प्रिंटिंग, कॉपी करना या एडिटिंग प्रतिबंधित करता है)। रिडैक्शन से अलग है — एन्क्रिप्शन यह नियंत्रित करता है कि फाइल को बिल्कुल खोल कौन सकता है, न कि खुलने के बाद क्या दिखता है। → Protect PDF

Compress (रास्टराइज़ बनाम री-एनकोड)

फाइल साइज़ को छोटा करना, आमतौर पर इमेज क्वालिटी या रिज़ॉल्यूशन घटाकर। रास्टराइज़िंग एक पेज को एक ही इमेज में बदल देती है (स्कैन किए गए पेजों के लिए आम); री-एनकोडिंग सिर्फ पेज पर मौजूद इमेज को दोबारा कंप्रेस करती है और असली टेक्स्ट को छोड़ देती है। यह फर्क इसलिए मायने रखता है क्योंकि टेक्स्ट पेज को रास्टराइज़ करना उसका चुनने योग्य टेक्स्ट नष्ट कर देता है — एक अच्छा कंप्रेसर (जैसे HivePDF का) सिर्फ उन पेजों को रास्टराइज़ करता है जो पहले से ही इमेज थे। → Compress PDF

Fillable form field (भरने योग्य फॉर्म फील्ड)

PDF में एक इंटरैक्टिव एलिमेंट — एक टेक्स्ट बॉक्स, चेकबॉक्स, या ड्रॉपडाउन — जिसे पाठक सीधे क्लिक करके टाइप कर सकता है, इसके उलट एक “फ्लैट” PDF जो फॉर्म जैसा दिखता है लेकिन जिस पर क्लिक करने के लिए कुछ नहीं होता। → Fill PDF Form

Client-side / in-browser processing (क्लाइंट-साइड / इन-ब्राउज़र प्रोसेसिंग)

ऐसा सॉफ्टवेयर जो सर्वर पर फाइल अपलोड करने के बजाय, WebAssembly का इस्तेमाल करके पूरी तरह आपके वेब ब्राउज़र के अंदर चलता है। इसकी पहचान करने वाली खासियत: पेज लोड होने के बाद यह बिना इंटरनेट कनेक्शन के भी काम करता रहता है, क्योंकि इसमें कोई सर्वर बीच में नहीं होता। → क्लाइंट-साइड PDF प्रोसेसिंग कैसे काम करती है

इस गाइड के टूल

अक्सर पूछे जाने वाले सवाल

फ्लैटनिंग और रिडैक्टिंग में क्या फर्क है?
फ्लैटनिंग इंटरैक्टिव कंटेंट (फॉर्म फील्ड, एनोटेशन) को स्टैटिक पेज में पका देती है ताकि उसे आगे एडिट न किया जा सके, लेकिन अंदर का कंटेंट फिर भी वहीं रहता है। रिडैक्टिंग खासतौर पर संवेदनशील कंटेंट को हटाती है ताकि उसे बिल्कुल भी वापस न पाया जा सके — एक बहुत मजबूत गारंटी, जो सिर्फ लेआउट लॉक करने के बजाय जानकारी छुपाने के लिए है।
क्या मुझे सामान्य डॉक्यूमेंट के लिए PDF/A चाहिए?
नहीं — PDF/A लंबे समय के आर्काइवल (कानूनी रिकॉर्ड, सरकारी फाइलिंग) के लिए मायने रखता है जहाँ फाइल को दशकों बाद भी बिल्कुल वैसे ही रेंडर होना चाहिए। रोज़मर्रा की शेयरिंग और प्रिंटिंग के लिए, एक सामान्य PDF काफी है।
क्या OCR और स्कैन को PDF में बदलना एक ही चीज़ है?
नहीं। स्कैन की गई इमेज को PDF में बदलना बस उस तस्वीर को PDF फाइल में लपेट देता है — "टेक्स्ट" अब भी बस पिक्सल है। OCR (Optical Character Recognition) उन पिक्सल का विश्लेषण करता है और नीचे एक असली, चुनने योग्य (selectable) टेक्स्ट लेयर जोड़ता है, जो स्कैन किए गए डॉक्यूमेंट को सर्च करने योग्य और कॉपी करने योग्य बनाता है।