PDF OCR

स्कैन किए PDF का पाठ पहचानिए और ऐसी फ़ाइल पाइए जिसे खोजा और कॉपी किया जा सके।

PDF OCR आपके उपकरण पर चलता है, इसलिए स्कैन किए अभिलेख आपके पास रहते हैं। केवल भाषा की सामग्री एक बार आती है और ब्राउज़र उसे सहेजता है।

खोजने योग्य परिणाम को Word बनाएँ

PDF OCR के बारे में

स्कैन किया PDF दस्तावेज़ की एक तस्वीर है। आप उसे पढ़ सकते हैं, पर और कुछ नहीं पढ़ सकता: खोज कुछ नहीं पाती, कॉपी कुछ नहीं देती, और पाठ पर चलने वाला हर औज़ार खाली हाथ रहता है। पाठ पहचान इसे ठीक करती है — वह अक्षरों की आकृतियाँ पढ़ती है और जो मिलता है उसे फ़ाइल में, छपे शब्दों के ठीक ऊपर बैठी अदृश्य परत की तरह लिख देती है। पेज वैसा ही दिखता है — स्कैन को छुआ नहीं जाता — पर अब दस्तावेज़ खोजा, चुना और बदला जा सकता है।

विशेषताएँ

PDF OCR का उपयोग कैसे करें

  1. स्कैन किया PDF पेज पर छोड़ें
  2. पेज पर छपी भाषा और स्कैन गुणवत्ता चुनें
  3. पहचान शुरू करें और पेजों पर काम होते देखें
  4. खोजने योग्य PDF, या केवल पहचाना गया पाठ डाउनलोड करें

उदाहरण

इनपुट

1987-minutes.pdf — 8 scanned pages, typewritten English

आउटपुट

1987-minutes-searchable.pdf — same images, now with selectable text behind them.

दिखने वाला पेज नहीं बदलता; बदलता यह है कि शब्द अब फ़ाइल के भीतर हैं।

सामान्य त्रुटियाँ और समस्या निवारण

अक्सर पूछे जाने वाले प्रश्न

क्या पहचाना गया पाठ स्कैन की जगह ले लेता है?
नहीं। छवि बिलकुल वैसी ही रहती है और पाठ उसके पीछे अदृश्य रूप में जुड़ता है। इसीलिए खोजने योग्य PDF मूल जैसा ही दिखता है।
क्या पहचान के लिए मेरे स्कैन किए पेज अपलोड होते हैं?
नहीं। पहचान का इंजन आपके ब्राउज़र में चलता है। केवल भाषा की सामग्री एक बार आती है, और ब्राउज़र उसे सहेज लेता है।
एक बार में कितने पेज पहचान सकता हूँ?
हर बार तीस तक, क्योंकि पहचान इतनी धीमी है कि लंबे दस्तावेज़ हिस्सों में बेहतर सँभलते हैं।
कौन-सी गुणवत्ता चुननी चाहिए?
तेज़ वाली से शुरू कीजिए। ऊँची तब लीजिए जब अक्षर छोटे हों, स्कैन पुराना हो, या पहली कोशिश गड़बड़ आई हो।
क्या ऐसे PDF पर OCR चला सकता हूँ जिसमें पहले से पाठ है?
चला सकते हैं, पर फ़ायदा नहीं: पहले कोई शब्द चुनकर देख लीजिए। पाठ पहले से हो तो सीधे बदल दीजिए।

संबंधित टूल

सभी ArrayKit टूल