PDF से HTML बनाएँ
PDF को अर्थपूर्ण, स्क्रीन के अनुसार ढलने वाला HTML बनाइए — शीर्षक और सूचियों सहित।
PDF से HTML बनाने में दस्तावेज़ आपके उपकरण पर पढ़ा और दोबारा लिखा जाता है। आंतरिक पुस्तिकाएँ और ग्राहक रिपोर्ट कभी अपलोड नहीं होतीं।
HTML को वापस PDF बनाएँ
PDF से HTML के बारे में
वेब पर प्रकाशित करने के लिए PDF खराब चीज़ है: वह खुलने के बजाय डाउनलोड होता है, फ़ोन पर फिर से नहीं बहता, और खोज इंजन उसे बेमन से सूचीबद्ध करते हैं। ठीक से बदलने का अर्थ है उस बनावट को वापस पाना जिसकी ओर सज्जा इशारा करती है, हर पंक्ति को div में लपेटना नहीं। यह उपकरण पाठ के टुकड़ों को पंक्तियों में, पंक्तियों को अनुच्छेदों में जोड़ता है और बड़ी पंक्तियों को शीर्षक बनाता है, फिर ऐसा मार्कअप लिखता है जो बताता है कि हर हिस्सा क्या है।
विशेषताएँ
- अर्थपूर्ण मार्कअप: h1 से h6, p, ul, li, blockquote, pre और table
- मुड़ी पंक्तियाँ हर एक अलग के बजाय असली अनुच्छेदों में जुड़ती हैं
- पूरा स्वतंत्र पेज, या अपने खाके के लिए केवल मुख्य भाग
- पूरा पेज ढलने वाला है और पाठक की उजली या गहरी सेटिंग मानता है
- हर पेज विराम पर वैकल्पिक पहचान, ताकि दस्तावेज़ में गहरा लिंक बन सके
- मार्कअप के साथ अलग किए ढाँचे में बना हुआ पूर्वावलोकन
- क्लिपबोर्ड पर कॉपी करें या .html फ़ाइल डाउनलोड करें
PDF से HTML का उपयोग कैसे करें
- PDF पेज पर छोड़ें
- पूरा पेज या मुख्य भाग चुनें
- बना हुआ पूर्वावलोकन पढ़कर बनावट जाँचें
- मार्कअप कॉपी करें या .html फ़ाइल डाउनलोड करें
उदाहरण
इनपुट
handbook.pdf — 24 pages
आउटपुट
<h1>Staff handbook</h1>
<p>This handbook sets out…</p>
<h2>Working hours</h2>
शीर्षक के स्तर हर पेज पर मूल पाठ की तुलना में अक्षर आकार से आते हैं।
सामान्य त्रुटियाँ और समस्या निवारण
- मार्कअप खाली है। — PDF में पाठ की परत नहीं है। पहले पाठ पहचानिए, फिर खोजने योग्य प्रति बदलिए।
- PDF की छवियाँ गायब हैं। — केवल पाठ बदला जाता है। पेजों को अलग से छवियों की तरह निर्यात कीजिए और मार्कअप में उनका संदर्भ दीजिए।
- सारे शीर्षक एक ही स्तर के हैं। — दस्तावेज़ हर शीर्षक एक ही आकार में रखता है, इसलिए स्तर 2 और 3 में फ़र्क करने को कुछ नहीं है। मार्कअप में एक बार हाथ से ठीक कर लीजिए।
- पेज की सजावट पूरे दस्तावेज़ में दिख रही है। — चलती शीर्षपंक्तियाँ PDF में सामान्य पाठ होती हैं। बने हुए मार्कअप पर खोज-और-बदल चलाकर उन्हें हटाइए।
अक्सर पूछे जाने वाले प्रश्न
- क्या HTML में बदलने से मेरा PDF अपलोड होता है?
- नहीं। पाठ की परत इसी टैब में पढ़ी जाती है और मार्कअप यहीं बनता है, इसलिए आंतरिक पुस्तिका या ग्राहक रिपोर्ट बाहर नहीं जाती।
- क्या HTML मूल PDF जैसा दिखेगा?
- नहीं — वह स्क्रीन पर अच्छे से पढ़े जाने के लिए बना है, यानी एक स्तंभ, आरामदायक चौड़ाई और ढलने वाली सज्जा।
- CMS के लिए कौन-सा निर्गम लेना चाहिए?
- मुख्य भाग। उसमें न शीर्ष, न शैली, न आवरण होता है, इसलिए वह मौजूदा खाके में बिना टकराव के बैठ जाता है।
- क्या बना हुआ पेज सुगम्य है?
- वह असली शीर्षक, सूचियाँ और तालिका की शीर्ष कोष्ठिकाएँ उपयोग करता है, जो स्क्रीन रीडर की अधिकांश ज़रूरत है। शीर्षकों का क्रम जाँच लीजिए।
- क्या कई PDF को एक ही पेज में बदल सकता हूँ?
- पहले PDF जोड़िए, फिर एक बार बदलिए — इससे पूरे दस्तावेज़ में शीर्षकों का क्रम एक-सा रहता है।
संबंधित टूल
- HTML से PDF — HTML मार्कअप को साफ़, पेजों में बँटे PDF दस्तावेज़ में बदलें।
- PDF से टेक्स्ट — PDF से चयन योग्य टेक्स्ट को सादे टेक्स्ट या Markdown के रूप में निकालें।
- PDF से Word — PDF को संपादन योग्य .docx दस्तावेज़ की तरह दोबारा बनाएँ।
- PDF से EPUB — PDF को रीडर के लिए बहने वाला EPUB बनाएँ।
- HTML फ़ॉर्मेटर — HTML को सुंदर या छोटा बनाएँ, इनलाइन CSS/JS फ़ॉर्मेट करें और परिणाम का पूर्वावलोकन करें।
- HTML to Markdown Converter — किसी भी HTML को साफ़, पठनीय Markdown में बदलें।
- PDF OCR — स्कैन किए PDF का पाठ पहचानकर उसे खोजने योग्य बनाएँ।
सभी ArrayKit टूल