PDF को ऑनलाइन Markdown में बदलें
PDF को साफ़ Markdown में बदलें: शीर्षक, बोल्ड और इटैलिक टेक्स्ट, सूचियाँ, टेबल, कोड ब्लॉक, लिंक और वैकल्पिक रूप से इमेज। मुफ़्त, निजी और आपके ब्राउज़र में।
PDF को Markdown में कैसे बदलें
PDF छापने के लिए बना है, Markdown लिखने, बदलने और दोबारा इस्तेमाल करने के लिए। WoowPDF का PDF से Markdown कन्वर्टर आपके दस्तावेज़ की संरचना को साफ़, पढ़ने में आसान Markdown के रूप में दोबारा बनाता है, जिसे आप GitHub, GitLab, Obsidian, Notion, स्टैटिक साइट जनरेटर, विकी या AI असिस्टेंट में चिपका सकते हैं। यह शीर्षक, ज़ोर, सूचियाँ, टेबल, कोड ब्लॉक और लिंक रखता है, और PDF से कॉपी किए टेक्स्ट को बिगाड़ने वाले हेडर, फ़ुटर और पेज नंबर हटा देता है। सब कुछ आपके ब्राउज़र में चलता है, इसलिए फ़ाइलें आपके डिवाइस पर ही रहती हैं।
PDF को Markdown में कैसे बदलें
- अपना PDF जोड़ें। एक या अधिक फ़ाइलें पेज पर छोड़ें या फ़ाइलें चुनें पर क्लिक करें।
- चुनें क्या पहचानना है। शीर्षक, टेबल और हेडर/फ़ुटर हटाना डिफ़ॉल्ट रूप से चालू हैं। तस्वीरें भी चाहिए तो इमेज निकालें चालू करें।
- ज़रूरत हो तो बारीक सेटिंग करें। एडवांस्ड विकल्पों में पेज ब्रेक को रेखा या HTML टिप्पणी से दिखा सकते हैं, शीर्षक और लेखक वाला YAML फ़्रंट मैटर जोड़ सकते हैं, या सिर्फ़ कुछ पेज बदल सकते हैं।
- बदलें और डाउनलोड करें। Markdown में बदलें पर क्लिक करें और अपनी .md फ़ाइल (या images फ़ोल्डर वाली ZIP) डाउनलोड करें।
सिर्फ़ टेक्स्ट नहीं, संरचना
PDF से टेक्स्ट कॉपी करने पर अक्सर टूटी पंक्तियाँ, खोए शीर्षक और वाक्यों के बीच पेज नंबर मिलते हैं। यह कन्वर्टर हर टेक्स्ट टुकड़े की जगह और फ़ॉन्ट के आधार पर काम करता है। पंक्तियाँ पैराग्राफ़ में जुड़ती हैं और पंक्ति के अंत में हाइफ़न से टूटे शब्द फिर जुड़ जाते हैं। मुख्य टेक्स्ट का आकार मापा जाता है और बड़ी पंक्तियाँ #, ## या ### शीर्षक बनती हैं। बोल्ड और इटैलिक शब्द अपना ज़ोर बनाए रखते हैं, मोनोस्पेस टेक्स्ट इनलाइन कोड या कोड ब्लॉक बनता है और लिंक असली Markdown लिंक बन जाते हैं।
सूचियाँ और टेबल
•, ▪, – और * जैसे बुलेट Markdown सूची आइटम बनते हैं, क्रमांकित आइटम क्रमांकित रहते हैं और इंडेंट किए आइटम नेस्ट होते हैं। सीधे कॉलम में बँटी टेक्स्ट पंक्तियाँ हेडर पंक्ति वाली GitHub-शैली Markdown टेबल बन जाती हैं, जो GitHub, Obsidian और ज़्यादातर डॉक्यूमेंटेशन टूल में अच्छी दिखती हैं। मर्ज सेल वाली टेबल में नतीजा देखकर हाथ से ठीक करें।
असली दस्तावेज़ों से साफ़ नतीजा
रिपोर्ट, शोधपत्र और मैनुअल हर पेज पर वही हेडर, फ़ुटर और पेज नंबर दोहराते हैं। WoowPDF इन दोहराए हिस्सों को पहचानकर हटा देता है, जिससे पैराग्राफ़ बिना रुकावट बहते हैं और अगले पेज पर जारी वाक्य जुड़ा रहता है। वैज्ञानिक शोधपत्रों और न्यूज़लेटर में आम दो-कॉलम लेआउट पूरे पेज पर पंक्ति-दर-पंक्ति नहीं, कॉलम-दर-कॉलम पढ़े जाते हैं।
इस्तेमाल के लिए तैयार फ़ोल्डर में इमेज
इमेज निकालें चालू होने पर आपको Markdown दस्तावेज़ और images फ़ोल्डर वाली ZIP फ़ाइल मिलती है। हर तस्वीर PDF में अपनी जगह पर रिलेटिव पाथ से लिंक होती है, इसलिए अनज़िप करते ही दस्तावेज़ सही दिखता है। हर पेज पर दोहराए गए लोगो छोड़ दिए जाते हैं।
AI, डॉक्यूमेंटेशन और नोट्स के लिए बढ़िया
Markdown छोटा होता है और वह अर्थ बनाए रखता है जो सादा टेक्स्ट खो देता है, इसलिए ChatGPT, Claude या RAG पाइपलाइन को दस्तावेज़ देने के लिए यह बेहतरीन फ़ॉर्मेट है। यह Obsidian और Logseq जैसे नॉलेज बेस, README फ़ाइलों और Docusaurus, MkDocs या Hugo से बनी डॉक्यूमेंटेशन साइटों का मूल फ़ॉर्मेट भी है।
बेहतरीन नतीजे के सुझाव
- स्कैन किया दस्तावेज़? पहले PDF OCR से खोजने योग्य बनाएँ, फिर बदलें।
- बिना फ़ॉर्मेटिंग सादा टेक्स्ट चाहिए? PDF टेक्स्ट एक्सट्रैक्टर इस्तेमाल करें। वेब पेज के लिए PDF से HTML और संपादन योग्य दस्तावेज़ के लिए PDF से Word आज़माएँ।
- सिर्फ़ तस्वीरें चाहिए? सीधे PDF से इमेज निकालें।
- उल्टा करना है? अपना टेक्स्ट टेक्स्ट से PDF में चिपकाएँ।
विशेषताएँ
- फ़ॉन्ट आकार से शीर्षक पहचानकर #, ## और ### में बदलना
- बोल्ड, इटैलिक और इनलाइन कोड बने रहते हैं
- बुलेट और क्रमांकित सूचियाँ, नेस्टेड आइटम सहित
- GitHub-शैली Markdown टेबल के रूप में टेबल दोबारा बनाना
- मोनोस्पेस टेक्स्ट को कोड ब्लॉक में बदलना
- लिंक बने रहते हैं, दोहराए गए हेडर, फ़ुटर और पेज नंबर हटते हैं
- दो कॉलम वाले लेआउट सही क्रम में पढ़े जाते हैं
- वैकल्पिक रूप से इमेज, images फ़ोल्डर वाली ZIP में
- निजी: PDF आपके ब्राउज़र में बदलता है, अपलोड नहीं होता
अक्सर पूछे जाने वाले सवाल
Markdown क्या है?
Markdown एक सादा-टेक्स्ट फ़ॉर्मेट है जो संरचना के लिए आसान चिह्न इस्तेमाल करता है: शीर्षक के लिए #, ज़ोर के लिए *, सूची के लिए - और टेबल के लिए |। इसे GitHub, GitLab, Obsidian, Notion, स्टैटिक साइट जनरेटर, डॉक्यूमेंटेशन टूल और AI असिस्टेंट इस्तेमाल करते हैं।
मेरे PDF के कौन-से हिस्से बने रहते हैं?
शीर्षक, पैराग्राफ़, बोल्ड और इटैलिक टेक्स्ट, बुलेट और क्रमांकित सूचियाँ, सरल टेबल, मोनोस्पेस कोड, लिंक और चालू करने पर इमेज। दोहराए गए हेडर, फ़ुटर और पेज नंबर हटा दिए जाते हैं।
क्या मेरा PDF सर्वर पर अपलोड होता है?
नहीं। बदलाव पूरी तरह आपके ब्राउज़र में होता है, आपकी फ़ाइल कभी आपके डिवाइस से बाहर नहीं जाती।
क्या यह स्कैन किए गए PDF पर काम करता है?
स्कैन PDF में सिर्फ़ टेक्स्ट की तस्वीरें होती हैं। पहले हमारे PDF OCR टूल से टेक्स्ट लेयर जोड़ें, फिर नतीजे को Markdown में बदलें।
शीर्षक कैसे पहचाने जाते हैं?
कन्वर्टर मुख्य टेक्स्ट का फ़ॉन्ट आकार पहचानता है। बड़ी पंक्तियाँ शीर्षक बनती हैं: सबसे बड़ा आकार #, उसके बाद ## और छोटे ###। चाहें तो शीर्षक पहचान बंद कर सकते हैं।
क्या यह टेबल बदलता है?
हाँ। जिन पंक्तियों का टेक्स्ट सीधे कॉलम में बँटा हो, वे हेडर पंक्ति वाली Markdown टेबल बन जाती हैं। मर्ज सेल वाली बहुत जटिल टेबल में थोड़ा हाथ से सुधार करना पड़ सकता है।
इमेज का क्या होता है?
डिफ़ॉल्ट रूप से सिर्फ़ टेक्स्ट बदलता है। इमेज निकालें चालू करने पर .md फ़ाइल और images फ़ोल्डर वाली ZIP मिलती है; हर इमेज वहीं लिंक होती है जहाँ वह दस्तावेज़ में है।
क्या नतीजा ChatGPT, Claude या अन्य AI के साथ इस्तेमाल कर सकते हैं?
हाँ। Markdown भाषा मॉडल को दस्तावेज़ देने के सबसे अच्छे फ़ॉर्मेट में से है, क्योंकि यह संरचना रखता है और छोटा रहता है।
क्या यह दो कॉलम वाले दस्तावेज़ संभालता है?
हाँ। जब पेज पर टेक्स्ट के दो कॉलम हों, तो पंक्तियाँ मिलाने के बजाय पहले बायाँ और फिर दायाँ कॉलम पढ़ा जाता है।
क्या एक साथ कई PDF बदल सकते हैं?
हाँ। कई फ़ाइलें जोड़ें, हर एक उन्हीं सेटिंग्स से बदलेगी। अलग-अलग या ZIP में एक साथ डाउनलोड करें।