Word से Markdown: .docx बदलें, बिना अपलोड किए
Word को पहले से पता होता है कि हेडिंग क्या है। PDF सिर्फ़ अक्षरों की स्थिति रखता है और संरचना का अनुमान लगाना पड़ता है, जबकि .docx अपनी हेडिंग, सूची-स्तर और टेबल सेल ख़ुद नाम देती है — इसलिए यह अनुवाद है, अनुमान नहीं।
अपनी PDF या Word फ़ाइल यहाँ छोड़ें
या अपने कंप्यूटर से कोई फ़ाइल चुनें
PDF या Word (.docx) · अधिकतम 50 MB
क्या Word को Markdown में बदलना PDF की तुलना में ज़्यादा सटीक है?
हाँ। .docx अपनी संरचना ख़ुद रखती है: स्टाइल का नाम बताता है कि कौन सा टेक्स्ट Heading 2 है, नंबरिंग बताती है कि सूची क्रमित है या नहीं, और मार्कअप बताता है कि हर सेल कहाँ शुरू होती है। PDF में यह कुछ भी नहीं होता।
Word को Markdown में बदलने पर क्या छूट जाता है?
छवियाँ, समीकरण, टिप्पणियाँ और फ़ुटनोट Markdown में नहीं आते। ट्रैक किए गए बदलावों में जोड़ा गया टेक्स्ट रखा जाता है और हटाया गया छोड़ दिया जाता है। Markdown में मर्ज की गई टेबल सेल भी नहीं होतीं।
मेरे Word शीर्षक Markdown शीर्षक क्यों नहीं बने?
क्योंकि कनवर्टर पैराग्राफ़ की शैली पढ़ता है, उसका रूप नहीं। हाथ से बड़ा और बोल्ड किया गया टेक्स्ट Normal शैली में ही रहता है, इसलिए वह सामान्य पैराग्राफ़ बनता है। Word में Heading 1 से 6 लगाइए, तो हर बार सही बदलता है।
Word दस्तावेज़ को Markdown में कैसे बदलें
- 1
कनवर्टर खोलें
mypdf2md.com पर जाएँ। कुछ इंस्टॉल करने की ज़रूरत नहीं और न ही कोई खाता बनाना है।
- 2
अपनी .docx जोड़ें
Word फ़ाइल को ड्रॉप ज़ोन पर खींचें, या क्लिक करके अपने कंप्यूटर से चुनें। 50 MB तक की फ़ाइलें स्वीकार हैं।
- 3
संरचना जाँचें
हेडिंग, सूचियाँ और टेबल Markdown पैनल में दिखते हैं और साथ में लाइव प्रीव्यू रहता है। ले जाने से पहले जो ठीक करना हो, कर लें।
- 4
कॉपी करें या डाउनलोड करें
Markdown को क्लिपबोर्ड पर कॉपी करें, या मूल दस्तावेज़ के नाम से .md फ़ाइल के रूप में डाउनलोड करें।
Word जो ख़ुद बता देता है
एक .docx असल में ZIP होती है जिसमें कई XML हिस्से होते हैं। कनवर्टर उनमें से केवल चार खोलता है: दस्तावेज़, स्टाइल, नंबरिंग परिभाषाएँ और लिंक संबंध। Markdown जो कुछ दिखा सकता है, वह इन्हीं चार में है।
इसीलिए नतीजे में PDF की तुलना में कम सुधार करने पड़ते हैं: यहाँ पेज की बनावट से कुछ भी अनुमान नहीं लगाया जाता।
- हेडिंग, पैराग्राफ़ स्टाइल से, जिसमें Title और Subtitle भी शामिल हैं
- बुलेट और क्रमांकित सूचियाँ, दस्तावेज़ में घोषित नेस्टिंग स्तर के साथ
- टेबल, जहाँ आड़ी मर्ज की गई सेल भर दी जाती हैं ताकि कॉलम खिसकें नहीं
- बोल्ड, इटैलिक, स्ट्राइकथ्रू और मोनोस्पेस टेक्स्ट
- हाइपरलिंक, अपने असली पते पर हल किए हुए
- उद्धरण और कोड ब्लॉक, Word द्वारा लगाई गई स्टाइल से
जो बदलाव में नहीं बचता
Markdown में छवि के बाइट नहीं रहते और यह कनवर्टर कुछ भी अपलोड नहीं करता, इसलिए छवियाँ गिनी जाती हैं और कितनी छूटीं यह बताया जाता है, चुपचाप हटाया नहीं जाता। समीकरण, टिप्पणियाँ और फ़ुटनोट भी नहीं आते।
ट्रैक किए गए बदलाव आज के पाठ के रूप में हल किए जाते हैं: जोड़ा गया रहता है, हटाया गया छोड़ दिया जाता है। स्वचालित विषय-सूची जैसे फ़ील्ड Word के लिए निर्देश हैं, सामग्री नहीं, इसलिए छोड़ दिए जाते हैं।
फ़ाइल कहाँ पढ़ी जाती है
यह .docx आपके ब्राउज़र टैब में ही खुलती और पढ़ी जाती है। आप जाँच सकते हैं: बदलते समय नेटवर्क पैनल खोलें, कोई अपलोड नहीं दिखेगा।
अंदर की छवियाँ पढ़ी तक नहीं जातीं, क्योंकि केवल ज़रूरी चार XML ही खोले जाते हैं। तस्वीरों से भरी 40 MB की फ़ाइल से कुछ सौ किलोबाइट मार्कअप ही निकलता है।
Word की वे आदतें जो ठीक से नहीं बदलतीं
लगभग हर निराश करने वाली .docx कनवर्ज़न की एक ही वजह होती है: दस्तावेज़ स्क्रीन पर संरचित दिखता है, पर भीतर से संरचित नहीं होता। कनवर्टर वही पढ़ता है जो Word ने दर्ज किया, और Word लागू की गई शैली दर्ज करता है, दिखने वाला असर नहीं।
यह फ़ाइल की ख़ामी नहीं है। यह दस्तावेज़ को सजाने और उसे संरचना देने का अंतर है, और यह तब तक नहीं दिखता जब तक Word के अलावा कोई और उसे न पढ़े।
- हाथ से बड़ी और बोल्ड की गई पंक्ति Normal शैली में रहती है और पैराग्राफ़ बनती है
- 1. या - अक्षर टाइप करके बनाई गई सूची केवल टेक्स्ट है; बदलती Word की अपनी नंबरिंग है
- पेज सजाने के लिए इस्तेमाल की गई तालिका तालिका ही बनती है, क्योंकि वह है भी वही
- टैब या स्पेस से किया गया इंडेंट कोई सूची स्तर नहीं रखता, इसलिए नेस्टिंग सपाट हो जाती है
- Consolas या Courier में लिखा हिस्सा कोड बनता है: मोनोस्पेस फ़ॉन्ट ही एकमात्र संकेत है जो Word रखता है
जो बच जाता है और उम्मीद नहीं होती
तैरते टेक्स्ट बॉक्स का टेक्स्ट खोता नहीं। Word उसे उसी ड्रॉइंग के भीतर रखता है जो बॉक्स को संभालती है, और कनवर्टर पूरी ड्रॉइंग को न ले जा सकने वाली तस्वीर मानकर छोड़ने के बजाय भीतर जाकर वह टेक्स्ट निकाल लाता है।
कंटेंट कंट्रोल, यानी टेम्पलेट के छोड़े ड्रॉपडाउन और तारीख़ चुनने वाले खाने, उनके भीतर इस समय मौजूद टेक्स्ट तक खोल दिए जाते हैं। ट्रैक किए गए जोड़ रखे जाते हैं और हटाए गए हिस्से छोड़ दिए जाते हैं, यानी आपको दस्तावेज़ वैसा मिलता है जैसा वह अब पढ़ा जाता है। लंबवत मिली हुई तालिका कोशिका अपने कॉलम में आगे बढ़ा दी जाती है, ख़ाली जगह नहीं छोड़ती।
अक्सर पूछे जाने वाले प्रश्न
- क्या पुरानी .doc फ़ाइलें खुल सकती हैं?
- नहीं। Word 97-2003 की .doc अंदर से अलग प्रारूप है, नाम बदली हुई .docx नहीं। उसे Word में खोलें, .docx के रूप में सहेजें और उसे बदलें। कनवर्टर इस स्थिति को पहचानकर यही बताता है।
- Word दस्तावेज़ के लिए पेज संख्या क्यों नहीं दिखती?
- एक .docx में पेज विभाजन सहेजा ही नहीं जाता। Word उसे दिखाते समय फ़ॉन्ट, पेज आकार और प्रिंटर ड्राइवर के अनुसार दोबारा बनाता है, इसलिए वही फ़ाइल एक मशीन पर 12 और दूसरी पर 14 पेज की होती है। इसीलिए मुफ़्त सीमा शब्दों में गिनी जाती है।
- स्वचालित विषय-सूची का क्या होता है?
- वह शामिल नहीं होती। Word की विषय-सूची एक फ़ील्ड है जो ख़ुद दोबारा बनती है और उसका मार्कअप मशीन के लिए है। हेडिंग तो बदल ही जाती हैं, और कोई भी Markdown उपकरण उनसे अपनी विषय-सूची बना सकता है।
- क्या पासवर्ड से सुरक्षित Word फ़ाइल बदली जा सकती है?
- नहीं। एन्क्रिप्टेड .docx अंदर से अलग तरह का कंटेनर है और कनवर्टर यही बताता है। Word में पासवर्ड हटाकर एक प्रति सहेजें और उसे बदलें। पासवर्ड वाली PDF समर्थित हैं।
- मेरे दस्तावेज़ का कुछ हिस्सा कोड में क्यों बदल गया?
- Word किसी हिस्से को कोड के रूप में चिह्नित नहीं करता, इसलिए मोनोस्पेस फ़ॉन्ट ही एकमात्र संकेत है जो फ़ाइल में रहता है। Consolas, Courier New या ऐसी ही किसी फ़ॉन्ट में लिखा टेक्स्ट इनलाइन कोड बन जाता है। अगर यह इरादा नहीं था तो Word में फ़ॉन्ट बदल दीजिए।