PDF से DOCX कनवर्टर

pdf → docx

PDF को एडिट करने लायक Word (.docx) डॉक्यूमेंट में बदलें। आपका ब्राउज़र टेक्स्ट लेयर पढ़कर खुद फ़ाइल बनाता है, इसलिए कुछ भी अपलोड नहीं होता।

सेटिंग्स
कतारकुछ भी अपलोड नहीं होता
PDF फ़ाइल यहाँ खींचें और छोड़ें
PDF की टेक्स्ट लेयर पढ़ी जा रही है...

इस PDF से DOCX कनवर्टर के बारे में

यह कनवर्टर आपके ब्राउज़र में PDF को एडिट करने लायक Word डॉक्यूमेंट में बदलता है। PDF.js हर पेज की टेक्स्ट लेयर पढ़ता है, पोज़िशन वाले टेक्स्ट को फिर से लाइनों और पैराग्राफ़ में जोड़ा जाता है, और नतीजे को JSZip से असली Office Open XML .docx फ़ाइल के रूप में पैक किया जाता है।

PDF यह सहेजता है कि पेज पर हर अक्षर कहाँ है, यह नहीं कि कोई लाइन हेडिंग है या टेबल की सेल, इसलिए कनवर्टर को पोज़िशन और स्पेसिंग से संरचना का अंदाज़ा लगाना पड़ता है। सामान्य टेक्स्ट वाले पेज पर यह पढ़ने का क्रम और पैराग्राफ़ सही पकड़ लेता है। स्कैन किए पेज में टेक्स्ट लेयर होती ही नहीं, इसलिए वहाँ पढ़ने को कुछ नहीं होता।

इस्तेमाल कैसे करें

01

PDF जोड़ें

बॉक्स पर PDF छोड़ें, या PDF फ़ाइल चुनें से चुनें। फ़ाइल में टेक्स्ट लेयर हो तो टेक्स्ट प्रीव्यू दिखता है, नहीं तो चेतावनी दिखती है।

02

लेआउट चुनें

तय करें कि टूटी हुई लाइनें पैराग्राफ़ में जुड़ें या अलग रहें, और हर पेज पर "Page N" हेडिंग जोड़नी है या नहीं।

03

बदलें

PDF को DOCX में बदलें पर क्लिक करें। PDF.js हर पेज पढ़ता है और प्रोग्रेस बार इसे दिखाता है।

04

अपनी फ़ाइल पाएँ

तैयार .docx डाउनलोड बटन के साथ दिखती है, नाम उसी PDF का जिससे आपने शुरू किया था। यह आपके डिवाइस पर तभी आती है जब आप क्लिक करते हैं।

यह क्या करता है

  • आपका ब्राउज़र PDF पढ़ता है और Word फ़ाइल बनाता है; कुछ भी अपलोड नहीं होता।
  • पढ़ने का क्रम और पैराग्राफ़ ब्रेक बने रहते हैं। डिफ़ॉल्ट रूप से टूटी हुई लाइनें फिर से पैराग्राफ़ में जुड़ जाती हैं, या आप PDF की हर लाइन को अलग पैराग्राफ़ रख सकते हैं।
  • हर पेज के टेक्स्ट के ऊपर एक वैकल्पिक बोल्ड "Page N" हेडिंग जोड़ी जा सकती है।
  • नतीजा एक असली Office Open XML .docx पैकेज होता है, वही फ़ॉर्मैट जिसमें Word खुद सेव करता है, JSZip से बना।
  • स्कैन किए पेज या सिर्फ़ इमेज वाली किसी और PDF में टेक्स्ट लेयर नहीं होती, इसलिए टूल उसे पढ़ नहीं पाता; ऐसे में एक चेतावनी आपको OCR टूल की तरफ़ भेजती है।
  • एक बार में एक PDF बदलता है, अधिकतम 100 MB तक।

तकनीकी जानकारी

विशेषता विवरण
स्वीकार करता है टेक्स्ट लेयर वाली PDF फ़ाइलें, एक बार में एक
आउटपुट एक .docx फ़ाइल, A4 साइज़, 2 सेमी मार्जिन के साथ
लेआउट विकल्प टूटी लाइनों को पैराग्राफ़ में जोड़ें, या हर लाइन अलग रखें
पेज हेडिंग हर पेज पर वैकल्पिक बोल्ड "Page N" हेडिंग
नहीं निकाला जाता इमेज, टेबल, कॉलम, फ़ॉन्ट और रंग; सिर्फ़ टेक्स्ट पढ़ा जाता है
साइज़ सीमा 100 MB
लाइब्रेरी PDF.js फ़ाइल पढ़ता है; JSZip .docx पैक करता है; दोनों cdnjs CDN से लोड होते हैं
आपकी फ़ाइल कहाँ जाती है कहीं नहीं। यह इस टैब की मेमोरी में ही रहती है।
ध्यान देने लायक

कनवर्टर क्या नहीं करता

यह PDF के टेक्स्ट को Word पैराग्राफ़ के रूप में दोबारा बनाता है। जो चीज़ें PDF वाक़ई सहेजता ही नहीं, वे वापस नहीं आ सकतीं।

स्कैन की गई PDF नहीं चलेगी

स्कैन किया पेज बिना टेक्स्ट लेयर की एक इमेज है, इसलिए टूल उसे पढ़ नहीं पाता। पहले इसे PDF और इमेज OCR से गुज़ारें, फिर पहचाना गया टेक्स्ट किसी डॉक्यूमेंट में पेस्ट करें।

इमेज या टेबल नहीं

सिर्फ़ टेक्स्ट निकलता है। इमेज और Word की असली टेबल नहीं निकाली जातीं; टेबल की सेल आम तौर पर अलग-अलग टेक्स्ट लाइनों के रूप में वापस आती हैं।

मूल फ़ॉर्मैटिंग नहीं

फ़ॉन्ट, रंग, बोल्ड और इटैलिक स्टाइल, और मल्टी-कॉलम लेआउट नहीं बचते, और सोर्स पेजों के बीच कोई असली Word पेज ब्रेक नहीं होता, सिर्फ़ एक वैकल्पिक "Page N" हेडिंग होती है।

रीफ़्लो एक अंदाज़ा है

पैराग्राफ़ ब्रेक टेक्स्ट लाइनों के बीच की दूरी नापकर तय होते हैं, PDF की असली संरचना से नहीं, इसलिए असामान्य लेआउट ठीक से रीफ़्लो नहीं हो पाते। अगर पैराग्राफ़ ग़लत तरीक़े से जुड़ रहे हों, तो "हर लाइन को अलग पैराग्राफ़ रखें" पर स्विच करें।

एक बार में एक फ़ाइल

कतार में एक बार में एक ही PDF आता है, अधिकतम 100 MB तक। दूसरी दिशा में जाने के लिए DOCX से PDF इस्तेमाल करें।

संबंधित टूल

अक्सर पूछे जाने वाले सवाल

कनवर्टर आपकी PDF के टेक्स्ट को एडिट करने लायक Word पैराग्राफ़ के रूप में दोबारा बनाता है। पढ़ने का क्रम और पैराग्राफ़ ब्रेक बने रहते हैं, लेकिन कॉलम, टेबल, इमेज और फ़ॉन्ट की सटीक स्टाइलिंग नहीं, क्योंकि PDF डॉक्यूमेंट की संरचना के बजाय तय जगहों पर रखे अक्षर सहेजती है।

स्कैन की गई PDF बिना टेक्स्ट लेयर के किसी पेज की तस्वीर होती है, इसलिए यह टूल उसे पढ़ नहीं सकता। पहले फ़ाइल को PDF और इमेज OCR से गुज़ारकर टेक्स्ट पहचानें, फिर उसे किसी डॉक्यूमेंट में पेस्ट करें।

टूल उसे खोल नहीं पाता। जिस ऐप से PDF बनाई थी उसमें, या किसी और PDF टूल से पासवर्ड हटाएँ और दोबारा कोशिश करें।

नहीं। PDF.js फ़ाइल खोलता है और JSZip .docx पैकेज तैयार करता है, यह सब पूरी तरह ब्राउज़र के इस टैब के अंदर होता है। आपके डॉक्यूमेंट का एक भी बाइट डिवाइस से बाहर नहीं जाता।

हाँ। यह टूल स्टैंडर्ड के अनुरूप Office Open XML WordprocessingML पैकेज बनाता है, यानी वही .docx फ़ॉर्मैट जिसमें Word खुद फ़ाइलें सेव करता है, इसलिए यह Microsoft Word, Google Docs, LibreOffice Writer, Pages और WPS Office में खुलती है।

डिफ़ॉल्ट रूप से टूटी हुई लाइनें फिर से सामान्य पैराग्राफ़ में जुड़ जाती हैं। यह सेटिंग इसके बजाय PDF के मूल लाइन ब्रेक बनाए रखती है, जो टेबल, कोड, पते और ऐसे बाक़ी कंटेंट के लिए ठीक रहता है जिसे दोबारा फ़्लो नहीं करना चाहिए।

आपकी फ़ाइल आपके डिवाइस पर ही रहती है

PDF.js फ़ाइल पढ़ता है और JSZip .docx बनाता है, दोनों इसी टैब के अंदर। आपका डॉक्यूमेंट अपलोड या सेव नहीं होता, और टैब बंद करते ही यह मेमोरी से मिट जाता है। सिर्फ़ ये लाइब्रेरी cdnjs CDN से डाउनलोड होती हैं।