PDF को Word में बदलें
किसी भी PDF को एडिट होने वाले Word डॉक्यूमेंट में बदलें — इमेज समेत, ओरिजिनल पेजों जैसा दिखाने वाले “हूबहू रूप” मोड और स्कैन के लिए बिल्ट-इन OCR के साथ। कुछ भी स्टोर नहीं किया जाता; आपकी फ़ाइल कभी रखी नहीं जाती।
- कभी स्टोर नहीं होती
- न कतार, न इंतज़ार
- साइनअप नहीं, वॉटरमार्क नहीं
यह कैसे काम करता है
अपनी PDF जोड़ें
PDF को पेज पर छोड़ें। टूल उसे अपने-आप जांचता है और स्कैन पहचानने पर OCR चालू कर देता है।
मोड चुनें
डिफ़ॉल्ट “एडिट होने वाला टेक्स्ट” आपको एक सामान्य Word डॉक्यूमेंट देता है, PDF के साथ पेज-दर-पेज: पैराग्राफ़, हेडिंग, बोल्ड और इटैलिक, लिंक और इमेज, हर पेज अपने ओरिजिनल साइज़ में अपने मार्जिन और लाइन स्पेसिंग के साथ, ताकि PDF का पेज 12 डॉक्यूमेंट का भी पेज 12 हो — और फ़ाइल लगभग PDF जितनी ही बड़ी। “हूबहू रूप” हर लाइन को पेज की तस्वीर के ऊपर ठीक उसी जगह टिका देता है — प्रिंट के लिए यह PDF जैसा ही दिखता है, पर एडिट करना मुश्किल है और फ़ाइल कई गुना बड़ी होती है। स्कैन के लिए OCR अपने-आप चालू होता है, पहले पेज से भाषा पहचानता है, और टेढ़े स्कैन हुए पेजों को सीधा करता है।
बदलें और डाउनलोड करें
“Word में बदलें” पर क्लिक करें और हेडिंग व पैराग्राफ़ वाली साफ़ .docx डाउनलोड करें, एडिट के लिए तैयार।
क्या साफ़ कन्वर्ट होता है, और क्या नहीं
PDF ग्लिफ़ को कोऑर्डिनेट पर दर्ज करती है। उसमें पैराग्राफ़ नहीं होते और, जब तक किसी ने जान-बूझकर टैग न किया हो, हेडिंग भी नहीं — इसलिए दोनों को पढ़ा नहीं, अंदाज़े से तय किया जाता है। एक ही बेसलाइन वाले शब्द एक लाइन बनते हैं, बढ़ता हुआ खड़ा फ़ासला नया पैराग्राफ़ शुरू करता है, और डॉक्यूमेंट के मीडियन बॉडी साइज़ से लगभग 1.6 गुना पर सेट छोटी लाइन Heading 1 बनती है, 1.3 गुना पर Heading 2। एडिट शुरू करने से पहले यह आख़िरी नियम जानना काम का है: जिस डॉक्यूमेंट की हेडिंग बोल्ड हैं पर बॉडी टेक्स्ट से बड़ी नहीं, वे बॉडी टेक्स्ट बनकर आती हैं, और Word का नेविगेशन पेन ख़ाली रहेगा।
लिंक बच जाते हैं, जिससे लोग हैरान होते हैं। टेक्स्ट के किसी हिस्से पर लगा लिंक एनोटेशन असली Word हाइपरलिंक बन जाता है, और जो विषय-सूची की एंट्री या क्रॉस-रेफ़रेंस पेज बारह पर ले जाता था, वह उस पेज के ऊपर लगाए गए बुकमार्क का अंदरूनी लिंक बन जाता है — इसलिए कन्वर्ज़न के बाद भी विषय-सूची काम करती है।
दो चीज़ें बिल्कुल नहीं पढ़ी जातीं। भरे हुए PDF फ़ॉर्म के जवाब पेज में नहीं, फ़ील्ड ऑब्जेक्ट में रहते हैं, इसलिए “एडिट होने वाला टेक्स्ट” में वे होते ही नहीं; “हूबहू रूप” उन्हें दिखाता है, क्योंकि वे पेज की तस्वीर का हिस्सा हैं, पर एडिट होने वाले टेक्स्ट के रूप में नहीं। कमेंट और स्टैम्प भी इसी तरह के ऑब्जेक्ट हैं और उनका भी यही हाल होता है। और “हूबहू रूप” में आर्टवर्क एक बार 144 DPI पर रेंडर होता है और असली टेक्स्ट उसके ऊपर रखा जाता है, इसलिए PDF में जो लोगो या चार्ट वेक्टर था, वह .docx में एक तस्वीर है, और बड़ा करने पर यह दिख जाता है।
जब आपको कुछ और चाहिए
जब आपको Word डॉक्यूमेंट नहीं बल्कि सिर्फ़ शब्द चाहिए, तो Poppler का pdftotext -layout file.pdf ज़्यादा तेज़ और ज़्यादा भरोसेमंद है, कॉलम को स्पेस से अलग रखता है, और PDF को किसी और चीज़ में डालने का आम तरीक़ा यही है। और अगर PDF शुरू में किसी Word फ़ाइल से ही बनी थी, तो बनाने वाले से .docx मांग लें: वापस किया गया हर कन्वर्ज़न कोऑर्डिनेट से किया गया पुनर्निर्माण है, और ओरिजिनल ही अकेली कॉपी है जो ऐसी नहीं है।
टेबल हर PDF-से-कुछ-भी कन्वर्टर की कमज़ोर कड़ी हैं, यह भी शामिल है। अगर डॉक्यूमेंट में ज़्यादातर टेबल हैं और नंबर मायने रखते हैं, तो Tabula और Camelot मुफ़्त हैं, इसी एक समस्या के लिए बने हैं, और इसमें किसी सामान्य कन्वर्टर को पीछे छोड़ देंगे।
अक्सर पूछे जाने वाले सवाल
कन्वर्ट करते समय क्या मेरी PDF स्टोर होती है?
नहीं। दोनों कन्वर्ज़न मोड कुछ भी स्टोर नहीं करते — आपकी फ़ाइल कभी रखी नहीं जाती। OCR के साथ, रीडर और भाषा पैक पहली बार इसी साइट से आते हैं; आपका डॉक्यूमेंट ख़ुद कभी कहीं नहीं भेजा जाता।
क्या यह स्कैन की गई PDF और डॉक्यूमेंट की फ़ोटो कन्वर्ट कर सकता है?
हां। OCR चालू करें (स्कैन पहचानने पर टूल अपने-आप इसका सुझाव देता है) और टेक्स्ट पेज की इमेज से पढ़ा जाता है। भाषा पेज से पहचानी जाती है — 120 से ज़्यादा भाषाएं सपोर्ट हैं, जिनमें अंग्रेज़ी, बंगाली, हिंदी, उर्दू, अरबी, स्पेनिश और चीनी शामिल हैं — और अंदाज़ा ग़लत हो तो आप ख़ुद भाषा चुन सकते हैं। “एडिट होने वाला टेक्स्ट” मोड में लाइन वाले फ़ॉर्म असली Word टेबल बनकर आते हैं।
OCR कितना सटीक है?
छपे हुए टेक्स्ट के साफ़ स्कैन पर सटीकता बहुत ज़्यादा है। धुंधली फ़ोटो, हाथ की लिखावट या असामान्य फ़ॉन्ट पर क्वालिटी घटती है। साफ़, सीधे और अच्छी रोशनी वाले स्कैन सबसे अच्छे नतीजे देते हैं।
क्या मेरी फ़ॉर्मैटिंग और इमेज बनी रहेंगी?
हां। “हूबहू रूप” हर पेज को उसके ओरिजिनल साइज़ में रखता है और उसे दो लेयर में दोबारा बनाता है: हर फ़ोटो, लोगो, रंगीन पट्टी और वेक्टर आर्टवर्क ठीक वैसे ही आता है जैसे PDF उसे बनाती है, और असली टेक्स्ट उसके ऊपर अपनी ओरिजिनल जगह पर बैठता है, ओरिजिनल रंग, बोल्ड और हेडिंग के साथ। वहीं “एडिट होने वाला टेक्स्ट” साफ़ पैराग्राफ़ और हेडिंग दोबारा बनाता है, इमेज पढ़ने के क्रम में, PDF के साथ पेज-दर-पेज — जब आपको बहुत ज़्यादा एडिट करना हो तो यही बेहतर है।
मुझे कौन-सा Word फ़ॉर्मैट मिलता है?
एक स्टैंडर्ड .docx फ़ाइल, जो Microsoft Word, Google Docs, LibreOffice और हर आधुनिक एडिटर में खुलती है।
क्या पेज या फ़ाइल की कोई लिमिट है?
कोई तय लिमिट नहीं। OCR में हर पेज पर कुछ सेकंड लगते हैं, क्योंकि पढ़ने का काम आपका अपना डिवाइस करता है, इसलिए बहुत लंबे स्कैन में बस ज़्यादा समय लगता है — प्रोग्रेस इंडिकेटर ठीक-ठीक दिखाता है कि काम कहां तक पहुंचा।
ध्यान दें: फ़ॉन्ट की जगह मिलते-जुलते फ़ॉन्ट लगाए जाते हैं, क्योंकि PDF अपने फ़ॉन्ट एम्बेड करती है और Word उन्हें इस्तेमाल नहीं कर सकता — इसलिए “हूबहू रूप” पिक्सेल-दर-पिक्सेल एक जैसा नहीं, लगभग एक जैसा होता है, और कोई लाइन ओरिजिनल से थोड़ी चौड़ी या संकरी हो सकती है। टेक्स्ट वाली PDF की टेबल Word टेबल के बजाय जगह पर रखे टेक्स्ट के रूप में कन्वर्ट होती हैं; स्कैन में लाइन वाली टेबल Word टेबल बनती हैं, पर बिना लाइन वाली जगह पर रखे टेक्स्ट ही रहती हैं। OCR जान-बूझकर फ़ोटो, लोगो और सजावटी ग्राफ़िक्स को अनदेखा करता है ताकि वे कभी बेतुके अक्षर न बनें, हाथ की लिखावट और स्टैम्प को तस्वीर ही रहने देता है, और हर पेज पर कुछ सेकंड लेता है।
यह टूल अपनी वेबसाइट पर लगाएं
किसी भी ब्लॉग, क्लास पेज या हेल्प आर्टिकल के लिए मुफ़्त। एक स्निपेट पेस्ट करें और आपके विज़िटर इसे सीधे आपके पेज पर इस्तेमाल कर सकेंगे।
और PDF टूल्स
PDF को टेक्स्ट में बदलें
प्लेन टेक्स्ट, जिसे कॉपी और एडिट कर सकें
PDF को Excel में बदलें
टेबल को असली स्प्रेडशीट में
PDF एडिट करें
मौजूदा टेक्स्ट बदलें, जोड़ें, ड्रॉ करें और साइन करें
PDF को PowerPoint में बदलें
किसी भी PDF से एडिट होने वाली स्लाइड
PDF को JPG में बदलें
हर पेज एक JPG इमेज के रूप में
PDF को PNG में बदलें
शार्प, लॉसलेस पेज इमेज