सीधे कंटेंट पर जाएं

पेज की फ़ोटो को स्कैन में बदलें

डॉक्यूमेंट की फ़ोटो ग्रे होती है, एक तरफ़ से रोशन होती है और थोड़ी टेढ़ी होती है। यह टूल उसे सीधा करता है, रोशनी बराबर करता है ताकि कागज़ सफ़ेद दिखे, और उसे PDF के रूप में सेव करता है — चाहें तो पीछे टेक्स्ट के साथ, ताकि स्कैन सर्च किया जा सके।

  • कभी स्टोर नहीं होती
  • न कतार, न इंतज़ार
  • साइनअप नहीं, वॉटरमार्क नहीं

यह कैसे काम करता है

1

अपनी फ़ोटो जोड़ें

एक पेज या कई — वे एक PDF के पेज बन जाते हैं, उसी क्रम में जिसमें आपने उन्हें जोड़ा।

2

साफ़ होते देखें

तिरछापन मापकर हटाया जाता है, और स्याही के पीछे के कागज़ का अनुमान लगाकर उसे सफ़ेद किया जाता है — इसी से फ़ोटो, फ़ोटो जैसी दिखना बंद करती है।

3

PDF डाउनलोड करें

टेक्स्ट लेयर मांगें तो शब्द पढ़कर पेज के ऊपर अदृश्य रूप से रख दिए जाते हैं, ताकि स्कैन में सर्च किया जा सके और उससे कॉपी किया जा सके।

फ़ोटो को ऐसा बनाना जो डॉक्यूमेंट जैसा पढ़ा जाए

पेज की फ़ोटो और पेज के स्कैन में तीन फ़र्क़ होते हैं, और उनमें से दो यहां ठीक किए जाते हैं। पेज सीधा किया जाता है — जो शीट तिरछी गई थी, या जिसकी फ़ोटो थोड़ी घूमी हुई ली गई थी, उसे सीधा घुमाया जाता है — और उसे खड़ा किया जाता है, ताकि साइड में कैप्चर हुआ पेज सही दिशा में आए। पढ़ने के लिए ये दोनों वैसे भी ज़रूरी थे, इसीलिए ये मुफ़्त में मिल जाते हैं। कॉन्ट्रास्ट बढ़ाया जाता है ताकि कागज़ सफ़ेद और स्याही काली दिखे, न कि डॉक्यूमेंट की ग्रे फ़ोटो जैसी।

तीसरा फ़र्क़ ठीक नहीं किया जाता, और उसी को ध्यान में रखकर तैयारी करनी है। पर्सपेक्टिव ठीक नहीं होता: तिरछे कोण से खींचा गया पेज अपना समलंब आकार बनाए रखता है, दूर वाले किनारे पर संकरा, और सिर्फ़ उसका रोटेशन सीधा होता है। गहरी तह वाला पेज, या मोटी किताब की जिल्द की ओर मुड़ता पेज, मुड़ा ही रहता है। दोनों से टेक्स्ट पढ़ना भी मुश्किल होता है और दिखने में भी भद्दा — इसलिए सबसे काम की बात यह है कि कैमरे को पेज पर झुकाने के बजाय ठीक उसके ऊपर रखें।

टेक्स्ट लेयर मांगने पर आपको ऐसी PDF मिलती है जो बिल्कुल फ़ोटो जैसी दिखती है और डॉक्यूमेंट जैसा बर्ताव करती है: पहचाने गए शब्द फ़ोटो के शब्दों के ऊपर अदृश्य रूप से रखे जाते हैं, ताकि फ़ाइल ओरिजिनल की इमेज रहते हुए भी सर्च, सेलेक्ट और कॉपी की जा सके। कुछ भी दोबारा टाइपसेट नहीं होता, और रूप नहीं बदलता — रसीद, कॉन्ट्रैक्ट या किसी भी ऐसी चीज़ के लिए आपको यही चाहिए जिसमें ओरिजिनल का रूप रिकॉर्ड का हिस्सा है।

सटीकता कैप्चर पर निर्भर करती है, और फ़र्क़ मामूली नहीं होता। समतल, एक-सी रोशनी वाला, फ़ोकस में और कैमरे के ठीक सामने वाला पेज अच्छा पढ़ा जाता है; पेज पर आपके अपने सिर की परछाईं, चमकदार कागज़ से टकराती फ़ोन की फ़्लैश, या मुड़ी-तुड़ी रसीद नहीं। चीनी, जापानी और कोरियाई शब्द पहचाने तो जाते हैं, पर टेक्स्ट लेयर में लिखे नहीं, सिर्फ़ गिने जाते हैं, क्योंकि उन्हें लिख सकने वाला कोई फ़ॉन्ट साथ नहीं आता — आपको बताया जाता है कि कितने हैं, ताकि आपके पास ऐसी ख़ाली जगहें न रह जाएं जिन पर शायद आपका ध्यान न जाए।

जब आपको कुछ और चाहिए

आपके फ़ोन में यह लगभग पक्के तौर पर पहले से मौजूद है, और बेहतर। iOS का Notes ऐप और Android पर Google Drive दोनों लाइव पर्सपेक्टिव सुधार के साथ डॉक्यूमेंट स्कैन करते हैं — कैमरा पकड़ते ही वे पेज के किनारे ढूंढ लेते हैं और समलंब को ठीक से सीधा करते हैं, और ठीक यही चरण यहां नहीं है। पेज की फ़ोटो लेने के लिए इनमें से किसी का इस्तेमाल करें, और अगर उस पर काम करना हो तो नतीजा कहीं और ले जाएं।

पेजों के ढेर के लिए OCRmyPDF सही टूल है और मुफ़्त है: ocrmypdf --deskew --rotate-pages --clean in.pdf out.pdf किसी भी लंबाई के डॉक्यूमेंट पर एक ही बार में सीधा करना, रोटेशन, सफ़ाई और टेक्स्ट लेयर कर देता है, और --output-type pdfa उसी समय उसे आर्काइव लायक बना देता है। unpaper स्कैन की ज़्यादा मुश्किल सफ़ाई संभालता है — किताब के स्कैन से काला बॉर्डर हटाना, दो पेज वाले स्प्रेड को अलग करना — जिसकी यहां कोई कोशिश नहीं की जाती।

अक्सर पूछे जाने वाले सवाल

यह असल में क्या बदलता है?

तीन चीज़ें। तिरछापन: पूरे पेज में टेक्स्ट का कोण मापकर हटाया जाता है, ताकि लाइनें सीधी हों। रोशनी: स्याही के पीछे के कागज़ की चमक टुकड़ों में आंकी जाती है और एक-सी सफ़ेद कर दी जाती है, जिससे एक किनारे की ओर घटती रोशनी और आपके हाथ की परछाईं हट जाती है। और कॉन्ट्रास्ट: उस सफ़ेद के सामने स्याही गहरी की जाती है। यह कुछ भी नया नहीं गढ़ता — शार्प करके कुछ पैदा नहीं किया जाता।

क्या यह स्कैन को सर्च करने लायक बना सकता है?

हां। टेक्स्ट लेयर चालू करें, तो हर शब्द पढ़ा जाता है और फ़ोटो के ऊपर ठीक उसी जगह अदृश्य रूप से रखा जाता है जहां वह दिखता है, ताकि Ctrl+F उसे ढूंढ सके और आप PDF से सेलेक्ट और कॉपी कर सकें। पेज फिर भी बिल्कुल फ़ोटो जैसा दिखता है; टेक्स्ट कभी पेंट नहीं होता, सिर्फ़ सेलेक्ट करने लायक बनाया जाता है।

क्या मेरी फ़ोटो कहीं स्टोर होती है?

नहीं। सफ़ाई और पढ़ाई दोनों यहीं होती हैं, और कुछ भी स्टोर नहीं होता। कुछ भी कहीं भेजा नहीं जाता।

क्या मुझे पहले पेज तक क्रॉप करना चाहिए?

इससे मदद मिलती है। कागज़ का अनुमान तब सबसे अच्छा काम करता है जब फ़्रेम का ज़्यादातर हिस्सा कागज़ हो, इसलिए किनारों पर गहरी मेज़ वाली फ़ोटो पहले क्रॉप करने पर बेहतर निकलती है। तिरछापन मापते समय बाहरी किनारे जानबूझकर नज़रअंदाज़ किए जाते हैं, इसलिए थोड़ा-सा बैकग्राउंड कोई समस्या नहीं।

क्या यह तिरछे कोण से ली गई फ़ोटो ठीक करेगा?

यह रोटेशन हटाता है — कुछ डिग्री टेढ़ा पेज सीधा कर दिया जाता है। यह पर्सपेक्टिव ठीक नहीं करता, इसलिए साइड से खींचा गया पेज, जिसका एक किनारा दूसरे से लंबा है, उसी आकार में रहता है। ठीक ऊपर से फ़ोटो लेने में लगा एक सेकंड वसूल है।

रंगीन या ब्लैक एंड व्हाइट?

रंग बने रहते हैं, पीछे का कागज़ सफ़ेद कर दिया जाता है — इसलिए मुहर, नीली स्याही वाले हस्ताक्षर या हाइलाइट की गई लाइन अपने रंग में रहती है। डॉक्यूमेंट से आमतौर पर यही चाहिए होता है; यह ब्लैक एंड व्हाइट फ़ैक्स नहीं है।

PDF कितनी बड़ी होगी?

हर पेज कैमरे के पूरे रिज़ॉल्यूशन पर नहीं, बल्कि पढ़ने लायक साइज़ की JPEG के रूप में रखा जाता है, इसलिए 4 MB वाली फ़ोन फ़ोटो आमतौर पर प्रति पेज 1 MB से कम में आ जाती है, 100% पर बिना किसी दिखने वाले नुक़सान के।

ध्यान दें: पर्सपेक्टिव ठीक नहीं किया जाता: तिरछे कोण से खींचा गया पेज अपना समलंब आकार बनाए रखता है, सिर्फ़ रोटेशन ठीक होता है। गहरी तह वाला या जिल्द के पास ज़्यादा मुड़ा हुआ पेज मुड़ा ही रहेगा। टेक्स्ट लेयर, अगर आप मांगें, पर वही शर्तें लागू हैं जो किसी भी OCR पर — और चीनी, जापानी व कोरियाई शब्द लिखे नहीं, सिर्फ़ गिने जाते हैं, क्योंकि उनके लिए कोई फ़ॉन्ट साथ नहीं आता।

यह टूल अपनी वेबसाइट पर लगाएं

किसी भी ब्लॉग, क्लास पेज या हेल्प आर्टिकल के लिए मुफ़्त। एक स्निपेट पेस्ट करें और आपके विज़िटर इसे सीधे आपके पेज पर इस्तेमाल कर सकेंगे।