पेज की फ़ोटो को स्कैन में बदलें
डॉक्यूमेंट की फ़ोटो ग्रे होती है, एक तरफ़ से रोशन होती है और थोड़ी टेढ़ी होती है। यह टूल उसे सीधा करता है, रोशनी बराबर करता है ताकि कागज़ सफ़ेद दिखे, और उसे PDF के रूप में सेव करता है — चाहें तो पीछे टेक्स्ट के साथ, ताकि स्कैन सर्च किया जा सके।
- कभी स्टोर नहीं होती
- न कतार, न इंतज़ार
- साइनअप नहीं, वॉटरमार्क नहीं
यह कैसे काम करता है
अपनी फ़ोटो जोड़ें
एक पेज या कई — वे एक PDF के पेज बन जाते हैं, उसी क्रम में जिसमें आपने उन्हें जोड़ा।
साफ़ होते देखें
तिरछापन मापकर हटाया जाता है, और स्याही के पीछे के कागज़ का अनुमान लगाकर उसे सफ़ेद किया जाता है — इसी से फ़ोटो, फ़ोटो जैसी दिखना बंद करती है।
PDF डाउनलोड करें
टेक्स्ट लेयर मांगें तो शब्द पढ़कर पेज के ऊपर अदृश्य रूप से रख दिए जाते हैं, ताकि स्कैन में सर्च किया जा सके और उससे कॉपी किया जा सके।
फ़ोटो को ऐसा बनाना जो डॉक्यूमेंट जैसा पढ़ा जाए
पेज की फ़ोटो और पेज के स्कैन में तीन फ़र्क़ होते हैं, और उनमें से दो यहां ठीक किए जाते हैं। पेज सीधा किया जाता है — जो शीट तिरछी गई थी, या जिसकी फ़ोटो थोड़ी घूमी हुई ली गई थी, उसे सीधा घुमाया जाता है — और उसे खड़ा किया जाता है, ताकि साइड में कैप्चर हुआ पेज सही दिशा में आए। पढ़ने के लिए ये दोनों वैसे भी ज़रूरी थे, इसीलिए ये मुफ़्त में मिल जाते हैं। कॉन्ट्रास्ट बढ़ाया जाता है ताकि कागज़ सफ़ेद और स्याही काली दिखे, न कि डॉक्यूमेंट की ग्रे फ़ोटो जैसी।
तीसरा फ़र्क़ ठीक नहीं किया जाता, और उसी को ध्यान में रखकर तैयारी करनी है। पर्सपेक्टिव ठीक नहीं होता: तिरछे कोण से खींचा गया पेज अपना समलंब आकार बनाए रखता है, दूर वाले किनारे पर संकरा, और सिर्फ़ उसका रोटेशन सीधा होता है। गहरी तह वाला पेज, या मोटी किताब की जिल्द की ओर मुड़ता पेज, मुड़ा ही रहता है। दोनों से टेक्स्ट पढ़ना भी मुश्किल होता है और दिखने में भी भद्दा — इसलिए सबसे काम की बात यह है कि कैमरे को पेज पर झुकाने के बजाय ठीक उसके ऊपर रखें।
टेक्स्ट लेयर मांगने पर आपको ऐसी PDF मिलती है जो बिल्कुल फ़ोटो जैसी दिखती है और डॉक्यूमेंट जैसा बर्ताव करती है: पहचाने गए शब्द फ़ोटो के शब्दों के ऊपर अदृश्य रूप से रखे जाते हैं, ताकि फ़ाइल ओरिजिनल की इमेज रहते हुए भी सर्च, सेलेक्ट और कॉपी की जा सके। कुछ भी दोबारा टाइपसेट नहीं होता, और रूप नहीं बदलता — रसीद, कॉन्ट्रैक्ट या किसी भी ऐसी चीज़ के लिए आपको यही चाहिए जिसमें ओरिजिनल का रूप रिकॉर्ड का हिस्सा है।
सटीकता कैप्चर पर निर्भर करती है, और फ़र्क़ मामूली नहीं होता। समतल, एक-सी रोशनी वाला, फ़ोकस में और कैमरे के ठीक सामने वाला पेज अच्छा पढ़ा जाता है; पेज पर आपके अपने सिर की परछाईं, चमकदार कागज़ से टकराती फ़ोन की फ़्लैश, या मुड़ी-तुड़ी रसीद नहीं। चीनी, जापानी और कोरियाई शब्द पहचाने तो जाते हैं, पर टेक्स्ट लेयर में लिखे नहीं, सिर्फ़ गिने जाते हैं, क्योंकि उन्हें लिख सकने वाला कोई फ़ॉन्ट साथ नहीं आता — आपको बताया जाता है कि कितने हैं, ताकि आपके पास ऐसी ख़ाली जगहें न रह जाएं जिन पर शायद आपका ध्यान न जाए।
जब आपको कुछ और चाहिए
आपके फ़ोन में यह लगभग पक्के तौर पर पहले से मौजूद है, और बेहतर। iOS का Notes ऐप और Android पर Google Drive दोनों लाइव पर्सपेक्टिव सुधार के साथ डॉक्यूमेंट स्कैन करते हैं — कैमरा पकड़ते ही वे पेज के किनारे ढूंढ लेते हैं और समलंब को ठीक से सीधा करते हैं, और ठीक यही चरण यहां नहीं है। पेज की फ़ोटो लेने के लिए इनमें से किसी का इस्तेमाल करें, और अगर उस पर काम करना हो तो नतीजा कहीं और ले जाएं।
पेजों के ढेर के लिए OCRmyPDF सही टूल है और मुफ़्त है: ocrmypdf --deskew --rotate-pages --clean in.pdf out.pdf किसी भी लंबाई के डॉक्यूमेंट पर एक ही बार में सीधा करना, रोटेशन, सफ़ाई और टेक्स्ट लेयर कर देता है, और --output-type pdfa उसी समय उसे आर्काइव लायक बना देता है। unpaper स्कैन की ज़्यादा मुश्किल सफ़ाई संभालता है — किताब के स्कैन से काला बॉर्डर हटाना, दो पेज वाले स्प्रेड को अलग करना — जिसकी यहां कोई कोशिश नहीं की जाती।
अक्सर पूछे जाने वाले सवाल
यह असल में क्या बदलता है?
तीन चीज़ें। तिरछापन: पूरे पेज में टेक्स्ट का कोण मापकर हटाया जाता है, ताकि लाइनें सीधी हों। रोशनी: स्याही के पीछे के कागज़ की चमक टुकड़ों में आंकी जाती है और एक-सी सफ़ेद कर दी जाती है, जिससे एक किनारे की ओर घटती रोशनी और आपके हाथ की परछाईं हट जाती है। और कॉन्ट्रास्ट: उस सफ़ेद के सामने स्याही गहरी की जाती है। यह कुछ भी नया नहीं गढ़ता — शार्प करके कुछ पैदा नहीं किया जाता।
क्या यह स्कैन को सर्च करने लायक बना सकता है?
हां। टेक्स्ट लेयर चालू करें, तो हर शब्द पढ़ा जाता है और फ़ोटो के ऊपर ठीक उसी जगह अदृश्य रूप से रखा जाता है जहां वह दिखता है, ताकि Ctrl+F उसे ढूंढ सके और आप PDF से सेलेक्ट और कॉपी कर सकें। पेज फिर भी बिल्कुल फ़ोटो जैसा दिखता है; टेक्स्ट कभी पेंट नहीं होता, सिर्फ़ सेलेक्ट करने लायक बनाया जाता है।
क्या मेरी फ़ोटो कहीं स्टोर होती है?
नहीं। सफ़ाई और पढ़ाई दोनों यहीं होती हैं, और कुछ भी स्टोर नहीं होता। कुछ भी कहीं भेजा नहीं जाता।
क्या मुझे पहले पेज तक क्रॉप करना चाहिए?
इससे मदद मिलती है। कागज़ का अनुमान तब सबसे अच्छा काम करता है जब फ़्रेम का ज़्यादातर हिस्सा कागज़ हो, इसलिए किनारों पर गहरी मेज़ वाली फ़ोटो पहले क्रॉप करने पर बेहतर निकलती है। तिरछापन मापते समय बाहरी किनारे जानबूझकर नज़रअंदाज़ किए जाते हैं, इसलिए थोड़ा-सा बैकग्राउंड कोई समस्या नहीं।
क्या यह तिरछे कोण से ली गई फ़ोटो ठीक करेगा?
यह रोटेशन हटाता है — कुछ डिग्री टेढ़ा पेज सीधा कर दिया जाता है। यह पर्सपेक्टिव ठीक नहीं करता, इसलिए साइड से खींचा गया पेज, जिसका एक किनारा दूसरे से लंबा है, उसी आकार में रहता है। ठीक ऊपर से फ़ोटो लेने में लगा एक सेकंड वसूल है।
रंगीन या ब्लैक एंड व्हाइट?
रंग बने रहते हैं, पीछे का कागज़ सफ़ेद कर दिया जाता है — इसलिए मुहर, नीली स्याही वाले हस्ताक्षर या हाइलाइट की गई लाइन अपने रंग में रहती है। डॉक्यूमेंट से आमतौर पर यही चाहिए होता है; यह ब्लैक एंड व्हाइट फ़ैक्स नहीं है।
PDF कितनी बड़ी होगी?
हर पेज कैमरे के पूरे रिज़ॉल्यूशन पर नहीं, बल्कि पढ़ने लायक साइज़ की JPEG के रूप में रखा जाता है, इसलिए 4 MB वाली फ़ोन फ़ोटो आमतौर पर प्रति पेज 1 MB से कम में आ जाती है, 100% पर बिना किसी दिखने वाले नुक़सान के।
ध्यान दें: पर्सपेक्टिव ठीक नहीं किया जाता: तिरछे कोण से खींचा गया पेज अपना समलंब आकार बनाए रखता है, सिर्फ़ रोटेशन ठीक होता है। गहरी तह वाला या जिल्द के पास ज़्यादा मुड़ा हुआ पेज मुड़ा ही रहेगा। टेक्स्ट लेयर, अगर आप मांगें, पर वही शर्तें लागू हैं जो किसी भी OCR पर — और चीनी, जापानी व कोरियाई शब्द लिखे नहीं, सिर्फ़ गिने जाते हैं, क्योंकि उनके लिए कोई फ़ॉन्ट साथ नहीं आता।
यह टूल अपनी वेबसाइट पर लगाएं
किसी भी ब्लॉग, क्लास पेज या हेल्प आर्टिकल के लिए मुफ़्त। एक स्निपेट पेस्ट करें और आपके विज़िटर इसे सीधे आपके पेज पर इस्तेमाल कर सकेंगे।
मिलते-जुलते टूल्स
इमेज से टेक्स्ट निकालें
फ़ोटो से शब्द, 120+ भाषाओं में
PDF OCR करें
स्कैन को सर्च करने लायक बनाएं
JPG को PDF में बदलें
फ़ोटो एक PDF में, आपके क्रम में
स्क्रीनशॉट से टेक्स्ट निकालें
स्क्रीनशॉट पेस्ट करें, टेक्स्ट पाएं
हाथ की लिखावट पढ़ें
अलग-अलग लिखे अक्षर, ईमानदारी से पढ़े गए
QR कोड स्कैन करें
खोलने से पहले देखें कि QR कोड में क्या लिखा है