ছবি থেকে বাংলা পড়ুন
পাতার ছবি, স্ক্যান বা স্ক্রিনশট দিন আর বাংলা লেখাটি ইউনিকোড হিসেবে ফেরত পান — সার্চযোগ্য, এডিটযোগ্য আর পেস্ট করার জন্য তৈরি। ছবি আসার আগেই রিডার বাংলায় সেট করা থাকে, তাই শনাক্ত করার কিছু নেই, বেছে নেওয়ারও কিছু নেই। আপনার ছবি কখনো সংরক্ষণ করা হয় না।
- কখনো সংরক্ষণ করা হয় না
- কোনো লাইন নেই, অপেক্ষা নেই
- সাইনআপ নেই, ওয়াটারমার্ক নেই
যেভাবে কাজ করে
ছবি যোগ করুন
বইয়ের পাতার ছবি, পুরোনো পরিপত্র, স্ক্যান করা সার্টিফিকেট বা বাংলা লেখার স্ক্রিনশট। JPG, PNG, WebP, HEIC ও TIFF সবই চলে; কোণ থেকে তোলা ছবি আগে সোজা করা হয়।
পড়তে দিন
বাংলা আগে থেকেই বাছাই করা। পাতায় ইংরেজিও থাকলে — ফর্ম, লেটারহেড — তালিকা থেকে সেটি যোগ করুন, দুটোই পড়া হবে।
ইউনিকোড হিসেবে কপি করুন
মূল লেখা যে ফন্টেই ছাপা হোক, লেখা আসে ইউনিকোডে: SutonnyMJ-তে ছাপা পরিপত্র সাধারণ বাংলা হিসেবেই পড়া যায়, “evsjv‡`k”-এর মতো নয়। লেআউট রাখুন বা লাইনগুলো জুড়ে নিন, তারপর কপি বা ডাউনলোড করুন।
বাংলা হলে পড়ায় কী বদলায়
বাংলার মডেল অক্ষর নয়, অক্ষরগুচ্ছ পড়ে। ক্ষ বা ন্ত্র-এর মতো যুক্তাক্ষর পাতায় একটিই আকার, আর মডেলকে ঠিক করতে হয় সেটি কী এবং ইউনিকোডে কীভাবে ভাঙবে — এ কারণেই বাংলায় ভুল পড়া হলে সাধারণত সরাসরি ভুল অক্ষর নয়, ভুল যুক্তাক্ষর বা ভুল অক্ষরের ওপর স্বরচিহ্ন আসে। আউটপুট আসে ইউনিকোড যে ক্রম চায় সেই ক্রমে: স্বরচিহ্ন তার ব্যঞ্জনগুচ্ছের পরে, রেফ লেখা হয় র + হসন্ত হিসেবে যে গুচ্ছের ওপর বসে তার আগে, আর দুই অংশের স্বরচিহ্ন আসে একটি কোড পয়েন্টে। প্রতিটি সার্চ বক্স, বানান পরীক্ষক আর ফন্ট এই ক্রমই চায়, আর বিজয়ের টাইপিস্ট যে দৃশ্যমান ক্রমে কাজ করেন, এটি তার ঠিক উল্টো।
সাধারণ রিডার যা যা করে, এখানেও সবই করা হয়: কাগজের আলো সমান করা হয়, পাতা সোজা করা হয়, দাগ টানা টেবিল সেল ধরে ধরে পড়া হয় যাতে লেবেল আর তার মান আলাদা থাকে, আর ফলাফল আসে হয় পাতায় যেমন ছিল সেই লেআউটে, নয় অনুচ্ছেদে জোড়া। বাংলা অঙ্কে ছাপা সংখ্যা বাংলা অঙ্ক হিসেবেই পড়া হয়; যে ফর্মে ০১২ আর 012 মেশানো, তাতে দুটোই থাকে।
বাংলার মডেল অন্য কোনো ভাষার সঙ্গে ভাগাভাগি করা নয়, কিন্তু ছবিতে তবু ইংরেজি থাকতে পারে — লেটারহেড, রেফারেন্স নম্বর, সইয়ের ঘর — আর এক ভাষা অন্যটিকে অর্থহীন লেখা হিসেবে পড়ে। তালিকা থেকে ইংরেজি যোগ করলে পাতাটি দুটি প্যাক দিয়েই পড়া হয়, আর প্রতিটি শব্দ যে লিপিতে ছাপা, সেই লিপিতেই থাকে।
অন্য কিছু দরকার হলে
যে বিজয় ডকুমেন্ট এখনো ফাইল হিসেবে আছে, তার ছবি তোলার চেয়ে কনভার্ট করা ভালো। OCR পিক্সেল থেকে লেখা নতুন করে গড়ে, আর সেরা পাতাতেও হাজারে কয়েকটি অক্ষর ভুল করে; বিজয় থেকে ইউনিকোড কনভার্টার কি-স্ট্রোক থেকে গড়ে, একটিও ভুল করে না, আর বোল্ড ও টেবিল রাখে। ফাইল হারিয়ে গেলে তবেই পাতার ছবি তুলুন।
পুরো বই বা স্ক্যানের আর্কাইভের জন্য ডেস্কটপ টুলই সঠিক আকারের: একই বাংলা মডেলের কমান্ড-লাইন OCR টুল রাতভর একটি ফোল্ডার পড়ে ফেলে, আর OCRmyPDF তার প্রতিটি PDF-এ সার্চযোগ্য টেক্সট লেয়ার যোগ করে। এই পেজটি আপনার সামনের পাতার জন্য।
সাধারণ প্রশ্নোত্তর
আমার ছবি কি কোথাও সংরক্ষণ করা হয়?
না। কোনো ভাষা প্রথমবার ব্যবহার করলে তার ল্যাঙ্গুয়েজ প্যাক এই সাইট থেকে আসে; ছবিটি নিজে কখনো সংরক্ষণ করা হয় না এবং কোথাও পাঠানো হয় না, তাই Wi-Fi বন্ধ থাকলেও কাজ করে।
বাংলা কতটা ভালো পড়ে?
প্রচলিত টাইপফেসে ছাপা বাংলা — SutonnyMJ, Nikosh, Kalpurush, SolaimanLipi, কোনো বই বা সংবাদপত্র — সোজা করে, ফোকাসে তোলা হলে ভালোই পড়া যায়; ঝাপসা বা বিবর্ণ পাতায় মাঝেমধ্যে একটি যুক্তাক্ষর ভুল আসে। ভুলগুলো এই লিপির নিজস্ব ধরনের: মডেল যে আকারে দেখেনি এমন কোনো অক্ষরের ওপর রেফ বা স্বরচিহ্ন, আর ছোট করে ছাপা যুক্তাক্ষর। ৩০০ dpi-র পরিষ্কার স্ক্যান ফোনের ছবির চেয়ে ভালো পড়া যায়, আর দিনের আলোয় তোলা ফোনের ছবি টিউবলাইটের নিচে তোলার চেয়ে ভালো।
বিজয় ডকুমেন্টে কাজ করে?
হ্যাঁ, আর এটি এর সেরা ব্যবহারগুলোর একটি। OCR পড়ে অক্ষরের ছবি, ফন্টের কোড পয়েন্ট নয়, তাই SutonnyMJ-তে টাইপ করা পাতা সরাসরি ইউনিকোড বাংলা হিসেবে আসে — কোনো কনভার্শন লাগে না। যে Word ফাইল এখনো বিজয়ে আছে (লেখা, ছবি নয়), তার জন্য বরং বিজয় থেকে ইউনিকোড ব্যবহার করুন, যা ফরম্যাটিং রাখে আর পড়ায় কোনো ভুল করে না।
বাংলার জন্য আলাদা পেজ কেন?
কারণ শনাক্তকরণে সময় লাগে, আর অন্য লিপির তুলনায় বাংলায় তা বেশি ভুল করে: ল্যাটিন লেটারহেড, সিল বা সংখ্যা থাকা পাতা ইংরেজি হিসেবে পড়া হতে পারে, আর ফলাফল হয় আত্মবিশ্বাসী একটা পুরো পাতা অর্থহীন লেখা। ছবি আসার আগেই ভাষা ঠিক করে রাখার মানে, পেজ খোলার মুহূর্তেই বাংলার প্যাক ডাউনলোড শুরু হয় আর রিডার কখনো ভুল ভাষার অডিশন নেয় না। সাধারণ ছবি থেকে লেখা পেজ একই কাজ করে শনাক্তকরণ চালু রেখে, যেকোনো ভাষার ছবির জন্য।
হাতের লেখা পড়তে পারে?
আলাদা আলাদা ছাপার মতো অক্ষরে লেখা হলে কখনো কখনো; টানা হাতের লেখা না, বাংলায়ও না, অন্য কোনো লিপিতেও না — এটা সব সাধারণ OCR টুলের ক্ষেত্রেই সত্যি। হাতের লেখার পেজ এ কথা সোজাসুজি বলে আর যতটুকু পারল তা দেখায়।
স্ক্যান করা PDF হলে?
পুরো ডকুমেন্টের জন্য বাংলা PDF থেকে Word ব্যবহার করুন: এটি প্রতিটি পেজ একইভাবে পড়ে আর আপনাকে একটি .docx দেয়। এই পেজটি একটি ছবির জন্য।
জেনে রাখুন: শুধু ছাপা লেখা: টানা হাতের লেখা শনাক্ত হয় না। সাজানো নকশার বাংলা টাইপফেস, ছবির ওপর লেখা আর খুব বিবর্ণ ছাপা আংশিকভাবে আসে। অসমীয়া আলাদা একটি প্যাক — পাতা অসমীয়ায় হলে তালিকা থেকে যোগ করুন। ফলাফল প্লেইন টেক্সট: বোল্ড, রং আর ছবিটি নিজে আসে না।
এই টুলটি আপনার ওয়েবসাইটে যোগ করুন
যেকোনো ব্লগ, ক্লাসের পেজ বা হেল্প আর্টিকেলের জন্য ফ্রি। একটি স্নিপেট পেস্ট করলেই আপনার ভিজিটররা আপনার পেজেই এটি ব্যবহার করতে পারবেন।
সম্পর্কিত টুল
ছবি থেকে লেখা
ছবি থেকে লেখা বের করুন, ১২০টির বেশি ভাষায়
বাংলা PDF থেকে Word
বাংলা PDF থেকে এডিটযোগ্য .docx, স্ক্যান হোক বা না হোক
বিজয় থেকে ইউনিকোড
SutonnyMJ-এর লেখা সত্যিকারের বাংলায় পড়ুন
PDF OCR
স্ক্যান করা ফাইলকে সার্চযোগ্য করুন
স্ক্রিনশট থেকে লেখা
স্ক্রিনশট পেস্ট করুন, লেখা পেয়ে যান
হাতের লেখা থেকে টেক্সট
আলাদা আলাদা অক্ষরে লেখা, সৎভাবে পড়া