বিজয় থেকে ইউনিকোডে কনভার্ট করুন
SutonnyMJ বা যেকোনো বিজয় ফন্টে টাইপ করা লেখা পেস্ট করুন আর সেটি ইউনিকোড বাংলায় পড়ুন — অথবা পুরো Word ডকুমেন্ট বা Excel ওয়ার্কবুক ছাড়ুন, আর বিজয়ে থাকা প্রতিটি অংশ কনভার্ট হয়ে, ফরম্যাটিং হুবহু রেখে ফাইলটি ফেরত পান।
- কখনো সংরক্ষণ করা হয় না
- কোনো লাইন নেই, অপেক্ষা নেই
- সাইনআপ নেই, ওয়াটারমার্ক নেই
বিজয় টেক্সট পেস্ট করুন — অন্য কোনো ফন্টে SutonnyMJ ডকুমেন্ট যেমন দেখায় — আর সেটি ইউনিকোড বাংলায় পড়ুন।
বরং ইউনিকোড থেকে বিজয়ইউনিকোড টেক্সট এখানে দেখা যাবে।
পুরো ফাইল কনভার্ট করুন
Word ডকুমেন্ট, Excel ওয়ার্কবুক বা টেক্সট ফাইল: বিজয় ফন্টে থাকা প্রতিটি অংশ বা সেল কনভার্ট হয়ে ইউনিকোড ফন্টে বসে, আর বাকি সবকিছু হুবহু যেমন ছিল তেমনই থাকে।
যেভাবে কাজ করে
বিজয় লেখা পেস্ট করুন
Word ফাইল, PDF বা অন্য কোথাও থেকে কপি করা — সাধারণ ফন্টে এটি দেখায় “evsjv‡`k”-এর মতো। অথবা পুরোটা কনভার্ট করতে একটি .docx, .xlsx বা .txt ফাইল ছাড়ুন।
ইউনিকোড যাচাই করুন
টাইপ করতে করতেই ফলাফল আসে। বিজয়ের সাধারণ ক্রমে টাইপ করা রেফ, য-ফলা বা দুই অংশের স্বরচিহ্ন নিজের সঠিক জায়গায় বসে।
কপি বা ডাউনলোড করুন
লেখাটি কপি করুন, বা কনভার্ট হওয়া ফাইল ডাউনলোড করুন: বিজয় ফন্টে থাকা প্রতিটি অংশ এখন Nirmala UI, আর অন্য ফন্টে থাকা সবকিছু হুবহু যেমন ছিল।
কী কনভার্ট হয়, আর কী যেমন আছে তেমনই থাকে
শুধু বিজয় ফন্টে থাকা লেখাই কনভার্ট হয় — অংশটির নিজের ফন্ট, তার ক্যারেক্টার বা প্যারাগ্রাফ স্টাইলের ফন্ট, অথবা ডকুমেন্টের ডিফল্ট, এই অগ্রাধিকার ক্রমে। এভাবেই Arial-এ ইংরেজি শিরোনাম আর SutonnyMJ-তে বাংলা অনুচ্ছেদ মেশানো একটি ডকুমেন্ট ফেরত আসে শিরোনাম অক্ষত রেখে, অনুচ্ছেদগুলো ইউনিকোডে। কনভার্ট হওয়া অংশগুলো বসে Nirmala UI-তে, যা বাংলা আর ল্যাটিন দুটোই ধরে এবং Windows-এর সঙ্গেই আসে, তাই কিছু ইনস্টল না করেই ফাইলটি বাংলা হিসেবে খোলে; অন্য কোনো ফন্ট পছন্দ হলে পরে যেকোনো ইউনিকোড বাংলা ফন্টে বদলে নিন। Word কমপ্লেক্স-স্ক্রিপ্ট লেখার জন্য আলাদা সাইজ ও ওজন রাখে, আর বিজয় অংশে থাকে শুধু সাধারণগুলো, তাই সেগুলোই কপি করে দেওয়া হয় — ১৪ পয়েন্টের ডকুমেন্ট কমপ্লেক্স-স্ক্রিপ্টের ডিফল্টে না নেমে ১৪ পয়েন্টই থাকে।
বানান পরীক্ষক যেখানে দাগ দিয়েছে বা ফরম্যাটিং যেখানে বদলেছে, Word সেখানেই একটি অংশ (রান) ভেঙে ফেলে, ফলে প্রায়ই এক শব্দের দুই অর্ধেক দুটি অংশে পড়ে। অর্ধেকগুলো আলাদা করে কনভার্ট করলে স্বরচিহ্ন ভাঙনের ভুল পাশে থেকে যেত, তাই একই বিজয় ফন্টের পাশাপাশি অংশগুলো একটানা হিসেবে কনভার্ট হয় আর ফলাফল যায় তাদের প্রথমটিতে। এর একমাত্র দৃশ্যমান ফল: মাঝপথে বোল্ড থেকে সাধারণ হয়ে যাওয়া একটি শব্দ আসে প্রথম অংশের ফরম্যাটিংয়ে। Excel-এ একই লেখা যতগুলো সেলে দেখানো হয়, সবগুলোর মধ্যে শেয়ার হয়, তাই এক সেলে SutonnyMJ আর অন্য সেলে Calibri-তে দেখানো একটি স্ট্রিং দুই ভাগ হয়, আর শুধু SutonnyMJ সেলগুলোই কনভার্ট হওয়া কপিটি পায়।
প্লেইন টেক্সট ফাইল UTF-8 হিসেবে পড়া হয়, আর সেটি বৈধ UTF-8 না হলে — Notepad-এ সেভ করা বিজয় .txt হয় Windows-1252 — Windows-1252 হিসেবে, যেটিই “‡”-কে তার বাইট দেয়। প্রতিটি লাইন কনভার্ট হয় আর ফলাফল UTF-8 হিসেবে সেভ হয়। Word বা Excel ফাইলের অন্য কিছুই নতুন করে লেখা হয় না: ছবি, স্টাইল, নাম্বারিং, মন্তব্য, কাস্টম XML আর ম্যাক্রো বাইট ধরে ধরে হুবহু কপি হয়, আর ডিজিটালি সই করা ডকুমেন্টের সই ভাঙা দেখাবে, কারণ বিষয়বস্তু বদলেছে।
অন্য কিছু দরকার হলে
একই ফন্টের ভেতরে বিজয় আর ইংরেজি মেশানো ফাইলই একমাত্র ক্ষেত্র, যেখানে এটি বিচার করতে পারে না। কেউ SutonnyMJ বাছাই থাকা অবস্থায় একটি ইংরেজি বাক্য টাইপ করলে ফাইলে দুই ক্ষেত্রেই ল্যাটিন অক্ষরই থাকে, আর SutonnyMJ-তে “Dhaka” সত্যিই বাংলা হিসেবে আঁকা হয় — কনভার্টারকে ওই ফন্টের প্রতিটি অক্ষরকেই বিজয় ধরতে হয়, তাই ইংরেজি শব্দটিও একটি বাংলা শব্দ হয়ে যায়। কনভার্ট করুন, তারপর অর্থহীন হয়ে যাওয়া ইংরেজি খুঁজে পড়ে দেখুন; দুটোকে আলাদা করার কোনো স্বয়ংক্রিয় পরীক্ষা নেই।
শত শত ডকুমেন্টের জন্য একটি স্ক্রিপ্টই সঠিক আকারের টুল। এই পেজ যে ওপেন-সোর্স রূপান্তর টেবিল ব্যবহার করে, সেগুলোই লাইব্রেরি হিসেবে পাওয়া যায়, আর তার একটি দিয়ে একটি ফোল্ডারের ওপর লুপ চালিয়ে প্রতিটি মূল ফাইলের পাশে কনভার্ট হওয়া কপি লেখা Python বা Node-এ বিশ লাইনের কাজ, যা নজর ছাড়াই চলে। এই পেজ আপনার সামনের ডকুমেন্টটির জন্য।
সাধারণ প্রশ্নোত্তর
আমার লেখা কি কোথাও সংরক্ষণ করা হয়?
না। কিছুই সংরক্ষণ করা হয় না, কোনো রিকোয়েস্টও পাঠানো হয় না। পেজ লোড হওয়ার পর ইন্টারনেট সংযোগ বিচ্ছিন্ন করলেও এটি কাজ করে।
বিজয় আর ইউনিকোড বাংলার মধ্যে পার্থক্য কী?
বিজয় হলো একটি কিবোর্ড লেআউট আর এক পরিবারের ফন্ট — SutonnyMJ যার মধ্যে সবচেয়ে প্রচলিত — বাংলার কোনো প্রমিত এনকোডিং হওয়ার আগের সময়ের। বিজয় ফন্ট বাংলা অক্ষরগুলোকে ল্যাটিন অক্ষরের কোড পয়েন্টে বসায়, তাই ফাইলে আসলে থাকে “evsjv‡`k”, আর ফন্টটি তাকে আঁকে বাংলাদেশ হিসেবে। ফন্ট বদলালেই সেটি আবার দুর্বোধ্য হয়ে যায়; কোনো শব্দ খুঁজলে কিছুই পাওয়া যায় না, কারণ শব্দটি সেখানে নেই-ই। ইউনিকোড প্রতিটি বাংলা অক্ষরকে নিজস্ব কোড পয়েন্ট দেয়, তাই লেখাটি যেকোনো ডিভাইসে, যেকোনো ফন্টে বাংলাই থাকে, আর সার্চ, বানান পরীক্ষা, অনুবাদ ও স্ক্রিন রিডার — সবই কাজ করে। ওয়েব, প্রতিটি ফোন, আর Avro, Ridmik ও বাকি আধুনিক কিবোর্ডগুলো সবই ইউনিকোডে লেখে।
আমার ডকুমেন্ট আদৌ “evsjv‡`k”-এর মতো দেখাচ্ছে কেন?
কারণ ফন্টটি নেই বা বদলে গেছে। লেখাটি SutonnyMJ-তে টাইপ করা, আর যে মেশিনে দেখানো হচ্ছে — একটি ফোন, একটি ওয়েব পেজ, সহকর্মীর ল্যাপটপ — সেখানে ওই ফন্ট নেই, তাই অক্ষরগুলো যে ফন্ট আছে সেটি দিয়েই আঁকা হয়, আর সেগুলো ল্যাটিন অক্ষর। ডকুমেন্টটি নষ্ট হয়নি। ইউনিকোডে কনভার্ট করলে এটি শুধু SutonnyMJ ইনস্টল থাকা জায়গায় নয়, সব জায়গায় পড়া যায়।
এটি কি ফরম্যাটিংসহ পুরো Word বা Excel ফাইল কনভার্ট করে?
হ্যাঁ। একটি .docx বা .xlsx ছাড়ুন, আর বিজয় ফন্টে — SutonnyMJ, বা নামে MJ থাকা যেকোনো ফন্টে — থাকা প্রতিটি টেক্সট অংশ কনভার্ট হয়ে Nirmala UI-তে বসে, যা একটি ইউনিকোড ফন্ট এবং প্রতিটি Windows মেশিনেই থাকে। বোল্ড, সাইজ, রং, টেবিল, ছবি, হেডার, ফুটার, ফুটনোট আর ফর্মুলা হুবহু যেমন ছিল তেমনই থাকে, আর অন্য কোনো ফন্টে থাকা লেখায় হাত দেওয়া হয় না। যে ডকুমেন্টের সব ফন্ট ইউনিকোড, কিন্তু লেখাটি কনভার্ট না করেই বিজয় থেকে পেস্ট করা, সেটিতে কোনো বিজয় পাওয়া যায়নি বলে জানানো হয়, আর তখন আপনি চাইলে তবু প্রতিটি অংশ কনভার্ট করতে পারেন।
কয়েকটি অক্ষর ভুল এল কেন?
বিজয়ে কিছু জিনিস টাইপ করার একাধিক উপায় আছে। রেফ স্বরচিহ্নের আগে বা পরে টাইপ করা যায়, দুটি কি-তে একই উ-কার আসে, আর বিজয়ের ভিন্ন ভিন্ন সংস্করণ কয়েকটি যুক্তাক্ষর ভিন্ন কি-তে রাখে। কনভার্টারটি বাস্তব ডকুমেন্টে পাওয়া রীতিগুলো অনুসরণ করে — সরকারি পরিপত্রগুলোই ছিল পরীক্ষার উপাদান — আর প্রচলিত বিকল্পগুলো ঠিক করে নেয়, কিন্তু বিরল কোনো কি-সিকোয়েন্স তবু অপ্রত্যাশিত অক্ষর দিতে পারে। এগুলো ফলাফলে হাতে ঠিক করে নেওয়াই ভালো; প্রতি পেজে বড়জোর হাতে গোনা কয়েকটি। Boishakhi বা Alpona-র মতো বিজয়-বহির্ভূত ANSI ফন্টের লেখার লেআউট আলাদা, তাই সঠিকভাবে কনভার্ট হবে না।
এটি কি PDF কনভার্ট করতে পারে?
সরাসরি নয়: PDF-এ এডিটযোগ্য কোনো টেক্সট অংশ নেই। আগে PDF থেকে Word ব্যবহার করুন, তারপর Word ফাইলটি এখানে ছাড়ুন। PDF-টি বিজয় ডকুমেন্ট থেকে বানানো হলে তার টেক্সট লেয়ারও সাধারণত বিজয়ই হয়, আর Word ফাইলটি কনভার্ট হবে; স্ক্যান করা PDF-এর জন্য OCR লাগে, যা অক্ষরের ছবি পড়ে সরাসরি ইউনিকোড দেয়।
জেনে রাখুন: রূপান্তরটি বিজয়ের কি-স্ট্রোকের রীতি মেনে চলে, তাই অস্বাভাবিক কি-সিকোয়েন্সে টাইপ করা লেখা, বা বিজয় পরিবারের বাইরের কোনো ANSI ফন্টে (Boishakhi ও Alpona-র লেআউট আলাদা) লেখা টেক্সটে এখানে-ওখানে একটি অক্ষর ভুল আসতে পারে। বিজয় ফন্টের ভেতরে টাইপ করা ইংরেজিও বাংলা ধরে কনভার্ট হয়, কারণ লেখার মধ্যে এমন কিছু নেই যা অন্য কথা বলে। পুরোনো .doc ও .xls ফাইল আগে .docx বা .xlsx হিসেবে সেভ করে নিতে হবে, আর PDF-কে আসতে হবে PDF থেকে Word-এর মধ্য দিয়ে।
এই টুলটি আপনার ওয়েবসাইটে যোগ করুন
যেকোনো ব্লগ, ক্লাসের পেজ বা হেল্প আর্টিকেলের জন্য ফ্রি। একটি স্নিপেট পেস্ট করলেই আপনার ভিজিটররা আপনার পেজেই এটি ব্যবহার করতে পারবেন।
সম্পর্কিত টুল
ইউনিকোড থেকে বিজয়
ইউনিকোড বাংলা SutonnyMJ ফন্টে বসান
বাংলা OCR
ছবি বা স্ক্যান থেকে বাংলা লেখা পড়ুন
বাংলা PDF থেকে Word
বাংলা PDF থেকে এডিটযোগ্য .docx, স্ক্যান হোক বা না হোক
Word ফাইল অনুবাদ (DOCX)
অন্য ভাষায় Word ডকুমেন্ট, লেআউট অক্ষত
DOCX থেকে TXT
Word ডকুমেন্ট থেকে পরিষ্কার প্লেইন টেক্সট
ডুপ্লিকেট লাইন রিমুভ
পুনরাবৃত্তি সরান, তালিকা সাজান ও গুছিয়ে নিন