মূল অংশে যান

পাতার ছবিকে স্ক্যানে পরিণত করুন

ডকুমেন্টের ছবি হয় ধূসর, এক পাশ থেকে আলো পড়া, আর সামান্য বাঁকা। এই টুল সেটাকে সোজা করে, আলো সমান করে যাতে কাগজ সাদা আসে, আর PDF হিসেবে সেভ করে — চাইলে পেছনে লেখাসহ, যাতে স্ক্যানটি সার্চযোগ্য হয়।

  • কখনো সংরক্ষণ করা হয় না
  • কোনো লাইন নেই, অপেক্ষা নেই
  • সাইনআপ নেই, ওয়াটারমার্ক নেই

যেভাবে কাজ করে

1

ছবি যোগ করুন

একটি পেজ বা অনেকগুলো — যে ক্রমে যোগ করবেন, সেই ক্রমে একটি PDF-এর পেজ হয়ে যাবে।

2

পরিষ্কার হতে দেখুন

হেলে থাকা মেপে সরানো হয়, আর কালির পেছনের কাগজ আন্দাজ করে সাদা করা হয় — এতেই ছবিকে আর ছবির মতো দেখায় না।

3

PDF ডাউনলোড করুন

টেক্সট লেয়ার চাইলে শব্দগুলো পড়ে পেজের ওপর অদৃশ্যভাবে বসানো হয়, যাতে স্ক্যানে সার্চ করা ও কপি করা যায়।

ছবিকে ডকুমেন্টের মতো করে তোলা

পাতার ছবি আর পাতার স্ক্যানের মধ্যে তিনটি পার্থক্য, যার দুটি এখানে ঠিক করা হয়। পেজ সোজা করা হয় — যে পাতা বাঁকা হয়ে ঢুকেছে, বা সামান্য ঘোরানো অবস্থায় তোলা হয়েছে, তা সমান করা হয় — আর খাড়া করা হয়, তাই পাশ ফিরে তোলা পেজ সঠিক দিকে আসে। পড়ার জন্য দুটোই এমনিতেই দরকার ছিল, তাই এগুলো বাড়তি খরচ ছাড়াই পাওয়া যায়। কনট্রাস্ট বাড়ানো হয়, যাতে কাগজ সাদা আর কালি কালো দেখায়, ডকুমেন্টের ধূসর ছবির মতো নয়।

তৃতীয় পার্থক্যটি ঠিক করা হয় না, আর পরিকল্পনা করতে হবে এটাকে মাথায় রেখেই। পারস্পেক্টিভ ঠিক করা হয় না: কোণ থেকে তোলা পেজ দূরের কিনারায় সরু হয়ে তার ট্র্যাপিজিয়াম আকৃতিই রাখে, শুধু ঘূর্ণন সোজা করা হয়। জোরালো ভাঁজওয়ালা পেজ, বা মোটা বইয়ের বাঁধাইয়ের দিকে বেঁকে যাওয়া পেজ বাঁকাই থাকে। দুটোই লেখাকে দেখতে খারাপ করার পাশাপাশি পড়াও কঠিন করে — তাই সবচেয়ে কাজের একটি জিনিস হলো, পেজের ওপর ঝুঁকে না পড়ে ক্যামেরা ঠিক ওপরে ধরা।

টেক্সট লেয়ার চাইলে এমন PDF পাবেন, যা দেখতে হুবহু ছবির মতো আর আচরণ করে ডকুমেন্টের মতো: শনাক্ত করা শব্দগুলো ছবির শব্দের ওপর অদৃশ্যভাবে বসানো হয়, তাই মূলের ছবি থেকেও ফাইলটিতে সার্চ, সিলেক্ট ও কপি করা যায়। নতুন করে কিছু টাইপসেট করা হয় না, চেহারাও বদলায় না — রসিদ, চুক্তি বা যেখানে মূলের চেহারাই রেকর্ডের অংশ, সেখানে এটাই চাওয়া হয়।

নির্ভুলতা নির্ভর করে ছবি তোলার ওপর, আর পার্থক্যটা সূক্ষ্ম নয়। সমতল, সমান আলোয়, ফোকাসে আর ক্যামেরার সোজাসুজি থাকলে ভালো পড়া যায়; পেজজুড়ে আপনার নিজের মাথার ছায়া, চকচকে কাগজে ফোনের ফ্ল্যাশের প্রতিফলন, বা দোমড়ানো রসিদ হলে যায় না। চীনা, জাপানি ও কোরিয়ান শব্দ শনাক্ত হয়, কিন্তু টেক্সট লেয়ারে লেখা না হয়ে শুধু গোনা হয়, কারণ সেগুলো ধারণ করতে পারে এমন কোনো ফন্ট সঙ্গে দেওয়া নেই — আপনাকে জানানো হয় কয়টি, যাতে চোখ এড়িয়ে যেতে পারে এমন ফাঁকা জায়গা রয়ে না যায়।

অন্য কিছু দরকার হলে

আপনার ফোনে প্রায় নিশ্চিতভাবেই এটা আরও ভালোভাবে বিল্ট-ইন আছে। iOS-এর Notes অ্যাপ আর Android-এ Google Drive দুটোই লাইভ পারস্পেক্টিভ সংশোধনসহ ডকুমেন্ট স্ক্যান করে — ক্যামেরা ধরে থাকার সময়ই পেজের কিনারা খুঁজে ট্র্যাপিজিয়ামকে ঠিকঠাক সমতল করে, আর ঠিক এই ধাপটাই এখানে নেই। পেজের ছবি তোলার জন্য এগুলোর একটি ব্যবহার করুন, আর পরে কাজ করতে হলে ফলাফলটি অন্য কোথাও নিয়ে যান।

অনেক পেজের জন্য OCRmyPDF ঠিক টুল এবং বিনামূল্যে: ocrmypdf --deskew --rotate-pages --clean in.pdf out.pdf যেকোনো দৈর্ঘ্যের ডকুমেন্টে এক দফায় সোজা করা, ঘোরানো, পরিষ্কার করা আর টেক্সট লেয়ার যোগ করে, আর --output-type pdfa একই সঙ্গে সেটাকে আর্কাইভযোগ্য করে। unpaper কঠিনতর স্ক্যান পরিষ্কারের কাজ সামলায় — বইয়ের স্ক্যান থেকে কালো কিনারা সরানো, দুই পেজের স্প্রেড ভাগ করা — যা এখানে কিছুই চেষ্টা করা হয় না।

সাধারণ প্রশ্নোত্তর

এটা আসলে কী বদলায়?

তিনটি জিনিস। হেলে থাকা: পুরো পেজজুড়ে লেখার কোণ মেপে তা সরানো হয়, যাতে লাইনগুলো সমান থাকে। আলো: কালির পেছনের কাগজের উজ্জ্বলতা টুকরো টুকরো অংশে আন্দাজ করে সমান সাদায় তোলা হয়, যাতে এক কিনারার দিকে আলো কমে যাওয়া আর আপনার হাতের ছায়া দূর হয়। আর কনট্রাস্ট: সেই সাদার বিপরীতে কালি গাঢ় করা হয়। যা করে না তা হলো কিছু বানিয়ে দেওয়া — শার্প করে নতুন কিছু তৈরি করা হয় না।

স্ক্যানটি কি সার্চযোগ্য করা যায়?

হ্যাঁ। টেক্সট লেয়ার চালু করলে প্রতিটি শব্দ পড়ে ছবির যেখানে আছে সেখানে অদৃশ্যভাবে বসানো হয়, তাই Ctrl+F দিয়ে খুঁজে পাওয়া যায় এবং PDF থেকে সিলেক্ট ও কপি করা যায়। পেজটি দেখতে হুবহু ছবির মতোই থাকে; লেখা কখনো আঁকা হয় না, শুধু সিলেক্ট করার উপযোগী করা হয়।

আমার ছবি কি কোথাও সংরক্ষণ করা হয়?

না। পরিষ্কার করা আর পড়া দুটোই এখানে হয়, আর কিছুই সংরক্ষণ করা হয় না। কোথাও কিছু পাঠানো হয় না।

আগে কি পেজ পর্যন্ত ক্রপ করা উচিত?

করলে সুবিধা হয়। ফ্রেমের বেশিরভাগ কাগজ হলে কাগজের আন্দাজ সবচেয়ে ভালো কাজ করে, তাই কিনারায় গাঢ় টেবিলসহ ছবি আগে ক্রপ করে নিলে ভালো আসে। হেলে থাকা মাপার সময় বাইরের মার্জিন ইচ্ছে করেই বাদ দেওয়া হয়, তাই সামান্য ব্যাকগ্রাউন্ড থাকলে সমস্যা নেই।

কোণ থেকে তোলা ছবি কি ঠিক করবে?

ঘূর্ণন সরায় — কয়েক ডিগ্রি বাঁকা পেজ সোজা করা হয়। পারস্পেক্টিভ ঠিক করে না, তাই পাশ থেকে তোলা পেজ, যার এক কিনারা অন্যটির চেয়ে লম্বা, সেই আকৃতিতেই থাকে। ঠিক ওপর থেকে তোলায় বাড়তি এক সেকেন্ড দেওয়া সার্থক।

রঙিন না সাদাকালো?

রং বজায় থাকে, পেছনের কাগজ সাদা করে — তাই সিল, নীল কালির সই বা হাইলাইট করা লাইন যে রঙের ছিল সেই রঙেই থাকে। ডকুমেন্টের কাছে সাধারণত এটাই চাওয়া হয়; এটা সাদাকালো ফ্যাক্স নয়।

PDF কত বড় হবে?

প্রতিটি পেজ ক্যামেরার পূর্ণ রেজোলিউশনে নয়, পড়ার উপযোগী সাইজের JPEG হিসেবে রাখা হয়, তাই ৪ MB-এর একটি ফোন-ছবি সাধারণত প্রতি পেজে ১ MB-এর নিচে নেমে আসে, ১০০%-এ কোনো দৃশ্যমান ক্ষতি ছাড়াই।

জেনে রাখুন: পারস্পেক্টিভ ঠিক করা হয় না: কোণ থেকে তোলা পেজ তার ট্র্যাপিজিয়াম আকৃতিই রাখে, শুধু ঘূর্ণন ঠিক হয়। জোরালো ভাঁজ বা বাঁধাইয়ের কাছে বেশি বাঁকানো পেজ বাঁকাই থাকবে। টেক্সট লেয়ার চাইলে তাতে যেকোনো OCR-এর মতোই সীমাবদ্ধতা থাকে — আর চীনা, জাপানি ও কোরিয়ান শব্দ লেখা হয় না, শুধু গোনা হয়, কারণ সেগুলোর কোনো ফন্ট সঙ্গে দেওয়া নেই।

এই টুলটি আপনার ওয়েবসাইটে যোগ করুন

যেকোনো ব্লগ, ক্লাসের পেজ বা হেল্প আর্টিকেলের জন্য ফ্রি। একটি স্নিপেট পেস্ট করলেই আপনার ভিজিটররা আপনার পেজেই এটি ব্যবহার করতে পারবেন।