অডিও কনভার্ট করলে কেন মান খারাপ হতে পারে
লসি এনকোডারের ভেতর দিয়ে প্রতিবার গেলেই আরেকটু বাদ পড়ে, আর তা কখনো ফেরে না। কখন এটি গুরুত্বপূর্ণ — আর কখন সত্যিই নয় — তা জানলে মানও বাঁচে, অকারণ কনভার্ট করার ঝামেলাও বাঁচে।
সর্বশেষ পর্যালোচনা:
লসি কমপ্রেশন আসলে কী বাদ দেয়
MP3, AAC, Vorbis আর Opus মূলত একইভাবে কাজ করে: মানুষের শ্রবণ কী ধরতে পারে আর কী পারে না, তার একটি মডেল বানায়, আর শুধু সেটুকুই রাখে, যা আপনি খেয়াল করবেন। জোরালো শব্দের ঠিক পরের মৃদু শব্দ ঢাকা পড়ে যায়, তাই বাদ দেওয়া যায়। রেকর্ডিংয়ে যা আছে, তার চেয়ে উঁচু ফ্রিকোয়েন্সির জন্য কোনো বিট লাগে না। দুই চ্যানেলে প্রায় একই রকম স্টেরিও তথ্য একবারই রাখা যায়।
ফলাফল বিস্ময়কর কমপ্রেশন — একটি CD ট্র্যাক প্রায় দশ ভাগের এক ভাগ সাইজে, শোনার মতো কোনো পার্থক্য ছাড়াই — আর এটি ফেরানো যায় না। বাদ দেওয়া তথ্য ফাইল থেকে চলে গেছে, আর কোনো ডিকোডার, কনভার্টার বা এনহান্সমেন্ট তা ফেরাতে পারে না। “লসি” কথাটির পুরো অর্থই এটি, আর নিচের সবকিছু এ থেকেই আসে।
জেনারেশন লস: দ্বিতীয়বার কেন প্রথমবারের চেয়ে বেশি ক্ষতি করে
এই অংশটি মানুষকে অবাক করে। একটি পরিষ্কার রেকর্ডিং ভালো বিটরেটে MP3-তে এনকোড করা প্রায় নিখুঁত। সেই MP3 ডিকোড করে আবার এনকোড করলে — একই বিটরেটে, এমনকি একই এনকোডারেও — শুনতেই খারাপ লাগে, আর এর কারণটি নির্দিষ্ট।
দ্বিতীয় এনকোডার প্রথম এনকোডারের ত্রুটিকে আসল শব্দ থেকে আলাদা করতে পারে না। সে যা পায়, তা মূল রেকর্ডিং নয়; তা হলো মূল রেকর্ডিং থেকে বাদ দেওয়া অংশ বাদে বাকিটা, আর সঙ্গে সেই বাদ দেওয়ার ফলে তৈরি ছোট ছোট বিকৃতি। একটি সাইকোঅ্যাকাস্টিক মডেলের কাছে সেই বিকৃতিগুলো সাধারণ অডিও কনটেন্ট — তাই এনকোডার নিষ্ঠার সঙ্গে সেগুলো ধরে রাখতে বিট খরচ করে, আর বাকি অংশ থেকে আরও এক টুকরো ফেলে দেয়।
ভিন্ন কোডেকের মধ্যে এটি আরও খারাপ, কারণ কী শোনা যায় না, তা নিয়ে তারা একমত নয়। AAC থেকে MP3, বা Opus থেকে MP3 কনভার্ট করা মানে দ্বিতীয় এনকোডার এমন সিদ্ধান্ত ধরে রাখছে, যা প্রথমটি নিয়েছিল এমন কারণে, যা দ্বিতীয়টির নেই। এ কারণেই ট্রান্সকোড করা একটি ফাইল শুনতে এমন খারাপ লাগতে পারে, যা পরিষ্কার সোর্স থেকে অর্ধেক বিটরেটে যেকোনো একটি কোডেকেও লাগত না।
একটিই নিয়ম
একটি লসলেস মূল ফাইল রাখুন, আর বিতরণের প্রতিটি কপি সেটি থেকেই বানান।
পুরো শৃঙ্খলা এটুকুই। আপনার কাছে FLAC বা WAV থাকলে তা থেকে বানানো প্রতিটি MP3 একটি মাত্র পরিষ্কার জেনারেশন — আর পরে ভিন্ন বিটরেট, ভিন্ন ফরম্যাট, বা MP3-এর জায়গায় পরে যা-ই আসুক, তা চাইলে আবার মূল ফাইল থেকে কনভার্ট করবেন, বাড়তি কিছুই হারাবেন না। FLAC থেকে MP3 কনভার্ট যেকোনো লসি এনকোডারের জন্য সবচেয়ে ভালো পরিস্থিতি, ঠিক এই কারণে যে ধরে রাখার মতো আগের কোনো ক্ষতি নেই।
লসলেস মূল ফাইলটি মুছে ফেললে ভবিষ্যতের প্রতিটি কনভার্শন শুরু হবে আগে থেকেই মান-কমা কিছু থেকে। এই সিদ্ধান্তের প্রভাব থাকে দীর্ঘদিন, আর সাধারণত নেওয়া হয় এমন ডিস্ক স্পেস বাঁচাতে, যার দাম গানগুলোর দামের চেয়েও কম।
কখন সত্যিই কোনো সমস্যা নেই
এ বিষয়ে সুনির্দিষ্ট হওয়া সতর্কবার্তার মতোই কাজের, কারণ এই ক্ষেত্রে অনেক পরামর্শই কুসংস্কার।
যুক্তিসংগত বিটরেটে একবার ট্রান্সকোড সাধারণত শোনা যায় না। পুরোনো গাড়ির স্টেরিওতে চালাতে ১৯২ kbps-এর AAC-কে ২৫৬ kbps-এর MP3-তে কনভার্ট করা ঠিক আছে। মানুষ জেনারেশন লসের কথা শুনে ধরে নেয় যে যেকোনো কনভার্শনই ফাইল নষ্ট করে; তা করে না, যদি দ্বিতীয় এনকোডারকে যথেষ্ট জায়গা দেন।
সোর্সের চেয়ে একটু বেশিতে এনকোড করুন। মূল ফাইল ১২৮ kbps হলে ১২৮-এ এনকোড করা একই বাজেটে দুই দফা ক্ষতি জমায়; ১৯২-এ এনকোড করলে দ্বিতীয় দফা যথেষ্ট বিট পায়, ফলে শোনার মতো কিছুই যোগ করে না। ৩২০-এ গেলে সোর্সের চেয়ে ভালো হয় না — যা দিয়ে শুরু করেছেন, তা ছাড়ানো যায় না — কিন্তু দ্বিতীয় দফাকে কিছু কেড়ে নিতে দেয় না।
গানের চেয়ে কথা অনেক বেশি সহনশীল। মনোতে ৯৬ kbps-এ একটি লেকচার বা পডকাস্ট পুরোপুরি স্পষ্ট, আর ট্রান্সকোড করলে প্রায় টেরই পাওয়া যায় না। সিম্বাল, হাততালি আর ঘন রিভার্বেই কম বিটরেট আর দ্বিতীয় জেনারেশন স্পষ্ট হয়ে ওঠে।
WAV যা করে, আর যা করে না
লসি ফাইলকে WAV-এ কনভার্ট করা বোঝা দরকার, কারণ মানুষ ভুল কিছু আশা করে এর দিকে হাত বাড়ায়। MP3 থেকে WAV বানালে ডিকোড করা অডিও আনকমপ্রেসড অবস্থায় রাখা হয়, যা পরের যেকোনো ক্ষতি থামায়, কিন্তু প্রথমটি ফেরায় না। WAV-টি দশ গুণ বড়, আর তাতে হুবহু সেই শব্দই থাকে, যা MP3-তে ছিল।
তবু এডিটিংয়ের আগে এটিই সঠিক পদক্ষেপ। কাটা, মিক্স করা আর অ্যাডজাস্ট করা মানে ফাইল বারবার সেভ করা, আর লসি ফাইলের প্রতিটি সেভ আরেকটি জেনারেশন। WAV-এ কনভার্ট করুন, সব কাজ শেষ করুন, শেষে একবার এনকোড করুন — পাঁচটির বদলে একটি জেনারেশনের ক্ষতি।
একটি ব্যবহারিক সীমা: প্রচলিত ফরম্যাটে একটি WAV ফাইল ৪ GB ছাড়াতে পারে না, আর উচ্চ রেজোলিউশনের দীর্ঘ রেকর্ডিং সেখানে পৌঁছাতে পারে। দীর্ঘ কাজের জন্য তার উপযোগী করে তৈরি ফরম্যাট দরকার।
সাধারণ প্রশ্নোত্তর
বেশি বিটরেটে কনভার্ট করে কি MP3-এর মান বাড়ানো যায়?
না। ফাইল বড় হয়, আর তাতে থাকে একই শব্দ, সঙ্গে নতুন এনকোডারের অনুমান। যে তথ্য বাদ পড়েছে, কিছুই তা ফেরাতে পারে না — আপস্কেল করা MP3 শুধু বড় ফাইল, ভালো নয়।
কতবার কনভার্ট করলে তা কানে ধরা পড়বে?
মাঝারি বিটরেটে গানের বেলায় কঠিন অংশে — সিম্বাল, হাততালি, ঘন মিক্স — দ্বিতীয় জেনারেশনই প্রায়ই শোনা যায়, আর তৃতীয়টি সাধারণত যায়। কথার বেলায় কয়েকবার পর্যন্ত পার পাওয়া যায়। সৎ উত্তর হলো, এটি কনটেন্টের ওপর নির্ভর করে — এ কারণেই নিয়মটা হলো কতবার হলো তা গোনা নয়, পরিস্থিতিটাই এড়ানো।
২০২৬ সালেও কি MP3 সঠিক পছন্দ?
শুধু কম্প্যাটিবিলিটির জন্য, যা একটি আসল কারণ। প্রতিটি বিটরেটে AAC একে হারায়, আর Opus দুটিকেই হারায়, আর বর্তমানের প্রতিটি ফোন ও কম্পিউটার এগুলো চালায়। MP3 বেছে নিন তখনই, যখন প্রক্রিয়ার কোনো পুরোনো অংশ তা দাবি করে — ডিফল্ট হিসেবে নয়।
ভিডিও থেকে অডিও বের করলে কি তা রি-এনকোড হয়?
আপনি কী চাইছেন তার ওপর নির্ভর করে। বিদ্যমান ট্র্যাকটি কপি করে বের করা লসলেস ও তাৎক্ষণিক, কারণ কিছুই ডিকোড হয় না। নির্দিষ্টভাবে MP3 বা WAV চাইলে তা কনভার্শন — তাই আপনি শুধু অডিও চাইলে মূল ট্র্যাক কপি করা দ্রুতও, ভালোও।
আমার ৩২০ kbps MP3 একটি ১২৮ kbps মূল ফাইলের চেয়ে খারাপ শোনায় কেন?
প্রায় নিশ্চিতভাবেই কারণ এটি আগে থেকেই লসি কিছু থেকে ট্রান্সকোড করা। বিটরেট জানায় শেষ এনকোডার কতটা জায়গা পেয়েছিল, সোর্স কতটা ভালো ছিল তা নয় — ৯৬ kbps-এর মূল ফাইল থেকে বানানো ৩২০ kbps-এর ফাইলে সেই মূলের সব ক্ষতিই থাকে, শুধু অনেক বড় ফাইলে।