آڈیو فائل میں اصل میں کیا محفوظ ہوتا ہے
ریکارڈنگ کو تین نمبر بیان کرتے ہیں، اور کسی ایک فائل پر ان میں سے صرف دو لاگو ہوتے ہیں۔ سیمپل ریٹ یہ ہے کہ آواز کتنی بار ناپی گئی: CDs کے لیے 44.1 kHz، ویڈیو سے آنے والی ہر چیز کے لیے 48 kHz۔ بٹ ڈیپتھ یہ ہے کہ ہر پیمائش کتنی باریکی سے لکھی گئی، اور اس کا مطلب صرف غیر کمپریسڈ فارمیٹ میں ہوتا ہے — 16-bit CD کا معیار ہے، 24-bit مزید پروسیسنگ کے لیے گنجائش چھوڑتا ہے، 32-bit float مکسنگ کے لیے ہے۔ بٹ ریٹ کا مطلب صرف کمپریسڈ فارمیٹ میں ہوتا ہے: یہ کہ انکوڈر کو فی سیکنڈ کتنے بٹس خرچ کرنے کی اجازت تھی۔
اسی لیے سائز اتنا مختلف برتاؤ کرتے ہیں۔ WAV کا سائز سیدھا حساب ہے — ریٹ ضرب ڈیپتھ ضرب چینلز — اس لیے 44.1 kHz پر 16-bit اسٹیریو کا ایک منٹ تقریباً 10 MB ہوتا ہے، اندر کچھ بھی ہو، خاموشی سمیت۔ MP3 کا سائز وہ ہے جو بٹ ریٹ آپ نے چنا: 192 kbps پر تقریباً 1.4 MB فی منٹ، اور 96 پر اس کا آدھا۔ WAV سننے کا نہیں بلکہ کام کرنے کا فارمیٹ ہے، اور یہی فرق دونوں سمتوں میں کنورٹ کرنے کی وجہ ہے۔
MP3 کو WAV میں تبدیل کرنے سے کچھ واپس نہیں آتا، اور کبھی نہیں آئے گا۔ MP3 بنتے وقت انکوڈر نے تفصیل ضائع کر دی تھی؛ اس سے بنی WAV وہی نقصان پوری ریزولوشن پر رکھتی ہے۔ کنورژن کا مقصد نقصان کو آگے بڑھنے سے روکنا ہے — WAV کے بعد ایڈیٹنگ، کٹائی اور دوبارہ محفوظ کرنے پر کچھ خرچ نہیں ہوتا۔ یہی بات FLAC پر لاگو ہوتی ہے، جو لاس لیس کمپریشن ہے: دیے گئے سیمپلز کو بالکل ویسا ہی چھوٹی جگہ میں رکھنے کا طریقہ، انہیں بہتر بنانے کا نہیں۔ FLAC میں بدلی گئی MP3 ایک بڑی فائل ہے جس کے اندر MP3 ہے۔
لاسی انکوڈر سے ہر گزر مزید کچھ ضائع کرتا ہے، اور وہ کبھی واپس نہیں آتا۔ AAC کو MP3 میں، OGG کو MP3 میں، یا ایک MP3 کو دوسری میں تبدیل کرنا ایسا ہی ایک گزر ہے۔ سورس کے اپنے بٹ ریٹ یا اس سے اوپر انکوڈ کرنا — جو یہاں ہر صفحہ فائل ڈراپ کرتے ہی آپ کو دکھاتا ہے — اس نقصان کو کم رکھتا ہے؛ اس سے بہت اوپر جانا صرف پہلے انکوڈر کی غلطیاں محفوظ کرنے پر بٹس خرچ کرتا ہے۔ اگر آپ ریکارڈنگ پر کئی کام کرنے والے ہیں تو پہلے WAV میں تبدیل کریں، کام کریں، اور آخر میں ایک بار انکوڈ کریں۔
کاٹنے اور جوڑنے کے لیے ری انکوڈ ضروری نہیں۔ کمپریسڈ آواز چھوٹے فریمز میں محفوظ ہوتی ہے — MP3 میں تقریباً 26 ملی سیکنڈ کا ایک — اور “آڈیو کاٹیں” ان فریمز کو ڈیکوڈ کرنے کے بجائے نقل کرتا ہے، اس لیے کاٹی گئی MP3 بٹ بہ بٹ وہی MP3 ہوتی ہے جو وہ تھی، اور لمبی ریکارڈنگ تقریباً اتنی ہی تیزی سے کٹتی ہے جتنی تیزی سے پڑھی جا سکے۔ قیمت یہ ہے کہ نقل کیا گیا کٹ قریب ترین فریم کی حد پر شروع ہوتا ہے، آپ کے چنے ہوئے مقام سے سیکنڈ کے چند سوویں حصے آگے یا پیچھے؛ “درست کٹ” پر نشان لگانے سے ری انکوڈ ہوتا ہے تاکہ کٹ ٹھیک اسی سیمپل پر لگے جو آپ نے مانگا۔ “آڈیو جوڑیں” بھی اسی طرح کام کرتا ہے — ایک ہی کوڈیک، سیمپل ریٹ اور چینلز کی تعداد والی فائلیں نقل کر کے جوڑی جاتی ہیں، اور مختلف فائلیں ڈیکوڈ کر کے پہلی فائل کے مطابق دوبارہ انکوڈ کی جاتی ہیں۔
آواز برابر کرنا loudness normalisation نہیں، اور کمپریشن بھی نہیں۔ “آواز کم یا زیادہ کریں” فائل کا سب سے اونچا لمحہ ناپتا ہے اور ہر چیز کو اسی ایک مقدار سے بلند کرتا ہے، تاکہ پیک حد سے ذرا نیچے رہے۔ یہ peak normalisation ہے، اور اس ریکارڈنگ کا صحیح علاج ہے جو شروع سے آخر تک بس بہت دھیمی ہو۔ یہ وہ LUFS پیمائش نہیں جو پوڈکاسٹ اور اسٹریمنگ پلیٹ فارمز مانگتے ہیں، جو پورے پروگرام میں محسوس ہونے والی بلندی کو تولتی ہے — ایک ہی پیک پر لائی گئی دو فائلیں بلندی میں اب بھی واضح طور پر مختلف ہو سکتی ہیں۔ اور پوری فائل کو بلند کرنے سے دھیمے اور اونچے حصے ساتھ ساتھ اوپر جاتے ہیں، اس لیے یہ اس ریکارڈنگ کو برابر نہیں کر سکتا جو ان دونوں کے درمیان جھولتی ہو۔ وہ dynamic-range کمپریشن ہے: ایک الگ کام، اور ایسا نہیں جو یہ ٹولز کرتے ہیں۔
جہاں براؤزر واقعی غلط ٹول ہے
آپ کی ریکارڈنگ کو نجی رکھنا ہی وہ مقصد ہے جس کے لیے یہ بنائے گئے ہیں، اور پروسیسنگ کے لحاظ سے اس سے آپ کو کچھ بھی حاصل نہیں ہوتا۔ یہ ٹولز کنورٹ کرتے ہیں، کاٹتے ہیں، جوڑتے ہیں اور آواز کی سطح طے کرتے ہیں۔ یہ آواز کو ایڈٹ نہیں کرتے۔
نہ مرمت، نہ آواز کی تشکیل۔ نہ شور کم کرنا، نہ بھنبھناہٹ یا کلک ہٹانا، نہ EQ، نہ de-esser، نہ dynamic-range کمپریشن، نہ فیڈز اور نہ ملٹی ٹریک مکسنگ۔ جوڑے گئے ٹکڑوں کے درمیان کراس فیڈز بھی نہیں، اسی لیے اونچی موسیقی کے بیچ میں لگا کٹ کلک کر سکتا ہے۔ Audacity مفت ہے، ہر ڈیسک ٹاپ پر چلتا ہے اور یہ سب ٹھیک طرح کرتا ہے — سرسراہٹ والا انٹرویو، یا ایسی ریکارڈنگ جس کے پیچھے فریج بھنبھنا رہا ہو، اسے اس کی بجائے Audacity چاہیے۔
پیک ناپے جاتے ہیں، بلندی نہیں۔ “آواز کم یا زیادہ کریں” پہلے اور بعد کا پیک بتاتا ہے اور ہر اس چیز کو روک لیتا ہے جو حد سے گزر جائے، مگر نہ کوئی true-peak limiter ہے اور نہ LUFS ہدف۔ اگر آپ کسی مخصوص معیار پر فائل دے رہے ہیں — پوڈکاسٹ کے لیے −16 LUFS، اسٹریمنگ پلیٹ فارم کے لیے −14 — تو آپ کو ایسا ٹول چاہیے جو پیک کے بجائے بلندی ناپے۔
ٹیگز ساتھ نہیں جاتے۔ عنوانات، فنکار، البم آرٹ اور چیپٹرز ابھی یہاں کنورژن میں منتقل نہیں ہوتے: آواز آ جاتی ہے، لائبریری کا میٹا ڈیٹا نہیں۔ میوزک لائبریری کنورٹ کرنے کے لیے ایسا ڈیسک ٹاپ مینیجر جو ساتھ ساتھ ٹیگز دوبارہ لکھے، آپ کے دوبارہ ٹیگ لگانے کے گھنٹے بچائے گا۔
ایک فائل، ایک کلک۔ آٹھ سو وائس میموز کنورٹ کرنا ffmpeg کے گرد ایک shell لوپ کا کام ہے، جو مفت ہے اور ایک منٹ میں وہ کر دے گا جس پر کلک کرنے والا انسان پوری سہ پہر لگا دے۔
اور کچھ کام کوئی براؤزر نہیں کر سکتا۔ پروٹیکشن والی خریداریاں — پرانی .m4p فائلیں، Apple Music ڈاؤن لوڈز، کسی بھی سبسکرپشن سے آنے والی چیز — یہاں نہیں کھل سکتیں، اور وہ پروٹیکشن ہٹانے میں ہم مدد نہیں کرتے۔ MP3 خود زیادہ سے زیادہ دو چینلز اور 48 kHz تک رکھتی ہے، اس لیے سراؤنڈ یا زیادہ ریٹ والا سورس راستے میں سمٹ جاتا ہے۔
ملتے جلتے ناموں والے ٹولز میں سے انتخاب
آڈیو کمپریس کریں بمقابلہ WAV سے MP3۔ دونوں ایک ہی فائل بنا سکتے ہیں، اور صرف ایک صحیح سمت میں ہے۔ WAV سے MP3 غیر کمپریسڈ سورس سے پہلا انکوڈ ہے، جو سب سے کم نقصان والا انکوڈ ہے۔ “آڈیو کمپریس کریں” کچھ بھی لے کر آپ کے چنے ہوئے بٹ ریٹ پر ری انکوڈ کرتا ہے — WAV سے یہ وہی کام ہے، مگر MP3 سے یہ دوسرا لاسی گزر ہے۔ جب آپ کا مانگا ہوا بٹ ریٹ فائل کو چھوٹا نہ کر سکے تو یہ آپ کو خبردار کرتا ہے، جیسا کہ 128 kbps کی MP3 کو 192 پر کمپریس کرنے سے ہوتا ہے۔
آڈیو میں “کمپریس” کے دو مطلب ہیں، اور ان میں سے صرف ایک یہاں ہے۔ “آڈیو کمپریس کریں” بٹ ریٹ کم کر کے فائل چھوٹی کرتا ہے۔ dynamic-range کمپریشن دھیمے حصوں کو اونچے حصوں کے مقابلے میں بلند کرتی ہے، اور پوڈکاسٹ پروڈیوسر اس لفظ سے یہی مراد لیتا ہے۔ نہ “آڈیو کمپریس کریں” دوسرا کام کرتا ہے اور نہ “آواز کم یا زیادہ کریں” — “آواز کم یا زیادہ کریں” پوری فائل کو ایک ہی مقدار سے اوپر نیچے کرتا ہے۔
AAC سے MP3 بمقابلہ M4A سے MP3۔ تقریباً ایک ہی صفحہ۔ .aac فائل ایک سادہ AAC اسٹریم ہے اور .m4a ایک MP4 ڈبے کے اندر AAC ہے جس میں آرٹ ورک اور چیپٹرز بھی آ سکتے ہیں؛ دونوں صفحات دونوں کو پڑھتے ہیں، اور اندر کی آواز یکساں ہے۔ M4A والا صفحہ iPhone وائس میموز کے لیے لکھا گیا ہے، جو پہلے ہی کم بٹ ریٹ پر mono AAC ہوتے ہیں اور نکلتے وقت 128 kbps mono چاہتے ہیں۔
MP3 سے WAV بمقابلہ FLAC سے MP3۔ الٹی سمتیں، اور دونوں یک طرفہ۔ MP3 سے WAV ایک ورکنگ کاپی بناتا ہے جسے آپ مزید کچھ کھوئے بغیر ایڈٹ کر سکیں؛ یہ آواز بہتر نہیں کرتا، اور فائل تقریباً دس گنا بڑی ہو جاتی ہے۔ FLAC سے MP3 ایک ایسے ماسٹر کی ہلکی کاپی بناتا ہے جسے آپ کو سنبھال کر رکھنا چاہیے، کیونکہ MP3 کو کبھی اس FLAC میں واپس نہیں بدلا جا سکتا جس سے وہ بنی۔
آڈیو کاٹیں بمقابلہ آڈیو جوڑیں۔ “آڈیو کاٹیں” ایک فائل میں سے ٹکڑے نکالتا ہے — درمیان کے ٹکڑوں سمیت — اور باقی کو جوڑ دیتا ہے۔ “آڈیو جوڑیں” الگ الگ فائلوں کو ایک کے بعد ایک اس ترتیب میں رکھتا ہے جو آپ ڈریگ کر کے طے کریں۔ تین حصوں میں ریکارڈ کیا گیا انٹرویو جس کے دوسرے حصے میں کھانسی ہو، دونوں کام ہیں: کھانسی کاٹیں، پھر تینوں کو جوڑیں۔