CSV فائل کھولیں
دیکھیں فائل میں اصل میں کیا ہے۔ شروع کے صفر برقرار رہتے ہیں، تاریخیں گھڑی نہیں جاتیں، اور delimiter اور انکوڈنگ آپ کے لیے پہچان لیے جاتے ہیں۔ کچھ بھی محفوظ نہیں کیا جاتا۔
- کبھی محفوظ نہیں کی جاتی
- نہ قطار، نہ انتظار
- نہ سائن اپ، نہ واٹر مارک
یہ کیسے کام کرتا ہے
فائل ڈراپ کریں
CSV، TSV، یا سیمی کولن یا پائپ سے الگ کی گئی کوئی بھی فائل — separator خود بخود پہچانا جاتا ہے۔
اسے ٹیبل کی شکل میں پڑھیں
ترتیب اور تلاش کے قابل، رو اور کالم نمبرز کے ساتھ۔ ہر ویلیو بالکل ویسی دکھائی جاتی ہے جیسی محفوظ ہے۔
جو چاہیے وہ ڈھونڈیں
رو فلٹر کریں، کسی کالم پر جائیں، اور دیکھیں کون سے سیل خالی یا بے ترتیب ہیں۔
Excel کو ہاتھ لگائے بغیر CSV پڑھنا
CSV کو Excel کے بجائے یہاں دیکھنے کی وجہ یہ ہے کہ Excel اسے کھولتے ہوئے ہی بدل دیتا ہے۔ پوسٹ کوڈ یا اکاؤنٹ نمبر کا شروع والا صفر ہٹا دیا جاتا ہے، کیونکہ کالم نمبروں والا لگتا ہے۔ پندرہ ہندسوں سے لمبا شناختی نمبر round ہو جاتا ہے۔ جو کچھ تاریخ جیسا لگے اسے مقامی انداز میں بدل دیا جاتا ہے، یوں 03/05 کا مطلب ملک کے حساب سے بدل جاتا ہے۔ اور SEPT1 جیسا جین کا نام تاریخ بن جاتا ہے — یہ مسئلہ اتنا مستقل تھا کہ جینیات کے ماہرین نے جینز کے نام ہی بدل دیے۔ یہاں ایسا کچھ نہیں ہوتا: ویلیوز بالکل ویسی دکھائی جاتی ہیں جیسا فائل کے بائٹس کہتے ہیں۔
CSV کا کوئی حقیقی معیار نہیں، اس لیے پہلا کام یہ سمجھنا ہے کہ فائل ہے کیا۔ delimiter کوما، سیمی کولن یا ٹیب ہو سکتا ہے — یورپی لوکیلز سیمی کولن کے ساتھ ایکسپورٹ کرتے ہیں کیونکہ وہاں کوما اعشاریہ کا نشان ہے — اور انکوڈنگ UTF-8 یا کوئی پرانا code page ہو سکتی ہے، جس کا غلط اندازہ لگایا جائے تو accent والے نام بے معنی حروف میں بدل جاتے ہیں۔ دونوں فرض نہیں کیے جاتے بلکہ پہچانے جاتے ہیں، جس سے تقریباً ہر حقیقی ایکسپورٹ سنبھل جاتی ہے، اور اگر پہچان غلط ہو تو دونوں کو خود بدلا جا سکتا ہے، آپ پھنستے نہیں۔
quoting وہ جگہ ہے جہاں سادہ ویورز ناکام ہوتے ہیں۔ quotes میں بند فیلڈ میں جائز طور پر کوما، لائن بریک اور دوہرے quote کے نشان ہو سکتے ہیں، اس لیے ڈاک کا پتا رکھنے والی رو فائل میں کئی لائنوں پر پھیلی ہوتی ہے مگر پھر بھی ایک ہی ریکارڈ رہتی ہے۔ جو چیز صرف کوما پر تقسیم کرتی ہے وہ بالکل انہی رو کو بگاڑ دیتی ہے — اسی لیے کوئی فائل ٹیکسٹ ایڈیٹر میں ٹھیک اور ویور میں غلط دکھتی ہے، یا اس کے الٹ۔
بے ترتیب فائل — جس کی رو میں ہیڈر سے زیادہ یا کم فیلڈز ہوں — جیسی ہے ویسی دکھائی جاتی ہے، خاموشی سے بھری یا کاٹی نہیں جاتی، کیونکہ غلط تعداد کی فیلڈز والی رو عموماً اوپر کہیں quoting کے مسئلے کی علامت ہوتی ہے، اور اسے چھپانا خرابی کو چھپانا ہے۔ پوری فائل صفحے کے اندر پارس کی جاتی ہے، اس لیے میموری کا استعمال اس کے سائز کے حساب سے ہوتا ہے۔
جب آپ کو کچھ اور چاہیے
کمانڈ لائن پر csvkit بالکل اسی کام کے لیے بنا ہے: csvlook ترتیب سے ٹیبل دکھاتا ہے، csvstat ہر کالم کا خلاصہ دیتا ہے، اور csvclean بے ترتیب رو کی نشاندہی کر کے انہیں ٹھیک کرتا ہے۔ Miller — mlr --icsv --opprint cat data.csv — یہی کام تیزی سے کرتا ہے اور میموری سے بڑی فائلیں بھی سنبھال لیتا ہے۔ انٹرایکٹو طریقے سے ڈیٹا کھنگالنے کے لیے VisiData جاننے کے قابل ہے: یہ کئی گیگابائٹ کی فائل ٹرمینل میں فوراً کھول دیتا ہے، ترتیب، فلٹر اور تعداد کی گنتی کے ساتھ۔
اگر CSV کو Excel میں کھولنا ہی ہے تو اس پر ڈبل کلک کرنے کے بجائے Data → From Text/CSV استعمال کریں۔ امپورٹ ڈائیلاگ آپ کو کچھ بھی پارس ہونے سے پہلے ہر کالم کی قسم طے کرنے دیتا ہے، اور اوپر بیان کردہ تبدیلیوں کو روکنے کا یہی واحد قابلِ اعتماد طریقہ ہے۔ ڈبل کلک Excel کو اندازہ لگانے کی اجازت دے دیتا ہے، اور وہ پورے اعتماد سے اندازہ لگاتا ہے۔
اکثر پوچھے جانے والے سوالات
کیا میری فائل کہیں محفوظ کی جاتی ہے؟
نہیں۔ کچھ بھی محفوظ نہیں کیا جاتا، کچھ بھی رکھا نہیں جاتا، اور صفحہ لوڈ ہونے کے بعد یہ Wi-Fi بند ہونے پر بھی کام کرتا ہے۔ CSV عموماً گاہکوں کی فہرست، کوئی ایکسپورٹ یا مالیاتی رپورٹ ہوتی ہے، جو بالکل ایسی فائل ہے جو کسی اجنبی کے سرور کو نہیں دینی چاہیے۔
Excel میری CSV کیوں بگاڑ دیتا ہے؟
کیونکہ Excel کھولتے ہی، بغیر پوچھے، ویلیوز بدل دیتا ہے۔ 00123 جیسا پروڈکٹ کوڈ نمبر 123 بن جاتا ہے اور صفر ہمیشہ کے لیے چلے جاتے ہیں۔ 5-3 جیسا پارٹ نمبر 5 مارچ بن جاتا ہے۔ لمبا آرڈر نمبر 1.23457E+14 بن جاتا ہے۔ سیمی کولن سے الگ کی گئی جرمن CSV پوری کی پوری کالم A میں آ جاتی ہے۔ یہ سب آپ کی فائل میں نہیں — یہ وہ ہے جو Excel نے کھولتے وقت اس کے ساتھ کیا۔ یہ ویور ہر ویلیو کو ٹیکسٹ کے طور پر، بالکل ویسی جیسی محفوظ ہے، دکھاتا ہے، تاکہ آپ دیکھ سکیں کہ آپ کو اصل میں کیا ملا۔
کون سے separators اور انکوڈنگز چلتی ہیں؟
کوما، سیمی کولن، ٹیب اور پائپ، جو فائل کی ایکسٹینشن سے نہیں بلکہ فائل کو دیکھ کر پہچانے جاتے ہیں — کسی جرمن سسٹم کی ایکسپورٹ کی گئی "CSV" عموماً سیمی کولن سے الگ ہوتی ہے۔ انکوڈنگ بھی پہچانی جاتی ہے: byte-order mark کے ساتھ یا اس کے بغیر UTF-8، UTF-16، اور وہ Windows-1252/Latin-1 فائلیں جو پرانے سسٹمز بناتے ہیں۔ اگر انکوڈنگ غلط ہو تو "é" کی جگہ "é" نظر آتا ہے، اور صفحہ آپ کو اسے بدلنے دیتا ہے۔
کیا یہ ایسی quoted فیلڈز سنبھالتا ہے جن میں کوما ہوں؟
ہاں — صحیح طریقے سے، RFC 4180 کے مطابق۔ quotes میں بند فیلڈ میں کوما، لائن بریک اور escaped quotes ہو سکتے ہیں، اور تینوں سنبھالے جاتے ہیں۔ quotes کا خیال رکھے بغیر کوما پر تقسیم کرنا CSV کی کلاسک خرابی ہے، اور یہ خاموشی سے اس فیلڈ کے بعد کا ہر کالم کھسکا دیتی ہے۔
یہ کتنی بڑی فائل کھول سکتا ہے؟
جتنی دستیاب میموری اجازت دے، کوئی مقررہ سائز کی حد نہیں — کئی میگابائٹ اور لاکھوں رو والی فائلیں ٹھیک چلتی ہیں۔ صرف اسکرین پر نظر آنے والی رو بنائی جاتی ہیں، اس لیے بڑی فائل پر بھی اسکرولنگ ہموار رہتی ہے۔
کیا میں اسے ایڈٹ یا تبدیل کر سکتا ہوں؟
یہ صفحہ پڑھنے کے لیے ہے۔ تبدیل کرنے کے لیے ہمارے [CSV سے Excel](csv-to-excel) اور [CSV سے JSON](csv-to-json) ٹولز بالکل یہی کرتے ہیں، اور شروع کے صفر کو ٹیکسٹ کے طور پر رکھتے ہیں، اسپریڈشیٹ کو انہیں کھانے نہیں دیتے۔
جاننا مفید ہے: پوری فائل صفحے کے اندر پارس کی جاتی ہے، اس لیے بہت بڑی ایکسپورٹ اپنے سائز کے حساب سے میموری استعمال کرے گی۔ delimiter، quoting اور انکوڈنگ فرض نہیں کیے جاتے بلکہ پہچانے جاتے ہیں، جس سے تقریباً ہر حقیقی ایکسپورٹ سنبھل جاتی ہے — اگر پہچان غلط ہو تو آپ اسے خود بدل سکتے ہیں، پھنستے نہیں۔
یہ ٹول اپنی ویب سائٹ پر لگائیں
کسی بھی بلاگ، کلاس پیج یا ہیلپ آرٹیکل کے لیے مفت۔ ایک اسنیپٹ پیسٹ کریں اور آپ کے وزیٹرز اسے سیدھا آپ کے صفحے پر استعمال کر سکیں گے۔
متعلقہ ٹولز
XML ویور
XML کو ایسے ٹری میں پڑھیں جسے سمیٹا جا سکے
Markdown پیش نظارہ
اپنا Markdown ویسا دیکھیں جیسا GitHub دکھاتا ہے
CSV سے Excel
CSV سے XLSX، اصل نمبرز اور تاریخوں کے ساتھ
JSON فارمیٹر
بے ترتیب JSON کو پڑھنے کے قابل بنائیں
الفاظ گنیں
الفاظ، جملے اور پڑھنے کا وقت
حروف گنیں
حروف، بائٹس، اور آپ کی حد اصل میں کیا گنتی ہے