CSV ফাইল খুলুন
ফাইলে আসলে কী আছে, দেখুন। শুরুর শূন্য টিকে থাকে, কোনো তারিখ বানানো হয় না, আর ডিলিমিটার ও এনকোডিং আপনার হয়ে বের করে নেওয়া হয়। কিছুই সংরক্ষণ করা হয় না।
- কখনো সংরক্ষণ করা হয় না
- কোনো লাইন নেই, অপেক্ষা নেই
- সাইনআপ নেই, ওয়াটারমার্ক নেই
যেভাবে কাজ করে
ফাইলটি এখানে ছাড়ুন
CSV, TSV, বা সেমিকোলন কিংবা পাইপ দিয়ে আলাদা করা যেকোনো ফাইল — বিভাজক নিজে থেকেই শনাক্ত হয়।
টেবিল হিসেবে পড়ুন
সর্ট ও সার্চ করা যায়, সারি ও কলাম নম্বরসহ। প্রতিটি মান ঠিক যেভাবে সংরক্ষিত, সেভাবেই দেখানো হয়।
যা দরকার খুঁজে নিন
সারি ফিল্টার করুন, কোনো কলামে চলে যান, আর দেখুন কোন সেল ফাঁকা বা অসমান।
Excel-কে হাত দিতে না দিয়ে CSV পড়া
CSV Excel-এ না খুলে এখানে দেখার কারণ হলো, Excel খোলার সময়ই ফাইলটি এডিট করে ফেলে। পোস্টকোড বা অ্যাকাউন্ট নম্বরের শুরুর শূন্য মুছে যায়, কারণ কলামটি সংখ্যার মতো দেখায়। পনেরো ডিজিটের বেশি লম্বা আইডেন্টিফায়ার রাউন্ড হয়ে যায়। তারিখের মতো দেখতে যেকোনো কিছু স্থানীয় রীতিতে নতুন করে সাজানো হয়, ফলে দেশভেদে 03/05-এর অর্থ বদলে যায়। আর SEPT1-এর মতো জিনের নাম হয়ে যায় তারিখ — সমস্যাটি এতই নাছোড় যে জিনতত্ত্ববিদেরা জিনগুলোর নামই বদলে ফেলেছেন। এখানে এমন কিছুই ঘটে না: ফাইলের বাইটে যা আছে, মানগুলো হুবহু সেভাবেই দেখানো হয়।
CSV-এর সত্যিকারের কোনো মানদণ্ড নেই, তাই প্রথম কাজ হলো ফাইলটি আসলে কেমন, তা বের করা। ডিলিমিটার হতে পারে কমা, সেমিকোলন বা ট্যাব — ইউরোপীয় লোকেল সেমিকোলন দিয়ে এক্সপোর্ট করে, কারণ সেখানে কমা দশমিক চিহ্ন — আর এনকোডিং হতে পারে UTF-8 বা কোনো পুরোনো কোড পেজ, যা ভুল অনুমান করলে উচ্চারণচিহ্নযুক্ত নাম দুর্বোধ্য হিজিবিজিতে (mojibake) পরিণত হয়। দুটোই ধরে নেওয়া হয় না, শনাক্ত করা হয় — এতে প্রায় সব বাস্তব এক্সপোর্টই ঠিকমতো খোলে; আর শনাক্তকরণ ভুল হলে আপনাকে আটকে না রেখে দুটোই বদলানো যায়।
সাধারণ ভিউয়ারগুলো ব্যর্থ হয় কোটিংয়ে। কোটেশনে ঘেরা ফিল্ডে বৈধভাবেই কমা, লাইন ব্রেক আর দ্বিগুণ কোটেশন চিহ্ন থাকতে পারে, তাই ডাকঠিকানা থাকা একটি সারি ফাইলে কয়েকটি লাইন জুড়ে থাকে, অথচ রেকর্ড একটিই। যা কিছু শুধু কমা ধরে ভাগ করে, তা ঠিক এই সারিগুলোই এলোমেলো করে দেয় — সেজন্যই কোনো ফাইল টেক্সট এডিটরে ঠিক দেখায় আর ভিউয়ারে ভুল, বা উল্টোটা।
অসমান ফাইল — যেখানে কোনো সারিতে হেডারের চেয়ে বেশি বা কম ফিল্ড — চুপচাপ ভরাট বা ছেঁটে না দিয়ে যেমন আছে তেমনই দেখানো হয়, কারণ ভুল সংখ্যক ফিল্ডের সারি সাধারণত ওপরের কোথাও কোটিং সমস্যার লক্ষণ, আর তা লুকালে বাগটিই লুকানো হয়। পুরো ফাইলটি পেজের ভেতরেই পার্স হয়, তাই মেমরির ব্যবহার তার সাইজের অনুপাতে।
অন্য কিছু দরকার হলে
কমান্ড লাইনে csvkit ঠিক এই কাজের জন্যই তৈরি: csvlook সাজানো টেবিল দেখায়, csvstat প্রতিটি কলামের সারসংক্ষেপ দেয়, আর csvclean অসমান সারিগুলো জানায় ও ঠিক করে। Miller — mlr --icsv --opprint cat data.csv — একই কাজ দ্রুত করে এবং মেমরির চেয়ে বড় ফাইলও সামলায়। ইন্টার্যাক্টিভভাবে ঘেঁটে দেখার জন্য VisiData জেনে রাখার মতো: এটি কয়েক গিগাবাইটের ফাইলও টার্মিনালে মুহূর্তেই খোলে, সর্টিং, ফিল্টারিং ও ফ্রিকোয়েন্সি গণনাসহ।
CSV একান্তই Excel-এ খুলতে হলে ডাবল-ক্লিক না করে Data → From Text/CSV ব্যবহার করুন। ইমপোর্ট ডায়ালগে কোনো কিছু পার্স হওয়ার আগেই প্রতিটি কলামের টাইপ ঠিক করে দেওয়া যায় — ওপরের রূপান্তরগুলো ঠেকানোর একমাত্র নির্ভরযোগ্য উপায় এটিই। ডাবল-ক্লিক করলে Excel অনুমান করার অনুমতি পায়, আর সে পূর্ণ আত্মবিশ্বাসে অনুমান করে।
সাধারণ প্রশ্নোত্তর
আমার ফাইল কি কোথাও সংরক্ষণ করা হয়?
না। কিছুই সংরক্ষণ করা হয় না, কিছুই রাখা হয় না, আর পেজ একবার লোড হয়ে গেলে Wi-Fi বন্ধ রেখেও এটি কাজ করে। CSV সাধারণত হয় গ্রাহকের তালিকা, কোনো এক্সপোর্ট বা আর্থিক রিপোর্ট — ঠিক এমন ধরনের ফাইল, যা অচেনা কারও সার্ভারে তুলে দেওয়া উচিত নয়।
Excel কেন আমার CSV নষ্ট করে দেয়?
কারণ Excel খোলার সময়ই জিজ্ঞেস না করে রূপান্তর করে ফেলে। 00123 প্রোডাক্ট কোড হয়ে যায় 123 সংখ্যা, আর শূন্যগুলো চিরতরে হারিয়ে যায়। 5-3-এর মতো পার্ট নম্বর হয়ে যায় ৫ মার্চ। লম্বা অর্ডার নম্বর হয়ে যায় 1.23457E+14। সেমিকোলন দিয়ে আলাদা করা জার্মান CSV পুরোটাই পড়ে থাকে কলাম A-তে। এর কিছুই আপনার ফাইলে নেই — খোলার পথে Excel এগুলো করেছে। এই ভিউয়ার প্রতিটি মান টেক্সট হিসেবে, ঠিক যেভাবে সংরক্ষিত সেভাবে দেখায়, তাই আপনি আসলে কী পেয়েছেন, তা দেখতে পান।
কোন কোন বিভাজক ও এনকোডিং কাজ করে?
কমা, সেমিকোলন, ট্যাব ও পাইপ — এক্সটেনশন দেখে নয়, ফাইলের ভেতরটা দেখে শনাক্ত করা হয়; জার্মান কোনো সিস্টেমের এক্সপোর্ট করা “CSV” সাধারণত সেমিকোলন দিয়ে আলাদা থাকে। এনকোডিংও শনাক্ত হয়: বাইট-অর্ডার মার্কসহ বা ছাড়া UTF-8, UTF-16, আর পুরোনো সিস্টেমের তৈরি Windows-1252/Latin-1 ফাইল। এনকোডিং ভুল হলে “é”-এর জায়গায় “é” দেখায়, আর পেজ থেকেই আপনি তা বদলাতে পারেন।
কোটেশনের ভেতরে কমা থাকা ফিল্ড কি ঠিকমতো সামলায়?
হ্যাঁ — যথাযথভাবে, RFC 4180 অনুযায়ী। কোটেশনে ঘেরা ফিল্ডে কমা, লাইন ব্রেক ও এস্কেপ করা কোটেশন থাকতে পারে, আর তিনটিই সামলানো হয়। কোটেশন না মেনে শুধু কমা ধরে ভাগ করা CSV-এর চিরচেনা বাগ, আর এতে সমস্যার ফিল্ডটির পরের প্রতিটি কলাম নিঃশব্দে সরে যায়।
কত বড় ফাইল খোলা যায়?
নির্দিষ্ট কোনো সাইজসীমা নয়, যতটা মেমরি পাওয়া যায় — বহু মেগাবাইট আর কয়েক লাখ সারির ফাইলও ঠিকঠাক খোলে। শুধু স্ক্রিনে থাকা সারিগুলোই আঁকা হয়, তাই বড় ফাইলেও স্ক্রল মসৃণ থাকে।
এটি কি এডিট বা কনভার্ট করা যায়?
এই পেজ শুধু পড়ার জন্য। কনভার্ট করতে আমাদের [CSV থেকে Excel](csv-to-excel) ও [CSV থেকে JSON](csv-to-json) টুল ঠিক সেই কাজটিই করে, আর শুরুর শূন্যগুলো স্প্রেডশিটকে খেয়ে ফেলতে না দিয়ে টেক্সট হিসেবে রাখে।
জেনে রাখুন: পুরো ফাইলটি পেজের ভেতরেই পার্স হয়, তাই খুব বড় এক্সপোর্টে তার সাইজের অনুপাতে মেমরি লাগবে। ডিলিমিটার, কোটিং ও এনকোডিং ধরে নেওয়া হয় না, শনাক্ত করা হয় — এতে প্রায় সব বাস্তব এক্সপোর্টই ঠিকমতো খোলে; শনাক্তকরণ ভুল হলে আটকে না থেকে আপনি নিজেই তা বদলে দিতে পারেন।
এই টুলটি আপনার ওয়েবসাইটে যোগ করুন
যেকোনো ব্লগ, ক্লাসের পেজ বা হেল্প আর্টিকেলের জন্য ফ্রি। একটি স্নিপেট পেস্ট করলেই আপনার ভিজিটররা আপনার পেজেই এটি ব্যবহার করতে পারবেন।
সম্পর্কিত টুল
XML ভিউয়ার
XML পড়ুন ট্রি আকারে, যা ভাঁজ করা যায়
Markdown প্রিভিউ
GitHub যেভাবে দেখায়, সেভাবে আপনার Markdown দেখুন
CSV থেকে Excel
CSV থেকে XLSX, সংখ্যা ও তারিখ সঠিক রেখে
JSON ফরম্যাটার
অপাঠ্য JSON-কে পড়ার উপযোগী করুন
শব্দ গণনা (ওয়ার্ড কাউন্টার)
শব্দ, বাক্য আর পড়তে কত সময় লাগবে
অক্ষর গণনা (ক্যারেক্টার কাউন্টার)
অক্ষর, বাইট, আর আপনার সীমা আসলে কী গোনে