মূল অংশে যান

CSV থেকে Excel-এ কনভার্ট করুন

CSV ফাইলকে সঠিক XLSX ওয়ার্কবুকে বদলান: যোগ ও সাজানো যায় এমন সংখ্যা ও তারিখ, ZIP কোড ও লম্বা আইডি হুবহু যেমন লেখা তেমন, আর বোল্ড, ফ্রিজ করা, ফিল্টারযোগ্য হেডার সারি।

  • কখনো সংরক্ষণ করা হয় না
  • কোনো লাইন নেই, অপেক্ষা নেই
  • সাইনআপ নেই, ওয়াটারমার্ক নেই

যেভাবে কাজ করে

1

CSV ফাইল যোগ করুন

এক বা একাধিক .csv, .tsv বা .txt ফাইল ছাড়ুন, অথবা ডেটা পেস্ট করুন। কয়েকটি ফাইল একটি ওয়ার্কবুকের আলাদা শিট হয়।

2

প্রিভিউ দেখে নিন

ডেলিমিটার ও এনকোডিং আপনার হয়ে শনাক্ত করা হয়, আর প্রতিটি কলাম দেখায় সেটি কোন টাইপ পাবে। যা খুশি বদলান।

3

ডাউনলোড

একটি .xlsx ওয়ার্কবুক, যা Excel, Google Sheets, Numbers ও LibreOffice-এ খোলে।

একটি কলাম কীভাবে তার টাইপ পায়

একটি কলাম পুরোটা একসাথে পরীক্ষা করে একটি টাইপ দেওয়া হয়, আর কয়েকটি নির্দিষ্ট ধরন কলামটিকে লেখায় ফিরিয়ে দেয়, কলামের বাকিটা দেখতে যেমনই হোক। একাধিক অঙ্কের সামনে শূন্য থাকা যেকোনো মান এটি করে। পনেরোটির বেশি অর্থবহ অঙ্কের যেকোনো সংখ্যাও করে, কারণ এর পরে অঙ্ক ভিন্নভাবে দেখানো হয় না, হারিয়ে যায়। প্লাস চিহ্নের পর সাত বা তার বেশি অঙ্ক দিয়ে শুরু হওয়া যেকোনো কিছুও করে, কারণ সেটি ফোন নম্বর, পরিমাণ নয়। এক কলামে দুটি মুদ্রার চিহ্ন মেশালে তা হয়, দশমিক চিহ্ন মেশালেও হয়, আর ১৯০০-এর আগের তারিখেও হয়, যা Excel-এর নিজস্ব ক্যালেন্ডার ধরতে পারে না। এর প্রতিটি সিদ্ধান্ত কারণসহ প্রিভিউতে উল্লেখ করা হয়, যাতে কোনো কলাম কেন লেখা থেকে গেল, তা নিয়ে আপনাকে ভাবতে না হয়, দেখতে পান।

তারিখ মীমাংসা হয় সেল ধরে নয়, কলাম ধরে। বারোর বেশি মানগুলো ঠিক করে দেয় ফাইলটি দিন আগে লিখছে নাকি মাস আগে; কোনোটিই না পারলে অন্য কলামগুলো ভোট দেয়, তারপর আপনার নিজের সেটিং, তারপর দিন-আগে। দুই ক্রম মেশানো কলাম প্রত্যাখ্যান করে লেখা হিসেবে রাখা হয়, আন্দাজ করা হয় না — কারণ এই ক্ষেত্রেই ভুল আন্দাজ চোখে পড়ত না। দুই অঙ্কের বছর Excel-এর নিজস্ব নিয়ম মানে, যেখানে ত্রিশের নিচে যেকোনো কিছু এই শতাব্দীর। শুধু আক্ষরিক শব্দ true ও false আসল বুলিয়ান হয় — yes আর no, Y আর N, 1 আর 0 যেমন আছে তেমনই থাকে, কারণ এর প্রতিটিই কোনো না কোনো ফাইলে অন্য কিছু বোঝায়।

যে মান তার কলামের টাইপে খাপ খায় না, তা খালি না করে মূল লেখা হিসেবেই আবার লেখা হয়, আর যে টোকেনগুলো সাধারণত “নেই” বোঝায় — NA, N/A, null, nil, none, শুধু একটি ড্যাশ বা প্রশ্নবোধক চিহ্ন, আর Excel-এর নিজস্ব ত্রুটির লেখা — টাইপ করা কলামে এলে তা কলামটিকে ভাঙে না। প্রতিটি লেখার সেল তার সেল টাইপ দিয়ে লেখা হিসেবে লেখা হয়, সামনে অ্যাপোস্ট্রফি দিয়ে নয়, তাই সমান চিহ্ন দিয়ে শুরু হওয়া ফিল্ড ওয়ার্কবুকে শুধু ছদ্মবেশে থাকে না, সত্যিই নিষ্ক্রিয় থাকে। এর কিছু যদি আপনার ফাইলের জন্য ভুল হয়, ডাউনলোডের আগে প্রিভিউতে নির্দিষ্ট কলামগুলোকে লেখা হিসেবে আটকে দিতে পারেন।

অন্য কিছু দরকার হলে

এই প্রক্রিয়া পেজেই চলে — ট্যাব সাড়া দেওয়ার মতো রাখতে এটি বারবার বিরতি নেয়, আর এর কোনো ফাইল-সাইজের সীমা নেই; দুটো মিলিয়ে মানে, সত্যিই বড় একটি CSV কোনো ত্রুটি দেখানোর আগে আপনার ফ্যানের আওয়াজ শোনাবে। শত শত মেগাবাইটের ফাইল, বা প্রতি রাতে হওয়া কনভার্শনের জন্য, csvkit-এর in2csv আর হেডলেস মোডে LibreOffice দুটোই স্ক্রিপ্ট থেকে এ কাজ করে, আর কোনোটিরই পুরো টেবিল ধরে রাখতে ব্রাউজার লাগে না।

আরও কঠিন প্রশ্ন হলো, .xlsx আদৌ সঠিক গন্তব্য কি না। ওয়ার্কবুক হলো সেই জায়গা যেখানে মানুষ ডেটা পড়ে ও এডিট করে, আর ফাইলটি যদি শুধু কোডই পড়ে, তবে টাইপ ঠিক করতে ব্যয় করা প্রতিটি ঘণ্টা অপচয় — সে ক্ষেত্রে CSV-ই রাখুন, অথবা একবার Parquet বা JSON Lines-এ কনভার্ট করুন, আর ব্যবহারকারীকে মান থেকে আন্দাজ করতে না দিয়ে স্কিমা ঘোষণা করতে দিন। টাইপ অনুমান যত্ন নিয়ে করা একটি ভালো আন্দাজ; স্কিমা আদৌ কোনো আন্দাজ নয়।

সাধারণ প্রশ্নোত্তর

CSV সরাসরি Excel-এ খুললেই তো হয়?

Excel প্রতিটি সেল আলাদাভাবে আন্দাজ করে: ZIP কোড শুরুর শূন্য হারায়, ১৬ অঙ্কের আইডি 1.23457E+15 হয়ে যায়, SEPT2-এর মতো জিনের নাম তারিখ হয়ে যায়, আর সেমিকোলনের ফাইল একটিমাত্র কলামে এসে পড়ে। এই কনভার্টার প্রতিটি কলামের সব মান দেখে একবারে সিদ্ধান্ত নেয়, আর পুরো কলাম একমত হলেই কেবল কনভার্ট করে।

তারিখ কীভাবে চেনা হয়?

কলাম ধরে ধরে। 15/03/2024 আর 03/15/2024 আলাদা করা হয় একই কলামের অন্য তারিখগুলো দেখে; ISO তারিখ, সময় ও মাসের নামও চেনা হয়। তারিখগুলো আসল Excel তারিখ হয়, আপনি যে ক্রমে লিখেছেন সেভাবে দেখানো হয়। কোনো কলাম সত্যিই দ্ব্যর্থক হলে দিন-আগে নাকি মাস-আগে, নিজেই বেছে নিন।

আমার ফাইলে সেমিকোলন আর দশমিক কমা আছে।

স্বয়ংক্রিয়ভাবে শনাক্ত হয়: 9,8 হয় 9.8 সংখ্যা, আর 1.234,56 হয় 1234.56। ডেলিমিটার আর দশমিক বিভাজক নিজেও হাতে ঠিক করে দিতে পারেন।

কোন কোন ক্যারেক্টার এনকোডিং কাজ করে?

UTF-8 ও UTF-16 শনাক্ত হয়, আর পুরোনো Windows প্রোগ্রামে সেভ করা ফাইল — পশ্চিম ও মধ্য ইউরোপীয়, সিরিলিক, গ্রিক, তুর্কি, হিব্রু, আরবি, জাপানি, চীনা ও কোরিয়ান — চেনা হয় বা বেছে নেওয়া যায়, তাই ą, ß, Ж আর 日本 ঠিকঠাক আসে।

আমার ডেটা কি কোথাও সংরক্ষণ করা হয়?

না। ফাইলটি এখানেই পড়া হয় আর ওয়ার্কবুক এখানেই লেখা হয়; কোথাও কিছু পাঠানো হয় না এবং কিছুই সংরক্ষণ করা হয় না।

ওয়ার্কবুক খোলার সময় CSV কি ফর্মুলা চালাতে পারে?

না। = দিয়ে শুরু হওয়া সেল লেখা হিসেবে সংরক্ষিত হয়, কখনো ফর্মুলা হিসেবে নয়, তাই ক্ষতিকর CSV Excel-এ কিছুই চালাতে পারে না। টাইপ শনাক্তকরণ বন্ধ করলে প্রতিটি সেল হুবহু লেখা হিসেবেই থাকে।

জেনে রাখুন: একটি Excel শিটে সর্বোচ্চ ১০,৪৮,৫৭৬টি সারি থাকে; এর চেয়ে লম্বা ফাইল হেডার পুনরাবৃত্তি করে বাড়তি শিটে চলতে থাকে। খুব বড় ফাইল (শত শত MB) আপনার ডিভাইসের মেমরিতে সীমিত।

এই টুলটি আপনার ওয়েবসাইটে যোগ করুন

যেকোনো ব্লগ, ক্লাসের পেজ বা হেল্প আর্টিকেলের জন্য ফ্রি। একটি স্নিপেট পেস্ট করলেই আপনার ভিজিটররা আপনার পেজেই এটি ব্যবহার করতে পারবেন।