মূল অংশে যান

শব্দ গণনা করুন

শব্দ, বাক্য, অনুচ্ছেদ আর পড়তে কত সময় লাগবে — লেখার সঙ্গে সঙ্গে আপডেট হয়। যে ভাষাগুলোতে শব্দের মাঝে স্পেস থাকে না, সেগুলোর জন্যও সঠিক, যেখানে বেশিরভাগ কাউন্টার ভুল করে। কিছুই সংরক্ষণ করা হয় না।

  • কখনো সংরক্ষণ করা হয় না
  • কোনো লাইন নেই, অপেক্ষা নেই
  • সাইনআপ নেই, ওয়াটারমার্ক নেই

0

শব্দ

যেকোনো ভাষায়

0

অক্ষর

ইমোজি একটি হিসেবে গোনা হয়

0

বাক্য

সংক্ষিপ্ত রূপ বিবেচনা করে

0

অনুচ্ছেদ

ফাঁকা লাইনে ভাগ করা

প্রতিটি গণনা, আর কোথায় তা কাজে লাগে
লাইনএডিটর যেভাবে নম্বর দেয়
0
বাক্য“Dr.” বা “etc.”-এ ভাঙে না
0
অনুচ্ছেদফাঁকা লাইন দিয়ে আলাদা করা অংশ
0
কোড পয়েন্টরেগুলার এক্সপ্রেশনের “.” যা মেলায়
0
UTF-16 ইউনিটJavaScript-এ string.length যা দেখায়
0
UTF-8 বাইটVARCHAR সীমা আর HTTP হেডার যা মাপে
0
পড়ার সময়মনে মনে, মিনিটে ২৩৮ শব্দ হারে
—
বলার সময়জোরে, মিনিটে ১৫০ শব্দ হারে
—
সবচেয়ে লম্বা শব্দঅক্ষর ধরে, বাইট নয়
—
গড় শব্দপাঠযোগ্যতার একটি মোটামুটি ইঙ্গিত
—

লিখতে শুরু করুন, সব ঘর ভরে যাবে। একটি ইমোজি বা চীনা ভাষার একটি বাক্য লিখে দেখুন — দুটোই মানুষ যেভাবে গোনে সেভাবে গোনা হয়, যা বেশির ভাগ কাউন্টার ভুল করে।

যেভাবে কাজ করে

1

পেস্ট করুন বা লিখুন

অথবা একটি টেক্সট ফাইল ছাড়ুন। লিখতে লিখতেই গণনা আপডেট হয়; কোথাও কিছু পাঠানো হয় না।

2

সংখ্যাগুলো দেখুন

শব্দ, বাক্য, অনুচ্ছেদ, লাইন ও অক্ষর, সঙ্গে পড়া ও বলার সময়।

3

সীমা মিলিয়ে নিন

নির্দিষ্ট সীমার মধ্যে লিখলে — SEO টাইটেল, মেটা ডিসক্রিপশন, SMS — পেজটি দেখায় আপনি সীমার কতটা কাছে।

কী গোনা হয়, আর গোনে কে

শব্দসংখ্যা আমাদের হিসাব নয়। শব্দ আসে ব্রাউজারের নিজস্ব Unicode সেগমেন্টার থেকে, যাকে কোনো নির্দিষ্ট ভাষা নয়, তার ডিফল্ট লোকেল ধরে জিজ্ঞেস করা হয়, আর পেজটি সেই অংশগুলো রাখে যেগুলোকে সে শব্দের মতো বলে চিহ্নিত করে। এর ওপর হাইফেন, অ্যাপোস্ট্রফি বা অঙ্কের জন্য এখানে কোনো নিয়ম যোগ করা হয় না — আপনি পান শব্দ কোথায় শুরু হয় সে বিষয়ে সেগমেন্টারের বিচার, আর এ কারণেই চীনা ও জাপানিতে উত্তর সঠিক হয়, আবার দুটি মেশিনের দুটি ব্রাউজার একই লেখায় সামান্য আলাদা ফল দিতে পারে। সেগমেন্টার না থাকা পুরোনো ব্রাউজারে পেজটি স্পেস ধরে ভাগ করার পদ্ধতিতে ফিরে যায় এবং জানিয়ে দেয় যে সংখ্যাটি আনুমানিক — সাধারণ কাউন্টারগুলো কিছু না বলেই সবসময় এই সংখ্যাটিই দেয়।

অনুচ্ছেদ আর লাইন গোনা হয় আমাদের নিজস্ব নিয়মে, আর দুটির নিয়ম এক নয়। অনুচ্ছেদের সীমানা হলো একটি ফাঁকা লাইন — দুটি লাইন ব্রেক, যার মাঝে শুধু স্পেস বা ট্যাব ছাড়া কিছু নেই — তাই ক্যারেজ রিটার্ন অক্ষত থাকা একটি Windows টেক্সট ফাইল ছাড়লে তা একটিমাত্র অনুচ্ছেদ হিসেবে গোনা হয়; বক্সে পেস্ট করা লেখায় এই সমস্যা কখনো হয় না, কারণ টেক্সট বক্স লাইন ফিড দেয়। লাইন গোনা হয় এডিটরের পাশের নম্বর কলামের মতো করে: খালি বক্স মানে শূন্য লাইন, একটি শব্দ মানে এক লাইন, আর নিউলাইনে শেষ হওয়া ফাইলের শেষে একটি খালি লাইন থাকে, যা গোনা হয়। এটি ইচ্ছে করেই কমান্ড লাইনের wc-এর হিসাব নয়, যা লাইন শেষের চিহ্নের সংখ্যা জানায়।

ছোট দুটি সিদ্ধান্তেই সংখ্যা নিয়ে বেশিরভাগ তর্কের মীমাংসা হয়। স্পেস ছাড়া অক্ষর গোনার সময় ব্রাউজার যা কিছুকে হোয়াইটস্পেস বলে, সব বাদ যায় — ওয়েব পেজ থেকে কপি করা লেখার সঙ্গে আসা নন-ব্রেকিং স্পেসও — কিন্তু জিরো-উইডথ স্পেস বাদ যায় না, কারণ তা হোয়াইটস্পেস নয়, তাই গণনায় থেকে যায়। আর সবচেয়ে লম্বা শব্দ ও গড় শব্দদৈর্ঘ্য মাপা হয় কোড পয়েন্টে, প্রধান অক্ষরসংখ্যায় ব্যবহৃত গ্রাফিম ক্লাস্টারে নয়, তাই ইমোজি বা যুক্ত অ্যাকসেন্ট থাকা শব্দ দেখতে যতটা, এখানে তার চেয়ে লম্বা মাপা হয়। শব্দের পুনরাবৃত্তির টেবিল ইংরেজির প্রায় ষাটটি সাধারণ ফাংশন ওয়ার্ড লুকিয়ে রাখে, যদি না আপনি সেগুলো দেখতে চান, আর আপনি যে ভাষাতেই লিখুন, বড়-ছোট হাতের অক্ষর মেলায় ইংরেজির সাধারণ নিয়মে।

অন্য কিছু দরকার হলে

যখন নির্দিষ্ট কোনো প্রোগ্রাম বিচার করবে, তখন শুধু সেই প্রোগ্রামের সংখ্যাই গণ্য। কোনো জার্নাল যখন রেফারেন্সসহ আট হাজার শব্দ বলে, তখন তারা বোঝায় Word যে সংখ্যা দেয় সেটি, আর Word নিজের সেটিংস অনুযায়ী ফিল্ড, ফুটনোট, ক্যাপশন ও টেক্সট বক্স গোনে। সাধারণ গদ্যে এই পেজের হিসাব কাছাকাছি আসবে, কিন্তু প্রতিটি শব্দ পর্যন্ত মিলবে না, তাই যে টুল আপনাকে মূল্যায়ন করবে, তার সংখ্যা ধরেই জমা দিন, এটির নয়।

একটির বেশি ডকুমেন্টের জন্য গোনার কাজ শেলের এক লাইনেই হয়। wc -w একবারে পুরো একটি ফোল্ডার নেয় এবং আপনার মেমোরির চেয়ে বড় ফাইলও স্ট্রিম করে; Markdown, HTML বা LaTeX-এর ক্ষেত্রে আগে ফাইলটিকে pandoc দিয়ে প্লেইন টেক্সটে নিলে মার্কআপ বাদ যায়, ফলে কোড ব্লক, লিংকের ঠিকানা আর ট্যাগ গদ্য হিসেবে গোনা হয় না — রিপোজিটরির শব্দসংখ্যা আর আসল শব্দসংখ্যার ফারাক এটিই। চারশো ফাইলের জন্য এর কোনোটিই একটি পেস্ট বক্স করতে পারে না।

সাধারণ প্রশ্নোত্তর

আমার লেখা কি কোথাও সংরক্ষণ করা হয়?

না। কিছুই সংরক্ষণ করা হয় না, কোনো রিকোয়েস্টও পাঠানো হয় না, আর ইন্টারনেট সংযোগ বিচ্ছিন্ন থাকলেও এটি কাজ করে। লেখার ক্ষেত্রে এর গুরুত্ব যতটা মনে হয় তার চেয়ে বেশি: মানুষ অনলাইন কাউন্টারে যা পেস্ট করে, তা হলো অপ্রকাশিত লেখা, আইনি খসড়া, শিক্ষার্থীদের কাজ আর অভ্যন্তরীণ ডকুমেন্ট।

চীনা, জাপানি বা থাই ভাষায় কি কাজ করে?

হ্যাঁ, আর বেশিরভাগ কাউন্টার থেকে এটিকে আলাদা করে মূলত এটিই। ওই ভাষাগুলোতে শব্দের মাঝে স্পেস থাকে না, তাই প্রচলিত পদ্ধতি — স্পেস ধরে ভাগ করা — পুরো একটি চীনা আর্টিকেলকে একটি শব্দ বলে জানায়। এই টুল ব্রাউজারের Unicode শব্দ সেগমেন্টেশন (UAX #29 অ্যালগরিদম) ব্যবহার করে, যা জানে প্রতিটি লিপিতে শব্দ আসলে কোথায় শুরু আর কোথায় শেষ। এই পেজ আর অন্য একটি কাউন্টারে পাশাপাশি চীনা লেখা পেস্ট করে দেখুন; পার্থক্য সঙ্গে সঙ্গেই চোখে পড়বে।

পড়ার সময় কীভাবে হিসাব করা হয়?

নিঃশব্দে পড়ার জন্য শব্দসংখ্যাকে মিনিটে ২৩৮ দিয়ে, আর জোরে পড়ার জন্য মিনিটে ১৫০ দিয়ে ভাগ করে। ২৩৮ সংখ্যাটি এসেছে প্রাপ্তবয়স্কদের নিঃশব্দে পড়া নিয়ে ১৯০টি গবেষণার ওপর Brysbaert-এর ২০১৯ সালের মেটা-অ্যানালাইসিস থেকে, ব্লগ পোস্টে পোস্টে কপি হওয়া গোল সংখ্যা ২০০ বা ২৫০ থেকে নয়। এটি সাধারণ গদ্যের গড় — জটিল টেকনিক্যাল লেখা পড়তে বেশি সময় লাগে, আর পরিচিত বিষয়ে কম।

বাক্য হিসেবে কী গোনা হয়?

বাক্য শেষ হয় ফুল স্টপ, প্রশ্নবোধক বা বিস্ময়সূচক চিহ্নে — তবে উপাধি বা সংক্ষেপের পরে নয়। “We met Dr. Smith on Monday.” একটি বাক্য, দুটি নয়; ব্রাউজারের নিজস্ব সেগমেন্টেশন এখানে ভুল করে, আর এই পেজ তা শুধরে নেয়। “Bring pens, paper, etc. and we will start”-ও একটি বাক্য; একই কথার পরে বড় হাতের অক্ষর এলে তা দুটি।

অনুচ্ছেদ হিসেবে কী গোনা হয়?

একটি ফাঁকা লাইন দিয়ে আলাদা করা লেখার অংশ। প্রতিটি লাইন ব্রেককে অনুচ্ছেদ ধরলে ঠিকানার প্রতিটি লাইনই একেকটি অনুচ্ছেদ হয়ে যেত, আর এ কারণেই এখানকার সংখ্যা অন্য কিছু টুল থেকে আলাদা।

Word ডকুমেন্ট বা PDF-এর শব্দ কি গোনা যায়?

সরাসরি নয় — লেখাটি পেস্ট করুন, অথবা আগে আমাদের PDF থেকে টেক্সট টুল ব্যবহার করে ফলাফল পেস্ট করুন। এই পেজ টেক্সট নিয়ে কাজ করে, আর এ কারণেই এটি তাৎক্ষণিক ও ব্যক্তিগত।

আমার শব্দসংখ্যা Microsoft Word থেকে আলাদা কেন?

সাধারণত হাইফেন আর সংখ্যার কারণে। Word “well-known”-কে একটি শব্দ ধরে, আমরাও তাই ধরি; কিছু টুল দুটি ধরে। আলাদা করে থাকা সংখ্যা, তারিখ ও চিহ্নে কোনো অঙ্ক বা অক্ষর থাকলে এখানে সেগুলো শব্দ হিসেবে গোনা হয়। সাধারণ গদ্যে দুটির হিসাব প্রায় মিলে যায়; পার্ট নম্বরের তালিকায় মিলবে না।

জেনে রাখুন: পড়া ও বলার সময় সাধারণ গদ্যের গড় হিসাব — জটিল টেকনিক্যাল লেখা পড়তে বেশি সময় লাগে, আর পরিচিত বিষয়ে কম, তাই এগুলোকে প্রতিশ্রুতি নয়, আনুমানিক ধারণা হিসেবে নিন। গণনা ব্রাউজারের Unicode সেগমেন্টেশনের ওপর নির্ভর করে; যে ব্রাউজার এতটাই পুরোনো যে তাতে এটি নেই, সেখানে একটি আনুমানিক হিসাব দেখানো হয় এবং পেজে তা জানিয়ে দেওয়া হয়।

এই টুলটি আপনার ওয়েবসাইটে যোগ করুন

যেকোনো ব্লগ, ক্লাসের পেজ বা হেল্প আর্টিকেলের জন্য ফ্রি। একটি স্নিপেট পেস্ট করলেই আপনার ভিজিটররা আপনার পেজেই এটি ব্যবহার করতে পারবেন।