مواد پر جائیں

الفاظ گنیں

الفاظ، جملے، پیراگراف اور پڑھنے میں لگنے والا وقت — لکھتے ساتھ اپ ڈیٹ۔ ان زبانوں کے لیے بھی درست جو الفاظ کے درمیان اسپیس نہیں رکھتیں، جن میں زیادہ تر کاؤنٹرز غلطی کرتے ہیں۔ کچھ بھی محفوظ نہیں کیا جاتا۔

  • کبھی محفوظ نہیں کی جاتی
  • نہ قطار، نہ انتظار
  • نہ سائن اپ، نہ واٹر مارک

0

الفاظ

کوئی بھی زبان

0

حروف

ایموجی ایک گنا جاتا ہے

0

جملے

مخففات کا خیال رکھا گیا

0

پیراگراف

خالی لائنوں پر تقسیم

ہر گنتی، اور کہاں استعمال ہوتی ہے
لائنیںجیسے ایڈیٹر انہیں نمبر دیتا ہے
0
جملے“Dr.” یا “etc.” پر جملہ نہیں ٹوٹتا
0
پیراگرافخالی لائن سے الگ کیے گئے حصے
0
کوڈ پوائنٹسجنہیں ریگولر ایکسپریشن کا “.” میچ کرتا ہے
0
UTF-16 یونٹسجو JavaScript میں string.length بتاتا ہے
0
UTF-8 بائٹسجو VARCHAR کی حد اور HTTP ہیڈرز ناپتے ہیں
0
پڑھنے کا وقتخاموشی سے، 238 الفاظ فی منٹ
—
بولنے کا وقتبلند آواز سے، 150 الفاظ فی منٹ
—
سب سے لمبا لفظحروف کے حساب سے، بائٹس کے نہیں
—
اوسط لفظپڑھنے میں آسانی کا ایک موٹا اندازہ
—

ٹائپ کرنا شروع کریں، سب کچھ خود بھر جائے گا۔ کوئی ایموجی یا چینی زبان کا ایک جملہ آزمائیں — دونوں ویسے ہی گنے جاتے ہیں جیسے انسان گنتا ہے، جس میں زیادہ تر کاؤنٹرز غلطی کرتے ہیں۔

یہ کیسے کام کرتا ہے

1

پیسٹ کریں یا لکھیں

یا ٹیکسٹ فائل ڈراپ کریں۔ گنتی ساتھ ساتھ اپ ڈیٹ ہوتی ہے؛ کچھ بھی کہیں نہیں بھیجا جاتا۔

2

نمبرز دیکھیں

الفاظ، جملے، پیراگراف، لائنیں اور حروف، ساتھ میں پڑھنے اور بولنے کا وقت۔

3

اپنی حدیں چیک کریں

اگر آپ کسی حد کے اندر لکھ رہے ہیں — SEO ٹائٹل، میٹا ڈسکرپشن، SMS — تو صفحہ دکھاتا ہے کہ آپ کتنے قریب ہیں۔

کیا گنا جاتا ہے، اور گنتی کون کرتا ہے

الفاظ کی گنتی ہماری نہیں۔ الفاظ براؤزر کے اپنے Unicode سیگمنٹر سے آتے ہیں، جس سے کسی مخصوص لوکیل کے بجائے اس کا ڈیفالٹ لوکیل مانگا جاتا ہے، اور صفحہ وہ ٹکڑے رکھتا ہے جنہیں وہ لفظ جیسا قرار دیتا ہے۔ یہاں اس کے اوپر ہائفنز، اپوسٹروفیز یا ہندسوں کے لیے کوئی اضافی قاعدہ نہیں لگایا جاتا — آپ کو سیگمنٹر کا یہ فیصلہ ملتا ہے کہ الفاظ کہاں شروع ہوتے ہیں، اسی لیے چینی اور جاپانی میں جواب درست ہوتا ہے، اور اسی لیے دو مشینوں پر دو براؤزر ایک ہی ٹیکسٹ پر بہت معمولی فرق دکھا سکتے ہیں۔ جس پرانے براؤزر میں سیگمنٹر نہ ہو، وہاں صفحہ اسپیس پر تقسیم کرنے کا طریقہ استعمال کرتا ہے اور بتا دیتا ہے کہ عدد تخمینی ہے — یہی وہ عدد ہے جو سادہ کاؤنٹرز ہر وقت دیتے ہیں اور بتاتے بھی نہیں۔

پیراگراف اور لائنیں ہمارے اپنے قواعد سے گنی جاتی ہیں، اور یہ ایک ہی قاعدہ نہیں۔ پیراگراف کی حد خالی لائن ہے — دو لائن بریکس جن کے بیچ صرف اسپیس یا ٹیبز ہوں — اس لیے Windows کی ٹیکسٹ فائل اپنے carriage returns سمیت ڈراپ کی جائے تو ایک ہی پیراگراف گنی جاتی ہے؛ باکس میں پیسٹ کیے گئے ٹیکسٹ میں یہ مسئلہ کبھی نہیں ہوتا، کیونکہ ٹیکسٹ باکس line feeds دیتا ہے۔ لائنیں اسی طرح گنی جاتی ہیں جیسے ایڈیٹر کا گٹر گنتا ہے: خالی باکس صفر لائنیں ہے، ایک لفظ ایک لائن ہے، اور جو فائل newline پر ختم ہو اس کی آخری خالی لائن بھی گنی جاتی ہے۔ یہ جان بوجھ کر کمانڈ لائن کے wc سے مختلف ہے، جو لائن ختم کرنے والے حروف کی تعداد بتاتا ہے۔

دو چھوٹے فیصلے نمبرز پر زیادہ تر بحثیں نمٹا دیتے ہیں۔ اسپیس کے بغیر حروف میں وہ سب ہٹا دیا جاتا ہے جسے براؤزر whitespace کہتا ہے، جس میں ویب صفحے سے کاپی کیے گئے ٹیکسٹ کے ساتھ آنے والی non-breaking space بھی شامل ہے — لیکن zero-width space نہیں، جو whitespace نہیں اور گنتی میں رہتی ہے۔ اور سب سے لمبا لفظ اور الفاظ کی اوسط لمبائی code points میں ناپی جاتی ہے، نہ کہ ان grapheme clusters میں جو اوپر والے حروف کے عدد میں استعمال ہوتے ہیں، اس لیے ایموجی یا combining accent والا لفظ یہاں دکھنے سے زیادہ لمبا نکلتا ہے۔ فریکوئنسی ٹیبل انگریزی کے تقریباً ساٹھ عام function words چھپا دیتا ہے جب تک آپ انہیں نہ مانگیں، اور بڑے چھوٹے حروف کو انگریزی کے سادہ قاعدے سے یکساں کرتا ہے، چاہے آپ کسی بھی زبان میں لکھ رہے ہوں۔

جب آپ کو کچھ اور چاہیے

جب فیصلہ کوئی مخصوص پروگرام کرنے والا ہو تو صرف اسی پروگرام کا عدد معتبر ہے۔ جو جرنل کہتا ہے کہ حوالوں سمیت آٹھ ہزار الفاظ، اس کی مراد Word کا نکالا ہوا عدد ہے، اور Word فیلڈز، فٹ نوٹس، کیپشنز اور ٹیکسٹ باکسز اپنی سیٹنگز کے مطابق گنتا ہے۔ یہ صفحہ عام تحریر پر قریب رہے گا لیکن لفظ بہ لفظ میل نہیں کھائے گا، اس لیے اس ٹول کے مطابق جمع کرائیں جو آپ کو جانچ رہا ہے، اس کے مطابق نہیں۔

ایک سے زیادہ دستاویزات کے لیے گنتی ایک شیل لائن کا کام ہے۔ wc -w ایک ساتھ پورا فولڈر لے لیتا ہے اور آپ کی میموری سے بڑی فائلیں بھی اسٹریم کر لیتا ہے؛ Markdown، HTML یا LaTeX کے لیے فائل کو پہلے pandoc سے گزار کر سادہ ٹیکسٹ بنانے سے مارک اپ ہٹ جاتا ہے، تاکہ کوڈ فینسز، لنک ٹارگٹس اور ٹیگز تحریر کے طور پر نہ گنے جائیں — یہی فرق ہے ریپوزٹری کی الفاظ کی گنتی اور اصل گنتی میں۔ پیسٹ باکس چار سو فائلوں کے لیے ان میں سے کچھ بھی نہیں کر سکتا۔

اکثر پوچھے جانے والے سوالات

کیا میرا ٹیکسٹ کہیں محفوظ کیا جاتا ہے؟

نہیں۔ کچھ بھی محفوظ نہیں کیا جاتا اور کوئی ریکوئسٹ نہیں بھیجی جاتی، اور یہ نیٹ ورک بند ہونے پر بھی کام کرتا رہتا ہے۔ ٹیکسٹ کے لیے یہ جتنا لگتا ہے اس سے زیادہ اہم ہے: لوگ آن لائن کاؤنٹر میں جو پیسٹ کرتے ہیں وہ غیر شائع شدہ تحریریں، قانونی مسودے، طلبہ کا کام اور اندرونی دستاویزات ہوتی ہیں۔

کیا یہ چینی، جاپانی یا تھائی کے لیے کام کرتا ہے؟

جی ہاں، اور یہی وہ بنیادی چیز ہے جو اسے زیادہ تر کاؤنٹرز سے الگ کرتی ہے۔ یہ زبانیں الفاظ کے درمیان اسپیس نہیں رکھتیں، اس لیے عام طریقہ — اسپیس پر تقسیم کرنا — پورے چینی مضمون کو ایک لفظ بتاتا ہے۔ یہ صفحہ براؤزر کی Unicode ورڈ سیگمنٹیشن (UAX #29 الگورتھم) استعمال کرتا ہے، جو جانتی ہے کہ ہر رسم الخط میں الفاظ اصل میں کہاں شروع اور ختم ہوتے ہیں۔ چینی ٹیکسٹ اس صفحے اور کسی اور کاؤنٹر میں ساتھ ساتھ پیسٹ کریں؛ فرق فوراً نظر آ جائے گا۔

پڑھنے کا وقت کیسے نکالا جاتا ہے؟

خاموش پڑھائی کے لیے الفاظ کو 238 فی منٹ سے، اور بلند آواز میں پڑھنے کے لیے 150 فی منٹ سے تقسیم کیا جاتا ہے۔ 238 کا عدد Brysbaert کے 2019 کے میٹا اینالیسس سے آتا ہے، جس میں بالغوں کی خاموش پڑھائی پر 190 تحقیقات کا جائزہ لیا گیا، نہ کہ وہ گول 200 یا 250 جو ایک بلاگ سے دوسرے میں نقل ہوتے رہتے ہیں۔ یہ عام تحریر کی اوسط ہے — گھنی تکنیکی تحریر زیادہ وقت لیتی ہے، اور جانا پہچانا موضوع کم۔

جملہ کسے مانا جاتا ہے؟

جملہ فل اسٹاپ، سوالیہ نشان یا فجائیہ نشان پر ختم ہوتا ہے — لیکن کسی لقب یا مخفف کے بعد نہیں۔ “We met Dr. Smith on Monday.” ایک جملہ ہے، دو نہیں، جس میں براؤزر کی اپنی سیگمنٹیشن غلطی کرتی ہے اور یہ صفحہ اسے درست کرتا ہے۔ “Bring pens, paper, etc. and we will start” بھی ایک ہی جملہ ہے؛ یہی فقرہ اگر بڑے حرف سے آگے بڑھے تو دو جملے ہیں۔

پیراگراف کسے مانا جاتا ہے؟

ٹیکسٹ کا وہ حصہ جو خالی لائن سے الگ ہو۔ ہر لائن بریک کو پیراگراف گننے سے پتے کی ہر لائن پیراگراف بن جاتی، اسی لیے یہاں کے نمبرز کچھ دوسرے ٹولز سے مختلف ہیں۔

کیا یہ Word دستاویز یا PDF کے الفاظ گنتا ہے؟

براہِ راست نہیں — ٹیکسٹ پیسٹ کریں، یا پہلے ہمارا PDF سے ٹیکسٹ ٹول استعمال کریں اور نتیجہ پیسٹ کریں۔ یہ صفحہ ٹیکسٹ پر کام کرتا ہے، اسی لیے یہ فوری اور نجی ہے۔

میرے الفاظ کی گنتی Microsoft Word سے مختلف کیوں ہے؟

عموماً ہائفنز اور نمبرز کی وجہ سے۔ Word “well-known” کو ایک لفظ گنتا ہے اور ہم بھی؛ کچھ ٹولز دو گنتے ہیں۔ یہاں الگ کھڑے نمبرز، تاریخیں اور علامات لفظ مانے جاتے ہیں جب ان میں کوئی ہندسہ یا حرف ہو۔ عام تحریر پر دونوں کی گنتی بہت قریب رہتی ہے؛ پارٹ نمبرز کی فہرست پر نہیں۔

جاننا مفید ہے: پڑھنے اور بولنے کے اوقات عام تحریر کی اوسط ہیں — گھنی تکنیکی تحریر زیادہ وقت لیتی ہے اور جانا پہچانا موضوع کم، اس لیے انہیں وعدہ نہیں بلکہ اندازہ سمجھیں۔ گنتی براؤزر کی Unicode سیگمنٹیشن پر منحصر ہے؛ جس پرانے براؤزر میں یہ موجود نہ ہو، وہاں تخمینہ استعمال ہوتا ہے اور صفحے پر یہ بتا دیا جاتا ہے۔

یہ ٹول اپنی ویب سائٹ پر لگائیں

کسی بھی بلاگ، کلاس پیج یا ہیلپ آرٹیکل کے لیے مفت۔ ایک اسنیپٹ پیسٹ کریں اور آپ کے وزیٹرز اسے سیدھا آپ کے صفحے پر استعمال کر سکیں گے۔