统计字数
字数、句数、段落数以及阅读所需时间——边输入边更新。对于词与词之间不加空格的语言也能准确统计,而大多数统计工具在这一点上都会出错。不存储任何内容。
- 绝不存储
- 无需排队,无需等待
- 无需注册,无水印
0
字数
支持任何语言
0
字符
表情符号算一个
0
句数
可正确处理缩写
0
段落
按空行分段
- 行数与编辑器的行号一致
- 0
- 句数不会被“Dr.”或“etc.”断开
- 0
- 段落以空行分隔的文本块
- 0
- 码位正则表达式中“.”匹配的单位
- 0
- UTF-16单元JavaScript中string.length返回的值
- 0
- UTF-8字节VARCHAR限制和HTTP头部的计量方式
- 0
- 阅读时间默读,每分钟238字
- —
- 朗读时间朗读,每分钟150字
- —
- 最长的词按字符计,而非字节
- —
- 平均词长粗略的可读性参考
- —
开始输入,各项数据就会自动填入。试试输入一个表情符号,或一句中文——两者都按人的计数方式统计,而大多数统计工具在这一点上都会出错。
使用方法
粘贴或输入
也可以拖放一个文本文件。统计结果实时更新;内容不会发送到任何地方。
查看数字
字数、句数、段落数、行数和字符数,以及阅读和朗读时间。
检查字数限制
如果您的写作有字数限制——SEO标题、meta描述、短信——页面会显示您离上限还有多远。
统计什么,由谁来统计
字数不是由我们计算的。词语来自浏览器自带的Unicode分词器,调用时使用其默认区域设置而非指定的某种语言,页面保留它标记为“类词”的片段。在此之上,我们没有为连字符、撇号或数字额外添加任何规则——您得到的是分词器对词语起始位置的判断,所以中文和日文的结果是正确的,也正因如此,两台机器上的两个浏览器对同一段文本的结果可能会有细微差别。如果浏览器版本太旧、没有分词器,页面会退回到按空白拆分,并告诉您这个数字是近似值——而更简单的统计工具一直都在给您这个数字,只是从不说明。
段落数和行数由我们自己的规则统计,而且两者的规则并不相同。段落的边界是一个空行——两个换行符之间只有空格或制表符——所以拖放进来的Windows文本文件如果保留了回车符,会被算作一个段落;粘贴到文本框里的文本从来不会有这个问题,因为文本框传过来的是换行符。行数按照编辑器行号栏的方式统计:空文本框是零行,一个词是一行,以换行符结尾的文件最后有一个空行,也会被计入。这刻意不同于命令行wc报告的结果,wc统计的是行结束符的数量。
另外两个较小的决定,可以解决大多数关于数字的争议。“不含空格的字符数”会去掉浏览器认定为空白的所有字符,其中包括从网页复制文本时带来的不换行空格——但不包括零宽空格,它不属于空白,仍会计入。最长词和平均词长是按码位计算的,而不是按主要字符数所用的字素簇计算,所以带有emoji或组合重音符号的词,在这里量出来会比看上去更长。词频表默认隐藏约六十个常见的英语功能词,除非您要求显示;并且无论您用什么语言写作,都按普通英语规则忽略大小写。
如果您需要的是别的
如果最终由某个特定程序来评判,只有那个程序的数字才算数。期刊要求“包括参考文献在内八千词”,指的是Word统计出的数字,而Word会按照自己的设置统计域、脚注、题注和文本框。本页在普通文章上的结果会很接近,但不会一字不差,所以请以评判您的那个工具为准,而不是以本页为准。
如果不止一个文档,统计只需一行命令。wc -w可以一次处理整个文件夹,并能流式处理比内存还大的文件;对于Markdown、HTML或LaTeX,先用pandoc把文件转成纯文本,就能去掉标记,这样代码块、链接目标和标签就不会被当作正文计入——这就是仓库字数统计和真实字数之间的差距。这两件事,粘贴框都无法对四百个文件做到。
常见问题
我的文本会被存储吗?
不会。不存储任何内容,也不发出任何请求,断开网络后照样能用。对文本来说,这一点比看上去更重要:人们粘贴到在线统计工具里的,往往是未发表的文章、法律文书草稿、学生作业和内部文件。
支持中文、日文或泰文吗?
支持,这也是它与大多数统计工具最大的区别。这些语言的词与词之间不加空格,所以常见的做法——按空白拆分——会把一整篇中文文章算成一个词。本工具使用浏览器的Unicode分词功能(UAX #29算法),它知道每种文字中词语真正的起止位置。把一段中文分别粘贴到本页和另一个统计工具里对比一下,差别一目了然。
阅读时间是怎么算的?
默读按每分钟238个词计算,朗读按每分钟150个词计算。238这个数字来自Brysbaert在2019年对190项成人默读研究所做的元分析,而不是博客之间互相抄来抄去的整数200或250。它是针对普通文章的平均值——内容密集的技术文章读得更慢,熟悉的主题读得更快。
怎样才算一句话?
句子在句号、问号或感叹号处结束——但称谓或缩写后面的句点不算。“We met Dr. Smith on Monday.”是一句话而不是两句,浏览器自带的分句功能会在这里出错,本页会加以纠正。“Bring pens, paper, etc. and we will start”也是一句;同样的短语如果后面跟着大写字母,就是两句。
怎样才算一个段落?
由空行分隔的一段文本。如果把每个换行都算作一个段落,那么地址的每一行都会被当成一个段落,这就是这里的数字与某些工具不同的原因。
能统计Word文档或PDF的字数吗?
不能直接统计——请把文本粘贴进来,或者先用我们的PDF转文本工具,再把结果粘贴进来。本页处理的是文本,这正是它能即时响应、保护隐私的原因。
为什么我的字数和Microsoft Word统计的不一样?
通常是连字符和数字造成的。Word把“well-known”算作一个词,我们也一样;有些工具会算成两个。独立的数字、日期和符号,只要包含数字或字母,在这里就算作词。对于普通文章,两者的结果非常接近;对于一串零件编号,则不会一致。
小贴士: 阅读和朗读时间是基于普通文章的平均值——内容密集的技术文章读得更慢,熟悉的主题读得更快,所以请把它们当作参考,而不是保证。统计依赖浏览器的Unicode分词功能;如果浏览器版本太旧、不支持该功能,会退回到估算,并在页面上注明。
把这个工具放到您的网站上
博客、课程页面或帮助文章均可免费使用。粘贴一段代码,访客就能直接在您的页面上使用。