跳到正文

统计字数

字数、句数、段落数以及阅读所需时间——边输入边更新。对于词与词之间不加空格的语言也能准确统计,而大多数统计工具在这一点上都会出错。不存储任何内容。

  • 绝不存储
  • 无需排队,无需等待
  • 无需注册,无水印

0

字数

支持任何语言

0

字符

表情符号算一个

0

句数

可正确处理缩写

0

段落

按空行分段

各项统计及其用途
行数与编辑器的行号一致
0
句数不会被“Dr.”或“etc.”断开
0
段落以空行分隔的文本块
0
码位正则表达式中“.”匹配的单位
0
UTF-16单元JavaScript中string.length返回的值
0
UTF-8字节VARCHAR限制和HTTP头部的计量方式
0
阅读时间默读,每分钟238字
—
朗读时间朗读,每分钟150字
—
最长的词按字符计,而非字节
—
平均词长粗略的可读性参考
—

开始输入,各项数据就会自动填入。试试输入一个表情符号,或一句中文——两者都按人的计数方式统计,而大多数统计工具在这一点上都会出错。

使用方法

1

粘贴或输入

也可以拖放一个文本文件。统计结果实时更新;内容不会发送到任何地方。

2

查看数字

字数、句数、段落数、行数和字符数,以及阅读和朗读时间。

3

检查字数限制

如果您的写作有字数限制——SEO标题、meta描述、短信——页面会显示您离上限还有多远。

统计什么,由谁来统计

字数不是由我们计算的。词语来自浏览器自带的Unicode分词器,调用时使用其默认区域设置而非指定的某种语言,页面保留它标记为“类词”的片段。在此之上,我们没有为连字符、撇号或数字额外添加任何规则——您得到的是分词器对词语起始位置的判断,所以中文和日文的结果是正确的,也正因如此,两台机器上的两个浏览器对同一段文本的结果可能会有细微差别。如果浏览器版本太旧、没有分词器,页面会退回到按空白拆分,并告诉您这个数字是近似值——而更简单的统计工具一直都在给您这个数字,只是从不说明。

段落数和行数由我们自己的规则统计,而且两者的规则并不相同。段落的边界是一个空行——两个换行符之间只有空格或制表符——所以拖放进来的Windows文本文件如果保留了回车符,会被算作一个段落;粘贴到文本框里的文本从来不会有这个问题,因为文本框传过来的是换行符。行数按照编辑器行号栏的方式统计:空文本框是零行,一个词是一行,以换行符结尾的文件最后有一个空行,也会被计入。这刻意不同于命令行wc报告的结果,wc统计的是行结束符的数量。

另外两个较小的决定,可以解决大多数关于数字的争议。“不含空格的字符数”会去掉浏览器认定为空白的所有字符,其中包括从网页复制文本时带来的不换行空格——但不包括零宽空格,它不属于空白,仍会计入。最长词和平均词长是按码位计算的,而不是按主要字符数所用的字素簇计算,所以带有emoji或组合重音符号的词,在这里量出来会比看上去更长。词频表默认隐藏约六十个常见的英语功能词,除非您要求显示;并且无论您用什么语言写作,都按普通英语规则忽略大小写。

如果您需要的是别的

如果最终由某个特定程序来评判,只有那个程序的数字才算数。期刊要求“包括参考文献在内八千词”,指的是Word统计出的数字,而Word会按照自己的设置统计域、脚注、题注和文本框。本页在普通文章上的结果会很接近,但不会一字不差,所以请以评判您的那个工具为准,而不是以本页为准。

如果不止一个文档,统计只需一行命令。wc -w可以一次处理整个文件夹,并能流式处理比内存还大的文件;对于Markdown、HTML或LaTeX,先用pandoc把文件转成纯文本,就能去掉标记,这样代码块、链接目标和标签就不会被当作正文计入——这就是仓库字数统计和真实字数之间的差距。这两件事,粘贴框都无法对四百个文件做到。

常见问题

我的文本会被存储吗?

不会。不存储任何内容,也不发出任何请求,断开网络后照样能用。对文本来说,这一点比看上去更重要:人们粘贴到在线统计工具里的,往往是未发表的文章、法律文书草稿、学生作业和内部文件。

支持中文、日文或泰文吗?

支持,这也是它与大多数统计工具最大的区别。这些语言的词与词之间不加空格,所以常见的做法——按空白拆分——会把一整篇中文文章算成一个词。本工具使用浏览器的Unicode分词功能(UAX #29算法),它知道每种文字中词语真正的起止位置。把一段中文分别粘贴到本页和另一个统计工具里对比一下,差别一目了然。

阅读时间是怎么算的?

默读按每分钟238个词计算,朗读按每分钟150个词计算。238这个数字来自Brysbaert在2019年对190项成人默读研究所做的元分析,而不是博客之间互相抄来抄去的整数200或250。它是针对普通文章的平均值——内容密集的技术文章读得更慢,熟悉的主题读得更快。

怎样才算一句话?

句子在句号、问号或感叹号处结束——但称谓或缩写后面的句点不算。“We met Dr. Smith on Monday.”是一句话而不是两句,浏览器自带的分句功能会在这里出错,本页会加以纠正。“Bring pens, paper, etc. and we will start”也是一句;同样的短语如果后面跟着大写字母,就是两句。

怎样才算一个段落?

由空行分隔的一段文本。如果把每个换行都算作一个段落,那么地址的每一行都会被当成一个段落,这就是这里的数字与某些工具不同的原因。

能统计Word文档或PDF的字数吗?

不能直接统计——请把文本粘贴进来,或者先用我们的PDF转文本工具,再把结果粘贴进来。本页处理的是文本,这正是它能即时响应、保护隐私的原因。

为什么我的字数和Microsoft Word统计的不一样?

通常是连字符和数字造成的。Word把“well-known”算作一个词,我们也一样;有些工具会算成两个。独立的数字、日期和符号,只要包含数字或字母,在这里就算作词。对于普通文章,两者的结果非常接近;对于一串零件编号,则不会一致。

小贴士: 阅读和朗读时间是基于普通文章的平均值——内容密集的技术文章读得更慢,熟悉的主题读得更快,所以请把它们当作参考,而不是保证。统计依赖浏览器的Unicode分词功能;如果浏览器版本太旧、不支持该功能,会退回到估算,并在页面上注明。

把这个工具放到您的网站上

博客、课程页面或帮助文章均可免费使用。粘贴一段代码,访客就能直接在您的页面上使用。