字数统计
统计字数、字元数、句数与段落数,正确处理中文、日文、韩文与 emoji。全部在你的浏览器中执行。
在你的浏览器中运行
0
词数
0
字符数
0
不含空白
0
中日韩字
0
句数
0
段落
0
行数
0
阅读时间
中文的字数该怎么算
多数字数统计工具是用空白切词。中文不用空白,所以一段 200 字的文章会被算成「1 个词」——这个数字 不只是不精确,而是毫无意义。
这个工具使用浏览器内建的 Intl.Segmenter,也就是平台在你双击选字时所用的同一套 Unicode 断词
规则,因此中文是按词计算,而不是按空白区块。中英夹杂也没问题:句子里的英文与中文都会各自算对。
中日韩字这个数字是分开统计的,因为那才是华文出版社、学校与各种平台真正要求的单位。「800 字」 指的是 800 个字,不是 800 个词。
字元、码位,以及你看到的东西
同一段文字,有三个数字都可以宣称自己是「字元数」:
以 👩🚀 为例 | 数量 | 原因 |
|---|---|---|
UTF-16 字码单位("👩🚀".length) | 5 | JavaScript 默认回报的值 |
码位([..."👩🚀"].length) | 3 | 两个 emoji 加一个零宽连接符 |
| 字素丛集 | 1 | 读者看到的字,也是本页采用的计法 |
上面的工具算的是字素丛集,所以一个 emoji、一个由基底字加结合符号组成的字、一个韩文音节,都各算 一个字。
其他系统的字数上限往往用不同方式计算。X(Twitter)多数中日韩字元算两个字元;SMS 只要出现一个
非拉丁字元,上限就从 160 字掉到 70 字;数据库的 VARCHAR(255) 依引擎不同,可能是 255 个字节,
也可能是 255 个字元。
阅读时间
估算采用拼音文字每分钟 220 个词、中日韩文字每分钟 350 个字,都是一般散文默读的中间值。请把它当 成量级参考而非量测结果:夹杂代码的技术文章会慢得多,快速扫读则会快上数倍。
你的数据只留在这里
所有统计都在你打字的当下于浏览器内完成,内容不会上传——如果你在统计的是还没发表的草稿,这一点 就很重要。