字数统计
实时统计单词、字符、句子、字节数与阅读时长
本地运行
loading…
关于此工具
实时的字数与字符统计,给出开发者和写作者真正需要的数字:单词数、含与不含空格的字符数、UTF-8 字节数(数据库字段或 API 限制真正度量的东西)、行数、句子数、段落数,以及按每分钟 220 词估算的阅读时长。
字符按 Unicode 码点计数而不是 UTF-16 单元,所以 emoji 和中日韩文本的计数符合人的直觉——而独立的字节计数让差异可见:日本語是 3 个字符但 9 个字节。这个区别恰恰是 VARCHAR(255) 字段拒绝一个 200「字符」字符串时坑到你的地方。
一切随输入实时更新,不发送到任何地方——统计公告草稿、合同或任何尚未公开的内容都很安全。
常见问题
- 为什么字符数和字节数不同?
- 字符是 Unicode 码点;字节是它们的 UTF-8 编码。ASCII 字母每个 1 字节,多数欧洲重音字母 2 字节,中日韩字符 3 字节,emoji 4 字节(序列还会更多)。数据库限制、HTTP 头和许多 API 度量的是字节,不是字符。
- 对没有空格的语言,单词怎么数?
- 单词计数按空白拆分,对未分词的中文或日文会低估。对这些语言,字符数是更有意义的指标——这正是两者始终同时显示的原因。
- 什么算一个句子?
- 以 .、!、? 或 … 结尾、后跟空白或输入结束的一段文本。「e.g.」这类缩写会让计数略微偏高——句子计数本质上是启发式的。
- 阅读时长有多准?
- 用词数除以 220 wpm,这是成年人默读一般散文的常见均值。含代码的技术材料读得更慢;可略读的清单类文章更快。把它当数量级估计即可。