操作指南 · 写作

中文和日文字数统计:怎样数才算对

Word Counter4 分钟阅读

简短回答

统计中文和日文要按字符数,不是按空格分词。中日文的词与词之间没有空格,普通计数器会把一整段看成一个“词”。Word Counter 把汉字、平假名和片假名逐字计数,对混排文本的拉丁部分套用词规则,并且完全在本地运行。

  1. 1

    在任意页面选中中文或日文文本——或复制它。

  2. 2

    点击 Word Counter 图标;没有选中就粘进弹窗。

  3. 3

    读头条计数:中日文字符逐字计,拉丁词按词规则计。

  4. 4

    混排文本查看拉丁词与中日文字符的明细。

  5. 5

    拿字符总数(含/不含空格)对照平台或稿件限制。

把一段中文粘进典型的字数统计工具,你会得到 1 这样的数字——或者 3,如果文本里恰好有几处标点。工具没坏;它在按空格切分,而中文和日文的词与词之间不放空格。这样的结果毫无用处,因为衡量中日文文本的一切标准——出版社的稿件限制、翻译计价、平台字符上限——都以字符为单位。下面是在 Chrome 里得到符合这一口径的计数的方法,而且不用上传你的文本。

按字符计数,因为口径如此

Word Counter 把每个汉字、平假名和片假名都计为一个单位——包括「々」这样的叠字符号——而不是把拉丁词规则硬套在没有空格的文本上。这正符合中文和日文实际被衡量的方式:字数要求、按字符计价的翻译报价、3000 字的作文上限。在任意页面选中文本打开弹窗,或把文本粘进去;总数即刻出现。

混排文本两套规则都用——还把账目摊开

真实文档总是混着写:日文文章引用英文产品名,中文报告里满是拉丁字母缩写。Word Counter 对拉丁片段套用词规则,对中日文片段逐字计数,再汇总成头条数字——当选区确实混合了两种文字时,还会显示明细,让你看到总数里有多少拉丁词、多少中日文字符,而不是只能相信一个不透明的数字。

韩文被刻意区别对待

一条诚实的边界:韩文按字符计数。谚文书写时词与词之间有空格,韩文文本的惯例是按词衡量——所以它走词规则,那才是它该在的地方。要是一个计数器“因为都是 CJK”就把韩文和中日文混为一谈,每个韩文计数都会虚高好几倍。

句数和字符数对中日文同样有效

句子统计除 . ! ? 外还识别全角终止符 。!?,日文和中文的行文能得到真实的句数。字符按 Unicode 码点计数,一个 emoji 或一个生僻字算一个字符,不是两个。字符总数还分含空格与不含空格两种——后者才是平台上限真正核对的数字。

全程本地,任意页面

扩展只在你于那个标签页点击图标时读取页面选区——无后台访问、无上传、无账户、无付费版。而这恰恰对人们数得最仔细的那些文本最要紧:未发表的书稿、客户的译稿、考试作文。一般流程——选中文字、读取全套计数——见统计任意网页的字数

中日文,按对的方式数

中文日文逐字计数,混排明细坦诚可查——免费且本地。

了解 Word Counter →