一、指标与资料链接

中文管线

需要特别说明:平均句长、生僻字比例、虚词密度、平均词长和中文 0–100 综合分是本站根据字表、分词和统计规则构造的启发式指标,并不是《通用规范汉字表》规定的官方可读性公式。

英文管线

七项英文指标由 textstat 官方实现与文档计算:

二、中文可读性指标怎么理解

1. 《通用规范汉字表》覆盖率

《通用规范汉字表》共收录 8105 个汉字:

  • 一级字 3500 个,以常用字为主;
  • 二级字 3000 个,使用频率相对较低;
  • 三级字 1605 个,主要满足姓氏、人名、地名、科技和教育等专门领域的用字需要。

工具会统计文本中的汉字分别落在哪一级,而不是只检查文本是否“包含”某个字。

例如,一篇文章共有 1000 个汉字,其中一级字出现 920 次,那么一级字覆盖率就是 92%。一级字覆盖率越高,通常说明常用字占比越大;三级字和表外字越多,普通读者遇到识读障碍的可能性越高。

需要注意,三级字并不等于错误字。姓名、古籍、地方文化、医学和科技文章出现较多三级字完全正常。

2. 平均句长

平均句长表示每个句子平均包含多少字符。

短句通常更容易快速理解;长句往往包含更多修饰语、并列结构或嵌套关系,对工作记忆的要求更高。因此,在其他条件相近时,平均句长越高,文本通常越难读。

不过,句长不能单独决定可读性。结构清楚的长句可能比指代混乱的短句更易理解。标题、表格、对话和标点不规范的文本也可能影响断句结果。

3. 生僻字比例

本站把三级字和《通用规范汉字表》之外的汉字合并作为“生僻字信号”:

生僻字比例 = 三级字及表外字出现次数 ÷ 汉字总数

比例越高,意味着读者可能更频繁地遇到不熟悉的字。但它只能反映识字门槛,不能判断专业术语是否必要,也不能判断文章是否准确。

人名、地名、古文、方言和专业文献应结合具体语境解读,不宜为了提高分数而机械替换所有生僻字。

4. 虚词密度

虚词密度是助词、介词、连词、代词、副词、语气词等功能性词语在全部分词结果中的占比。

“的、了、在、与、但是、因此、这、其”等词语通常不直接表示具体事物,却承担连接、限定、指代和组织句子的作用。

虚词密度过低,有时意味着文本由名词和专业术语密集堆叠,句子之间缺少清晰连接。但虚词过多也可能造成表达拖沓,所以该指标适合用来发现异常,不存在适用于所有文体的唯一最佳值。

5. 平均词长

平均词长表示分词后每个词平均包含多少字符。

较长的词往往是复合词、专有名词或专业术语。因此,平均词长升高有时意味着概念密度增加,读者需要掌握更多领域知识。

中文词语之间没有天然空格,平均词长会受到分词结果影响。例如,“人工智能技术”可能被切分为一个长词,也可能被切成“人工智能”和“技术”。这个指标更适合比较同一批、同一领域的文本,不宜跨分词工具直接比较。

三、中文 0–100 综合分从哪里来

中文综合分是本站为了便于比较而设计的启发式分数,分数越高,表示文本在字词和句子层面越容易阅读。

计算从 100 分开始,根据以下情况扣分:

  • 一级字覆盖率低于 85%;
  • 三级字和表外字比例升高;
  • 平均句长超过约 20 个字符;
  • 平均词长超过约 2 个字符;
  • 虚词密度过低,出现术语或实词堆叠的迹象。

最终分数限制在 0–100 之间,并近似映射为:

综合分近似阅读层级
80–100小学高年级
65–79初中
50–64高中
35–49一般成人读物
0–34学术或专业文本

这里的“阅读年级”是解释标签,不代表教育部门制定的分级标准,也不能用来判断某篇文章是否适合特定年龄的所有读者。

四、七种英文可读性指标怎么理解

1. Flesch Reading Ease

Flesch Reading Ease 主要考虑两个因素:

  • 每句话平均有多少词;
  • 每个词平均有多少音节。

基本公式为:

206.835 − 1.015 × 平均句长 − 84.6 × 平均音节数

它与其他几个指标的方向不同:分数越高越容易读。

分数常见解释
90–100非常容易
80–89容易
70–79较容易
60–69标准难度
50–59较难
30–49困难
0–29非常困难

公式结果在特殊文本中可能低于 0 或高于 100,因此不应把 0–100 当成绝对边界。

2. Flesch-Kincaid Grade

Flesch-Kincaid Grade 同样使用句长和音节数,但结果直接表示近似的美国学校年级:

0.39 × 每句词数 + 11.8 × 每词音节数 − 15.59

例如,结果为 8,通常表示文本大约需要美国八年级的阅读能力。它不是中国学制年级,不能直接把 Grade 8 翻译为“中国初二学生一定能读懂”。

3. Gunning Fog Index

Gunning Fog 同时关注句长和复杂词比例。复杂词通常指包含三个及以上音节的词。

0.4 ×(每句词数 + 复杂词百分比)

结果也近似对应美国受教育年数。Fog 为 12,通常表示读者大约需要完成 12 年教育。长句和多音节词都会把结果推高。

它可能把必要的专业名词判断为复杂词,因此医学、法律和科技文本的分数通常较高。

4. SMOG Index

SMOG 重点统计三音节及以上词语,并据此估算完整理解文本所需的教育年级。

它在健康传播、医学材料和公共信息评估中较常见,因为这类文本中的多音节术语会明显影响普通读者理解。

SMOG 原始方法更适合至少约 30 个句子的样本。文本太短时,少数长词就可能显著改变结果,分数稳定性会下降。

5. Coleman-Liau Index

Coleman-Liau 不统计音节,而是使用:

  • 每 100 个词中的字母数;
  • 每 100 个词中的句子数。

公式为:

0.0588 × L − 0.296 × S − 15.8

其中 L 是每 100 词的平均字母数,S 是每 100 词的平均句子数。

由于只需统计字符、词和句子,它很适合计算机自动处理,也减少了音节识别错误。但较长的专有名词、网址和异常拼写仍可能推高结果。

6. Automated Readability Index(ARI)

ARI 使用字符数而不是音节数:

4.71 × 每词字符数 + 0.5 × 每句词数 − 21.43

结果近似对应美国学校年级。它计算简单,适合批量处理大量文本。

与 Coleman-Liau 类似,ARI 容易受到长单词、缩写、编号和技术术语影响。分析网页、代码说明或产品型号时,应先清理非自然语言内容。

7. Dale-Chall Readability Score

Dale-Chall 不只看词长,还把文本中的词与一份约 3000 个常见易词组成的词表进行比较。

计算主要考虑:

  • 不在易词表中的“困难词”比例;
  • 平均句长。

与年级型指标不同,Dale-Chall 原始分数越低越容易读。常见解释为:

分数近似阅读层级
4.9 以下四年级及以下
5.0–5.9五至六年级
6.0–6.9七至八年级
7.0–7.9九至十年级
8.0–8.9十一至十二年级
9.0 以上大学及以上

人名、地名和专业术语可能不在易词表中,即使读者实际上很熟悉,也可能被计为困难词。

五、为什么要同时看七项英文指标

这些指标关注的难点不同:

  • Flesch 系列强调句长和音节;
  • Gunning Fog、SMOG 强调多音节复杂词;
  • Coleman-Liau、ARI 使用字符长度,适合自动计算;
  • Dale-Chall 关注词汇是否属于常见易词。

如果多项指标同时显示文本较难,结论通常更可信。如果指标差异很大,则应检查文本是否包含大量专有名词、缩写、数字、网址、项目符号或特别短的句子。

不建议把七个分数直接做算术平均,因为 Flesch Reading Ease 的量纲和方向与其余指标不同。

六、使用结果时应注意什么

可读性分数适合回答:

  • 两个版本中哪一个更容易读;
  • 哪些句子最值得优先改写;
  • 文本是否明显高于目标读者的阅读门槛;
  • 同一机构、同一文体的文本难度是否发生变化。

它不能回答:

  • 内容是否真实;
  • 论证是否严谨;
  • 文章是否有价值;
  • 某个具体读者是否一定能理解;
  • 专业术语是否应该删除。

最稳妥的使用方式,是在同一种语言、同一文体和相近长度的文本之间比较,并结合难句样本进行人工判断。分数用于发现问题,而不应代替编辑、教师或领域专家的判断。