一、指标与资料链接
中文管线
需要特别说明:平均句长、生僻字比例、虚词密度、平均词长和中文 0–100 综合分是本站根据字表、分词和统计规则构造的启发式指标,并不是《通用规范汉字表》规定的官方可读性公式。
英文管线
七项英文指标由 textstat 官方实现与文档计算:
- Flesch Reading Ease:Flesch 1948 年原始论文
- Flesch-Kincaid Grade:美国海军技术报告
- Gunning Fog Index:Gunning 原著《The Technique of Clear Writing》
- SMOG Index:McLaughlin 1969 年原始论文
- Coleman-Liau Index:Coleman 与 Liau 原始论文
- Automated Readability Index(ARI):Smith 与 Senter 技术报告
- Dale-Chall Readability Score:Dale 与 Chall 原始论文
二、中文可读性指标怎么理解
1. 《通用规范汉字表》覆盖率
《通用规范汉字表》共收录 8105 个汉字:
- 一级字 3500 个,以常用字为主;
- 二级字 3000 个,使用频率相对较低;
- 三级字 1605 个,主要满足姓氏、人名、地名、科技和教育等专门领域的用字需要。
工具会统计文本中的汉字分别落在哪一级,而不是只检查文本是否“包含”某个字。
例如,一篇文章共有 1000 个汉字,其中一级字出现 920 次,那么一级字覆盖率就是 92%。一级字覆盖率越高,通常说明常用字占比越大;三级字和表外字越多,普通读者遇到识读障碍的可能性越高。
需要注意,三级字并不等于错误字。姓名、古籍、地方文化、医学和科技文章出现较多三级字完全正常。
2. 平均句长
平均句长表示每个句子平均包含多少字符。
短句通常更容易快速理解;长句往往包含更多修饰语、并列结构或嵌套关系,对工作记忆的要求更高。因此,在其他条件相近时,平均句长越高,文本通常越难读。
不过,句长不能单独决定可读性。结构清楚的长句可能比指代混乱的短句更易理解。标题、表格、对话和标点不规范的文本也可能影响断句结果。
3. 生僻字比例
本站把三级字和《通用规范汉字表》之外的汉字合并作为“生僻字信号”:
生僻字比例 = 三级字及表外字出现次数 ÷ 汉字总数
比例越高,意味着读者可能更频繁地遇到不熟悉的字。但它只能反映识字门槛,不能判断专业术语是否必要,也不能判断文章是否准确。
人名、地名、古文、方言和专业文献应结合具体语境解读,不宜为了提高分数而机械替换所有生僻字。
4. 虚词密度
虚词密度是助词、介词、连词、代词、副词、语气词等功能性词语在全部分词结果中的占比。
“的、了、在、与、但是、因此、这、其”等词语通常不直接表示具体事物,却承担连接、限定、指代和组织句子的作用。
虚词密度过低,有时意味着文本由名词和专业术语密集堆叠,句子之间缺少清晰连接。但虚词过多也可能造成表达拖沓,所以该指标适合用来发现异常,不存在适用于所有文体的唯一最佳值。
5. 平均词长
平均词长表示分词后每个词平均包含多少字符。
较长的词往往是复合词、专有名词或专业术语。因此,平均词长升高有时意味着概念密度增加,读者需要掌握更多领域知识。
中文词语之间没有天然空格,平均词长会受到分词结果影响。例如,“人工智能技术”可能被切分为一个长词,也可能被切成“人工智能”和“技术”。这个指标更适合比较同一批、同一领域的文本,不宜跨分词工具直接比较。
三、中文 0–100 综合分从哪里来
中文综合分是本站为了便于比较而设计的启发式分数,分数越高,表示文本在字词和句子层面越容易阅读。
计算从 100 分开始,根据以下情况扣分:
- 一级字覆盖率低于 85%;
- 三级字和表外字比例升高;
- 平均句长超过约 20 个字符;
- 平均词长超过约 2 个字符;
- 虚词密度过低,出现术语或实词堆叠的迹象。
最终分数限制在 0–100 之间,并近似映射为:
| 综合分 | 近似阅读层级 |
|---|---|
| 80–100 | 小学高年级 |
| 65–79 | 初中 |
| 50–64 | 高中 |
| 35–49 | 一般成人读物 |
| 0–34 | 学术或专业文本 |
这里的“阅读年级”是解释标签,不代表教育部门制定的分级标准,也不能用来判断某篇文章是否适合特定年龄的所有读者。
四、七种英文可读性指标怎么理解
1. Flesch Reading Ease
Flesch Reading Ease 主要考虑两个因素:
- 每句话平均有多少词;
- 每个词平均有多少音节。
基本公式为:
206.835 − 1.015 × 平均句长 − 84.6 × 平均音节数
它与其他几个指标的方向不同:分数越高越容易读。
| 分数 | 常见解释 |
|---|---|
| 90–100 | 非常容易 |
| 80–89 | 容易 |
| 70–79 | 较容易 |
| 60–69 | 标准难度 |
| 50–59 | 较难 |
| 30–49 | 困难 |
| 0–29 | 非常困难 |
公式结果在特殊文本中可能低于 0 或高于 100,因此不应把 0–100 当成绝对边界。
2. Flesch-Kincaid Grade
Flesch-Kincaid Grade 同样使用句长和音节数,但结果直接表示近似的美国学校年级:
0.39 × 每句词数 + 11.8 × 每词音节数 − 15.59
例如,结果为 8,通常表示文本大约需要美国八年级的阅读能力。它不是中国学制年级,不能直接把 Grade 8 翻译为“中国初二学生一定能读懂”。
3. Gunning Fog Index
Gunning Fog 同时关注句长和复杂词比例。复杂词通常指包含三个及以上音节的词。
0.4 ×(每句词数 + 复杂词百分比)
结果也近似对应美国受教育年数。Fog 为 12,通常表示读者大约需要完成 12 年教育。长句和多音节词都会把结果推高。
它可能把必要的专业名词判断为复杂词,因此医学、法律和科技文本的分数通常较高。
4. SMOG Index
SMOG 重点统计三音节及以上词语,并据此估算完整理解文本所需的教育年级。
它在健康传播、医学材料和公共信息评估中较常见,因为这类文本中的多音节术语会明显影响普通读者理解。
SMOG 原始方法更适合至少约 30 个句子的样本。文本太短时,少数长词就可能显著改变结果,分数稳定性会下降。
5. Coleman-Liau Index
Coleman-Liau 不统计音节,而是使用:
- 每 100 个词中的字母数;
- 每 100 个词中的句子数。
公式为:
0.0588 × L − 0.296 × S − 15.8
其中 L 是每 100 词的平均字母数,S 是每 100 词的平均句子数。
由于只需统计字符、词和句子,它很适合计算机自动处理,也减少了音节识别错误。但较长的专有名词、网址和异常拼写仍可能推高结果。
6. Automated Readability Index(ARI)
ARI 使用字符数而不是音节数:
4.71 × 每词字符数 + 0.5 × 每句词数 − 21.43
结果近似对应美国学校年级。它计算简单,适合批量处理大量文本。
与 Coleman-Liau 类似,ARI 容易受到长单词、缩写、编号和技术术语影响。分析网页、代码说明或产品型号时,应先清理非自然语言内容。
7. Dale-Chall Readability Score
Dale-Chall 不只看词长,还把文本中的词与一份约 3000 个常见易词组成的词表进行比较。
计算主要考虑:
- 不在易词表中的“困难词”比例;
- 平均句长。
与年级型指标不同,Dale-Chall 原始分数越低越容易读。常见解释为:
| 分数 | 近似阅读层级 |
|---|---|
| 4.9 以下 | 四年级及以下 |
| 5.0–5.9 | 五至六年级 |
| 6.0–6.9 | 七至八年级 |
| 7.0–7.9 | 九至十年级 |
| 8.0–8.9 | 十一至十二年级 |
| 9.0 以上 | 大学及以上 |
人名、地名和专业术语可能不在易词表中,即使读者实际上很熟悉,也可能被计为困难词。
五、为什么要同时看七项英文指标
这些指标关注的难点不同:
- Flesch 系列强调句长和音节;
- Gunning Fog、SMOG 强调多音节复杂词;
- Coleman-Liau、ARI 使用字符长度,适合自动计算;
- Dale-Chall 关注词汇是否属于常见易词。
如果多项指标同时显示文本较难,结论通常更可信。如果指标差异很大,则应检查文本是否包含大量专有名词、缩写、数字、网址、项目符号或特别短的句子。
不建议把七个分数直接做算术平均,因为 Flesch Reading Ease 的量纲和方向与其余指标不同。
六、使用结果时应注意什么
可读性分数适合回答:
- 两个版本中哪一个更容易读;
- 哪些句子最值得优先改写;
- 文本是否明显高于目标读者的阅读门槛;
- 同一机构、同一文体的文本难度是否发生变化。
它不能回答:
- 内容是否真实;
- 论证是否严谨;
- 文章是否有价值;
- 某个具体读者是否一定能理解;
- 专业术语是否应该删除。
最稳妥的使用方式,是在同一种语言、同一文体和相近长度的文本之间比较,并结合难句样本进行人工判断。分数用于发现问题,而不应代替编辑、教师或领域专家的判断。
