可读性关注的是“读起来需要多少认知负担”。它不评价观点是否正确,也不判断文章写得好不好。短句、常用字和清楚的连接通常降低阅读门槛;长句、复杂标点、低频字词和术语密集则可能增加难度。
中文管线先统计《通用规范汉字表》的一级、二级、三级与表外字覆盖,再结合平均句长、平均词长、虚词密度和生僻字比例形成综合分。分数范围为0–100,越高越易读。系统再把分数映射为小学高年级、初中、高中、通用成人读物或学术专业等近似阅读年级。
英文管线从阅读容易度、年级数、长词比例、字母数和句长等角度计算七项指标。其中Flesch Reading Ease越高越容易,其余多项通常按年级数理解,数值越高表示阅读门槛越高。系统使用Flesch-Kincaid Grade估算英文阅读年级。
适用文档
教材、少儿读物和科普短文适合用可读性结果检查读者匹配。面向儿童或普通公众时,阅读年级、平均句长和难句样本比单独追求高分更有参考价值。专业概念不能为了降分随意删除,通常先处理过长句和不必要的嵌套表达。
政策说明、公共服务文本和品牌知识稿常需要在正式与易懂之间取平衡。把原稿与简化稿一起分析,可以通过多文件汇总和雷达图查看阅读门槛是否变化。比较时需要保持语言和材料主题相近,避免把内容差异误当成改写效果。
学术摘要、行业报告和技术说明也能分析,但阅读年级偏高不等于质量差。术语可能是内容不可缺少的一部分。报告更适合定位句长、词长和高难句,再由作者判断哪些表达能简化,哪些术语需要保留并解释。
中英混排材料会按主导语言进入一条管线。若英文缩写、专名或引文很多,自动判断可能与分析目的不一致,此时手动指定语言更合适。古文、代码、表格、对话和极短文本不符合常规说明文的统计前提,结果只适合作为辅助信息。
使用步骤
第一步:确定目标读者和比较目标。先明确材料是给儿童、公众、专业读者还是内部人员阅读,也要区分单篇诊断与多版本比较。目标不同,对同一分数的解释也不同。
第二步:选择文本语言。系统默认自动检测,适合语言较单一的材料。中文、英文内容都占较大比例时,可按主要读者实际需要手动指定中文或英文,避免分析管线与目的不一致。
第三步:确认主要展示标准。这里默认选择中文标准。中文材料关注规范汉字表覆盖与综合分,英文材料可选择Flesch-Kincaid主指标。这个设置表达关注口径,不会让中文文本强行套用英文公式,也不会让英文文本按汉字表计算。
第四步:决定是否保留难句和易句样本。默认输出最难5句与最易5句。需要改写或教学分级时通常保持开启;只做批量汇总时可以关闭,减少报告中的句子样本。
第五步:先读顶部说明与当前文件卡片。报告给出文件数量、语言分布和多文件中的相对难易,再展示当前文件的主指标、估计阅读年级、平均句长和句子数。这一步用于形成整体判断。

第六步:查看语言对应的细项。中文重点看一级到三级及表外字覆盖、虚词密度、平均词长、生僻字比例和综合分。英文查看七项公式,先分清哪些指标越高越易读,哪些按年级数解释。


第七步:比较多篇材料。两篇以上同语言文件会出现对应的难度雷达;若为中文材料,还会显示字表覆盖堆叠对比。所有文件都会进入汇总表。雷达越靠外表示相应维度越难,但不同语言的材料应分别比较。
第八步:回到最难与最易句样本。句级难度分范围为0–100。中文主要受句长、非一级字、表外字和复杂标点影响;英文主要受句长、长词与复杂标点影响。这个分数用于排序,不是句子质量评分。

参数解析与对比示例
| 参数 | 说明 | 默认值 |
|---|---|---|
| 文本语言 | 自动检测、中文或英文;混排材料可手动指定主导语言 | 自动检测 |
| 主要展示标准 | 中文规范汉字表覆盖与综合分,或英文Flesch-Kincaid主指标;不改变实际语言管线 | 中文标准(cn) |
| 输出难句与易句样本 | 控制是否列出最难5句和最易5句及其难度分 | 开启 |
| 完成后邮件通知 | 控制任务完成后是否发送提醒,不改变分析结果 | 关闭 |
配置一:中文科普稿。语言用自动或中文,主要标准选中文,句子样本保持开启。先看综合分和平均句长,再从最难句判断是否需要拆句或解释术语。
配置二:英文说明文。语言选英文,主要标准选英文,句子样本保持开启。先看Flesch Reading Ease和Flesch-Kincaid Grade,再用其余指标检查长词和句长带来的差异。
配置三:中英混排报告。按主要分析对象手动指定语言,并选择对应标准。若中文正文夹有英文缩写,通常仍按中文;若英文正文只包含少量中文专名,则按英文。跨语言结果不宜直接用同一分数排序。
案例分析
案例一:湿地科普短文。样本用8个短句讲一次湿地观察,采用中文管线并输出难易句。实际结果为综合分100,估计阅读年级为小学高年级,平均句长14.88字,一级字覆盖率100%,生僻字比例0%。报告选出的相对最难句得分0.6,说明这篇文本的全部候选句都处在很低的难度区间。这个结果适合作为低门槛版本继续人工核对。
案例二:湿地研究说明。样本同样包含8句,主题仍是湿地,但加入水文调蓄、营养盐迁移、群落结构和不确定性等完整说明。实际结果为综合分75,估计阅读年级为初中,平均句长41.38字,一级字覆盖率仍为100%,生僻字比例同样为0%,最难句难度分16.2。两篇用字覆盖相同,分数差异主要来自句长、词长和结构。报告因此能发现“字都常见,但句子仍然难读”的情况。
类似功能对比
| 功能 | 适合的问题 | 主要结果 |
|---|---|---|
| 文本可读性分析 | 判断整体阅读门槛并定位难句 | 综合分、阅读年级、语言细项、多文件比较、难易句样本 |
| 词汇等级分析 | 检查具体词语是否超出目标词汇等级 | 各等级词汇覆盖与超纲词 |
| 文本质量评估 | 检查文本是否存在更广泛的质量问题 | 质量维度与对应判断 |
| 文体风格指纹 | 描述句法、词汇和表达风格特征 | 多维风格指标与文本特征 |
