信息价值评估

逐段计算信息熵、词汇密度、信息密度、稀有信息、语义信息量、简洁性等指标,再合成一个 0 到 1 的综合得分,用来比较同一份材料里哪些段落内容更密集、哪些段落空泛或重复。

综合得分对照所选文本类型模板的推荐阈值,分出高价值与低价值两部分,并给低价值段落写明触发原因,例如段落过短、信息熵偏低、实质内容占比偏低。得分贴近阈值的少量段落还可以各生成一句复核说明,供人工判断该留还是该删。

一行 = 一段

按行切段,不再按标点断句,空行会被跳过。整篇没有换行的文件只会得到一段,段落之间无法比较;提交前请先把长文按段落分好行。

加载文件上传组件中...
已识别 0 / 500 个词

不同材料的信息密度差异较大,系统会按该模板解释报告并设置默认筛选阈值;报告页仍可手动调整。

仅对接近推荐阈值的少量段落生成一句复核理由,帮助判断该保留还是剔除;关闭时只使用规则标签,速度更快。

每 10,000 个字符 2 点