信息价值评估
逐段计算信息熵、词汇密度、信息密度、稀有信息、语义信息量、简洁性等指标,再合成一个 0 到 1 的综合得分,用来比较同一份材料里哪些段落内容更密集、哪些段落空泛或重复。
综合得分对照所选文本类型模板的推荐阈值,分出高价值与低价值两部分,并给低价值段落写明触发原因,例如段落过短、信息熵偏低、实质内容占比偏低。得分贴近阈值的少量段落还可以各生成一句复核说明,供人工判断该留还是该删。
一行 = 一段
按行切段,不再按标点断句,空行会被跳过。整篇没有换行的文件只会得到一段,段落之间无法比较;提交前请先把长文按段落分好行。
加载文件上传组件中...
已识别 0 / 500 个词
不同材料的信息密度差异较大,系统会按该模板解释报告并设置默认筛选阈值;报告页仍可手动调整。
仅对接近推荐阈值的少量段落生成一句复核理由,帮助判断该保留还是剔除;关闭时只使用规则标签,速度更快。
每 10,000 个字符 2 点
