命名实体识别
把文本里的人名、地名、机构名和时间找出来并归类,同时给出两种口径的结果:规则识别按常见中文专名写法扫描,结果稳定,适合逐句核对;语义识别结合句子意思判断,数量和边界可能与规则识别不同。两份结果并排摆在一起,不一致的地方正是需要人工确认的地方。
每个实体都保留它在原句中的位置,可以回到上下文里核对。统计各类实体的数量占比和反复出现的实体,用来盘点材料里究竟讲了哪些人、哪些地方、哪些机构。可加载自定义词典和停用词表,把机构简称、项目代号这类专有说法补进来。
加载文件上传组件中...
已识别 0 / 500 个词
一行一个词,也可写成 词 词频 词性(空格分隔);逗号、顿号、分号或换行分隔均可。
字典帮助:可使用 搜狗细胞词库 下载你需要的字典 SCEL 文件,并使用辅助工具中的 【搜狗输入法词库 SCEL 转 TXT 字典工具】 转为 txt 后,用上方的导入按钮加入
分词工具碰到不认识的新词常会拆开,比如把“乡村振兴”拆成“乡村”和“振兴”。打开后,会先把你文本里的这类词找出来加进词典,分词时就不容易拆散了。仅支持中文文本。每 10,000 字 5 点。
已识别 0 / 500 个词
每 10,000 个字符 5 点
