加权平均熵加权平均纯度加权平均归一化互信息加权平均准确率加权.ppt

加权平均熵加权平均纯度加权平均归一化互信息加权平均准确率加权.ppt

* * * * * * * @ 表格的表头居中。见表格。 * * * * * * 模板优先队列 ⑴中国科学院.*?所; ⑵中国科学院.*?院; ⑶中国科学院.*?中心; ⑷中国科学院.*?台; ⑸^.*?大学; ⑹^.*?学院; ⑺^.*?学校; ⑻^.*?研究院; ⑼^.*?院; ⑽^.*?公司; ⑾^.*?厂; ⑿^.*?部队; ⒀^.*?所; ⒁^.*?中心; ⒂^.*?局。 算法有效性 不需要人工事先整理出机构规范化表 不需要有很厚语文素养的专家参与 不需要复杂的规则模板 仅依赖数据的自学习和自校验能力 总结 从处理前后数据量的变化来看文本挖掘系统的有效性 从实验数据的评测指标上来看文本挖掘系统的有效性 从知识服务网络平台的用户体验上来看文本挖掘系统的有效性 从知识服务网络平台与其他平台的对比来看文本挖掘系统的有效性 总结 文本挖掘系统在知识要素抽取上的效果 原始数据(条) 处理后数据(条) 题录信息 116,642(知网)/58,235(万方) 109,788 关键词中英对照组 148,825 83,602 作者 299,823 135,969 机构 60,874 10,865 总结 论文中提出的算法及性能评价 论文成果 评价 基于卡方拟合优度的特征词选择算法 低维优势显著、选词更具代表性 关键词的形态语义聚类算法 AverageP=92

文档评论(0)

1亿VIP精品文档

相关文档