基于改进特征提取及聚类网络评论挖掘研究.docVIP

  • 4
  • 0
  • 约7.34千字
  • 约 13页
  • 2018-08-29 发布于福建
  • 举报

基于改进特征提取及聚类网络评论挖掘研究.doc

基于改进特征提取及聚类网络评论挖掘研究

基于改进特征提取及聚类网络评论挖掘研究   〔摘要〕[目的/意义]针对信息过载条件下中文网络产品评论中特征提取性能低以及特征聚类中初始中心点的选取问题。[方法/过程]本研究提出采用基于权重的改进Apriori算法产生候选产品特征集合,再根据独立支持度、频繁项名词非特征规则及基于网络搜索引擎的PMI算法对候选产品特征集合进行过滤。并以基于HowNet的语义相似度和特征观点共现作为衡量产品特征之间关联程度的特征,提出一种改进 K-means 聚类算法对产品特征进行聚类。[结果/结论]实验结果表明,在特征提取阶段,查准率为69%,查全率为9264%,综合值达到7907%。在特征聚类阶段,本文提出的改进K-means算法相对传统算法具有更优的挖掘性能。   〔关键词〕Apriori算法;特征提取;PMI算法;K-means算法;语义相似度   DOI:10.3969/j.issn.1008-0821.2018.02.011   〔中图分类号〕TP393〔文献标识码〕A〔文章编号〕1008-0821(2018)02-0068-07   Research on Network Review Mining Based on Improved   Feature Extraction and Clustering   Li ChangbingPang Chongpeng*Ling

文档评论(0)

1亿VIP精品文档

相关文档