《文本聚类分析的国内外研究现状文献综述》2500字.docx

《文本聚类分析的国内外研究现状文献综述》2500字.docx

文本聚类分析的国内外研究现状文献综述

在文本聚类分析中,本文主要研究文本特征向量化[2]、特征提取[3]和聚类算法[4]。通过创建一个可用、可靠和高效的数学模型,文本数据被转换成计算机识别的词汇向量,并利用不同的权重、概率模型对其进行分类,并利用适当的聚类算法进行聚类分析。目前,在传统的文字表达模式和传统的自然语言处理技术的基础上,提出了一种新的文本表达方法。但是,由于因特网上的文字资料数量呈指数级增长,传统的文本处理方法容易出现维数灾难、特征稀疏、语义模糊等问题。因此,寻找一个能够有效地学习语境语义学并检验其内在联系特征的数学模型具有重要的实用价值。本章将简要介绍国内外学者对文本数据的数学模

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档