自然语言处理流程.docxVIP

  • 7
  • 0
  • 约1.08万字
  • 约 9页
  • 2020-11-24 发布于境外
  • 举报
文本挖掘主要内容存储信息使用最多的是文本文本挖掘被认为比数据挖掘具有更高的商业潜力当数据挖掘的对象完全由文本这种数据类型组成时这个过程就称为文本数据挖掘文本分类及情感分析文本分类指按照预先定义的主题类别为文档集合中的每个文档确定一个类别需要训练集训练分类器然后应用于测试集主要有朴素贝叶斯分类决策树等情感分析是近年来国内外的研究热点是基于计算机整理分析相关评价信息对带有感情色彩的的主观性文本进行分析处理和归纳情感分析包括情感分类观点抽取观点问答等文本聚类聚类与分类的不同之处在于聚类没有预先定义好的

1、文本挖掘主要内容 存储信息使用最多的是文本, 文本挖掘被认为比数据挖掘具有更高的商业潜 力,当数据挖掘的对象完全由文本这种数据类型组成时, 这个过程就称为文本数 据挖掘。 文本分类及情感分析 文本分类指按照预先定义的主题类别, 为文档集合中的每个文档确定一个类 别。需要训练集训练分类器,然后应用于测试集。主要有朴素贝叶斯分类、决策 树等。情感分析是近年来国内外的研究热点, 是基于计算机整理、 分析相关评价 信息,对带有感情色彩的的主观性文本进行分析、 处理和归纳。 情感分析包括情 感分类、观点抽取、观点问答等。 文本聚类 聚类与分类的不同之处在于, 聚类没有预先定义好的一部分文档的类别,

文档评论(0)

1亿VIP精品文档

相关文档