汉语组块识别的研究-计算机应用技术专业论文.docxVIP

  • 0
  • 0
  • 约5.3万字
  • 约 57页
  • 2019-04-12 发布于上海
  • 举报

汉语组块识别的研究-计算机应用技术专业论文.docx

大连理工大学硕士学位论文摘 大连理工大学硕士学位论文 摘 要 随着自然语言处理中词法分析的臼趋成熟,句法分析已经成为当前研究的重点和难 点,组块识别的提出是为了降低完全句法分析的复杂性。通过采用“分而治之”的策略 将句法分析分为组块识别和组块间关系分析,这样将在词语级的处理转换为组块级的处 理,降低了句法分析的难度。本文的目的就是在词法分析的基础上,完成汉语句子的组 块识别,为完全句法分析和其他自然语言处理任务提供基础。 本文首先阐述了组块识别的研究现状及研究意义,并参考前人的研究成果给出了组 块的详细定义,研究并实现了基于增益隐马尔可夫模型和支持向量机(Support Vector Machine,SVM)的组块识别系统,应用错误驱动学习机制校正组块识别结果。 通过将不同的上下文信息导入隐马尔可夫模型(Hidden Markov Model,HMM)eP, 构建了5个二元增益HMM模型用于汉语句子的组块识别。对于SVM模型,选择组块 的多种不同特征信息组合和不同的多分类划分方法,训练学习后得到了基于统计的 SvM模型。为进一步提高组块识别的结果,采用错误驱动学习机制分别对增益HMM 模型和SVM模型的识别结果进行校正。论文给出了两种模型的算法,并给出了两种不 同模型的组块识别结果,及引入错误驱动学习机制校正后的结果。 实验表明,两种不同的组块识别模型都取得了较好的结果,其中增益H

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档