基于上下文的统计关系学习分析-计算机应用技术专业论文.docx

基于上下文的统计关系学习分析-计算机应用技术专业论文.docx

摘要统计机器学习方法假设所有数据都是具有相同结构的实体,数据之间是独立且同分 摘要 统计机器学习方法假设所有数据都是具有相同结构的实体,数据之间是独立且同分 布的。然而在现实世界中存在着大量的半结构化关系数据,如超文本、Web网页f网站)、 Web图像、数字图书、教育资源等,这些数据集合由不同类型的数据对象组成,数据对 象本身具有复杂的内部结构,同时不同数据对象之间通过(超)链接、引用等联系起来 构成关系数据集合。传统的统计学习方法忽略了数据对象间的关系结构,而这些语义信 息却有助于使学习算法具有更好的性能。因此本论文研究的中心内容就是如何在统计机 器学习中明确地利用数据实例间的关系信息来构建健壮的学习模型。 本论文采用的主要方法论是上下文建模与分析。在研究中,上下文被定义为使得目 标对象具有唯一的和可理解的语义的关联对象和其他影响因素的集合;相应地,上下文 依赖关系则是传达了明确语义相关的“关系”。论文在对上下文分析和建模、统计关系学 习等两方面的研究现状进行全面综述的基础上,以不同的应用问题为背景,开展了基于 上下文分析的统计关系学习方法的研究。创新和研究成果如下: 第一,提出了基于多粒度语义模型的Web站点挖掘方法。Web站点可以看作是一种 具有复杂结构的超文本文档。论文用多粒度树来作为站点的描述模型,同时提出四种上 下文模型来刻画树中结点间的主题相关关系。在此基础上,论文采

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档