数据挖掘6、大型数据库中的关联规则挖掘要点.pptVIP

  • 5
  • 0
  • 约7.88千字
  • 约 40页
  • 2016-05-17 发布于湖北
  • 举报

数据挖掘6、大型数据库中的关联规则挖掘要点.ppt

挖掘量化关联规则 (1) 量化关联规则中,数值属性将根据某种挖掘标准,进行动态的离散化 例如:最大化挖掘规则的置信度和紧凑性 为了简化量化关联规则挖掘的讨论,我们将聚焦于类似以下形式的2-维量化关联规则:Aquan1 ? Aquan2 ? Acat (两个量化属性和一个分类属性间的关联) 例如: age(X,”30-39”) ? income(X,”42K - 48K”) ? buys(X,”high resolution TV”) 挖掘量化关联规则 (2) 找出这类2-维量化关联规则的方法:关联规则聚类系统(ARCS) 一种源于图像处理的技术,该技术将量化属性对映射到满足给定分类属性条件的2-D栅格上,然后通过搜索栅格点的聚类而产生关联规则 关联规则聚类系统(ARCS) (1) ARCS过程中的步骤包括 1. 分箱(根据不同分箱方法创建一个2-D数组),本步骤的目的在于减少量化属性相对应的巨大的值个数,使得2-D栅格的大小可控 等宽分箱 等深分箱 基于同质的分箱(每个箱中元组一致分布) 2. 找出频繁谓词集 扫描分箱后形成的2-D数组,找出满足最小支持度和置信度的频繁谓词集 关联规则聚类系统(ARCS) (2) 3. 关联规则聚类 将上一步得到的强关联规则映射到2-D栅格上,使用聚类算法,扫描栅格,搜索规则的矩形聚类 ARCS的局限性 所挖掘的关联规则左手边只能是量化属性 规则的

文档评论(0)

1亿VIP精品文档

相关文档