6_第六讲(关联规则分析)(最新修正版).pptVIP

  • 18
  • 0
  • 约1.21万字
  • 约 54页
  • 2018-10-27 发布于湖北
  • 举报

6_第六讲(关联规则分析)(最新修正版).ppt

6_第六讲(关联规则分析)(最新修正版).ppt

3、根据规则集所涉及的抽象层 单层关联规则(关联规则表达时不涉及到概念分层) 多层关联规则(关联规则表达时涉及到概念分层,其内部隐含有概念分层的关系) 4、根据关联挖掘的各种扩充 挖掘最大的频繁模式(该模式的任何真超模式都是非频繁的,意味着这个模式是最大的频繁模式) 挖掘频繁闭项集(一个项集c是频繁闭项集,如果不存在其真超集c`,使得每个包含c的事务也包含c`,意味着c的任何一个真超集都不可能是频繁的,我们就说c是频繁闭项集) * 由事务数据库挖掘单维布尔关联规则 最简单的关联规则挖掘,即单维、单层、布尔关联规则的挖掘,而且我们的举例尽量不涉及概念分层。 首先挖掘频繁项集,其前提条件是: 最小支持度 50%,且最小置信度 50% 对规则A ? C,其支持度 =50% 置信度分A推导C和由C推导A,以A推导C为例: * Apriori算法(计算大型数据库时挖掘关联规则的常用算法之一) Apriori算法利用频繁项集性质的先验知识(prior knowledge),通过逐层搜索的迭代方法,即将k-项集用于探察(k+1)-项集,来穷尽数据集中的所有频繁项集(通过先验知识挖掘未知知识)。 先找到频繁1-项集集合(即单个项出现的频率)L1,然后用L1找到频繁2-项集集合L2,接着用L2找L3,直到找不到频繁k-

文档评论(0)

1亿VIP精品文档

相关文档