基于互关联后继树的关联规则挖掘研究-计算机软件与理论专业论文.docxVIP

  • 3
  • 0
  • 约4.84万字
  • 约 55页
  • 2019-02-26 发布于江苏
  • 举报

基于互关联后继树的关联规则挖掘研究-计算机软件与理论专业论文.docx

基于互关联后继树的关联规则挖掘研究-计算机软件与理论专业论文

复旦大学硕士论文 复旦大学硕士论文 摘要 摘要 关联规则(association rules)在数据挖掘是一个重要的研究内容。而产生 频繁集(frequent items)则是产生关联规则的第一步。在大多数以前的实现中, 人们普遍采用了类似于Aprior的算法。这种算法首先产生频繁候选集 (candidate items),然后根据最小支持度(minimum support)生成频繁集,最后 得出关联规则。Apriori算法有一个很大的缺点,就是使用了不断产生候选集并 加以测试的方式来得到频繁集,这样产生候选集的代价是非常大的。虽然人们想 出了很多办法,但根本的扫描多遍数据库没变,因此不可能从根本上提高算法的 效率。 在1999年,Jiawei Han等人又提出了以FP—tree(Frequent Pattern Tree) 结构为基础并结合FP-growth算法的不需要产生候选集的频繁集的挖掘算法。该 算法是目前我们所看到的研究中最新、最有效率,同时也最为著名的算法之一, DBMINER便是实际运用FP-growth算法的产品。基于FP-tree结构的关联规则挖 掘在挖掘单一维和布尔值规则的领域中是相当有用的结构。该算法的思想是将提 供频繁项集的数据库压缩到一棵频繁模式树(或FP-缸ee),但仍保留项集关联信 息,然后,将这种压缩后的数据库分成一组条件数据库(一种特殊类型的投影

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档