基于分布式并行关联规则的挖掘算法.docVIP

  • 2
  • 0
  • 约2.6千字
  • 约 5页
  • 2020-12-03 发布于福建
  • 举报

基于分布式并行关联规则的挖掘算法.doc

精品文档(可编辑) 值得下载 基于分布式并行关联规则的挖掘算法 摘 要 以往使用的分布式数据挖掘算法各有优缺点,提出了一种基于星型网络的分布式关联规则挖掘算法。对其基本思想、算法描述等进行了分析。 【关键词】并行关联规则 挖掘算法 SDAM算法 在因特网的推动下,分布式数据库的应用范围越来越广,如超市、银行、图书馆等领域都有所应用。随着数据量的增多,对信息安全要求的提高,数据挖掘技术备受关注,成了当前研究的重点。作为数据挖掘领域的重要组成部分,关联规则可发现不同项之间内在的联系,进而提高更优质的服务。自上世纪90年代被发现后,相关研究日益增多,特别是分布式并行挖掘方面,很多算法相继被提出。其中,FDM算法得到广泛应用,但尚有缺陷点。为此,提出一种新的算法。 1 SDAM算法 实际中,网络拓扑结构多呈现星型结构,针对FDM算法的不足,对其加以改进,介绍一种基于星型网络的分布式关联规则挖掘算法SDAM算法。SDAM算法是在Aprioi算法的基础上,候选集为1项的项目长度,通过数据库扫描分析,算出局部大项集。接着将此局部大项集发送至中心结点,通过判断,检查此项集能否满足全局的大项集标准。在项目长度为k的大项集基础上,生成项目长度为k+1的大项集,然后对数据库进行二次分析、扫描,最后确定项目的全部大项集。SDAM算法与FDM算法不同点是,SDAM算法只需要一个结

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档