基于改进型数据挖掘模型研究.docVIP

  • 3
  • 0
  • 约2.49千字
  • 约 6页
  • 2018-10-30 发布于福建
  • 举报
基于改进型数据挖掘模型研究

基于改进型数据挖掘模型研究   摘 要:近年来在人工智能领域极具突出研究价值的是数据挖掘技术。数据挖掘技术就是从大量的无规则的数据中提取出潜在的人们感兴趣的知识。提取出的知识表现形式可以为概念、规则、规律、模式等等。目前数据挖掘算法有许多种,如经典的Apriori算法,FP-Tree等。而遗传算法自1975年由J.Holland提出以来,因其结构简单,采用模拟自然选择,适用于解决非线性问题,对于解决存在大量的无序的数据中的挖掘,遗传算法有独特的优势。本文基于遗传算法的优势,采用遗传算法进行关联规则的挖掘。   关键词:数据挖掘;关联规则; 遗传算法   1 相关概念   1.1 关联规则   关联规则是用来发现一组数据中同时发生的概率。假定是数据项的集合。给定一个交易数据库D,定义支持度(support)为D中事务同时包含事件A与事件B的百分比;定义置信度(confidence)为D中事务在已经包含事件A的情况下,包含Y的百分比,即条件概率。如果满足设定的最小支持度阈值和最小置信度阈值,则认为所得到的规则是潜在有用的。   1.2 关联规则挖掘的过程   关联规则的挖掘可以分为两部分:   (1)找出所有频繁项集:即找出所有支持度大于设定的最小支持度阈值的项目集。   (2)由频繁项集产生强关联规则;即通过第一步中得到的频繁项集中选取置信度大于给定的最小置信度阈

文档评论(0)

1亿VIP精品文档

相关文档