高教社课件计算机科学导论计算思维程序实践精装版第18讲-炒股不看股盘看微博—关联规则挖掘与大数据思维.pptxVIP

  • 0
  • 0
  • 约1.2千字
  • 约 22页
  • 2026-09-28 发布于广东
  • 举报

高教社课件计算机科学导论计算思维程序实践精装版第18讲-炒股不看股盘看微博—关联规则挖掘与大数据思维.pptx

;炒股不看股盘,看微博,为什么?;数据挖掘,又称为数据库中知识发现,它是一个从大量数据中抽取挖掘出未知的、有价值的模式或规律等知识的复杂过程。简单地讲就是从大量数据中挖掘或抽取出知识。;数据对超市经营有无帮助呢?;超市数据库;数据挖掘之关联规则挖掘;1.项、项集与事务

设P={p1,p2,...,pm}是所有项(Item)的集合。D是数据库中所有事务的集合,其中每个事务T(Transaction)是项的集合,是P的子集,即T?P;

每一个事务有一个关键字属性,称作交易号或事务号以区分数据库中的每一个事务。设A是一个项集(ItemSet),事务T包含A当且仅当A?T。

2.关联规则

关联规则是形如A?B的蕴涵式,即命题A(如“项集A的购买”)蕴涵着命题B(“如项集B的购买”),或者说由命题A能够推出命题B,其中A?P,B?P,并且A∩B=?。;3.支持度与置信度

Support(A?B)=P(A∪B)=包含A和B的事务数?D中事务总数。

confidence(A?B)=P(B|A)=包含A和B的事务数?包含A的事务数。

支持度反映一条规则的实用性,置信度反映规则的“值得信赖性”的程度

4.强规则

同时满足最小支持度阈值(min_s)和最小置信度阈值(min_c)的规则称作强规

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档