数据库的讲义数据仓库.pptVIP

  1. 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
  2. 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  3. 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  4. 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  5. 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  6. 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  7. 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
数据库的讲义数据仓库

数据仓库 数据处理的分类 操作型处理(事务处理) 是指对数据库联机的日常操作,通常是对一个或一组记录的查询和修改,主要是为企业的特定应用服务的。人们关心的是响应时间,数据的安全性和完整性。 分析型处理(或信息型处理)。 用于管理人员的决策分析。例如,DSS,EIS和多维分析等,经常要访问大量的历史数据。 两种数据处理类型的不同 事务处理和分析处理的性能特性不同 数据集成问题 事务处理应用的分散 “蜘蛛网”问题 数据不一致问题 外部数据和非结构化数据 数据动态集成问题 历史数据问题 数据的综合问题 两种数据处理类型的不同 数据仓库 数据仓库就是一个用以更好地支持企业或组织的决策分析处理的、面向主题的、集成的、不更新的、随时间不断变化的数据集合。 面向主题 主题是一个抽象的概念,是在较高层次上将企业信息系统中的数据综合、归类并进行分析利用的抽象。在逻辑意义上,它是对应企业中某一宏观分析领域所涉及的分析对象 面向主题的数据组织方式,就是在较高层次上对分析对象的数据的一个完整、一致的描述,能完整、统一地刻画各个分析对象所涉及的企业的各项数据,以及数据之间的联系。 面向应用的例子 一家采用“会员制”经营方式的商场,按业务已建立起销售、采购、库存管理以及人事管理子系统。按照其业务处理要求,建立了相应的数据库模式: 采购子系统: 订单(订单号,供应商号,总金额,日期) 订单细则(订单号,商品号,类别,单价,数量) 供应商(供应商号,供应商名,地址,电话) 销售子系统: 顾客(顾客号,姓名,性别,年龄,文化程度,地址,电话) 销售(员工号,顾客号,商品号,数量,单价,日期) 面向应用的例子 库存管理子系统 领料单(领料单号,领料人,商品号,数量,日期) 进料单(进料单号,订单号,进料人,收料人,日期) 库存(商品号,库房号,库存量,日期) 库房(库房号,仓库管理员,地点,库存商品描述) 人事管理子系统: 员工(员工号,姓名,性别,年龄,文化程度,部门号) 部门(部门号,部门名称,部门主管,电话) 面向应用数据组织方式的特点 兼顾“数据”和应用 面向应用进行数据组织要反映一个企业内数据的动态特征,表达企业各部门内的数据流动情况以及部门间的数据输入输出关系。并按照实际应用即业务处理流程来组织数据,以提高日常业务处理的速度和准确性等,提高服务质量。 面向应用数据组织方式的特点 数据库模式与企业中实际的业务处理流程中所涉及的单据或文档有很好的对应关系 数据应用逻辑与数据在一定程度上又重新捆绑在一起了 面向主题的例子 商品: 商品固有信息:商品号,商品名,类别,颜色等 商品采购信息:商品号,供应商号,供应价,供应日期,供应量等 商品销售信息:商品号,顾客号,售价,销售日期,销售量等 商品库存信息:商品号,库房号,库存量,日期等 面向主题的例子 供应商: 供应商固有信息:供应商号,供应商名,地址,电话等 供应商品信息:供应商号,商品号,供应价,供应日期,供应量等 顾客: 顾客固有信息:顾客号,顾客名、性别,年龄,文化程度,住址,电话等 顾客购物信息:顾客号,商品号,售价,购买日期,购买量等 面向主题组织方式的特点 关心的是与分析对象、分析领域有关的数据,不再关心数据的处理过程。 需要集成分散于各个子系统中的有关分析对象的数据。 数据不再是流水帐,而是有了一定的综合 不同的主题之间也可以有重叠的部分 面向主题组织方式的特点 集成 数据仓库的每一个主题所对应的源数据在原有的各分散数据库中有许多重复和不一致的地方,且来源于不同联机系统的数据都和不同的应用逻辑捆绑在一起。需要解决冲突,构造统一的模式 数据仓库中的综合数据不能从原有的数据库系统直接得到。在数据进入数据仓库之前要经过综合与计算 不由应用程序更新 数据仓库的数据主要供企业决策分析之用,所涉及的数据操作主要是数据查询,一般情况下并不进行修改操作。 数据仓库的数据反映的是一段相当长的时间内历史数据的内容,及其统计、综合和重组的导出数据,而不是联机处理的数据。 数据库中进行联机处理的数据经过集成输入到数据仓库中,一旦数据仓库存放的数据已经超过数据仓库的数据存储期限,这些数据将从当前的数据仓库中删去。 不由应用程序更新 因为数据仓库只进行数据查询操作,所以数据仓库管理系统DWMS相比DBMS而言要简单得多。像完整性保护,并发控制等等,在数据仓库的管理中几乎可以省去。 但由于数据仓库的查询数据量往往很大,所以对数据查询提出了更高的要求,它要求采用各种复杂的索引技术; 同时由于数据仓库面向的是企业的高层管理者,因而对数据查询的界面友好性和数据表示提出更高的要求。 随时间不断变化的 数据仓库随时间变化不断增加新的数据内容。 数据仓库随时间变化不断删去旧的数据内容。 数据仓库中

文档评论(0)

189****7685 + 关注
实名认证
文档贡献者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档