- 1
- 0
- 约4.44千字
- 约 6页
- 2019-06-07 发布于河南
- 举报
ETL构建数据仓库五步法
在数据仓库构建中,ETL贯穿于项目始终,它是整个数据仓库的生命线,包括了从数据清洗,整合,到转换,加载等的各个过程,如果说数据仓库是一座大厦,那 么ETL就是大厦的根基,ETL抽取整合数据的好坏直接影响到最终的结果展现。所以ETL在整个数据仓库项目中起着十分关键的作用,必须摆到十分重要的位 置。一、什么是ETLETL是数据抽取(Extract)、转换(Transform)、加载(Load )的简写,它是将OLTP系统中的数据经过抽取,并将不同数据源的数据进行转换、整合,得出一致性的数据,然后加载到数据仓库中。简而言之ETL是完成从 OLTP系统到OLAP系统的过程(图一:pic1.jpg)。二、数据仓库的架构数据仓库(Data Warehouse \ DW)是基于OLTP系统的数据源,为了便于多维分析和 多角度展现将其数据按特定的模式进行存储而建立的关系型数据库,它不同于多维数据库,数据仓库中的数据是细节的,集成的,数据仓库是面向主题的,是以 OLAP系统为分析目的。它包括星型架构(图二:pic2.jpg)与雪花型架构(图三:pic3.jpg),其中星型架构中间为事实表,四周为维度表, 类似星星;雪花型架构中间为事实表,两边的维度表可以再有其关联子表,而在星型中只允许一张表作为维度表与事实表关联,雪花型一维度可以有多张表,而星型 不可以。考虑到效率
您可能关注的文档
最近下载
- 2025年浙江省单独考试招生语文试卷真题答案详解(精校打印版) .pdf VIP
- 模板工程施工方案.docx VIP
- 深度学习:从入门到精通(微课版)PPT全套完整教学课件.pptx
- [萧山区]2025杭州萧山水务有限公司招聘40人笔试历年参考题库典型考点附带答案详解.docx VIP
- 宏观经济学--AD-AS模型课件.ppt VIP
- 《基于FX-2N PLC的物料分拣系统设计》10000字.docx
- 自来水厂笔试题及详细答案.docx VIP
- 钢筋工程施工方案(详细版).pdf VIP
- 亚龙YL-235型光机电一体化装置培训内容.ppt VIP
- 节水灌溉施工组织设计 灌溉工程施工施工组织设计.doc VIP
原创力文档

文档评论(0)