- 5
- 0
- 约2.92万字
- 约 32页
- 2024-10-19 发布于辽宁
- 举报
PAGE1
PAGE1
Hadoop简介与生态系统
1Hadoop的历史与发展
Hadoop是一个开源软件框架,用于分布式存储和处理大规模数据集。它由Apache软件基金会维护,最初由DougCutting和MikeCafarella在2005年基于Google的MapReduce和GoogleFileSystem(GFS)论文开发。Hadoop的设计目标是提供一个高可靠、高扩展、成本效益的解决方案,以处理PB级别的数据。
1.1Hadoop的起源
Hadoop的命名来源于DougCutting的儿子的一个玩具大象。在2003年和2004年,Google发表了关于
您可能关注的文档
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop安全与权限管理.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop安装与配置.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop分布式文件系统HDFS详解.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop基础知识与架构.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Flume日志收集系统.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:HBase分布式数据库.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Mahout机器学习库.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Pig数据流语言.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Spark大数据处理引擎.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Sqoop数据迁移工具.docx
原创力文档

文档评论(0)