大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Hive数据仓库.docxVIP

  • 5
  • 0
  • 约2.92万字
  • 约 32页
  • 2024-10-19 发布于辽宁
  • 举报

大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Hive数据仓库.docx

PAGE1

PAGE1

Hadoop简介与生态系统

1Hadoop的历史与发展

Hadoop是一个开源软件框架,用于分布式存储和处理大规模数据集。它由Apache软件基金会维护,最初由DougCutting和MikeCafarella在2005年基于Google的MapReduce和GoogleFileSystem(GFS)论文开发。Hadoop的设计目标是提供一个高可靠、高扩展、成本效益的解决方案,以处理PB级别的数据。

1.1Hadoop的起源

Hadoop的命名来源于DougCutting的儿子的一个玩具大象。在2003年和2004年,Google发表了关于

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档