hadoop-MapReduce框的架结构.pdf

  1. 1、本文档共13页,可阅读全部内容。
  2. 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
  3. 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  4. 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
查看更多
hadoop-MapReduce框的架结构

Javen-St udio 咖啡小屋 ht t p://javenst udio .org - C++ Java 分布式 搜索引擎 Navens Research Laboratory - Thinking of Life, Imagination of Future C++博客 :: 首页 :: 新随笔 :: 联系 :: 聚合 :: 管理 :: 24 随笔 :: 57 文章 :: 15 1 评论 :: 4 Trac bac s 20 11年6月 Annot at ed Hadoo p : 第二节 Ma pRed uce框架结构 日 一 二 三 四 五 六 29 30 3 1 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 2 Ma pRed uce框架结构 19 20 2 1 22 23 24 25 Ma p/ Red uce是一 用于大规模数据处理的分布式计算模型,它最初是由Goog le工程师设计并实现的,Goog le 已经将它完整 26 27 28 29 30 1 2 的Ma pRed uce论文公开发布了。其中对它的定义是,Ma p/ Red uce是一 编程模型 (prog ra mming model),是一 用于处理和生成大规模 3 4 5 6 7 8 9 数据集 (processing a nd ge nerating la rge data sets)的相关的实现。用户定义一 ma p 函数来处理一 ey/value对以生成一批中间 的 ey/value对,再定义一 red uce 函数将所有这些中间的有着相同 ey 的values合并起来。很多现实世界中的任务都可用这 模型来表达。 常用链接 我的随笔 我的评论 Hadoo p 的Ma p/ Red uce框架也是基于这 原理实现的,下面简要介绍一下Ma p/ Red uce框架主要组成及相互的关系。 我参与的随笔 2.1 总体结构 留言簿(2 9 ) 给我留言 2.1.1 Ma ppe r和Red uce r 查看公开留言 查看私人留言 运行于Hadoo p 的Ma pRed uce应用程序最基本的组成部分包括一 Mapper 和一 Reducer 类,以及一 创建 obConf 的 行程序,在一些 文章档案 应用中还可以包括一 Combiner 类,它实际也是Reducer 的实现。 20 0 8 年12月 (5) 20 0 8 年3月 (2) 2.1.2 Jo bTracke r和Tas kTracke r 20 0 8 年2月 (4) 20 0 7年6月 (1) 它们都是由一 master服务 obTracker 和多 运行于多 节点的slaver服务Task Tracker 两 类提供的服务调度的。master负责调度jo b 的 20 0 7年5月 (5) 每一 子任务tas 运行于slave 上,并监控它们 ,如果发现有失败的tas 就重新运行它,slave则负责直接 行每一 tas 。Task Tracker 都需要 20 0 7年4月 (1)

文档评论(0)

ayangjiayu3 + 关注
实名认证
内容提供者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档