MapReduce工作原理[参考].pdfVIP

  • 12
  • 0
  • 约1.26万字
  • 约 12页
  • 2020-08-23 发布于福建
  • 举报
MapReduce工作原理 1 MapReduce原理(一) 1.1 MapReduce编程模型 MapReduce采用 分而治之 的思想,把对大规模数据集的操作,分发给一个主节点管理下的 各个分节点共同完成, 然后通过整合各个节点的中间结果, 得到最终结果。 简单地说, MapReduce 就是 任务的分解与结果的汇总 。 在 Hadoop中,用于执行 MapReduce任务的机器角色有两个:一个是 JobTracker ;另一个是 TaskTracker ,JobTracker 是用于调度工作的, TaskTracker 是用于执行工作的。一个 Hadoop集 群中只有一台 JobTracker 。 在分布式计算中, MapReduce框架负责处理了并行编程中分布式存储、 工作调度、 负载均衡、 容错均衡、 容错处理以及网络通信等复杂问题, 把处理过程高度抽象为两个函数: map和 reduce , map负责把任务分解成多个任务, red

文档评论(0)

1亿VIP精品文档

相关文档