GoogleMapReduce中文版-hadoop核心思想来源.pdfVIP

  • 2
  • 0
  • 约2.63万字
  • 约 18页
  • 2019-10-13 发布于湖北
  • 举报

GoogleMapReduce中文版-hadoop核心思想来源.pdf

Google MapReduce中文版中文版 译者译者: alex 摘要摘要 MapReduce是一个编程模型,也是一个处理和生成超大数据集的算法模型的相关实现。用户首先创建一个 Map函数处理一个基于key/value pair的数据集合,输出中间的基于key/value pair的数据集合;然后再 创建一个Reduce函数用来合并所有的具有相同中间key值的中间value值。现实世界中有很多满足上述处 理模型的例子,本论文将详细描述这个模型。 MapReduce架构的程序能够在大量的普通配置的计算机上实现并行化处理。这个系统在运行时只关心:如 何分割输入数据,在大量计算机组成的集群上的调度,集群中计算机的错误处理,管理集群中计算机之间 必要的通信。采用MapReduce架构可以使那些没有并行计算和分布式处理系统开发经验的程序员有效利用 分布式系统的丰富资源。 我们的MapReduce实现运行在规模可以灵活调整的由普通机器组成的集群上:一个典型的MapReduce计 算往往由几千台机器组成、处理以TB计算的数据。程序员发现这个系统非常好用:已经实现了数以百计的 MapReduce程序,在Google的集群上,每天都有1000多个MapReduce程序在执行。 1、介绍、介绍 在过去的5年里,包括本文作者在内的Google的很多程序员,为了处理海

文档评论(0)

1亿VIP精品文档

相关文档