- 1、本文档共30页,可阅读全部内容。
- 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
[互联网]Hadoop的淘宝方案
* * * * * * * * * * * * * * * * * * * * * * Hadoop与数据分析 淘宝数据平台及产品部基础研发组 周敏 日期:2010-05-26 Outline Hadoop基本概念 Hadoop的应用范围 Hadoop底层实现原理 Hive与数据分析 Hadoop集群管理 典型的Hadoop离线分析系统架构 常见问题及解决方案 关于打扑克的哲学 打扑克与MapReduce Input split shuffle output 分牌 各自齐牌 交换 再次理牌 搞定 统计单词数 The weather is good This guy is a good man Today is good Good man is good the 1 weather 1 is 1 good 1 today 1 is 1 good 1 this 1 guy 1 is 1 a 1 good 1 man 1 good 1 man 1 is 1 good 1 a 1 good 1 good 1 good 1 good 1 good 1 man 1 man 1 the 1 weather 1 today 1 guy 1 is 1 is 1 is 1 is 1 this 1 a 1 good 5 guy 1 is 4 man 2 the 1 this 1 today 1 weather 1 流量计算 * 趋势分析 * /截图 用户推荐 * 分布式索引 * * Hadoop 核心 Hadoop Common 分布式文件系统HDFS MapReduce框架 并行数据分析语言Pig 列存储NoSQL数据库 Hbase 分布式协调器Zookeeper 数据仓库Hive(使用SQL) Hadoop日志分析工具Chukwa Hadoop生态系统 * Data Data data data data data Data data data data data Data data data data data Data data data data data Data data data data data Data data data data data Data data data data data Data data data data data Data data data data data Data data data data data Data data data data data Data data data data data Results Data data data data Data data data data Data data data data Data data data data Data data data data Data data data data Data data data data Data data data data Data data data data Hadoop Cluster DFS Block 1 DFS Block 1 DFS Block 2 DFS Block 2 DFS Block 2 DFS Block 1 DFS Block 3 DFS Block 3 DFS Block 3 MAP MAP MAP Reduce Hadoop实现 作业执行流程 // MapClass1中的map方法 public void map(LongWritable Key, Text value, OutputCollectorText, Text output, Reporter reporter) throws IOException { String strLine = value.toString(); String[] strList = strLine.split(\); String mid = strList[3]; String sid = strList[4]; String timestr = strList[0]; try{ timestr = timestr.substring(0,10); }catch(Exception e){return;} timestr += 0000; // 省略数十行 output.collect(new Text(mid + “\”” + “sid\”” + timestr , ...); } Hadoop案例(1) public static cl
您可能关注的文档
- [二年级语文]阅读训练00.doc
- [二年级语文]识字6课件.ppt
- [二年级语文]香港璀璨的明珠PPT课件人教课标版小学语文第五册课件.ppt
- [二年级语文]雷雨.ppt
- [二年级语文]识字七最新课件.ppt
- [二年级语文]风娃娃PPT课件.ppt
- [二年级语文]重阳节_班会.ppt
- [二年级语文]骑牛比赛第二课时.ppt
- [互联网]01电子商务概述.ppt
- [二年级语文]鸟岛--宋娟娟.ppt
- 2025年甘肃省平凉市中考历史真题试卷(含答案).docx
- 四川省成都市蓉城名校2024-2025学年高二下学期6月期末联考英语试卷(含答案,无听力).docx
- 新疆伊犁哈萨克自治州2024-2025学年七年级下学期期末道德与法治试卷(含答案).docx
- 2025年江西省新余市中考历史模拟试卷(含答案).docx
- 河南省驻马店市新蔡县第一高级中学2024-2025学年高三下学期4月月考政治试题(含答案).docx
- 山东省济宁市汶上县第一中学2024-2025学年高一下学期期末模拟检测(一)政治试卷(含答案).docx
- 2025年甘肃省定西市中考历史考前适应性检测试卷(含答案).docx
- 黑龙江省龙东地区2025年初中学业水平考试道德与法治真题(含答案).docx
- 2025年陕西省咸阳市中考三模语文试题(含答案).docx
- 山东省济宁市汶上县第一中学 高一下学期期末模拟检测(三)政治试卷(含答案).docx
最近下载
- 水泥厂电气培训课件.pptx
- 体例格式9:工学一体化课程《windows服务器基础配置与局域网组建》任务1学习任务工作页.docx VIP
- 金税四期税务风险预警指标汇总.pdf
- 豆腐柴人工栽培技术.pdf VIP
- 天津市小升初小卷真题小外(天津市外国语大学附属外国语学校)(5套含答 .pdf VIP
- 控制计划(机加).docx VIP
- 土地资源管理学(第二版)张正峰,第一至第十二章知识点.docx VIP
- 专题三 透镜及其应用 2025年中考物理基础知识考点专题练习(含答案).docx VIP
- DL/T 502-2006 火力发电厂水汽分析方法(第1-32部分).pdf VIP
- 施工现场总平面布置培训.pptx VIP
文档评论(0)