- 5
- 0
- 约小于1千字
- 约 11页
- 2016-11-25 发布于湖北
- 举报
大数据工作流程概要
* 大数据处理流程及 相关工具介绍 目录 大数据处理流程简析 1 2 3 各处理流程相关技术简析 (基础常识、工作原理、常用工具) 分布式并行处理技术MapReduce 数据抽取、转换、装载过程 数据相互转移 分布式文件系统 海量结构化存储系统 机器学习、数据挖掘、语义搜索 PowerView 动态图表 数据采集 数据预处理 数据存储 数据分析挖掘 结果展现 海量非结构化存储系统 一、大数据处理流程简析 一、大数据处理流程简析 数据采集 数据预处理 数据存储 数据分析挖掘 结果展现 chukwa Sqoop HDFS HBASE HIVE PowerView 分布式并行处理运算MapReduce 常 用 工 具 maout 二、、分布式并行处理技术MapReduce 单词技术问题 MapReduce工作流程 分割文本 生成新的文本 结果归拢排序 原文本 MapReduce是一套软件框架,包括Map(映射)和Reduce(化简)两个阶段, 可以进行海量数据分割、任务分解与结果汇总,从而完成海量数据的并行处理。 三、各处理流程相关技术简析 数据采集 数据采集是数据分析、挖掘的基础,常用的海量数据采集工具有Hadoop的Chukwa,Cloudera的Flume,Facebook的Scribe等,这些工具均采用分布式
您可能关注的文档
最近下载
- yokogawa横河EJA110E高性能差压变送器产品选型技术资料.pdf
- 2025年贵州普通高中会考生物试卷及答案 .pdf VIP
- 2025年人教版道法八年级上册《第一单元走进社会生活》大单元整体教学设计(2022课标).docx
- 2019译林版高中英语选择性必修一Unit4 Exploring poetry 知识清单(学生版).docx VIP
- 《GB_T 10067.46-2014电热装置基本技术条件 第46部分:罩式电阻炉》专题研究报告.pptx VIP
- 质检报告模板.docx VIP
- 2019译林版高中英语选择性必修四Unit3 Careers and skills 知识清单(学生版).docx VIP
- 水平定向钻法管道穿越工程技术规程CECS 382-2014.docx VIP
- 军人党员发展流程.pptx VIP
- 7.1 小小鞋店 课件 北师大版(2024)数学三年级下册.pptx VIP
原创力文档

文档评论(0)