- 7
- 0
- 约1.88万字
- 约 23页
- 2024-10-19 发布于辽宁
- 举报
PAGE1
PAGE1
ApacheSpark基础介绍
1Spark的历史与发展
ApacheSpark是一个开源的分布式计算系统,由加州大学伯克利分校的AMPLab开发,于2009年首次发布。Spark的设计初衷是为了克服HadoopMapReduce在迭代计算和数据处理速度上的局限性。MapReduce虽然在批处理大数据方面表现出色,但在迭代计算和实时数据处理上效率较低,因为每次MapReduce作业都需要从磁盘读取数据,这在数据量巨大时会显著增加处理时间。
Spark通过引入ResilientDistributedDatasets(RD
您可能关注的文档
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop安全与权限管理.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop安装与配置.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop分布式文件系统HDFS详解.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop基础知识与架构.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Flume日志收集系统.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:HBase分布式数据库.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Hive数据仓库.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Mahout机器学习库.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Pig数据流语言.docx
- 大数据工程师-数据处理与分析-Apache Hadoop_Hadoop生态系统:Spark大数据处理引擎.docx
- 大数据工程师-数据处理与分析-Apache Spark_Spark核心组件解析.docx
- 大数据工程师-数据处理与分析-Apache Spark_Spark生态系统与相关工具.docx
- 大数据工程师-数据处理与分析-Apache Spark_Spark性能调优与最佳实践.docx
- 大数据工程师-数据处理与分析-Apache Spark_Spark应用案例分析.docx
- 大数据工程师-数据处理与分析-Java_JavaWeb基础:Servlet与JSP.docx
- 大数据工程师-数据处理与分析-Java_Java虚拟机基础.docx
- 大数据工程师-数据处理与分析-Java_代码调试与性能优化.docx
- 大数据工程师-数据处理与分析-Java_方法与参数传递.docx
- 大数据工程师-数据处理与分析-Java_输入输出流:文件操作与网络编程.docx
- 大数据工程师-数据处理与分析-Matplotlib_Matplotlib绘图性能优化.docx
原创力文档

文档评论(0)