- 24
- 0
- 约1.24万字
- 约 20页
- 2018-10-11 发布于福建
- 举报
Spark的环境下并行立方体计算的方法
Spark的环境下并行立方体计算的方法
摘要:针对传统联机分析处理(OLAP)处理大数据时实时响应能力差的问题,研究基于分布式内存计算框架Spark加速的数据立方体计算方法,设计基于Spark内存集群的自底向上构造(BUC)算法――BUCPark,来提高BUC的并行度和大数据适应能力。在此基础上,为避免内存中迭代的立方体单元膨胀,基于内存重复利用和共享的思想设计改进的BUCPark算法――LBUCPark。实验结果表明:LBUCPark算法性能优于BUC算法和BUCPark算法,能够胜任大数据背景下的快速数据立方体计算任务。
关键词:Spark;联机分析处理;数据立方体;自底向上构造
中图分类号:
TP393.027
文献标志码:A
Abstract:In view of the poor realtime response capability of traditional OnLine Analytical Processing (OLAP) when processing big data, how to accelerate computation of data cubes based on Spark was investigated, and a memorybased distributed computing framewor
您可能关注的文档
最近下载
- 恶性肿瘤患者围化疗期居家护理规范.pptx VIP
- 股市主力操盘盘 口摩斯密码(原创内容,侵权必究).pptx
- 2026年匹克球裁判员注册考试及答案.docx VIP
- 第九分册安全手册-新能达旗.pdf VIP
- 2024年微创外科行业白皮书-技术创新加速国产化,九大细分领域竞争升级.pdf VIP
- 2026年匹克球裁判员考核题库及答案.docx VIP
- 第七分册分析手册-新能达旗3535.pdf VIP
- 2025-2026学年北京市西城区九年级上学期期末语文试卷含详解.docx VIP
- 精品解析:北京市东城区2025-2026学年八年级上学期期末语文试题(解析版).docx VIP
- 2026年匹克球裁判员实操考试及答案.docx VIP
原创力文档

文档评论(0)