Spark的环境下并行立方体计算的方法.docVIP

  • 24
  • 0
  • 约1.24万字
  • 约 20页
  • 2018-10-11 发布于福建
  • 举报
Spark的环境下并行立方体计算的方法

Spark的环境下并行立方体计算的方法   摘要:针对传统联机分析处理(OLAP)处理大数据时实时响应能力差的问题,研究基于分布式内存计算框架Spark加速的数据立方体计算方法,设计基于Spark内存集群的自底向上构造(BUC)算法――BUCPark,来提高BUC的并行度和大数据适应能力。在此基础上,为避免内存中迭代的立方体单元膨胀,基于内存重复利用和共享的思想设计改进的BUCPark算法――LBUCPark。实验结果表明:LBUCPark算法性能优于BUC算法和BUCPark算法,能够胜任大数据背景下的快速数据立方体计算任务。   关键词:Spark;联机分析处理;数据立方体;自底向上构造   中图分类号:   TP393.027   文献标志码:A   Abstract:In view of the poor realtime response capability of traditional OnLine Analytical Processing (OLAP) when processing big data, how to accelerate computation of data cubes based on Spark was investigated, and a memorybased distributed computing framewor

文档评论(0)

1亿VIP精品文档

相关文档