大规模数据交互式查询优化研究.pdfVIP

  • 1
  • 0
  • 约3.39万字
  • 约 28页
  • 2026-09-03 发布于北京
  • 举报

眨眼之间:超大规模数据的交互式查询|end▁of▁sentence|

Sameer

Agarwal

加州大学伯克利分校

sameerag@cs.berkeley.edu

Anand

P.

Iyer

加州大学伯克利

分校

api@cs.berkeley.edu

Aurojit

Panda

加州大学伯克利分

apanda@cs.berkeley.edu

Samuel

Madden

麻省理工学

CSAIL

madden@csail.mit.edu

Barzan

Mozafari

麻省理

工学院

CSAIL

barzan@csail.mit.edu

Ion

Stoica

加州大学伯

克利分校

istoica@cs.berkeley.edu|end▁of▁sentence

|end▁of▁

sentence|

在本演示中,我们介绍了BlinkDB,这是一个基于采样的大规模并行近似查询处理框架,用

于对海量数据运行交互式查询。BlinkDB的关键观察是,在缺乏完美的情况下,人们仍

然可以做出合理的决策。BlinkDB扩展了Hive/HDFS堆栈,并可以处理与这些系统相同的

SPJ(选择、投影、连接和聚合)查询。BlinkDB实时以及统计误差保证,并且可以

以容错的方式扩展到PB级数据和数千台机器。我们使用TPC‑H基

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档