2026年大数据统计分析与建模真题.docxVIP

  • 1
  • 0
  • 约5.64千字
  • 约 8页
  • 2026-09-04 发布于河北
  • 举报

PAGE/NUMPAGES

2026年大数据统计分析与建模真题

考试时间:______分钟总分:______分姓名:______

一、选择题(每题2分,共20分。下列每小题备选答案中,只有一项是符合题目要求的。)

1.大数据通常被定义为具有“4V”特征的数据集,以下哪一项不属于经典的大数据“4V”特征?

A.Volume(海量性)

B.Velocity(高速性)

C.Variety(多样性)

D.Veracity(真实性)

2.在处理包含大量缺失值的数据时,以下哪种方法通常不适用于大数据场景,因为其计算复杂度随数据规模呈指数级增长?

A.删除含有缺失值的记录

B.使用均值、中位数或众数填充

C.使用回归或KNN等方法预测缺失值

D.众数填充

3.对于连续型变量X和Y,如果X的均值和标准差分别为100和10,Y的均值和标准差分别为20和2,那么可以得出以下哪个结论?

A.X的分布必然比Y的分布更分散

B.Y的分布必然比X的分布更集中

C.X和Y的分布集中程度相同

D.无法比较X和Y的分布集中程度

4.在假设检验中,犯第一类错误(TypeIError)指的是:

A.真实情况成立,但拒绝了原假设

B.真实情况

文档评论(0)

1亿VIP精品文档

相关文档