长春工程学院《数据分析与数据挖掘》2023-2024学年第一学期期末试卷.docVIP

长春工程学院《数据分析与数据挖掘》2023-2024学年第一学期期末试卷.doc

此“教育”领域文档为创作者个人分享资料,不作为权威性指导和指引,仅供参考
  1. 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
  2. 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  3. 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  4. 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  5. 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  6. 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  7. 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多

装订线

装订线

PAGE2

第PAGE1页,共NUMPAGES3页

长春工程学院《数据分析与数据挖掘》

2023-2024学年第一学期期末试卷

院(系)_______班级_______学号_______姓名_______

题号

总分

得分

一、单选题(本大题共20个小题,每小题2分,共40分.在每小题给出的四个选项中,只有一项是符合题目要求的.)

1、对于一个存在多重共线性的回归模型,使用岭回归方法进行修正,其原理是?

A.增加变量

B.减少变量

C.对系数进行约束

D.对数据进行标准化

2、在一项关于大学生就业意向的调查中,询问了学生期望的工作地点、行业、薪资等。若要分析不同专业的学生在就业意向上是否存在显著差异,应采用以下哪种统计方法?

A.卡方独立性检验

B.方差分析

C.相关分析

D.回归分析

3、某城市的交通流量在一天内不同时间段有明显差异。为了描述这种差异,将一天分为24个小时段,计算每个时段的交通流量均值。这种数据属于?

A.截面数据

B.时间序列数据

C.面板数据

D.混合数据

4、在进行回归分析时,如果存在多重共线性问题,会对模型产生什么影响?()

A.系数估计不准确

B.方差增大

C.预测能力下降

D.以上都有可能

5、某公司为了解员工对新福利政策的满意度,随机抽取了200名员工进行调查。结果显示,满意的有120人,不满意的有80人。要检验员工的满意度是否超过50%,应采用哪种假设检验方法?()

A.单侧Z检验

B.单侧t检验

C.双侧Z检验

D.双侧t检验

6、已知一组数据的偏态系数为0,峰度系数为3,说明数据的分布情况如何?()

A.接近正态分布

B.左偏态

C.右偏态

D.无法确定

7、某股票的收益率在过去10个交易日的变化情况如下:5%,-2%,8%,-3%,10%,-1%,6%,-4%,7%,2%。计算这组数据的几何平均收益率约为多少?()

A.2.5%

B.3.0%

C.3.5%

D.4.0%

8、要比较两个独立样本的离散程度,以下哪个统计量最合适?()

A.标准差

B.方差

C.变异系数

D.极差

9、已知一组数据的偏态系数为-0.8,峰态系数为2.5,说明这组数据的分布形态是?

A.左偏且尖峰

B.右偏且尖峰

C.左偏且平峰

D.右偏且平峰

10、为了解某超市不同商品的销售情况,对一周内的销售数据进行分析。哪种统计图表最能直观地展示各类商品的销售额占比?()

A.柱状图

B.折线图

C.饼图

D.箱线图

11、在比较两种测量方法的准确性时,收集了同一组样本分别用两种方法测量的数据。应采用哪种统计方法进行分析?()

A.配对样本t检验

B.独立样本t检验

C.方差分析

D.以上都不对

12、为比较两种教学方法的效果,分别对两个班级进行测试。甲班30人的平均成绩为85分,标准差为10分;乙班25人的平均成绩为90分,标准差为8分。要检验两个班级的平均成绩是否有显著差异,应采用()

A.单侧t检验

B.双侧t检验

C.单侧Z检验

D.双侧Z检验

13、已知随机变量X服从参数为λ的泊松分布,且P(X=2)=P(X=3),则λ的值是多少?

A.2

B.3

C.6

D.9

14、在分析某班级学生的考试成绩时,发现数学成绩和物理成绩之间存在一定的相关性。为进一步探究这种相关性的本质,应进行以下哪种分析?()

A.简单线性回归

B.曲线回归

C.非线性回归

D.以上都不对

15、对某城市的交通流量进行监测,连续记录了30天的数据。发现每天的平均车流量服从正态分布,均值为5000辆,标准差为800辆。若要以90%的置信区间估计该城市的日平均车流量,其区间宽度大约是多少?()

A.300辆

B.400辆

C.500辆

D.600辆

16、对一个总体进行多次抽样,每次抽样的样本均值会有所不同。样本均值的标准差被称为?()

A.总体标准差

B.样本标准差

C.抽样平均误差

D.标准误

17、对于一个包含多个变量的数据集,若要降低变量维度同时保留大部分信息,以下哪种方法较为常用?()

A.因子分析

B.聚类分析

C.对应分析

D.典型相关分析

18、某研究人员想分析多个变量之间的复杂关系,并将这些变量归结为几个综合指标。应采用哪种统计方法?()

A.主成分分析

B.因子分析

C.对应分析

D.典型相关分析

19、在对一家超市的销售额进行预测时,收集了过去5年每个月的销售额数据。如果采用季节指数法,需要首先计算每个月的季节指数。已知1月份的平均销售额为10万元,总平均销售额为8万元,那么1月份的季节指数约为多少?()

A.1.25

B.0.8

C.1.5

D.0.67

20、在一项关于消费者购买行为的调查中,记录了消费者的年龄、收入、购买

您可能关注的文档

文档评论(0)

132****8168 + 关注
实名认证
文档贡献者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档