- 1
- 0
- 约1.23万字
- 约 32页
- 2026-10-07 发布于山西
- 举报
2026年数据科学项目实战演练试卷
一、单项选择题(本大题共10小题,每小题2分,共20分)
1.在数据科学项目中,数据清洗的目的是什么?
A.提高数据存储效率
B.增强数据可视化效果
C.消除数据中的噪声和异常值
D.增加数据维度以提升模型复杂度
解析:数据清洗是数据科学项目中的基础环节,主要目的是通过识别和处理错误、缺失值、重复值等,使原始数据符合分析要求。选项A错误,存储效率属于工程问题而非清洗目标;选项B错误,可视化是下游环节;选项D错误,增加维度需基于业务需求而非盲目复杂化。正确答案C符合数据清洗的核心定义,如缺失值填充、异常值剔除等均属此范畴。
2.以下哪种方法最适合处理时间序列数据中的季节性波动?
A.线性回归
B.ARIMA模型
C.决策树
D.K-Means聚类
解析:季节性波动是时间序列数据的典型特征,ARIMA(自回归积分滑动平均模型)通过差分消除趋势、自回归项捕捉自相关性、移动平均项处理残差,专门针对时序特征设计。线性回归无法处理周期性,决策树对时序特征敏感度低,K-Means属于无监督聚类算法。正确答案B的原理在于其能通过差分项(d)消除季节性周期(s),如ARIMA(p,d,q)中的d可针对周期性差分。
3.在特征工程中,特征交叉通常指什么操作?
原创力文档

文档评论(0)