- 0
- 0
- 约1.07万字
- 约 27页
- 2026-08-17 发布于上海
- 举报
数据科学概论试题及解析
一、单项选择题(共10题,每题1分,共10分)
数据科学的核心目标是()。
A.编写复杂的计算机程序
B.从数据中提取有价值的信息和洞见
C.设计美观的数据可视化图表
D.建立大规模的数据存储系统
答案:B
解析:数据科学的根本目的在于利用科学方法、算法和系统,从结构化和非结构化数据中挖掘知识、形成洞见,并指导决策。编写程序、可视化和数据存储是实现这一目标的手段,而非核心目的。
以下哪项不属于数据预处理中常见的步骤()。
A.数据清洗
B.数据建模
C.数据集成
D.数据变换
答案:B
解析:数据预处理是为后续建模和分析准备数据的过程,主要包括数据清洗(处理缺失值、异常值)、数据集成(合并多个数据源)、数据变换(规范化、离散化)等。数据建模是预处理完成后的核心分析步骤,不属于预处理范畴。
在机器学习中,用于训练模型并评估其性能的数据集通常被划分为()。
A.训练集、验证集、测试集
B.输入集、输出集、处理集
C.样本集、特征集、标签集
D.结构化集、半结构化集、非结构化集
答案:A
解析:标准的机器学习流程中,数据通常被划分为三个部分:训练集用于模型学习;验证集用于调整模型超参数和选择模型;测试集用于最终评估模型的泛化性能。其他选项的划分方式不符合常规实践。
关于“过拟合”(Overfitting)现象的描述,正确的是()。
原创力文档

文档评论(0)