2026年数据科学原理与算法习题集.docxVIP

  • 1
  • 0
  • 约7.38千字
  • 约 21页
  • 2026-09-27 发布于广东
  • 举报

2026年数据科学原理与算法习题集

一、单项选择题(本大题共10小题,每小题2分,共20分)

1.在数据科学中,下列哪项技术主要用于通过建立数学模型来预测连续型变量的未来值?()

A.决策树分类算法

B.逻辑回归分析

C.神经网络回归模型

D.K-近邻聚类算法

解析:本题考查数据科学中预测模型的基本分类。选项A的决策树分类算法用于离散型分类问题;选项B的逻辑回归分析适用于二分类或多分类问题,输出为概率值而非连续值;选项C的神经网络回归模型通过拟合复杂非线性关系,能够输出连续型预测值,符合题干要求;选项D的K-近邻聚类算法属于无监督学习中的聚类技术,不涉及预测功能。正确答案为C,该技术通过优化损失函数建立输入与输出之间的映射关系,适用于房价预测、销售额预测等场景。

2.下列关于特征工程的说法中,哪项描述最为准确?()

A.特征工程仅指在原始数据上添加新特征

B.特征选择与特征提取是特征工程的两个主要子任务

C.特征工程在模型训练前完成,对模型性能无影响

D.特征工程主要依赖自动化工具,无需人工干预

解析:本题考察特征工程的核心概念。选项A错误,特征工程包括特征构造、特征选择、特征转换等多个环节;选项B正确,特征选择(如LASSO回归)和特征提取(如PCA降维)是特征工程的关键技术;选项C错误,特征工程

文档评论(0)

1亿VIP精品文档

相关文档