2026年数据建模工程师考试题库(附答案和详细解析)(0126).docxVIP

  • 2
  • 0
  • 约7.56千字
  • 约 11页
  • 2026-03-31 发布于上海
  • 举报

2026年数据建模工程师考试题库(附答案和详细解析)(0126).docx

数据建模工程师考试试卷

一、单项选择题(共10题,每题1分,共10分)

以下哪种方法不属于数据预处理中的缺失值处理?

A.均值填充

B.随机森林预测填充

C.直接删除含缺失值的样本

D.主成分分析(PCA)降维

答案:D

解析:数据预处理的缺失值处理方法包括均值/中位数填充(A)、模型预测填充(B)、删除缺失样本(C)等。主成分分析(PCA)是降维技术,用于减少特征维度,不直接处理缺失值(D错误)。

在分类任务中,当正负样本比例为1:100时,最不适合的评估指标是?

A.准确率(Accuracy)

B.F1分数

C.ROC-AUC

D.召回率(Recall)

答案:A

解析:准确率在类别高度不平衡时会产生误导(如全预测负类准确率可达99%)。F1(综合精确率和召回率)、ROC-AUC(不受类别比例影响)、召回率(关注正类识别能力)更适合不平衡数据(A错误)。

以下哪种算法属于生成式模型?

A.逻辑回归

B.支持向量机(SVM)

C.朴素贝叶斯

D.随机森林

答案:C

解析:生成式模型通过学习数据分布(P(X|Y)和P(Y))生成样本,如朴素贝叶斯(C);判别式模型直接学习决策边界(P(Y|X)),如逻辑回归(A)、SVM(B)、随机森林(D)。

为防止模型过拟合,以下哪种方法效果最差?

A.增加训练数据量

B.降低模型复杂度(如减少神经网络层数)

C.

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档