2026年数据建模工程师考试题库(附答案和详细解析)(0205).docxVIP

  • 0
  • 0
  • 约7.96千字
  • 约 11页
  • 2026-03-29 发布于上海
  • 举报

2026年数据建模工程师考试题库(附答案和详细解析)(0205).docx

数据建模工程师考试试卷

一、单项选择题(共10题,每题1分,共10分)

数据预处理中,处理高维稀疏分类特征最常用的方法是?A.直接删除该特征

B.均值填充缺失值

C.独热编码(One-HotEncoding)

D.主成分分析(PCA)降维

答案:C

解析:独热编码通过创建二进制列表示分类特征的每个类别,适用于高维稀疏的分类特征(如“职业”字段的多个类别)。A错误,直接删除会丢失关键信息;B错误,均值填充适用于数值型特征的缺失值处理;D错误,PCA是降维方法,不直接解决分类特征的稀疏性问题。

以下哪种指标最适合评估二分类模型的正负样本区分能力?

A.准确率(Accuracy)

B.F1分数

C.AUC-ROC曲线下面积

D.均方误差(MSE)

答案:C

解析:AUC-ROC衡量模型在不同阈值下区分正负样本的能力,适用于类别不平衡场景。A错误,准确率在类别不平衡时易产生误导(如99%负样本时全预测负类准确率99%);B错误,F1是精确率与召回率的调和平均,侧重平衡两者;D错误,MSE是回归任务的评估指标。

随机森林(RandomForest)防止过拟合的核心机制是?

A.使用L2正则化

B.对样本和特征进行随机抽样(Bagging)

C.限制树的最大深度

D.早期停止(EarlyStopping)

答案:B

解析:随机森林通过Bootstrap样本抽样(

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档