2026年数据建模工程师考试题库(附答案和详细解析)(0224).docxVIP

  • 2
  • 0
  • 约8.83千字
  • 约 13页
  • 2026-04-12 发布于上海
  • 举报

2026年数据建模工程师考试题库(附答案和详细解析)(0224).docx

数据建模工程师考试试卷

一、单项选择题(共10题,每题1分,共10分)

在分类模型评估中,F1-score的计算基于以下哪两个指标?

A.准确率与召回率

B.精确率与准确率

C.精确率与召回率

D.召回率与AUC-ROC

答案:C

解析:F1-score是精确率(Precision)和召回率(Recall)的调和平均数,公式为(F1=2)。选项A错误,准确率是总体正确分类比例;选项B错误,未涉及召回率;选项D错误,AUC-ROC是另一个评估指标。

以下哪项是解决过拟合的常用方法?

A.增加训练数据量

B.减少特征数量

C.降低模型复杂度

D.以上都是

答案:D

解析:过拟合的本质是模型对训练数据过度学习,泛化能力差。增加训练数据可提升模型泛化性(A正确),减少特征或降低复杂度(如减少神经网络层数)可降低模型复杂度(B、C正确),因此选D。

独热编码(One-HotEncoding)最适用于以下哪种类型的特征?

A.连续数值特征

B.高基数分类特征(如1000个类别)

C.低基数分类特征(如3个类别)

D.时间序列特征

答案:C

解析:独热编码通过二进制向量表示分类特征,会增加维度。低基数特征(类别少)使用独热编码可保留类别信息且维度可控(C正确)。高基数特征会导致维度灾难(B错误),连续特征无需编码(A错误),时间序列特征通常用时间差或周期性编

文档评论(0)

1亿VIP精品文档

相关文档