- 2
- 0
- 约8.83千字
- 约 13页
- 2026-04-12 发布于上海
- 举报
数据建模工程师考试试卷
一、单项选择题(共10题,每题1分,共10分)
在分类模型评估中,F1-score的计算基于以下哪两个指标?
A.准确率与召回率
B.精确率与准确率
C.精确率与召回率
D.召回率与AUC-ROC
答案:C
解析:F1-score是精确率(Precision)和召回率(Recall)的调和平均数,公式为(F1=2)。选项A错误,准确率是总体正确分类比例;选项B错误,未涉及召回率;选项D错误,AUC-ROC是另一个评估指标。
以下哪项是解决过拟合的常用方法?
A.增加训练数据量
B.减少特征数量
C.降低模型复杂度
D.以上都是
答案:D
解析:过拟合的本质是模型对训练数据过度学习,泛化能力差。增加训练数据可提升模型泛化性(A正确),减少特征或降低复杂度(如减少神经网络层数)可降低模型复杂度(B、C正确),因此选D。
独热编码(One-HotEncoding)最适用于以下哪种类型的特征?
A.连续数值特征
B.高基数分类特征(如1000个类别)
C.低基数分类特征(如3个类别)
D.时间序列特征
答案:C
解析:独热编码通过二进制向量表示分类特征,会增加维度。低基数特征(类别少)使用独热编码可保留类别信息且维度可控(C正确)。高基数特征会导致维度灾难(B错误),连续特征无需编码(A错误),时间序列特征通常用时间差或周期性编
原创力文档

文档评论(0)