- 4
- 0
- 约4.84千字
- 约 12页
- 2026-03-31 发布于福建
- 举报
第PAGE页共NUMPAGES页
2026年数据科学求职指南:数据挖掘与算法分析专业面试题目
一、选择题(每题3分,共10题)
1.在处理缺失值时,以下哪种方法最适用于连续型数据且能保留数据分布特征?
A.删除含有缺失值的样本
B.使用均值或中位数填充
C.K最近邻填充
D.回归填充
答案:C
解析:K最近邻填充(KNNImputation)通过考虑样本的局部相似性来填充缺失值,能较好地保留数据分布特征,适用于连续型数据。均值/中位数填充可能扭曲分布,删除样本会造成信息损失。
2.在评估分类模型性能时,当正负样本不平衡时,以下哪个指标最适合作为主要评价指标?
A.准确率(Accuracy)
B.精确率(Precision)
C.召回率(Recall)
D.F1分数(F1-Score)
答案:D
解析:F1分数是精确率和召回率的调和平均,适用于不平衡数据集,能平衡两者的权衡。准确率对不平衡数据集不敏感,精确率/召回率可能误导。
3.以下哪种算法属于非参数方法?
A.决策树(DecisionTree)
B.线性回归(LinearRegression)
C.K-均值聚类(K-Means)
D.朴素贝叶斯(NaiveBayes)
答案:C
解析:K-均值聚类不需要假设数据分布,属于非参数方法。决策树、线性回归和朴素贝叶斯都有参数假设
原创力文档

文档评论(0)