2025-2026年数据挖掘与机器学习实战练习题.docxVIP

  • 1
  • 0
  • 约6.81千字
  • 约 17页
  • 2026-09-22 发布于山东
  • 举报

2025-2026年数据挖掘与机器学习实战练习题.docx

2025-2026年数据挖掘与机器学习实战练习题

一、单选题(总共10题,每题2分,共20分)

1.在数据挖掘中,用于评估模型泛化能力的指标是()。

A.准确率

B.召回率

C.F1分数

D.AUC值

解析:AUC(AreaUndertheCurve)值通过ROC曲线评估模型在不同阈值下的分类性能,直接反映模型的泛化能力。准确率和召回率仅衡量模型在特定阈值下的表现,F1分数是精确率和召回率的调和平均,均无法全面评估泛化能力。

2.下列哪种算法属于监督学习中的分类算法?()

A.K-means聚类

B.主成分分析(PCA)

C.决策树

D.系统聚类

解析:决策树通过树状结构对数据进行分类或回归,是典型的监督学习算法。K-means和系统聚类属于无监督学习中的聚类算法,PCA是降维方法,均不属于分类算法。

3.在特征工程中,对连续变量进行离散化处理的方法是()。

A.标准化

B.归一化

C.二值化

D.线性回归

解析:二值化将连续变量映射为0或1,属于离散化方法。标准化和归一化是数据缩放技术,线性回归是预测模型,均与离散化无关。

4.下列哪种模型适用于处理非线性关系?()

A.线性回归

B.逻辑

文档评论(0)

1亿VIP精品文档

相关文档