- 2
- 0
- 约6.78千字
- 约 16页
- 2026-03-30 发布于四川
- 举报
2026年数据挖掘与分析技术考试试题及答案
一、单项选择题(每题2分,共20分)
1.以下哪项不是数据清洗中处理缺失值的常用方法?
A.均值填充
B.回归预测填充
C.直接删除含缺失值的记录
D.主成分分析(PCA)降维
答案:D(PCA是降维技术,不直接处理缺失值)
2.在分类任务中,随机森林的基分类器通常是:
A.线性回归模型
B.支持向量机(SVM)
C.决策树
D.K近邻(KNN)
答案:C(随机森林由多棵决策树集成)
3.DBSCAN聚类算法中,若设置参数ε=3,MinPts=5,则以下哪个样本点属于核心对象?
A.ε邻域内包含3个样本点
B.ε邻域内包含5个样本点
C.ε邻域内包含4个样本点
D.ε邻域内包含6个样本点
答案:D(核心对象要求ε邻域内样本数≥MinPts)
4.关联规则挖掘中,支持度(Support)的定义是:
A.包含前件和后件的事务数占总事务数的比例
B.包含前件的事务中同时包含后件的比例
C.后件在所有事务中的出现比例
D.前件和后件的卡方统计量
答案:A(支持度=|X∪Y|/总事务数)
5.特征选择中的“过滤法”常用的评估指标不包括:
A.信息增益
B.互信息
C.模型准确率
D.卡
原创力文档

文档评论(0)