- 1
- 0
- 约5.68千字
- 约 15页
- 2026-09-23 发布于辽宁
- 举报
2026年数据挖掘大学试题及答案
一、填空题(每题2分,共20分)
1.数据挖掘中的关联规则挖掘主要关注的是项目集之间的______关系。
2.在决策树算法中,常用的分裂标准有______和______。
3.支持向量机(SVM)在处理高维数据时表现出色,其基本思想是通过一个超平面将不同类别的数据分开。
4.在聚类算法中,K-means算法是一种基于______的算法,其目标是最小化簇内数据点到簇中心的距离平方和。
5.决策树模型在处理缺失值时,通常采用的方法是______。
6.在数据预处理阶段,数据规范化(归一化)的目的是将数据缩放到一个特定的范围,常用的方法有______和______。
7.关联规则挖掘中的支持度(Support)是指一个项目集在数据集中出现的______。
8.在贝叶斯分类中,朴素贝叶斯分类器假设特征之间是______的。
9.在集成学习方法中,随机森林(RandomForest)是一种基于______的集成学习算法,它通过构建多个决策树并对它们的预测结果进行投票来提高模型的泛化能力。
10.在异常检测中,孤立森林(IsolationForest)算法通过随机选择特征和分割点来构建多个隔离树,然后根据样本在树中的______来判断其是否为异常点。
二、判断题(每题2分,共20分)
1.决策树算法在处理不均衡数据集时,容易偏向于
原创力文档

文档评论(0)