- 0
- 0
- 约5千字
- 约 5页
- 2026-08-10 发布于山东
- 举报
实验3决策树分类与K均值聚类
一、实验目的及要求
理解决策树分类算法的基本思想,掌握使用scikit-learn构建决策树模型的方法。
理解决策树的可解释性优势,能够对生成的决策树进行可视化解读,并据此说明模型“为什么做出某种预测”。
理解无监督学习中聚类任务的基本思想,掌握K均值聚类算法的实现步骤(初始化、分配、更新、迭代)。
掌握肘部法则(ElbowMethod)确定聚类数K的方法,能够对聚类结果进行可视化与业务解释。
理解PCA降维在可视化高维数据、辅助聚类分析中的作用。
二、实验学时
2学时(建议时间分配:讲解10分钟,任务实践80分钟,总结报告10分钟)
三、实验前准备
软件环境:Python3.8及以上,建议使用JupyterNotebook或VSCode。
依赖库:NumPy、Pandas、Matplotlib、scikit-learn。安装命令如下:
pipinstallnumpypandasmatplotlibscikit-learn
知识储备:已学习教材第4.3.2节(无监督学习)与4.4.3、4.4.4节(决策树、K均值聚类)。
四、实验任务
任务1决策树水果分类(35分钟)
使用教材表4-8的水果识别数据(颜色、大小、形状、真实类别),构建决策树分类器。将类别特征编码后训练模型
原创力文档

文档评论(0)