- 210
- 0
- 约9.11千字
- 约 14页
- 2021-04-15 发布于浙江
- 举报
项目 1:基于 sklearn 的数据分类挖掘
一、项目任务
①熟悉 sklearn 数据挖掘的基本功能。
②进行用朴素贝叶斯、 KNN、决策树 C4.5 、 SVM算法进行数据分类分析。
二、项目环境及条件
? sklearn-0.18.0
? python-2.7.13
? numpy-1.11.3+mkl-cp27-cp27m-win_amd64
? scipy-0.19.0-cp27-cp27m-win_amd64
? matplotlib-1.5.3-cp27-cp27m-win_amd64
三、实验数据
Iris 数据集
Iris 数据集是常用的分类实验数据集,由 Fisher, 1936 收集整理。 Iris 也称鸢尾花卉数据
集,是一类多重变量分析的数据集。数据集包含 150 个数据集,分为 3 类,每类 50 个数据,
每个数据包含 4 个属性。可通过花萼长度,花萼宽度,花瓣长度,花瓣宽度 4 个属性预测鸢
尾花卉属于( Setosa ,Versicolour ,Virg
原创力文档

文档评论(0)