数据挖掘实训总结报告.pdfVIP

  • 210
  • 0
  • 约9.11千字
  • 约 14页
  • 2021-04-15 发布于浙江
  • 举报
项目 1:基于 sklearn 的数据分类挖掘 一、项目任务 ①熟悉 sklearn 数据挖掘的基本功能。 ②进行用朴素贝叶斯、 KNN、决策树 C4.5 、 SVM算法进行数据分类分析。 二、项目环境及条件 ? sklearn-0.18.0 ? python-2.7.13 ? numpy-1.11.3+mkl-cp27-cp27m-win_amd64 ? scipy-0.19.0-cp27-cp27m-win_amd64 ? matplotlib-1.5.3-cp27-cp27m-win_amd64 三、实验数据 Iris 数据集 Iris 数据集是常用的分类实验数据集,由 Fisher, 1936 收集整理。 Iris 也称鸢尾花卉数据 集,是一类多重变量分析的数据集。数据集包含 150 个数据集,分为 3 类,每类 50 个数据, 每个数据包含 4 个属性。可通过花萼长度,花萼宽度,花瓣长度,花瓣宽度 4 个属性预测鸢 尾花卉属于( Setosa ,Versicolour ,Virg

文档评论(0)

1亿VIP精品文档

相关文档