Python机器学习第6章 scikit-learn.pptxVIP

  • 8
  • 0
  • 约1.24千字
  • 约 27页
  • 2021-01-27 发布于辽宁
  • 举报
第6章 scikit-learn;我们可以看到官网的宣传中主要提到到了四点: 一个简单高效的数据挖掘和数据分析工具。 对于所有人都是易用的,而且可以在各个环境中使用。 它是基于Numpy,Scipy和Matplotlib库。 开源的,可以商用。 这个库另一个最大的优点是库的设计是十分有条理的。我们可以看到scikit-learn主要分为六个板块,他们分别是: 分类(classification) 回归(regression) 聚类(clustering) 降维(dimensionality reduction) 模型选择(model selection) 预处理(preprocessing);其中分类和回归问题又被称为有监??学习,而聚类问题被称为无监督学习。而我们在实际进行机器学习过程的先后次序是1)预处理,2)降维,3)有监督和无监督学习,4)模型选择,如图6.2所示。 ;6.1 预处理(preprocessing);6.1.1 标准化;;6.1.2 非线性转换;6.1.3 归一化;6.1.4 二值化;6.1.5 分类特征编码;;;;6.1.6 缺失值插补;6.1.7 生成多项式特征;6.2 降维;6.3 有监督学习、无监督学习;6.4 模型评估;6.4.1 测试集评分;看来这个模型的得分不错。我们可以调整模型不同的参数对其最后的得分进行比较,然后选择

文档评论(0)

1亿VIP精品文档

相关文档