- 53
- 0
- 约3.77千字
- 约 4页
- 2021-02-14 发布于山西
- 举报
六六 DATA
机器学习之pca 降维(python 中sklearn 实现)
现在我们对sklearn.decomposition.PCA 的主要参数做一个介绍:
1)n_components:这个参数可以帮我们指定希望PCA 降维后的特征维度数目。最常
用的做法是直接指定降维到的维度数目,此时n_components 是一个大于等于1 的整数。
当然,我们也可以指定主成分的方差和所占的最小比例阈值,让PCA 类自己去根据样本特
征方差来决定降维到的维度数,此时n_components 是一个(0,1]之间的数。当然,我
们还可以将参数设置为mle, 此时PCA 类会用MLE 算法根据特征的方差分布情况自己去
选择一定数量的主成分特征来降维。我们也可以用默认值,即不输入n_components,此
时n_components=min(样本数,特征数)。
2)whiten :判断是否进行白化。所谓白化,就是对降维后的数据的每个特征进行
归一化,让方差都为1.对于PCA 降维本身来说,一般不需要白化。如果你PCA 降维后有
后续的数据处理动作,可以考虑白化。默认值是False,即不进行白化。
3)svd_solver:即指定奇异值分解SVD 的
原创力文档

文档评论(0)