数据与软件应用__第九讲_主成份要点分析.ppt

数据与软件应用__第九讲_主成份要点分析.ppt

第九讲 主成份分析 主成分分析 立体数据表的主成分分析 * * 写为矩阵形式: * * §4 主成分的性质 一、均值 二、方差为所有特征根之和 说明主成分分析把P个随机变量的总方差分解成为P个不相关的随机变量的方差之和。 协方差矩阵?的对角线上的元素之和等于特征根之和。 * * 三、精度分析 1)贡献率:第i个主成分的方差在全部方差中所占比重 ,称为贡献率 ,反映了原来P个指标多大的信息,有多大的综合能力 。 2)累积贡献率:前k个主成分共有多大的综合能力,用这k个主成分的方差和在全部方差中所占比重 来描述,称为累积贡献率。 * * 我们进行主成分分析的目的之一是希望用尽可能少的主成分F1,F2,…,Fk(k≤p)代替原来的P个指标。到底应该选择多少个主成分,在实际工作中,主成分个数的多少取决于能够反映原来变量80%以上的信息量为依据,即当累积贡献率≥80%时的主成分的个数就足够了。最常见的情况是主成分为2到3个。 * * 四、原始变量与主成分之间的相关系数 * * 可见, 和 的相关的密切程度取决于对应线性组合系数的大小。 * * * * 五、原始变量被主成分的提取率 前面我们讨论了主成分的贡献率和累计贡献率,他度量了F1,F2,……,Fm分别从原始变量X1,X2,……

文档评论(0)

1亿VIP精品文档

相关文档