多元统计分析第五章主成分与经验正交分解
第5章主成分分析与经验正交分解
5.1主成分分析数学模型
当存在若干个随机变量时,寻求它们的少量线性组合(即主成分),用以解释这些随机
变量,是很必要的。首先我们看一个例子。
例5.1 为了调查学生的身材状况,可以测量他们的身高()、体重()、胸围()和坐高()。可是用这4个指标表达学生身材状况不方便。但若用
=3.6356+3.3242+2.4770+2.1650
表示学生身体魁梧程度;用
=-3.9739+1.3582+3.7323-1.5729
表示学生胖瘦程度。则这两个指标(,)很好概括了4个指标(-))、体重()、胸围()和坐高()不同;(, , , )是4维随机向量;,是他们的2个线性组合,,能很好表示, , , 的特性。类似的问题在许多地方出现:可观测的随机变量很多,需要选出所有所有随机变量的少数线性组合,使之尽可能刻划全部随机变量的特性,选出的线性组合就是诸多随机变量的主成分,又称为主分量。寻求随机向量主成分,并加以解释,称为主成分分析,又称为主分量分析。主成分分析在许多学科中都有应用,细节可参看张尧廷(1991)、Richard(2003),主成分分析在气象等科学中称为PCA方法,见吴洪宝(2005)。
主成分分析的数学模型是:对于随机向量X,想选一些常数向量,用尽可能多反映随机向量X的主要信息。也即尽量大。但是的模可以无限增大,从而使无限变大,这是我们不希望的
原创力文档

文档评论(0)