- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
一、概述
在处理信息时,当两个变量之间有一定相关关系时,可以解释为这两个变量反映此课题的信息有一定的重叠
二、基本原理
主成分分析是数学上对数据降维的一种方法。其基本思想是设法将原来众多的具有一定相关性的指标X1,X2,…,XP(比如p个指标),重新组合成一组较少个数的互不相关的综合指标Fm来代替原来指标。那么综合指标应该如何去提取,使其既能最大程度的反映原变量Xp所代表的信息,又能保证新指标之间保持相互无关(信息不重叠)。
设F1表示原变量的第一个线性组合所形成的主成分指标,即,由数学知识可知,每一个主成分所提取的信息量可用其方差来度量,其方差Var(F1)越大,表示1包含的信息越多。因此在所有的线性组合中选取的1应该是1,X2,…,XP的所有线性组合中方差最大的,故称1为第一主成分如果第一主成分不足以代表原来个指标的信息,再考虑选取2,为有效地反映原信息,1已有的信息就不需要再出现2中,2与F1要保持独立、不相关,用数学语言表达就是Cov(F1, F2)=0,1不相关的X1,X2,…,XP的所有线性组合中方差最大的,故称2为第二主成分,依此类推构造出……、Fm为原变量指标X1、X2……XP第……、第个主成分。
根据以上分析得知:
(1) Fi与Fj互不相关,即Cov(Fi,Fj) = 0,并有Var(Fi)=ai’Σai,其中Σ为X的协方差阵
(2)F1是X1,X2,…,Xp的一切线性组合(系数满足上述要求)中方差最大的,……,即Fm是与F1,F2,……,Fm-1都不相关的X1,X2,…,XP的所有线性组合中方差最大者。
F1,F2,…,Fm(m≤p)为构造的新变量指标,即原变量指标的第第个主成分i(i=1,2,…,m)关于原变量Xj(j=1,2 ,…, p)的表达式,即系数( i=1,2,…,m; j=1,2 ,…,p)。从数学上可以证明,原变量协方差矩阵的特征根是主成分的方差,所以前m个较大特征根就代表前m个较大的主成分方差值;原变量协方差矩阵前m个较大的特征值(这样选取才能保证主成分的方差依次最大)所对应的特征向量就是相应主成分Fi表达式的系数,为了加以限制,系数启用的是对应的单位化的特征向量,即有= 1。
(2)计算主成分载荷,主成分载荷是反映主成分Fi与原变量Xj之间的相互关联程度:
三、主成分分析法的计算步骤
主成分分析的具体步骤如下:
(1)计算协方差矩阵
计算样品数据的协方差矩阵:Σ=(sij)p(p,其中
i,j=1,2,…,p
(2)求出Σ的特征值及相应的正交化单位特征向量
Σ的前m个较大的特征值(1((2(…(m0,就是前m个主成分对应的方差,对应的单位特征向量就是主成分Fi的关于原变量的系数,则原变量的第i个主成分Fi为:
Fi =X
主成分的方差(信息)贡献率用来反映信息量的大小,为:
(3)选择主成分
最终要选择几个主成分,即F1,F2,……,Fm中m的确定是通过方差(信息)累计贡献率G(m)来确定
当累积贡献率大于85%时,就认为能足够反映原来变量的信息了,对应的m就是抽取的前m个主成分。
(4)计算主成分载荷
主成分载荷是反映主成分Fi与原变量Xj之间的相互关联程度,原来变量Xj(j=1,2 ,…, p)在诸主成分Fi(i=1,2,…,m)上的荷载 lij( i=1,2,…,m; j=1,2 ,…,p)。:
在SPSS软件中主成分分析后的分析结果中,“成分矩阵”反应的就是主成分载荷矩阵。
(5)计算主成分得分
计算样品在m个主成分上的得分:
i = 1,2,…,m
实际应用时,指标的量纲往往不同,所以在主成分计算之前应先消除量纲的影响。消除数据的量纲有很多方法,常用方法是将原始数据标准化,即做如下数据变换:
其中:,
根据数学公式知道,①任何随机变量对其作标准化变换后,其协方差与其相关系数是一回事,即标准化后的变量协方差矩阵就是其相关系数矩阵。②另一方面,根据协方差的公式可以推得标准化后的协方差就是原变量的相关系数,亦即,标准化后的变量的协方差矩阵就是原变量的相关系数矩阵。也就是说,在标准化前后变量的相关系数矩阵不变化。
根据以上论述,为消除量纲的影响,将变量标准化后再计算其协方差矩阵,就是直接计算原变量的相关系数矩阵,所以主成分分析的实际常用计算步骤是:
☆计算相关系数矩阵
☆求出相关系数矩阵的特征值及相应的正交化单位特征向量
☆选择主成分
☆计算主成分得分
总结:原指标相关系数矩阵相应的特征值(i为主成分方差的贡献,方差的贡献率为 ,越大,说明相应的主成分反映综合信息的能力越强,可根据(i的大小来提取主成分。每一个主成分的组合系数(原变量在该主成分上的载荷)就是相应特征值(i所对应的单位
您可能关注的文档
- 纸类、造纸业用粘合胶制备工艺技术.doc
- 制药工艺用水制备操作.ppt
- 制造生物活性肽绿色饲料添加剂高效菌株选育以及在肉仔鸡上抗生素替代效应.pdf
- 质量管理—ISO9000实施对组织影响.ppt
- 治疗充血性心力衰竭药物及进展.ppt
- 智能变电站关键技术的研究.ppt
- 智能变电站关键与技术的研究.ppt
- 智能电网的分析与的设计2 风电并网电压与稳定问题.pdf
- 智能家居概论及模式的分析.docx
- 智能优化方法应用改进.doc
- 2026年消防设施操作员之消防设备基础知识考试题库500道带答案(新).docx
- 销售岗前培训课件.ppt
- 2026年消防设备操作员考试题库500道(典型题).docx
- 2026年消防设施操作员之消防设备高级技能考试题库300道附答案(实用).docx
- 2026年消防设施操作员之消防设备高级技能考试题库300道标准卷.docx
- 2026年材料员之材料员基础知识考试题库300道附完整答案(全优).docx
- 2026年材料员之材料员基础知识考试题库300道带答案(培优a卷).docx
- 2026年机械员考试题库含答案(轻巧夺冠).docx
- 2026年材料员之材料员基础知识考试题库300道【夺分金卷】.docx
- 2026年期货从业资格之期货法律法规考试题库500道(考点精练).docx
最近下载
- 烟气连续监测系统产品说明书.docx VIP
- 小艇—稳性和浮性的评定与分类 第1部分:艇体长度不小于6m的非帆艇.pdf VIP
- 世界现代设计史功能主义设计与国际主义风格.ppt VIP
- 2025年司钻(井下)考试题库及答案.docx VIP
- 2024年11月9日北京市直遴选笔试真题及答案解析.doc VIP
- 《中小学、幼儿园安全风险分级管控和隐患排查治理双重预防体系建设通用规范》DB43T 3175-2024.pdf VIP
- 合理使用手机 做自律好少年——合理使用手机主题班会(课件).pptx VIP
- 黑龙江省哈尔滨市名校2023-2024学年高二上学期生物期中试卷.pdf VIP
- 《雇主责任险》课件.ppt VIP
- 医学九蒸九晒黄精PPT培训课件.ppt VIP
文档评论(0)