多元统计分析课后练习答案.docxVIP

下载本文档

22
0
约9.47千字
约 9页
2023-08-19 发布于山东
举报
版权申诉

多元统计分析课后练习答案.docx

1、原创力文档（book118）网站文档一经付费（服务费），不意味着购买了该文档的版权，仅供个人/单位学习、研究之用，不得用于商业用途，未经授权，严禁复制、发行、汇编、翻译或者网络传播等，侵权必究。。
2、本站所有内容均由合作方或网友上传，本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺！文档内容仅供研究参考，付费前请自行鉴别。如您付费，意味着您自己接受本站规则且自行承担风险，本站不退款、不进行额外附加服务；查看《如何避免下载的几个坑》。如果您已付费下载过本站文档，您可以点击这里二次下载。
3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等，请点击“版权申诉”（推荐），也可以打举报电话：400-050-0827(电话支持时间：9:00-18:30)。
4、该文档为VIP文档，如果想要下载，成为VIP会员后，下载免费。
5、成为VIP后，下载本文档将扣除1次下载权益。下载后，不支持退款、换文档。如有疑问请联系我们。
6、成为VIP后，您将拥有八大权益，权益包括：VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
7、VIP文档为合作方或网友上传，每下载1次，网站将根据用户上传文档的质量评分、类型等，对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档

第1章多元正态散布 1、在数据办理时，为什么往常要进行标准化办理？数据的标准化是将数据按比率缩放，使之落入一个小的特定区间。在某些比较和评论的指标办理中经常会用到，去除数据的单位限制，将其转变为无量纲的纯数值，便于不同单位或量级的指标能够进行比较和加权。其中最典型的就是0-1标准化和Z标准化。2、欧氏距离与马氏距离的优缺点是什么？欧氏距离也称欧几里得胸怀、欧几里得胸怀，是一个往常采用的距离定义，它是在m维空间中两个点之间的真切距离。在二维和三维空间中的欧氏距离的就是两点之间的距离。缺点：就大多数统计问题而言，欧氏距离是不能令人满意的。每个坐标对欧氏距离的贡献是同样的。当坐标表示测量值时，它们往往带有大小不等的随机波动，在这种情况下，合理的方法是对坐标加权，使变化较大的坐标比变化较小的坐标有较小的权系数，这就产生了各样距离。当各个分量为不同性质的量时，“距离”的大小与指标的单位有关。它将样品的不同属性之间的差别等同对待，这一点有时不能知足实际要求。没有考虑到总体变异对距离远近的影响。马氏距离表示数据的协方差距离。为两个听从同一散布并且其协方差矩阵为Σ的随机变量与的差别程度:如果协方差矩阵为单位矩阵,那么马氏距离就简化为欧氏距离,如果协方差矩阵为对角阵,则其也可称为正规化的欧氏距离。优点：它不受量纲的影响，两点之间的马氏距离与原始数据的测量单位无关。由标准化数据和中心化数据计算出的二点之间的马氏距离相同。马氏距离还能够清除变量之间的有关性的扰乱。缺点：夸大了变化微小的变量的作用。受协方差矩阵不稳定的影响，马氏距离并不老是能顺利计算出。 3、当变量X1和X2方向上的变差相等，且与互相独即刻，采用欧氏距离与统计距离是否一致？统计距离区别于欧式距离，此距离要依靠样本的方差和协方差，能够体现各变量在变差大小上的不同，以及优势存在的有关性，还要求距离与各变量所用的单位无关。如果各变量之间相互独立,即观察变量的协方差矩阵是对角矩阵,则马氏距离就退化为用各个观察指标的标准差的倒数作为权数的加权欧氏距离。 4、如果正态随机向量X(X1,X2,LXp)的协方差阵为对角阵，证明X的分量是相互独立的随机变量。解：因为X(X1,X2,LXp)的密度函数为 2 1 2 又由于Σ 2 O 2 p 则f(x1,...,xp) 则其分量是相互独立。 5.y1和y2是相互独立的随机变量，且y1～N（0,1），y2～N（3,4）。（a）求y12的散布。（b）如果y y1 ，写出yy对于y1 与y2 的表达式，并写出yy的散布。 (y2 3)/2 （c）如果y y1 1 且y～N（，），写出y y对于y1与y2的表达式，并写出 y2 y 1y的散布。 2 解：（a）由于y1～N（0,1），所以y1～（1）。（b）由于y1～N（0,1），y2～N（3,4）；所以 y2 3 （0,1） 2 ～N ；故yy 2 y 2 32 ，且yy～ 2 y1 ( ) （2） 2 第2章均值向量和协方差阵的查验 1、略 2、试谈Wilks统计量在多元方差剖析中的重要意义。 3、题目此略多元均值查验,从题意知道，容量为9的样本，总体协方差未知假定H0：0，H1：0(n=9p=5) 查验统计量 /(n-1) T2 n(X 0) S1(X 0)听从 P，n-1 的T2散布统计量T2实际上是样本均值与已知总体均值之间的马氏距离再乘以n*（n-1）,这个值越大，相等的可能性越小，备择假定成即刻，T2有变大的趋势，所以拒绝域选择T2值较大的右侧部分，也能够转变为F统计量零假定的拒绝地区{（n-p）/[(n-1)*p]}*T2Fp,np() 1/10*T2F5,4(5) μ0=（6212.0132.8729729.5 15.78）’ 样本均值（4208.7835.12 1965.89 12.21 27.79）’ （样本均值-μ0）’=(-2003.23 2.25-1006.112.7112.01) 协方差矩阵(降维——因子剖析——抽取) Inter-ItemCovarianceMatrix 人均GDP(元）三产比重（%）人均消费(元）人口增长(%) 文盲半文盲（%) 人均GDP(元） 1020190.840 582.460 331693.531 -599.784 -6356.325 三产比重（%） 582.460 19.480 -105.464 6.625 43.697 人均消费(元） 331693.531 -105.464 125364.321 -213.634 -3130.038 人口增长(%) -599.784 6.625 -213.634 6.099 25.410 文盲半文盲（%) -6356.325 43.69