- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
单因素方差分析 什么是方差分析? 检验多个总体均值是否相等 通过对各观察数据误差来源的分析来判断多个总体均值是否相等 什么是方差分析? (一个例子) 什么是方差分析? (例子的进一步分析) 检验饮料的颜色对销售量是否有影响,也就是检验四种颜色饮料的平均销售量是否相同 设?1为无色饮料的平均销售量,?2粉色饮料的平均销售量,?3为橘黄色饮料的平均销售量,?4为绿色饮料的平均销售量,也就是检验下面的假设 H0: ?1 ? ?2 ? ?3 ? ?4 H1: ?1 , ?2 , ?3 , ?4 不全相等 检验上述假设所采用的方法就是方差分析 方差分析的基本思想和原理(几个基本概念) 因素或因子 所要检验的对象称为因子 要分析饮料的颜色对销售量是否有影响,颜色是要检验的因素或因子 水平 因素的具体表现称为水平 A1、A2、A3、 A4四种颜色就是因素的水平 观察值 在每个因素水平下得到的样本值 每种颜色饮料的销售量就是观察值 方差分析的基本思想和原理(几个基本概念) 试验 这里只涉及一个因素,因此称为单因素四水平的试验 总体 因素的每一个水平可以看作是一个总体 比如A1、A2、A3、 A4四种颜色可以看作是四个总体 样本数据 上面的数据可以看作是从这四个总体中抽取的样本数据 单因素方差分析的数据结构 方差分析中的基本假定 每个总体都应服从正态分布 对于因素的每一个水平,其观察值是来自服从正态分布总体的简单随机样本 比如,每种颜色饮料的销售量必需服从正态分布 各个总体的方差必须相同 对于各组观察数据,是从具有相同方差的总体中抽取的 比如,四种颜色饮料的销售量的方差都相同 观察值是独立的 比如,每个超市的销售量都与其他超市的销售量独立 方差分析中的基本假定 在上述假定条件下,判断颜色对销售量是否有显著影响,实际上也就是检验具有同方差的四个正态总体的均值是否相等的问题 如果四个总体的均值相等,可以期望四个样本的均值也会很接近 四个样本的均值越接近,我们推断四个总体均值相等的证据也就越充分 样本均值越不同,我们推断总体均值不同的证据就越充分 提出假设 一般提法 H0: m1 = m2 =…= mk (因素有k个水平) H1: m1 ,m2 ,… ,mk不全相等 对前面的例子 H0: m1 = m2 = m3 = m4 颜色对销售量没有影响 H0: m1 ,m2 ,m3, m4不全相等 颜色对销售量有影响 方差分析的基本思想和原理(两类方差) 组内方差 因素的同一水平(同一个总体)下样本数据的方差 比如,无色饮料A1在5家超市销售数量的方差 组内方差只包含随机误差 组间方差 因素的不同水平(不同总体)下各样本之间的方差 比如,A1、A2、A3、A4四种颜色饮料销售量之间的方差 组间方差既包括随机误差,也包括系统误差 构造检验的统计量(计算水平的均值 ) 假定从第i个总体中抽取一个容量为ni的简单随机样本,第i个总体的样本均值为该样本的全部观察值总和除以观察值的个数 计算公式为 构造检验的统计量(计算全部观察值的总均值 ) 全部观察值的总和除以观察值的总个数 计算公式为 构造检验的统计量(前例计算结果 ) 构造检验的统计量(计算总离差平方和 SST) 全部观察值 与总平均值 的离差平方和 反映全部观察值的离散状况 其计算公式为 构造检验的统计量(计算组内误差项平方和 SSE) 每个水平或组的各样本数据与其组平均值的离差平方和 反映每个样本各观察值的离散状况,又称组内离差平方和 该平方和反映的是随机误差的大小 计算公式为 构造检验的统计量(计算组间误差项平方和 SSA) 各组平均值 与总平均值 的离差平方和 反映各总体的样本均值之间的差异程度,又称组间平方和 该平方和既包括随机误差,也包括系统误差 计算公式为 构造检验的统计量(三个平方和的关系) ?总离差平方和(SST)、误差项离差平方和(SSE)、水平项离差平方和 (SSA) 之间的关系 构造检验的统计量(三个平方和的作用) SST反映了全部数据总的误差程度;SSE反映了随机误差的大小;SSA反映了随机误差和系统误差的大小 如果原假设成立,即H1= H2 =…= Hk为真,则表明没有系统误差,组间平方和SSA除以自由度后的均方与组内平方和SSE和除以自由度后的均方差异就不会太大;如果组间均方显著地大于组内均方,说明各水平(总体)之间的差异不仅有随机误差,还有系统误差 判断因素的水平是否对其观察值有影响,实际上就是比较组间方差与组内方差之间差异的大小 为检验这种差异,需要构造一个用于检验的统计量 构造检验的统计量(计算均方 MS) 各离差平方和的大小与观察值的多少有关,为了消
文档评论(0)