.方差分析.pptVIP

  • 9
  • 0
  • 约1.18万字
  • 约 95页
  • 2017-09-08 发布于湖北
  • 举报
6.方差分析

方差分析 1 方差分析的引论 2 单因素方差分析 3 方差分析中的多重比较 4 多因素方差分析 5 试验设计 方差分析及其有关术语 什么是方差分析(ANOVA)? (analysis of variance) 检验多个总体均值是否相等 通过分析数据的误差判断各总体均值是否相等 有单因素方差分析和双因素方差分析 单因素方差分析:涉及一个分类的自变量 双因素方差分析:涉及两个分类的自变量 什么是方差分析? (例题分析) 什么是方差分析? (例题分析) 分析四个行业之间的服务质量是否有显著差异,也就是要判断“行业”对“投诉次数”是否有显著影响 作出这种判断最终被归结为检验这四个行业被投诉次数的均值是否相等 若它们的均值相等,则意味着“行业”对投诉次数是没有影响的,即它们之间的服务质量没有显著差异;若均值不全相等,则意味着“行业”对投诉次数是有影响的,它们之间的服务质量有显著差异 为什么要使用方差分析 1、效率高:与前面介绍的假设检验相比,方差分析可以提高检验效率。 2、犯错误率低:同时考虑所有的样本,因此排除了错误累计的概率,从而避免拒绝了一个真实的原假设。 方差分析中的有关术语 因素或因子(factor) 所要检验的对象 要分析行业对投诉次数是否有影响,行业是要检验的因素或因子 水平或处理(treatment) 因子的不同表现 零售业、旅游业、航空公司、家电制造业就是因子的水平 观察值 在每个因素的水平下得到的样本数据 每个行业被投诉的次数就是观察值 方差分析中的有关术语 4、变量 分类型变量:即自变量,如上例中的行业。 数值型变量:即因变量,如上例中的被投诉次数 当研究分类型自变量对数值型因变量的影响时,所用的方法就是方差分析法,上例中也就是“行业”对“被投诉次数”的影响。 例题分析 方差分析的基本思想和原理 方差分析的基本思想和原理 (图形分析) 方差分析的基本思想和原理 (图形分析结果) 从散点图上可以看出 不同行业被投诉的次数是有明显差异的 同一个行业,不同企业被投诉的次数也明显不同 家电制造被投诉的次数较高,航空公司被投诉的次数较低 行业与被投诉次数之间有一定的关系 如果行业与被投诉次数之间没有关系,那么它们被投诉的次数应该差不多相同,在散点图上所呈现的模式也就应该很接近 方差分析的基本思想和原理 图形分析的不足 仅从散点图上观察还不能提供充分的证据证明不同行业被投诉的次数之间有显著差异 这种差异也可能是由于抽样的随机性所造成的 需要有更准确的方法来检验这种差异是否显著,也就是进行方差分析 所以叫方差分析,因为虽然我们感兴趣的是均值,但在判断均值之间是否有差异时则需要借助于方差 这个名字也表示:它是通过对数据误差来源的分析判断不同总体的均值是否相等。因此,进行方差分析时,需要考察数据误差的来源 方差分析的基本思想和原理 (两类误差) 随机误差 因素的同一水平(总体)下,样本各观察值之间的差异 比如,同一行业下不同企业被投诉次数是不同的 这种差异可以看成是随机因素的影响,称为随机误差 系统误差 因素的不同水平(不同总体)下,各观察值之间的差异 比如,不同行业之间的被投诉次数之间的差异 这种差异可能是由于抽样的随机性所造成的,也可能是由于行业本身所造成的,后者所形成的误差是由系统性因素造成的,称为系统误差 方差分析的基本思想和原理 1. 比较两类误差,以检验均值是否相等 2. 如果系统(处理)误差明显地不同于随机误差,则均值就是不相等的;反之,均值就是相等的,比如行业之间的系统误差明显大于行业内部的随机误差,即认为行业之间的投诉次数的均值是不相等的,行业之间的服务质量有显著性差异 3. 误差是由各部分的误差占总误差的比例来测度的 方差分析的基本思想和原理 (误差平方和) 数据的误差总平方和(sum of squares)表示 组内平方和(within groups) 因素的同一水平(同一个总体)下样本数据的误差平方和 比如,零售业被投诉次数的误差平方和 组内平方和只包含随机误差 组间平方和(between groups) 因素的不同水平(不同总体)下各样本之间的误差平方和 比如,四个行业被投诉次数之间的误差平方和 组间平方和既包括随机误差,也包括系统误差 利用误差进行判断 1、显然,组内误差只包含随机误差,而组间误差即包括随机误差也包含系统误差。 2、如果不同行业对被投诉次数没有影响,那么在组间误差中就只包含随机误差,而没有系统误差。这时,组间误差与组内误差经过平均后的数值应该很接近,即接近1。反之,系统误差越大,组间误差也就越大,他们之间的比之就会大于1。 3、因此,判断行业对被投诉次数是否有显著影响这一问题,实践上也就是检验被投诉的差异主要是由什么原因引起。如果这种差异主要是系统误差,则不

文档评论(0)

1亿VIP精品文档

相关文档