2多元线性回归教材.pptVIP

  1. 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
  2. 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  3. 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  4. 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  5. 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  6. 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  7. 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
* * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * * August 2, 2010 在回归中引进虚拟变量 (例题分析) 【例】为研究考试成绩与性别之间的关系,从某大学商学院随机抽取男女学生各8名,得到他们的市场营销学课程的考试成绩如右表 9.5.2 含有一个虚拟自变量的回归 9.5 虚拟自变量的回归 August 2, 2010 在回归中引进虚拟变量 (例题分析) 【例】建立考试分数与性别之间的线性回归方程,并解释回归系数的含义 用Excel进行回归 August 2, 2010 虚拟自变量的回归 (例题分析) 引进虚拟变量时,回归方程表示为E(y)=?0+?1x 男(x=0):E(y)=?0—男学生考试成绩的期望值 女(x=1):E(y)=?0+?1—女学生考试成绩的期望值 注意:当指定虚拟变量0,1时 ?0总是代表与虚拟变量值0所对应的那个分类变量水平的平均值 ?1总是代表与虚拟变量值1所对应的那个分类变量水平的平均响应与虚拟变量值0所对应的那个分类变量水平的平均值的差值,即 平均值的差值 =(?0+ ?1) - ?0= ?1 August 2, 2010 虚拟自变量的回归 (例题分析) 考试成绩与性别的回归 男学生考试分数的平均值 女学生与男学生平均考试分数的差值 August 2, 2010 虚拟自变量的回归 (考试成绩与性别的散点图) 男 女 August 2, 2010 虚拟自变量的回归 (例题分析) 【例】为研究工资水平与工作年限和性别之间的关系,在某行业中随机抽取10名职工,所得数据如右表 用Excel进行回归 August 2, 2010 虚拟自变量的回归 (例题分析) 引进虚拟变量时,回归方程写为 E(y) =?0+ ?1x1+ ?2x2 女(x2=0):E(y|女性)=?0+?1x1 男(x2=1):E(y|男性)=(?0+?2)+?1x1 ?0的含义表示:女性职工的期望月工资收入 (?0+?2)的含义表示:男性职工的期望月工资收入 ?1含义表示:工作年限每增加1年,男性或女性工资的平均增加值 ?2含义表示:男性职工的期望月工资收入与女性职工的期望月工资收入之间的差值 (?0+?2)-?0=?2 结 束 * * * * * * * * * * * * * * * * * * * * * * * August 2, 2010 变量选择过程 在建立回归模型时,对自变量进行筛选 选择自变量的原则是对统计量进行显著性检验 将一个或一个以上的自变量引入到回归模型中时,是否使得残差平方和(SSE)有显著地减少。 确定引入自变量是否使SSE有显著减少的方法,就是使用F统计量的值作为一个标准,以此来确定是在模型中增加一个自变量,还是从模型中剔除一个自变量 变量选择的方法主要有:向前选择、向后剔除、逐步回归、最优子集等 August 2, 2010 向前选择 (forward selection) 从模型中没有自变量开始 对k个自变量分别拟合对因变量的一元线性回归模型,共有k个,然后找出F统计量的值最高的模型及其自变量(P值最小的),并将其首先引入模型 分别拟合引入模型外的k-1个自变量的线性回归模型 如此反复进行,直至模型外的自变量均无统计显著性为止 August 2, 2010 向后剔除 (backward elimination) 先对因变量拟合包括所有k个自变量的回归模型。然后考察p(pk)个去掉一个自变量的模型(这些模型中在每一个都有的k-1个自变量),使模型的SSE值减小最少的自变量被挑选出来并从模型中剔除 考察p-1个再去掉一个自变量的模型(这些模型中每一个都有k-2个的自变量),使模型的SSE值减小最少的自变量被挑选出来并从模型中剔除 如此反复进行,一直将自变量从模型中剔除,直至剔除一个自变量不会使SSE显著减小为止 August 2, 2010 逐步回归 (stepwise regression) 将向前选择和向后剔除两种方法结合起来筛选自变量 在增加了一个自变量后,它会对模型中所有的变量进行考察,看看有没有可能剔除某个自变量。如果在增加了一个自变量后,前面增加的某个自变量对模型的贡献变得不显著,这个变量就会被剔除 按照方法不停地增加变量并考虑剔除以前增加的变量的可能性,直至增加变量已经不能导致SSE显著减少 在前面步骤中增加的自变量在后面的步骤中有可能被剔除,而在前面步骤中剔除的自变量在

文档评论(0)

舞林宝贝 + 关注
实名认证
文档贡献者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档