回归分析小结.ppt

  1. 1、本文档共16页,可阅读全部内容。
  2. 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
  3. 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  4. 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
查看更多
比《数学3》中“回归”增加的内容 数学3——统计 画散点图 了解最小二乘法的思想 求回归直线方程 y=bx+a 用回归直线方程解决应用问题 选修1-2——统计案例 引入线性回归模型 y=bx+a+e 了解模型中随机误差项e产生的原因 了解相关指数 R2 和模型拟合的效果之间的关系 了解残差图的作用 利用线性回归模型解决一类非线性回归问题 正确理解分析方法与结果 * * * * * * 温故知新 两个变量的关系 不相关 相关关系 函数关系 线性相关 非线性相关 函数关系中的两个变量间是一种确定性关系。 相关关系是一种非确定性关系。 相关系数r 相关关系的测度 (相关系数取值及其意义) -1.0 +1.0 0 -0.5 +0.5 完全负相关 无线性相关 完全正相关 负相关程度增加 r 正相关程度增加 1、线性回归模型:y=bx+a+e 其中a和b为模型的未知参数,e称为随机误差。 2、数据点和它在回归直线上相应位置的差异 是随机误差的效应,称 为残差。 3、对每名女大学生计算这个差异,然后分别将所得的值平方后加起来,用数学符号表示为: 称为残差平方和,它代表了随机误差的效应。 在研究两个变量间的关系时,首先要根据散点图来粗略判断它们是否线性相关,是否可以用回归模型来拟合数据。 4、残差分析与残差图的定义: 然后,我们可以通过残差 来判断模型拟合的效果,判断原始数据中是否存在可疑数据,这方面的分析工作称为残差分析。 我们可以利用图形来分析残差特性,作图时纵坐标为残差,横坐标可以选为样本编号,或身高数据,或体重估计值等,这样作出的图形称为残差图。 我们可以用相关指数R2来刻画回归的效果,其计算公式是: R2 ?1,说明回归方程拟合的越好;R2?0,说明回归方程拟合的越差。 残差平方和 总偏差平方和 回归平方和 = + 解析变量和随机误差的总效应(总偏差平方和) =解析变量的效应(回归平方和)+随机误差的效应(残差平方和) 显然,R2的值越大,说明残差平方和越小,也就是说模型拟合效果越好。 R2越接近1,表示回归的效果越好(因为R2越接近1,表示解析变量和预报变量的线性相关性越强)。 如果某组数据可能采取几种不同回归方程进行回归分析,则可以通过比较R2的值来做出选择,即选取R2较大的模型作为这组数据的模型。 总的来说: 相关指数R2是度量模型拟合效果的一种指标。 在线性模型中,它代表自变量刻画预报变量的能力。 我们可以用相关指数R2来刻画回归的效果,其计算公式是: 一般地,建立回归模型的基本步骤为: (1)确定研究对象,明确哪个变量是解析变量,哪个变量是预报变量。 (2)画出确定好的解析变量和预报变量的散点图,观察它们之间的关系(如是否存在线性关系等)。 (3)由经验确定回归方程的类型(如我们观察到数据呈线性关系,则选用线性回归方程y=bx+a). (4)按一定规则估计回归方程中的参数(如最小二乘法)。 (5)得出结果后分析残差图是否有异常(个别数据对应残差过大,或残差呈现不随机的规律性,等等),过存在异常,则检查数据是否有误,或模型是否合适等。 案例2 一只红铃虫的产卵数y和温度x有关。现收集了7组观测数据列于表中: (1)试建立产卵数y与温度x之间的回归方程;并预测温度为28oC时产卵数目。 (2)你所建立的模型中温度在多大程度上解释了产卵数的变化? 温度xoC 21 23 25 27 29 32 35 产卵数y/个 7 11 21 24 66 115 325 非线性回归问题 y=bx2+a 变换 y=bt+a 非线性关系 线性关系 方案2 问题1 选用y=bx2+a ,还是y=bx2+cx+a ? 问题3 产卵数 气温 问题2 如何求a、b ? 合作探究 t=x2 二次函数模型 假设线性回归方程为 :?=bx+a 选 模 型 由计算器得:线性回归方程为y=19.87x-463.73 相关指数R2=r2≈0.8642=0.7464 估计参数 解:选取气温为解释变量x,产卵数 为预报变量y。 选变量 所以,二次函数模型中温度解释了74.64%的产卵数变化。 探索新知 画散点图 0 50

文档评论(0)

bsy12345 + 关注
实名认证
内容提供者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档