- 1、本文档共31页,可阅读全部内容。
- 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
回归分析(二)wxs
郑平正 制作 比《数学3》中“回归”增加的内容 数学3——统计 画散点图 了解最小二乘法的思想 求回归直线方程 y=bx+a 用回归直线方程解决应用问题 选修1-2——统计案例 引入线性回归模型 y=bx+a+e 了解模型中随机误差项e产生的原因 了解相关指数 R2 和模型拟合的效果之间的关系 了解残差图的作用 利用线性回归模型解决一类非线性回归问题 正确理解分析方法与结果 三个平方和的意义 离差平方和的分解 (三个平方和的意义) 总偏差平方和(SST) 反映因变量的 n 个观察值与其均值的总离差 回归平方和(SSR) 反映自变量 x 的变化对因变量 y 取值变化的影响,或者说,是由于 x 与 y 之间的线性关系引起的 y 的取值变化,也称为可解释的平方和 残差平方和(SSE) 反映除 x 以外的其他因素对 y 取值的影响,也称为不可解释的平方和或剩余平方和 样本决定系数 (判定系数 r2 ) 回归平方和占总离差平方和的比例 * * * * * 3.1回归分析的基本思想及其初步应用(二) 高二数学 选修2-3 整体的线性回归直线方程记为: 现实中体重与身高的关系为: 样本的线性回归直线方程记为: 和 为截距和斜率的估计值,它们与真实值a和b之间存在误差是引起预报值 与真实值y之间的误差的另一个原因. 随机误差e是引起预报值 与真实值y之间误差的原因之一,随机误差的方差越小,预报的精度越高. 其中a和b为模型的未知参数,e是y与 之间的误差,通常e为随机变量,称为随机误差. 其中:均值E(e)=0,方差D(e)=σ20 线性回归模型的完整表达式为: 线性回归模型适用范围比一次函数的适用范围大得多.当随机误差e恒等于0时,线性回归模型就变成一次函数模型.即:一次函数模型是线性回归模型的特殊形式,线性回归模型是一次函数模型的一般形式. 四、线性回归模型 函数模型与回归模型之间的差别 函数模型: 回归模型: 线性回归模型y=bx+a+e增加了随机误差项e,因变量y的值由自变 量x和随机误差项e共同确定,即自变量x只能解释部分y的变化。 在统计中,我们也把自变量x称为解释变量,因变量y称为预报变量。 思考: 产生随机误差项e的原因是什么? 随机误差e的来源(可以推广到一般): 1、用线性回归模型近似真实模型所引起的误差; 2、忽略了其它因素的影响:影响身高 y 的因素不只是体重 x,可能还包括遗传基因、饮食习惯、生长环境等因素; 3、身高 y 的观测误差。 以上三项误差越小,则回归模型的拟合效果越好. 随机误差e的主要来源: (1)用线性回归模型近似真实模型(真实模型是客观存在的,但我们并不知道到底是什么)所引起的误差.可能存在非线性的函数能更好的描述y与x之间的关系,但我们现在却用线性函数来表述这种关系,结果就产生误差,这种由于模型近似所引起的误差包含在e中. (2)忽略了某些因素的影响.影响变量y的因素不止变量x一个,可能还有其他因素,但通常它们每一个因素的影响可能都比较小,它们的影响都体现在e中. (3)观测误差.由于测量工具等原因,得到的y的观测值一般是有误差的,这样的误差也包含在e中. 以上三项误差越小,则回归模型的拟合效果越好. 随机误差 e的估计量 样本点: 相应的随机误差为: 随机误差的估计值为: 称为相应于点 的残差. 的估计量 为 称为残差平方和. 在线性回归模型中,e是用 预报真实值y的误差,它是一个不可观测的量,那么该怎样研究随机误差,如何衡量预报的精度? 由于随机误差e的均值为0,故采用方差 来衡量随机误差的大小. 残差 与残差平方和 的作用: 1.用 衡量回归直线的预报精确值, 即用 衡量回归直线的预报精确值: 越小,预报精度越高,反之越底; 2.利用残差来分析可疑数据(残差分析); 在研究两个变量间的关系时,首先要根据散点图来粗略判断它们是否是线性相关,是否可以用线性回归模型来拟合数据.然后,可以通过残差 来判断模型拟合的效果,判断原始数据中是否存在可疑数据.这方面的分析工作称为残差分析. 五、残差分析 0.382 -2.883 6.627 1.137 -4.618 2.419 2.627 -6.373 残差 59 43 61 64 54 50 57 48 体重/kg 170 155 165 175 170 157 165 165 身高/cm 8 7 6 5 4 3 2 1 编号 下表为女大学生身高和体重的原始数据以及相应的残差数据: ? e 以纵坐标为残差,横坐标为编
您可能关注的文档
- 高考代词知识清单.doc
- 毕业设计开题报告书薛东华.doc
- 人教案四年级下册数学教案第二单元位置与方向.doc
- 流体传动与控制第三次作业答案.doc
- 2011级《综合英语1》期末考试A卷-答案及评分标准.doc
- 2011年福建省普通高中学生学业基础会考模拟四.doc
- 计算机与IT入门(实践课Lab2).ppt
- 25ND.QEOP-J-05数据分析与应用控制程序E0(09.6.21).doc
- 世界的海陆分布说课稿2013.doc
- 2013福建高考政治必考纲必修三.doc
- 2023年陕西省商洛市柞水县两河乡招聘社区工作者真题参考答案详解.docx
- 2023年陕西省延安市宝塔区青化砭镇招聘社区工作者真题参考答案详解.docx
- 2023年陕西省汉中市西乡县罗镇乡招聘社区工作者真题及参考答案详解.docx
- 2023年陕西省延安市洛川县永乡招聘社区工作者真题及答案详解1套.docx
- 2023年陕西省商洛市商州区三岔河乡招聘社区工作者真题及参考答案详解一套.docx
- 2023年陕西省宝鸡市陇县八渡镇招聘社区工作者真题及参考答案详解一套.docx
- 2023年陕西省延安市洛川县石泉乡招聘社区工作者真题及参考答案详解一套.docx
- 2023年陕西省商洛市商州区沙河子镇招聘社区工作者真题附答案详解.docx
- 2023年陕西省咸阳市礼泉县赵镇招聘社区工作者真题及参考答案详解1套.docx
- 2023年陕西省商洛市丹凤县留仙坪乡招聘社区工作者真题及参考答案详解一套.docx
文档评论(0)