- 1、本文档共86页,可阅读全部内容。
- 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
- 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
你坐过火车、乘过飞机吗?晕车、晕机与性别有无关系?肺癌是人类的一大杀手,吸烟与患肺癌的关联性究竟有多大?你了解过你们班同学的身高与体重吗,身高与体重是否线性相关?你统计过你们班同学的考试成绩吗,物理成绩的高低与数学成绩关联度有多大?……这些都是统计学研究的内容. 本章我们将要学习独立性检验和回归分析的基本思想、方法.学习本章要注意学习收集、整理、分析数据的方法,体会统计分析的基本思想、建模思想和现代计算技术在统计中的应用,体会统计思维和确定性思维的差异. 通过典型案例的探究,了解回归分析的基本思想、方法及初步应用. 体会统计方法的特点及应用的广泛性,提高对现代计算技术与统计的应用的认识. 重点:线性回归模型及相关概念,用回归分析方法作出推断. 难点:对线性回归模型、残差分析、相关性检验的理解和用相关指数检验模型的拟合效果. 温故知新 请回顾复习在必修3中学过的两个变量的线性相关,回归直线,回归直线方程的求法. 新知导学 1.回归分析是处理两个变量之间__________的一种统计方法.若两个变量之间具有线性相关关系,则称相应的回归分析为________________. 当r0时,表明两个变量__________;当r0时,表明两个变量__________.r的绝对值越接近1,表明两个变量的线性相关性越__________;r的绝对值接近于0时,表明两个变量之间几乎不存在线性相关关系.通常当|r|大于__________时,认为两个变量有很强的线性相关关系. 牛刀小试 1.(2015·武汉市重点中学高二期末)在对两个变量x,y进行线性回归分析时,有下列步骤: ①对所求出的回归直线方程作出解释; ②收集数据(xi,yi),i=1,2,…,n; ③求线性回归方程; ④求相关系数; ⑤根据所搜集的数据绘制散点图. 如果根据可行性要求能够作出变量x,y具有线性相关的结论,则在下列操作顺序中正确的是( ) A.①②⑤③④ B.③②④⑤① C.②④③①⑤ D.②⑤④③① [答案] D [解析] 对两个变量进行回归分析时, 首先收集数据(xi,yi),i=1,2,…,n;根据所搜集的数据绘制散点图. 观察散点图的形状,判断线性相关关系的强弱, 求相关系数,写出线性回归方程, 最后依据所求出的回归直线方程作出解释; 故正确顺序是②⑤④③① 故选D. 新知导学 4.随机误差 (1)随机误差的概念:当样本点散布在某一条直线的附近,而不是在一条直线上时,不能用一次函数y=bx+a来描述两个变量之间的关系,而是用线性回归模型________________来表示,这里__________称为解释变量,__________称为预报变量,__________称为随机误差,E(e)=__________,D(e)=__________. (2)随机误差及其产生的原因 从散点图中我们可以看到,样本点散布在某一条直线附近,而不是在一条直线上,所以不能用一次函数y=bx+a来描述它们之间的关系,我们用下面的线性回归模型来表示:y=bx+a+e,其中a、b为模型的未知数,e称为随机误差.产生随机误差的主要原因有以下3个方面: ①用线性回归模型近似真实模型(真实模型是客观存在的,通常我们并不知道真实模型是什么)所引起的误差.可能存在非线性的函数能更好地描述y与x之间的关系,但是现在却用线性函数来表述这种关系,结果会产生误差. 这种由模型近似所引起的误差包含在e中. ②忽略了某些因素的影响.影响变量y的因素不只变量x,可能还包括其他许多因素(例如在描述身高和体重关系的模型中,体重不仅受身高的影响,还会受遗传基因、饮食习惯、生长环境等其他因素的影响),它们的影响都体现在e中. ③观测误差.由于测量工具等原因,导致y的观测值产生误差(比如一个人的体重是确定的数,但由于测量工具的影响和测量人技术的影响可能会得到不同的观测值,与真实值之间存在误差),这样的误差也包含在e中. 7.残差分析 (1)在研究两个变量间的关系时,首先要根据散点图来粗略判断它们是否线性相关,是否可以用线性回归模型来拟合数据,然后,通过残差__________________来判断模型拟合的效果,判断原始数据中是否存在可疑数据,这方面的分析工作称为残差分析. (2)在残差图中,如果残差点比较均匀地落在____________ ______中,说明选用的模型比较合适.这样的带状区域的宽度越窄,说明模型拟合精度__________,回归方程的预报精度也__________. 如果图中有某个样本点的残差比较大,需要确认在采集这个样本点的过程中是否有人为的错误.如果数据采集有错误,就予以纠正,然后再重新利用线性回归模型拟合数据;如果数据采集没有错误,则需要寻找其他的原因. R2的值
您可能关注的文档
- 8.1《咏雪》答题.ppt
- 016.易信互联网社交媒体产品答题.ppt
- 6第5章并行接口P0~P3和单片机的中断系统答题.ppt
- 6第6章财务与预测答题.ppt
- 16.1分子热运动答题.ppt
- 8.1《中东》答题.ppt
- 2015-2016学年高中化学第四章第4节金属的电化学腐蚀和防护新人教版选修4答题.ppt
- 8.1二战后资本主义世界经济体系的形成(人民版)答题.ppt
- 2015-2016学年高中化学第一章从实验学化学章末复习提升课新人教版必修1答题.ppt
- 8.1二战后资本主义世界经济体系的形成答题.ppt
- 基于人工智能教育平台的移动应用开发,探讨跨平台兼容性影响因素及优化策略教学研究课题报告.docx
- 高中生物实验:城市热岛效应对城市生态系统服务功能的影响机制教学研究课题报告.docx
- 信息技术行业信息安全法律法规研究及政策建议教学研究课题报告.docx
- 人工智能视角下区域教育评价改革:利益相关者互动与政策支持研究教学研究课题报告.docx
- 6 《垃圾填埋场渗滤液处理与土地资源化利用研究》教学研究课题报告.docx
- 小学音乐与美术教师跨学科协作模式构建:人工智能技术助力教学创新教学研究课题报告.docx
- 《航空航天3D打印技术对航空器装配工艺的创新与效率提升》教学研究课题报告.docx
- 教育扶贫精准化策略研究:人工智能技术在区域教育中的应用与创新教学研究课题报告.docx
- 《区块链技术在电子政务电子档案管理中的数据完整性保障与优化》教学研究课题报告.docx
- 《中医护理情志疗法对癌症患者心理状态和生活质量提升的长期追踪研究》教学研究课题报告.docx
文档评论(0)