2015-2016学年高中数学3.1回归的基本思想及其初步应用新人教A版选修2-3答题.pptVIP

2015-2016学年高中数学3.1回归的基本思想及其初步应用新人教A版选修2-3答题.ppt

  1. 1、本文档共86页,可阅读全部内容。
  2. 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
  3. 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  4. 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  5. 5、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  6. 6、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  7. 7、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  8. 8、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
你坐过火车、乘过飞机吗?晕车、晕机与性别有无关系?肺癌是人类的一大杀手,吸烟与患肺癌的关联性究竟有多大?你了解过你们班同学的身高与体重吗,身高与体重是否线性相关?你统计过你们班同学的考试成绩吗,物理成绩的高低与数学成绩关联度有多大?……这些都是统计学研究的内容. 本章我们将要学习独立性检验和回归分析的基本思想、方法.学习本章要注意学习收集、整理、分析数据的方法,体会统计分析的基本思想、建模思想和现代计算技术在统计中的应用,体会统计思维和确定性思维的差异. 通过典型案例的探究,了解回归分析的基本思想、方法及初步应用. 体会统计方法的特点及应用的广泛性,提高对现代计算技术与统计的应用的认识. 重点:线性回归模型及相关概念,用回归分析方法作出推断. 难点:对线性回归模型、残差分析、相关性检验的理解和用相关指数检验模型的拟合效果. 温故知新 请回顾复习在必修3中学过的两个变量的线性相关,回归直线,回归直线方程的求法. 新知导学 1.回归分析是处理两个变量之间__________的一种统计方法.若两个变量之间具有线性相关关系,则称相应的回归分析为________________. 当r0时,表明两个变量__________;当r0时,表明两个变量__________.r的绝对值越接近1,表明两个变量的线性相关性越__________;r的绝对值接近于0时,表明两个变量之间几乎不存在线性相关关系.通常当|r|大于__________时,认为两个变量有很强的线性相关关系. 牛刀小试 1.(2015·武汉市重点中学高二期末)在对两个变量x,y进行线性回归分析时,有下列步骤: ①对所求出的回归直线方程作出解释; ②收集数据(xi,yi),i=1,2,…,n; ③求线性回归方程; ④求相关系数; ⑤根据所搜集的数据绘制散点图. 如果根据可行性要求能够作出变量x,y具有线性相关的结论,则在下列操作顺序中正确的是(  ) A.①②⑤③④    B.③②④⑤① C.②④③①⑤ D.②⑤④③① [答案] D [解析] 对两个变量进行回归分析时, 首先收集数据(xi,yi),i=1,2,…,n;根据所搜集的数据绘制散点图. 观察散点图的形状,判断线性相关关系的强弱, 求相关系数,写出线性回归方程, 最后依据所求出的回归直线方程作出解释; 故正确顺序是②⑤④③① 故选D. 新知导学 4.随机误差 (1)随机误差的概念:当样本点散布在某一条直线的附近,而不是在一条直线上时,不能用一次函数y=bx+a来描述两个变量之间的关系,而是用线性回归模型________________来表示,这里__________称为解释变量,__________称为预报变量,__________称为随机误差,E(e)=__________,D(e)=__________. (2)随机误差及其产生的原因 从散点图中我们可以看到,样本点散布在某一条直线附近,而不是在一条直线上,所以不能用一次函数y=bx+a来描述它们之间的关系,我们用下面的线性回归模型来表示:y=bx+a+e,其中a、b为模型的未知数,e称为随机误差.产生随机误差的主要原因有以下3个方面: ①用线性回归模型近似真实模型(真实模型是客观存在的,通常我们并不知道真实模型是什么)所引起的误差.可能存在非线性的函数能更好地描述y与x之间的关系,但是现在却用线性函数来表述这种关系,结果会产生误差. 这种由模型近似所引起的误差包含在e中. ②忽略了某些因素的影响.影响变量y的因素不只变量x,可能还包括其他许多因素(例如在描述身高和体重关系的模型中,体重不仅受身高的影响,还会受遗传基因、饮食习惯、生长环境等其他因素的影响),它们的影响都体现在e中. ③观测误差.由于测量工具等原因,导致y的观测值产生误差(比如一个人的体重是确定的数,但由于测量工具的影响和测量人技术的影响可能会得到不同的观测值,与真实值之间存在误差),这样的误差也包含在e中. 7.残差分析 (1)在研究两个变量间的关系时,首先要根据散点图来粗略判断它们是否线性相关,是否可以用线性回归模型来拟合数据,然后,通过残差__________________来判断模型拟合的效果,判断原始数据中是否存在可疑数据,这方面的分析工作称为残差分析. (2)在残差图中,如果残差点比较均匀地落在____________ ______中,说明选用的模型比较合适.这样的带状区域的宽度越窄,说明模型拟合精度__________,回归方程的预报精度也__________. 如果图中有某个样本点的残差比较大,需要确认在采集这个样本点的过程中是否有人为的错误.如果数据采集有错误,就予以纠正,然后再重新利用线性回归模型拟合数据;如果数据采集没有错误,则需要寻找其他的原因. R2的值

您可能关注的文档

文档评论(0)

希望之星 + 关注
实名认证
文档贡献者

我是一名原创力文库的爱好者!从事自由职业!

1亿VIP精品文档

相关文档