第十二章线性回归分析概要.ppt

  1. 1、本文档共50页,可阅读全部内容。
  2. 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
  3. 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  4. 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
查看更多
第十二章线性回归分析概要

第十二章 线性回归分析 双变量计量资料:每个个体有两个变量值 总体:无限或有限对变量值 样本:从总体随机抽取的n对变量值 (X1,Y1), (X2,Y2), …, (Xn,Yn) 目的:研究X和Y的数量关系 方法:回归与相关 简单、基本——直线回归、直线相关 英国人类学家 F.Galton首次在《自然遗传》一书中,提出并阐明了“相关”和“相关系数”两个概念,为相关论奠定了基础。其后,他和英国统计学家 Karl Pearson对上千个家庭的身高、臂长、拃长(伸开大拇指与中指两端的最大长度)做了测量,发现: 儿子身高(Y,英寸)与父亲身高(X,英寸)存在线性关系: 。 也即高个子父代的子代在成年之后的身高平均来说不是更高,而是稍矮于其父代水平,而矮个子父代的子代的平均身高不是更矮,而是稍高于其父代水平。Galton将这种趋向于种族稳定的现象称之“回归”。 目前,“回归”已成为表示变量之间某种数量依存关系的统计学术语,并且衍生出“回归方程”“回归系数”等统计学概念。如研究糖尿病人血糖与其胰岛素水平的关系,研究儿童年龄与体重的关系等。 第一节 两相关变量的散点图 一、直线回归的概念 目的:研究应变量Y对自变量X的数量依 存关系。 特点:统计关系。 X值和Y的均数的关系, 不同于一般数学上的X 和Y的函数 关系。 为了直观地说明两相关变量的线性依存关系,用表12-1第(2)、(3)列中大白鼠的进食量和体重增加量的数据在坐标纸上描点,得图12-1所示的散点图(scatter plot)。 例12-1 用某饲料喂养12只大白鼠,得出大白鼠的进食量与体重增加量如表12-1,试绘制其散点图。 表12-1 12只大白鼠的进食量(g)与体重增加量(g)测量结果 在定量描述大白鼠进食量与体重增加量数量上的依存关系时,习惯上将进食量作为自变量(independent variable),用X表示;体重增加量作为应变量(dependent variable),用Y表示。 由图12-1可见,体重增加量有随进食量增加而增大的趋势,且散点呈直线趋势,但并非12个点都在直线上 ,此与两变量间严格的直线函数关系不同,称为直线回归(linear regression),其方程叫直线回归方程,以区别严格意义的直线方程。 回归是回归分析中最基本、最简单的一种,故又称简单回归。 第二节 回归方程 二、直线回归方程的求法 残差(residual)或剩余值,即实测值Y与假定回归线上的估计值 的纵向距离 。 求解a、b实际上就是“合理地”找到一条能最好地代表数据点分布趋势的直线。 此直线必然通过点( , )且与纵坐标轴相交于截距 。如果散点图没有从坐标系原点开始,可在自变量实测范围内远端取易于读数的 值代入回归方程得到一个点的坐标,连接此点与点( , )也可绘出回归直线。 第三节 回归系数的假设检验 建立样本直线回归方程,只是完成了统计分析中两变量关系的统计描述,研究者还须回答它所来自的总体的直线回归关系是否确实存在,即是否对总体有 ? 二、 的区间估计 是指总体中当X为一定值时的均数。是波动的,当把 代入回归方程所求得的估计值,为样本条件均数(condition mean),对总体 的估计可计算可信区间,其标准误可按公式计算。 三、个体Y值的容许区间 计算出个体Y值的95%容许区间为 第五节 回归方程的应用 一、线性回归的主要用途 1.研究因素间的依存关系 自变量和应变量之间是否存在线性关系,即研究一个或多个自变量对应变量的作用,或者应变量依赖自变量变化而变化的规律。 2.估计与预测 可用易测定的一组给定的自变量的观测值来推算较难测定的Y值 。 3.统计控制 是利用回归方程进行逆估计,即应变量Y给出一个确定的值或在一定范围内波动时,通过控制自变量的取值来实现 。 二、线性回归应用的注意事项 1.在进行直线回归分析之前,应绘制散点图。 2.作回归分析时,要注意两变量间是否存在实际意义。 3.两变量间存在直线关系时,不一定表明彼此之间就存在因果关系。 4.建立回

文档评论(0)

yaocen + 关注
实名认证
内容提供者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档