- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
查看更多
第12章; Content
1. Linear regression
2. Linear correlation
3. Rank correlation
4. Curve fitting
;双变量计量资料:每个个体有两个变量值
总体:无限或有限对变量值
样本:从总体随机抽取的n对变量值
(X1,Y1), (X2,Y2), …, (Xn,Yn)
目的:研究X和Y的数量关系
方法:回归与相关
简单、基本——直线回归、直线相关; ; 儿子身高(Y,英寸)与父亲身高(X,英寸)存在线性关系: 。
也即高个子父代的子代在成年之后的身高平均来说不是更高,而是稍矮于其父代水平,而矮个子父代的子代的平均身高不是更矮,而是稍高于其父代水平。Galton将这种趋向于种族稳定的现象称之“回归”。
;第一节 直线回归;一、直线回归的概念 ; 为了直观地说明两相关变量的线性依存关系,用表12-1第(2)、(3)列中大白鼠的进食量和体重增加量的数据在坐标纸上描点,得图12-1所示的散点图(scatter plot)。 ; 例12-1 用某饲料喂养12只大白鼠,得出大白鼠的进食量与体重增加量如表12-1,试绘制其散点图。 ;表12-1 12只大白鼠的进食量(g)与体重增加量(g)测量结果 ;; 在定量描述大白鼠进食量与体重增加量数量上的依存关系时,习惯上将进食量作为自变量(independent variable),用X表示;体重增加量作为应变量(dependent variable),用Y表示。 ; 由图12-1可见,体重增加量有随进食量增加而增大的趋势,且散点呈直线趋势,但并非12个点都在直线上 ,此与两变量间严格的直线函数关系不同,称为直线回归(linear regression),其方程叫直线回归方程,以区别严格意义的直线方程。
回归是回归分析中最基本、最简单的一种,故又称简单回归。
;直线回归方程;1.a 为回归直线在 Y 轴上的截距。;b0,直线从左下方走向右上方,Y 随 X 增大而增大;
b0,直线从左上方走向右下方,Y 随 X 增大而减小;
b=0,表示直线与 X 轴平行,X 与Y 无直线关系。;二、直线回归方程的求法 ; ;; 例12-2 (续例12-1)根据表12-1数据,对大白鼠的体重增加量进行回归分析。 ;解题步骤;; 此直线必然通过点( , )且与纵坐标轴相交于截距 a 。如果散点图没有从坐标系原点开始,可在自变量实测范围内远端取易于读数的 X 值代入回归方程得到一个点的坐标,连接此点与点( , )也可绘出回归直线。 ;二 直线回归中的统计推断; 建立样本直线回归方程,只是完成了统计分析中两变量关系的统计描述,研究者还须回答它所来自的总体的直线回归关系是否确实存在,即是否对总体有 ?;1.1回归系数的方差分析 ;;数理统计可证明:
;上式用符号表示为 ;;上述三个平方和,各有其相应的自由度 ,并有如下的关系: ; 如果两变量间总体回归关系确实存在,回归的贡献就要大于随机误差,大到何种程度时可以认为具有统计意义,可计算统计量F:
;式中
;2. t 检验;例12-3 (续例12-1)根据表12-1数据进行回归系数的方差分析。
解:先列出下列计算结果;;(3)确定P值。查F界值表,P0.001。;t 检验方法;注意:; (二)回归方程可信区间与预测
一、总体回归系数的区间估计
;例12-5 (续例12-1)试估计总体回归系数的95%的可信区间。;二、 的区间估计; 对一已知的自变量值 按回归方程求出预测值 ,再按下式求出此条件下100(1- )%的可信区间。;例12-6 (续例12-1) 根据例12-2所求直线回归方程,试计算当 时, 95%的可信区间。;本例;个体Y值的容许区间;个体Y值的 容许区间按下式计算。 ;计算出个体Y值的95%容许区间为;回归方程的应用 ; 一、线性回归的主要用途
1.研究因素间的依存关系 自变量和应变量之间是否存在线性关系,或者应变量依赖自变量变化而变化的规律。
2.估计与预测 可用易测定的一组给定的自变量的观测值来推算较难测定的Y值 。
3.统计
原创力文档


文档评论(0)