- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
第十章两变量之间关系的分析——回归与相关Linear Regression and Correlation问题引出 对两个变量之间关系的研究,例如糖尿病病人的血糖与胰岛素水平的关系如何?分析资料涉及每个病人的两个变量值(血糖、胰岛素水平),称为双变量资料(Bivariate data),记作: (X1,Y1), (X2,Y2), …, (Xn,Yn) 分析目的:研究X和Y之间的数量关系 分析方法:简单线性回归和简单线性相关。 第一节 简单线性回归 Simple Linear regression 历史背景: 十九世纪英国人类学家 F.Galton(1822-1891)在由父亲身高与儿子身高的关系的观察分析中,提出了著名的“相关”(correlation)与“回归”(regression)理论。 最初,Galton是将子代身高趋向于种族稳定的自然现象称之向均数“回归”。 目前,“回归”已成为表示变量之间某种数量依存关系的统计学术语,并且衍生出“回归方程”“回归系数”等统计学概念。如研究糖尿病病人血糖与其胰岛素水平的关系,研究儿童年龄与体重的关系等。一、线性回归的概念 目的:如果以某个变量X作为自变量,研究另一个变量Y (应变量)对自变量X的数量依存关系,就是线性回归。特点:线性回归关系是统计关系,不同于一般数学上的X 和Y的函数关系。 例9-1 某地方病研究所调查了8名正常儿童的尿肌酐含量(mmol/24h)如表9-1。估计尿肌酐含量(Y)对其年龄(X)的回归方程。 表9-1 8名正常儿童的年龄 (岁)与尿肌酐含量 (mmol/24h) 102 在定量描述儿童年龄与其尿肌酐含量数量上的依存关系时,将年龄称为自变量(independent variable),用 X 表示;尿肌酐含量称为应变量(dependent variable),用 Y 表示。 由图9-1可见,尿肌酐含量 Y 随年龄 X 增加而增大且呈直线趋势,但并非8个散点恰好都在一条直线上,这与两变量间严格的直线函数关系不同,称为直线回归(linear regression),其方程叫直线回归方程,以区别严格意义的直线方程。 双变量直线回归是回归分析中最基本、最简单的一种,故又称简单回归(simple regression)。直线回归方程的一般表达式为 (10.3) 为各X处Y的总体均数的估计。1.a 为回归直线在 Y 轴上的截距。a 0,表示直线与纵轴的交点在原点的上方;a 0,则交点在原点的下方;a = 0,则回归直线通过原点。Ya 0a = 0a 0X2. b为回归系数,即直线的斜率。b0,直线从左下方走向右上方,Y 随 X 增大而增大; b0,直线从左上方走向右下方,Y 随 X 增大而减小; b=0,表示直线与 X 轴平行,X 与Y 无直线关系。Yb0b=0b0X*b 的统计学意义是:X 每增加(或减少)一个单位,Y 平均改变的单位数。 公式(10.3)称为样本回归方程,它是对两变量总体间线性关系的一个估计。 根据散点图我们可以假定,对于各个X取值,相应Y的总体均数 在一条直线上(图9-2),表示为: (10.4) 102二、直线回归方程的求法 残差(residual)或剩余值,即实测值Y与假定回归线上的估计值 的纵向距离 。求解a、b实际上就是“合理地”找到一条能最好地代表数据点分布趋势的直线。(X,Y)最小二乘法(least sum of squares)原则:即保证各实测点至直线的纵向距离的平方和最小。 (10.6) 例9-1 某地方病研究所调查了8名正常儿童的尿肌酐含量(mmol/24h)如表9-1。估计尿肌酐含量(Y)对其年龄(X)的回归方程。 表9-1 8名正常儿童的年龄 (岁)与尿肌酐含量 (mmol/24h) 解题步骤 此直线必然通过点( , )且与纵坐标轴相交于截距 a 。如果散点图没有过坐标系原点,可在自变量实测范围内远端取易于读数的 X 值代入回归方程得到一个点的坐标,连接此点与点( , )也可绘出回归直线。 102三、直线回归中的统计推断(一)回归方程的假设检验 建立样本直线回归方程,只是完成了统计分析中两变量关系的统计描述,研究者还须回答它所来自的总体的直线回归关系是否确实存在,即是否对总体有 ?1021.方差分析 理解回归中方差分析的基本思想,需要对应变量Y 的离均差平方和 作分解(如图9-4所示)。(X,Y)102数理统计可证明:上式用符号表示为 式中 上述三个平方和,各有其相应的自由度,并有如下的关系: 如果两变量间总体回归关系确实存在,回归的贡献就要大于随机误差,大到何种程度时可以认为具有统计学意义,可计算统计量 F。式中:2. t 检验 例9-2 检验
您可能关注的文档
最近下载
- 生产经营单位生产安全事故应急预案编制导则GB/T29639-2020 .pptx VIP
- 唯一住房补贴申请书模板.docx VIP
- 员工花名册(自带公式).xlsx VIP
- 第三章交强险.pptx VIP
- 预防校园欺凌主题班会课件(共23张PPT).pptx VIP
- 《管理会计学》教案全套 孙茂竹 第1--12章 管理会计概论--- 管理会计报告.docx
- 顾客异议的类型.ppt VIP
- 预应力管桩试桩方案.doc VIP
- 北京宜通cl-06c六轴控制器说明书.pdf VIP
- 中职英语高教版(2025)基础模块2 Unit 1 Travel 单词课件(共61张PPT)(含音频+视频).pptx VIP
文档评论(0)