- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
专题06统计案例
【清单01】变量间的相关关系
1、变量之间的相关关系
当自变量取值一定时,因变量的取值带有一定的随机性,则这两个变量之间的关系叫相关关系.
注意:相关关系与函数关系是不同的,相关关系是一种非确定的关系,函数关系是一种确定的关系,而且函数关系是一种因果关系,但相关关系不一定是因果关系,也可能是伴随关系.
2、散点图
将样本中的个数据点描在平面直角坐标系中,所得图形叫做散点图.根据散点图中点的分布可以直观地判断两个变量之间的关系.
(1)如果散点图中的点散布在从左下角到右上角的区域内,对于两个变量的这种相关关系,我们将它称为正相关,如图(1)所示;
(2)如果散点图中的点散布在从左上角到右下角的区域内,对于两个变量的这种相关关系,我们将它称为负相关,如图(2)所示.
3、相关系数
若相应于变量的取值,变量的观测值为,则变量与的相关系数,通常用来衡量与之间的线性关系的强弱,的范围为.
(1)当时,表示两个变量正相关;当时,表示两个变量负相关.
(2)越接近,表示两个变量的线性相关性越强;越接近,表示两个变量间几乎不存在线性相关关系.当时,所有数据点都在一条直线上.
(3)通常当时,认为两个变量具有很强的线性相关关系.
【清单02】线性回归
1、线性回归
线性回归是研究不具备确定的函数关系的两个变量之间的关系(相关关系)的方法.
对于一组具有线性相关关系的数据(x1,y1),(x2,y2),…,(xn,yn),其回归方程的求法为
其中,,,(,)称为样本点的中心.
2、残差分析
对于预报变量,通过观测得到的数据称为观测值,通过回归方程得到的称为预测值,观测值减去预测值等于残差,称为相应于点的残差,即有.残差是随机误差的估计结果,通过对残差的分析可以判断模型刻画数据的效果以及判断原始数据中是否存在可疑数据等,这方面工作称为残差分析.
(1)残差图
通过残差分析,残差点比较均匀地落在水平的带状区域中,说明选用的模型比较合适,其中这样的带状区域的宽度越窄,说明模型拟合精确度越高;反之,不合适.
(2)通过残差平方和分析,如果残差平方和越小,则说明选用的模型的拟合效果越好;反之,不合适.
(3)相关指数
用相关指数来刻画回归的效果,其计算公式是:.
越接近于,说明残差的平方和越小,也表示回归的效果越好.
【清单03】独立性检验
1、分类变量和列联表
(1)分类变量:
变量的不同“值”表示个体所属的不同类别,像这样的变量称为分类变量.
(2)列联表:
①定义:列出的两个分类变量的频数表称为列联表.
②2×2列联表.
一般地,假设有两个分类变量X和Y,它们的取值分别为{,}和{,},其样本频数列联表(称为2×2列联表)为
总计
总计
从列表中,依据与的值可直观得出结论:两个变量是否有关系.
2、等高条形图
(1)等高条形图和表格相比,更能直观地反映出两个分类变量间是否相互影响,常用等高条形图表示列联表数据的频率特征.
(2)观察等高条形图发现与相差很大,就判断两个分类变量之间有关系.
3、独立性检验
计算随机变量利用的取值推断分类变量X和Y是否独立的方法称为χ2独立性检验.
0.10
0.05
0.010
0.005
0.001
2.706
3.841
6.635
7.879
10.828
【考点题型一】线性分析--相关系数、相关指数
【例1】.下列说法正确的个数是(????)
①线性相关系数越接近1,两个变量的线性相关程度越强;
②独立性检验可以100%确定两个变量之间是否具有某种关系;
③在回归分析中,可用残差图判断模型的拟合效果,残差点比较均匀地落在水平的带状区域中,说明这样的模型比较合适,带状区域的宽度越窄,说明模型的拟合精度越高;
④甲、乙两个模型的决定系数分别约为0.88和0.80,则模型甲的拟合效果更好.
A.1 B.2 C.3 D.4
【变式1-1】.下列说法错误的是(????)
A.两个随机变量的线性相关性越强,相关系数的绝对值越接近于1;
B.用不同的模型拟合同一组数据,则残差平方和越小的模型拟合的效果越好;
C.设,且,则;
D.若变量x和y满足关系,则x与y负相关.
【变式1-2】.已知5个成对数据的散点图如下,若去掉点,则下列说法正确的是()
A.变量x与变量y呈正相关 B.变量x与变量y的相关性变强
C.残差平方和变大 D.样本相关系数r变大
【变式1-3】.以下关于统计分析的描述,哪一个是正确的?(????)
A.样本均值越接近总体均值,样本的代表性越好.
B.样本标准差越大,数据的离散程度越小.
C.相关系数的绝对值越接近1,表示两个变量的线性关系越弱.
D.决定系数R2越接近1,模型的解释能力越强.
【变式1-4】.关于线性回归的描述,有下列命题:
①回归直线一定经过样本点的中心;
您可能关注的文档
- 高二历史期末复习材料阅读题专练(原卷版及全解全析).docx
- 高二历史期末复习开放题专练(原卷版及全解全析).docx
- 高二历史期末模拟预测卷01(原卷版及全解全析).docx
- 高二历史期末模拟预测卷02(原卷版及全解全析).docx
- 高二历史期末模拟预测卷03(原卷版及全解全析).docx
- 专题01 制度、选官、教化与邦交—国家治理篇(期末复习讲义) (原卷版及全解全析).docx
- 专题02 赋税、货币、基层与保障——社会治理篇(期末复习讲义) (原卷版及全解全析).docx
- 专题03 经济与社会生活——核心脉络与关键突破(期末复习讲义) (原卷版及全解全析).docx
- 高二历史期末复习材料阅读题专练(解析版).docx
- 高二历史期末复习材料阅读题专练(原卷版).docx
最近下载
- GB 16557-2023 船用救生设备安全标志.docx VIP
- 物业团队协作培训课件.pptx VIP
- 硬件研发主管述职报告.pptx VIP
- 北京大学初党练习试题附答案.doc VIP
- G3管理系统2017标准版使用说明书V1.0.0 A.3.pdf VIP
- 三年级青岛版数学上册应用题考点知识练习.pdf VIP
- 北京市石景山区2024-2025学年九年级上学期期末考试历史试题(含解析).docx VIP
- 临床常见病的中西医诊疗与康复新进展题库答案-2025年华医网继续教育答案.docx VIP
- 2025年华医网继续教育计划生育生殖健康保护及PAC(人流后关爱)标准流程建设题库及答案.docx VIP
- DB35T 1008-2010 斜带石斑鱼人工育苗技术规范.docx VIP
原创力文档


文档评论(0)