- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
独立性检验的基本思想及其初步应用(学案)
1.2独立性检验的基本思想及其初步应用
学习目标:
1.了解分类变量,会根据列联表和等高条形图计算和分析两个分类变量是否相关。
2.通过对典型案例的探究,了解独立性检验的基本思想及方法步骤。
3.体会反证法原理与独立性检验原理的区别和联系。
一.复习回顾:
1.回归分析的方法与步骤。
2.刻画模型拟合效果的方法(相关指数、残差分析)及步骤。
二.阅读课本完成以下几个问题:
1.与列联表相关的概念:
①分类变量:变量的不同“值”表示个体所属的 ,像这样的变量称为分类变量。
②列联表:列出的两个分类变量的 ,称为列联表。
2.从吸烟与患呼吸道疾病列联表中,可以得到什么结论?是如何得出的?
3.等高条形图:与表格相比,等高条形图更能直观地反映出两个分类变量间是否 ,常用它来展示列联表数据的 。
4.通过数据和图形分析得到的直观判断有何不足之处?那种方法能对 “两个分类变量是否有关系”给出较精确的判断?
5.独立性检验:
(1)在2×2列联表中,随机变量的计算公式为 ,其中n= 。利用随机变量来判断“两个分类变量有关系”的方法称为 。当的观测值越大时,两个变量之间的关系越 ,否则,关系越 。
(2)如何判断的观测值的大小?
(3)临界值的判断规则是怎样的?的含义是什么?
(4) 独立性检验的基本思想:
① 独立性检验的必要性(为什么不能只凭列联表的数据和图形下结论?)
② 反证法原理与独立性检验原理的比较:
反证法原理 独立性检验原理 ③ 师生共同总结“探究”的解决步骤:
第一步:提出假设检验问题
H:吸烟与患肺癌没有关系 H:吸烟与患肺癌有关系
(H:原假设 H:备择假设)
第二步:选择检验的指标
说明:它越小,原假设“H:吸烟与患病没有关系”成立的可能性越大;它越大,备择假设“H:吸烟与患病 有关系”成立的可能性越大.
第三步:查表得出结论
思考: 在吸烟与患病的例子中,由≥6.635得结论“吸烟与患病有关系”,并且这个结论犯错误的概率不会超过0.01。另一方面,由下表可知
P(≥10.828)”,并且这个结论犯错误的概率不会超过0.001。
这里用到的是同样的数据,得到的是相同的结论,为什么会得到不同的犯错误概率的上界估计?两个估计中哪一个正确?
附:临界值表
P(K2≥) 0.50 0.40 0.25 0.15 0.10 0.05 0.025 0.010 0.005 0.001 0.455 0.708 1.323 2.072 2.706 3.841 5.024 6.635 7.879 10.828
三、分析P95例1,回答:
利用独立性检验两个分类变量是否相关的方法基本步骤:
①制列联表 ②画等高条形图。
③分析判断两个分类变量是否有关系。 ④求观测值k,在题目条件要求下检验结论正确与否。
注意:适合范围。
练习:在500人身上试验某种血清预防感冒作用,把他们一年中的感冒记录与另外500名未用血清的人的感冒记录作比较,发现:在使用血清的500人中未感冒的有258人,感冒的有242人;在未使用血清的500人中未感冒的有216人,感冒的有284人。问:该种血清能否起到预防感冒的作用?
原创力文档


文档评论(0)