统计.板块五.独立性检验.学生版.docx

  1. 1、本文档共10页,可阅读全部内容。
  2. 2、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。
  3. 3、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  4. 4、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
查看更多
PAGE PAGE # - PAGE PAGE # 知识内容 随机抽样 1随机抽样:满足每个个体被抽到的机会是均等的抽样,共有三种经常采用的随机抽样方法: ⑴简单随机抽样:从元素个数为N的总体中不放回地抽取容量为 n的样本,如果每一次抽取时总体中的各 个个体有相同的可能性被抽到,这种抽样方法叫做简单随机抽样. 抽出办法:①抽签法:用纸片或小球分另悔号后抽签的方法. 随机数表法:随机数表是使用计算器或计算机的应用程序生成随机数的功能生成的一张数表?表中每一 位置出现各个数字的可能性相同. 随机数表法是对样本进行编号后,按照一定的规律从随机数表中读数,并取出相应的样本的方法. 简单随机抽样是最简单、最基本的抽样方法. ⑵系统抽样:将总体分成均衡的若干部分,然后按照预先制定的规则,从每一部分抽取一个个体,得到所 需要的样本的抽样方法. 抽出办法:从元素个数为 N的总体中抽取容量为 n的样本,如果总体容量能被样本容量整除,设 k —, n 先对总体进行编号,号码从 1到N,再从数字1到k中随机抽取一个数 s作为起始数,然后顺次抽取第 s k ,s 2k丄,s (n 1)k个数,这样就得到容量为 n的样本?如果总体容量不能被样本容量整除,可 随机地从总体中剔除余数,然后再按系统抽样方法进行抽样. 系统抽样适用于大规模的抽样调查,由于抽样间隔相等,又被称为等距抽样. ⑶分层抽样:当总体有明显差别的几部分组成时,要反映总体情况,常采用分层抽样,使总体中各个个体 按某种特征分成若干个互不重叠的几部分, 每一部分叫做层,在各层中按层在总体中所占比例进行简单随 机抽样,这种抽样方法叫做分层抽样. 分层抽样的样本具有较强的代表性,而且各层抽样时,可灵活选用不同的抽样方法,应用广泛. 2?简单随机抽样必须具备下列特点: ⑴简单随机抽样要求被抽取的样本的总体个数 N是有限的. ⑵简单随机样本数n小于等于样本总体的个数 N . ⑶简单随机样本是从总体中逐个抽取的. ⑷简单随机抽样是一种不放回的抽样. ⑸简单随机抽样的每个个体入样的可能性均为 工. N 系统抽样时,当总体个数 N恰好是样本容量n的整数倍时,取k N; n n整除.因为Nn n整除.因为 N n n 每个个体被剔除的机会相等,因而整个抽样过程中每个个体被抽取的机会仍然相等,为 频率直方图 列出样本数据的频率分布表和频率分布直方图的步骤: 计算极差:找出数据的最大值与最小值,计算它们的差; 极差决定组距与组数:取组距,用 极差 决定组数; 极差 决定组距与组数:取组距,用 极差 决定组数; 组距 决定分点:决定起点,进行分组; 列频率分布直方图: 对落入各小组的数据累计, 绘制频率分布直方图:以数据的值为横坐标,以 频率 知小长方形的面积=组距 X. =频率. 组距 算出各小数的频数, 除以样本容量,得到各小组的频率. 频率 频率的值为纵坐标绘制直方图, 组距 频率分布折线图:将频率分布直方图各个长方形上边的中点用线段连接起来,就得到频率分布折线图, 般把折线图画成与横轴相连,所以横轴左右两端点没有实际意义. 总体密度曲线:样本容量不断增大时,所分组数不断增加,分组的组距不断缩小,频率分布直方图可以用 一条光滑曲线y f(x)来描绘,这条光滑曲线就叫做总体密度曲线?总体密度曲线精确地反映了一个总体 在各个区域内取值的规律. 茎叶图 制作茎叶图的步骤: 将数据分为 茎”、叶”两部分; 将最大茎与最小茎之间的数字按大小顺序排成一列,并画上竖线作为分隔线; 将各个数据的叶”在分界线的一侧对应茎处同行列出. 统计数据的数字特征 用样本平均数估计总体平均数;用样本标准差估计总体标准差. 数据的离散程序可以用极差、方差或标准差来描述. 极差又叫全距,是一组数据的最大值和最小值之差,反映一组数据的变动幅度; 样本方差描述了一组数据平均数波动的大小,样本的标准差是方差的算术平方根. 般地,设样本的元素为 Xi , X2 , L , Xn样本的平均数为X , 定义样本方差为 2 2 (为 X) (X2 2 X) L 2 (Xn X) ^定义/|十本丿J差为 s n 样本标准差s (Xi X)2 (X2 X)2 L X X)2 V — n 简化公式:s2 1 2 2 [(Xi X2 L n 2 xJ _2 nx ]. 独立性检验 1 ?两个变量之间的关系; 常见的有两类:一类是确定性的函数关系;另一类是变量间存在关系,但又不具备函数关系所要求的确定 性,它们的关系是带有一定随机性的?当一个变量取值一定时,另一个变量的取值带有一定随机性的两个 变量之间的关系叫做相关关系. 2?散点图:将样本中的 n个数据点(X , y )(i 1,2丄,n)描在平面直角坐标系中,就得到了散点图. 散点图形象地

文档评论(0)

guoxiachuanyue + 关注
实名认证
内容提供者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档