计算机数据库(经济会计类)数据的概括性度量(1)随堂讲义.pptVIP

计算机数据库(经济会计类)数据的概括性度量(1)随堂讲义.ppt

  1. 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
  2. 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载
  3. 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
  4. 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
  5. 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们
  6. 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
  7. 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
相对位置的度量:标准分数 标准分数 (standard score) 1. 也称标准化值 2. 对某一个值在一组数据中相对位置的度量 3. 可用于判断一组数据是否有离群点(outlier) 4. 用于对变量的标准化处理 5. 计算公式为 标准分数 (性质) z分数只是将原始数据进行了线性变换,它并没有改变一个数据在该组数据中的位置,也没有改变该组数分布的形状,而只是使该组数据均值为0,标准差为1 标准分数 (例题分析) 9个家庭人均月收入标准化值计算表 家庭编号 人均月收入(元) 标准化值 z 1 2 3 4 5 6 7 8 9 1500 750 780 1080 850 960 2000 1250 1630 0.695 -1.042 -0.973 -0.278 -0.811 -0.556 1.853 0.116 0.996 经验法则 ?经验法则表明:当一组数据对称分布时 约有68%的数据在平均数加减1个标准差的范围之内 约有95%的数据在平均数加减2个标准差的范围之内 约有99%的数据在平均数加减3个标准差的范围之内 切比雪夫不等式 (Chebyshev’s inequality ) 如果一组数据不是对称分布,经验法则就不再适用,这时可使用切比雪夫不等式,它对任何分布形状的数据都适用 切比雪夫不等式提供的是“下界”,也就是“所占比例至少是多少” 对于任意分布形态的数据,根据切比雪夫不等式,至少有1-1/k2的数据落在平均数加减k个标准差之内。其中k是大于1的任意值,但不一定是整数 切比雪夫不等式 (Chebyshev’s inequality ) ?对于k=2,3,4,该不等式的含义是 至少有75%的数据落在平均数加减2个标准差的范围之内 至少有89%的数据落在平均数加减3个标准差的范围之内 至少有94%的数据落在平均数加减4个标准差的范围之内 相对离散程度:离散系数 离散系数 (coefficient of variation) 1. 标准差与其相应的均值之比 对数据相对离散程度的测度 消除了数据水平高低和计量单位的影响 用于对不同组别数据离散程度的比较 (即可以进行横向间的比较) 5. 计算公式为 离散系数 (例题分析) 某管理局所属8家企业的产品销售数据 企业编号 产品销售额(万元) x1 销售利润(万元) x2 1 2 3 4 5 6 7 8 170 220 390 430 480 650 950 1000 8.1 12.5 18.0 22.0 26.5 40.0 64.0 69.0 【 例 】某管理局抽查了所属的8家企业,其产品销售数据如表。试比较产品销售额与销售利润的离散程度 离散系数 (例题分析) 结论: 计算结果表明,v1v2,说明产品销售额的离散程度小于销售利润的离散程度 v1= 536.25 309.19 =0.577 v2= 32.5215 23.09 =0.710 4.3 偏态与峰态的度量 4.3.1 偏态及其测度 4.3.2 峰态及其测度 偏 态 偏态 (skewness) 统计学家Pearson于1895年首次提出 数据分布偏斜程度的测度 2. 偏态系数SK=0为对称分布 3. 偏态系数SK 0为右偏分布 偏态系数SK 0为左偏分布 偏态系数大于1或小于-1,被称为高度偏态分布; 偏态系数在0.5~1或-1~-0.5之间,被认为是中等偏态分布; 偏态系数越接近0,偏斜程度就越低 偏态系数 (coefficient of skewness) 根据原始数据计算 根据分组数据计算 偏态系数 (例题分析) 某电脑公司销售量偏态及峰度计算表 按销售量份组(台) 组中值(Mi) 频数 fi 140 ~ 150 150 ~ 160 160 ~ 170 170 ~ 180 180 ~190 190 ~200 200 ~210 210 ~220 220 ~ 230 230 ~ 240 145 155 165 175 185 195 205 215 225 235 4 9 16 27 20 17 10 8 4 5 -256000 -243000 -128000 -27000 0 17000 80000 216000 256000 625000 7290000 2560000 270000 0 170000 1600000 648000031250000 合计 — 120 540000 偏态系数 (例题分析)

文档评论(0)

151****0104 + 关注
实名认证
文档贡献者

该用户很懒,什么也没介绍

1亿VIP精品文档

相关文档