- 64
- 0
- 约5.08千字
- 约 10页
- 2017-06-09 发布于北京
- 举报
数据的标准化
在数据分析之前,我们通常需要先将数据标准化(normalization),利用标准化后的数据进行数据分析。数据标准化也就是统计数据的指数化。数据标准化处理主要包括数据同趋化处理和无量纲化处理两个方面。
数据同趋化处理主要解决不同性质数据问题,对不同性质指标直接加总不能正确反映不同作用力的综合结果,须先考虑改变逆指标数据性质,使所有指标对测评方案的作用力同趋化,再加总才能得出正确结果。
数据无量纲化处理主要解决数据的可比性。去除数据的单位限制,将其转化为无量纲的纯数值,便于不同单位或量级的指标能够进行比较和加权。
数据标准化的方法有很多种,常用的有“最小—最大标准化”、“Z-score标准化”和“按小数定标标准化”等。经过上述标准化处理,原始数据均转换为无量纲化指标测评值,即各指标值都处于同一个数量级别上,可以进行综合测评分析。
一、Min-max 标准化
min-max标准化方法是对原始数据进行线性变换。设minA和maxA分别为属性A的最小值和最大值,将A的一个原始值x通过min-max标准化映射成在区间[0,1]中的值x,其公式为:
新数据=(原数据-极小值)/(极大值-极小值)
二、z-score 标准化
这种方法基于原始数据的均值(mean)和标准差(standard deviation)进行数据的标准化。将A的原始
您可能关注的文档
最近下载
- 妊娠合并急性胰腺炎课件.pptx VIP
- 妊娠合并急性胰腺炎课件.pptx VIP
- 专题08 阅读理解-冲刺广西中考英语考前密训(含答案析).docx VIP
- 深静脉血栓(DVT)风险评估Wells评分表.doc VIP
- (二模)2026年深圳市高三年级第二次调研考试化学试卷(含答案).pdf
- 人教版英语七年级下册Unit5 SectionA 1a-1d课件.pptx VIP
- 2025海南海口市总工会招聘下属事业单位人员2人(第1号)备考题库及答案解析.docx VIP
- 2024年总工会招聘笔试新增考点专属试题及答案.doc VIP
- 2025年海口市总工会公开招聘下属事业单位工作人员2人笔试备考题库及答案解析.docx VIP
- 2026年海南省海口市工会系统人员招聘考试备考题库及答案解析.docx VIP
原创力文档

文档评论(0)