- 25
- 0
- 约1.03千字
- 约 2页
- 2021-01-31 发布于广东
- 举报
在统计学中为什么要对变量取对数? 对数据做一些变换的目的是它能够让它符
合我们所做的假设,使我们能够在已有理论上对其分析。 对数变换(log
transformation)是特殊的一种数据变换方式,它可以将一类我们理论上未解决
的模型问题转化为已经解决的问题。
我将说两类比较有代表性的模型。
理论上:随着自变量的增加,因变量的方差也增大的模型。
先给个很经典的例子,如分析美国每月电力生产数。
左边是正常数据,可以看到随着时间推进,电力生产也变得方差越来越大,即
越来越不稳定。这种情况下常有的分析假设经常就不会满足(误差服从独立同
分布的正态分布,时间序列要求平稳)。
这必然导致我们寻求一种方式让数据尽量满足假设,让方差恒定,即让波动相
对稳定。而这种目的可以通过对数转换做到。
理论上,我们将这类问题抽象成这种模型,即分布的标准差与其均值线性相
关。
即 ,
其中 。
由定义可推:
利用log 函数的性质: (当x 足够小)
那么 那么很容易就知道 和 所以对数
变换能够很好地将随着自变量的增加,因变量的方差也增大的模型转化为我们
熟知的问题。
经验上:研究数据的增长率分布存在一定规律的模型。
再给个例子:实际研究中,某一研究对象自身性质难以研究,但其增长率是服
从一定分布。
例如说: ,
其中 是每年增长率(不很大)。
1
我们可以考虑对数变换:
这样,
我们又可以将研究数据的增长率分布存在一定规律的模型转化为我们熟知的问
题。
在对数转换后,人们又思考了很多其他的转换方式(如Cox-Box 转换)。
但总而言之,每一种转换方式都是为了让数据符合我们的假设,来对其进行分
析。
2
原创力文档

文档评论(0)