核密度估计在收入分布中的bandwidth选择.docxVIP

  • 3
  • 0
  • 约4.81千字
  • 约 9页
  • 2026-04-23 发布于上海
  • 举报

核密度估计在收入分布中的bandwidth选择.docx

核密度估计在收入分布中的bandwidth选择

引言

收入分配是社会经济研究的核心议题之一,其分布形态的准确刻画对政策制定、贫困分析及社会公平评估具有重要意义。核密度估计(KernelDensityEstimation,KDE)作为非参数统计方法,无需预设分布模型,能灵活捕捉收入数据的真实特征,被广泛应用于收入分布研究中。然而,核密度估计的关键参数——带宽(bandwidth,简称h)的选择,直接影响估计结果的平滑度与精度:带宽过小会导致估计曲线过度拟合,呈现“锯齿状”波动;带宽过大则会过度平滑,掩盖收入分布的局部特征(如多峰性、尾部厚度)。在收入分布场景下,由于数据常呈现右偏态、厚尾性及潜在的分层结构(如不同职业、地区的收入差异),带宽选择的科学性更为关键。本文将围绕“核密度估计在收入分布中的bandwidth选择”展开,从基础原理、核心作用、方法比较到实践挑战,层层递进剖析这一问题,为收入分配研究提供方法学参考。

一、核密度估计与带宽的基础逻辑

(一)核密度估计的本质与功能

核密度估计是通过加权平均观测值的“核函数”来估计概率密度函数的非参数方法。其基本思想是:对于每个观测点,以该点为中心放置一个对称的核函数(如高斯核、Epanechnikov核),核函数的宽度由带宽h控制;所有观测点的核函数叠加后,归一化得到整体的密度估计曲线(Silverman,1986)。与参数估

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档