- 0
- 0
- 约1.62万字
- 约 3页
- 2026-08-04 发布于北京
- 举报
注:模型中的符号和说明要根据具体情况稍加改变
聚类分析一般与判别分析、主成分分析、回归分析等一起使用
聚类分析和判别分析有密切联系。
判别分析是1、已知类型和数目;2、并要有一批来自各个类别的类型和样本。然
后进行归类。
聚类分析是,事先不知类别的
通常情况下,距离系数用于对样本进行聚类,相似系数一般用于对变量(指标)
进行聚类。
由于聚类分析是常用分析方法,使用时看情况是否加入下面的具体模型。在聚类
分析不是问题关键时,我们可以直接描述如下:
对样本进行聚类的描述:聚类分析的相似性度量可利用欧氏距离、兰氏距离、
马氏距离。统计学一般采用欧氏距离进行聚类分析,欧氏距离中的每个分量对距
离的贡献同等。分量为测量值时常有大小不等的随机波动且当测量值为不同性质
的量时欧氏距离与单位有关,单位不同影响距离的大小。采用兰氏距离可避免此
缺点,但兰氏距离未考虑各测量值之间的相关性。而马氏距离不仅适用于分量性
质不同的情况,也考虑了各测量值之间的相关性。故本题采用马氏距离对样本进
行聚类分析。本题由于时间样本量比较小,利用sas进行聚类时,出现了样本量
不足的问题,本题采用添加常量样本解决,这样会使马氏距离整体发生变化,但
不会影响聚类结果。
样本进行聚类的方法很多,但这些方法涉及的面广且深,暂时只作了解:
平均连接法,重心
原创力文档

文档评论(0)