聚类解析总结计划学习总结计划.docxVIP

  • 14
  • 0
  • 约5.13千字
  • 约 7页
  • 2020-12-29 发布于山东
  • 举报
聚 类 分 析 学 习 体 会 聚类分析是多元统计分析中研究 “物以类聚” 的一种方法, 用于对事物的类别尚不清楚,甚至在事前连总共有几类都不能确定的情况下进行分类的场合。 聚类分析主要目的是研究事物的分类, 而不同于判别分析。 在判别分析中必须事先知道各种判别的类型和数目, 并且要有一批来自各判别类型的样本, 才能建立判别函数来对未知属性的样本进行判别和归类。 若对一批样品划分的类型和分类的数目事先并不知道,这时对数据的分类就需借助聚类分析方法来解决。 聚类分析把分类对象按一定规则分成组或类, 这些组或类不是事先给定的而是根据数据特征而定的。 在一个给定的类里的这些对象在某种意义上倾向于彼此相似, 而在不同类里的这些对象倾向于不相似。 1.聚类统计量 在对样品(变量)进行分类时,样品(变量)之间的相似性是怎么度量?通常有三种相 似性度量——距离、 匹配系数和相似系数。 距离和匹配系数常用来度量样品之间的相似 性,相似系数常用来变量之间的相似性。 样品之间的距离和相似系数有着各种不同的定 义,而这些定义与变量的类型有着非常密切的关系。通常变量按取值的不同可以分为: 定量变量:变量用连续的量来表示,例如长度、重量、速度、人口等,又称为间隔尺度变量。 定性变量:并不是数量上有变化,而只是性质上有差异。定性变量还可以再分为:⑴有序尺度变量:变量不是用明确的数量表示,而是用等级表示,例如

文档评论(0)

1亿VIP精品文档

相关文档