北京大学统计学课件第八章——聚类分析(.pptxVIP

  • 1
  • 0
  • 约1万字
  • 约 34页
  • 2026-09-04 发布于四川
  • 举报

北京大学统计学课件第八章——聚类分析(.pptx

第八章聚类分析(1)北京大学统计学经典课件·多元统计分析

Contents本章目录聚类分析的核心方法、评估指标与应用场景,涵盖从基础概念到前沿算法的完整知识体系。01聚类分析概述02K均值聚类03层次聚类04DBSCAN聚类05基于密度的聚类方法06聚类分析的评估指标与应用07总结与展望

CHAPTER01聚类分析概述从定义、分类到应用场景,建立聚类分析的完整认知框架

CLUSTERANALYSIS什么是聚类分析聚类分析是一种无监督学习方法,通过对数据对象之间的相似性进行计算,将它们自动分成若干内部相似、彼此差异明显的群体(cluster),其本质是让数据自己长出类别,而非人为预设标签。01无监督学习范式不需要预先标记的训练数据,算法自动从数据的分布特征中发现隐藏的分组结构和内在规律,适用于探索性数据分析场景。02核心目标——物以类聚同一聚类内的数据点尽可能相似(组内同质性),不同聚类间的数据点尽可能不同(组间异质性),形成清晰可辨的数据分组。03与分类分析的本质区别分类是已知类别标签,学习判别规则的监督学习;聚类是未知类别结构,探索自然分组的无监督发现过程。04数学本质在多维空间中寻找数据点的自然聚集区域,通过欧氏距离、余弦相似度等度量来量化相似与不同的程度。

DistanceMetrics聚类分析的基本原理聚类分析的数学基础建立在距离度量与相似性度量之上,不同度量方

文档评论(0)

1亿VIP精品文档

相关文档