第3章 数据库挖掘-聚类分析.pptVIP

  • 9
  • 0
  • 约7.17千字
  • 约 56页
  • 2018-06-28 发布于上海
  • 举报
第3章 数据库挖掘-聚类分析

* 同数量级 * 一个非中心对象h 和中心对象 I角色互换 * K-平均算法(例) 坐标表示5个点{X1,X2,X3,X4,X5}作为一个聚类分析的二维样本:X1=(0,2),X2=(0,0),X3=(1.5,0),X4=(5,0),X5=(5,2)。假设要求的簇的数量k=2。 * K-平均算法(例) 第1步:由样本的随机分布形成两个簇: C1={X1,X2,X4}和C2={X3,X5}。 这两个簇的质心M1和M2是: M1={(0+0+5)/3,(2+0+0)/3}={1.66,0.66}; M2={(1.5+5)/2,(0+2)/2}={3.25,1.00}; * K-平均算法(例) 第2步:取距离其中一个质心(M1或M2)最小的距离分配所有样本,簇内样本的重新分布如下: d(M1,X1)=(1.662+1.342)1/2=2.14 d(M2,X1)=3.40 ==X1∈C1; d(M1,X2)=1.79 和 d(M2,X2)=3.40 ==X2∈C1 d(M1,X3)=0.83 和 d(M2,X3)=2.01 ==X3∈C1 d(M1,X4)=3.41 和 d(M2,X4)=2.01 ==X4∈C2 d(M1,X5)=3.60 和 d(M2,X5)=2.01 ==X5∈C2 新簇C1={X1,X2,X3}和C2={X4,X5} * K-平均算法(例) 第3步:计算新的质心:

文档评论(0)

1亿VIP精品文档

相关文档