- 1、原创力文档(book118)网站文档一经付费(服务费),不意味着购买了该文档的版权,仅供个人/单位学习、研究之用,不得用于商业用途,未经授权,严禁复制、发行、汇编、翻译或者网络传播等,侵权必究。。
- 2、本站所有内容均由合作方或网友上传,本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺!文档内容仅供研究参考,付费前请自行鉴别。如您付费,意味着您自己接受本站规则且自行承担风险,本站不退款、不进行额外附加服务;查看《如何避免下载的几个坑》。如果您已付费下载过本站文档,您可以点击 这里二次下载。
- 3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等,请点击“版权申诉”(推荐),也可以打举报电话:400-050-0827(电话支持时间:9:00-18:30)。
- 4、该文档为VIP文档,如果想要下载,成为VIP会员后,下载免费。
- 5、成为VIP后,下载本文档将扣除1次下载权益。下载后,不支持退款、换文档。如有疑问请联系我们。
- 6、成为VIP后,您将拥有八大权益,权益包括:VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
- 7、VIP文档为合作方或网友上传,每下载1次, 网站将根据用户上传文档的质量评分、类型等,对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档
查看更多
聚类分析
在实际工作中,我们经常遇到分类问题.若事先已经建立类别,则使用判别分析,若事先没有建立类别,则使用聚类分析。
聚类与分类的不同在于,聚类所要求划分的类是未知的。
聚类是将数据分类到不同的类或者簇这样的一个过程,所以同一个簇中的对象有很大的相似性,而不同簇间的对象有很大的相异性。
Step1 寻找变量之间的相似性
用pdist函数计算相似矩阵,有多种方法可以计算距离,进行计算之前最好先将数据用zscore函数进行标准化。
X2=zscore(X); %标准化数据
Y=pdist(X2); %计算距离
Step2 定义变量之间的连接
Z=linkage(Y);
Step3 评价聚类信息
C=cophenet(Z,Y);
Step4 创建聚类,并作出谱系图
T=cluster(Z,6);
H=dendrogram(Z);维样本和,则它们的欧氏距离为
2)标准化欧氏距离
3)马氏距离
4)布洛克距离
5)闵可夫斯基距离
6)余弦距离
7)相似距离
二、MATLAB中常用的计算距离的函数
假设我们有阶数据矩阵,每一行是一个样本数据. 在MATLAB中计算样本点之间距离的内部函数为
y=pdist(x) 计算样本点之间的欧氏距离(默认)
y=pdist(x,seuclid) 计算样本点之间的标准化欧氏距离
y=pdist(x,mahal) 计算样本点之间的马氏距离
y=pdist(x,cityblock) 计算样本点之间的布洛克距离
y=pdist(x,minkowski) 计算样本点之间的闵可夫斯基距离
y=pdist(x,minkowski,p) 计算样本点之间的参数为p的闵可夫斯基距离
y=pdist(x,cosine) 计算样本点之间的余弦距离
y=pdist(x,correlation) 计算样本点之间的相似距离
另外,内部函数yy=squareform(y)表示将样本点之间的距离用矩阵的形式输出。
例:
x=[3 1.7;1 1;2 3; 2 2.5; 1.2 1; 1.1 1.5; 3 1] % 7×2,每行一个样本
y=pdist(x,mahal) %每两个样本的马氏距离
yy=squareform(y) %样本点之间的距离用矩阵的形式输出
x =
3.0000 1.7000
1.0000 1.0000
2.0000 3.0000
2.0000 2.5000
1.2000 1.0000
1.1000 1.5000
3.0000 1.0000
y =
Columns 1 through 13
2.3879 2.1983 1.6946 2.1684 2.2284 0.8895 2.6097 2.0616 0.2378 0.6255 2.3778 0.6353 2.5522
Columns 14 through 21
2.0153 2.9890 1.9750 1.5106 2.4172 0.6666 2.1400 2.4517
yy =
0 2.3879 2.1983 1.6946 2.1684 2.2284 0.8895
2.3879 0 2.6097 2.0616 0.2378 0.6255 2.3778
2.1983 2.6097 0 0.6353 2.5522 2.0153 2.9890
1.6946 2.0616 0.6353 0 1.9750 1.5106 2.4172
2.1684 0.2378 2.5522 1.9750 0 0.6666 2.1400
2.2284 0.6255 2.0153 1.5106 0.6666 0 2.4517
0.8895 2.3778 2.9890 2.4172 2.1400 2.4517 0
三、常用的聚类方法
常用的聚类方法主要有以下几种:最短距离法、最长距离法、平均距离法、重心法、平方和递增法等
您可能关注的文档
最近下载
- 中国飞机座舱透明件行业市场占有率及投资前景预测分析报告.pdf VIP
- 静脉用药安全输注药护专家指引.pptx VIP
- 十年(2015-2024)高考英语语法填空真题与模考试卷汇编16-定语从句a原卷版(含答案).pdf VIP
- AQ 2061-2018 金属非金属地下矿山防治水安全技术规范.docx VIP
- (新)预防艾梅乙母婴传播试卷.docx VIP
- 香丽高速公路第八标段弃土场.docx VIP
- CT扫描技术模拟试题及答案、南方医科大学2006级医学影像技术学试卷.pdf VIP
- 运动生理学(全集)PPT(精品PPT).pptx VIP
- 人工智能基础与应用课件.pptx VIP
- GB 14976-2002 流体输送用不锈钢无缝钢管.pdf VIP
文档评论(0)