大数据十大经典算法讲解.pptVIP

  • 9
  • 0
  • 约2.9千字
  • 约 34页
  • 2022-09-04 发布于重庆
  • 举报
带canopy预处理的kmeans算法的优点 第二十二页,共三十四页。 带canopy预处理的kmeans算法的新挑战 Canopy预处理这么好,我们以后就用它好了! 我看不见得,它虽然解决kmeans当中的一些问题,但其自身也引进了新的问题:t1、t2的选取。 第二十三页,共三十四页。 大数据下kmeans算法的并行策略 VS 单挑OR群殴?! 第二十四页,共三十四页。 The algorithm of Kmeans 小组成员:徐佳、张俊飞、刘志伟、孔祥玉 第一页,共三十四页。 主要内容: Kmeans实战 聚类算法简介 Kmeans算法详解 Kmeans算法的缺陷及若干改进 Kmeans的单机实现与分布式实现策略 第二页,共三十四页。 聚类算法简介 1 2 3 聚类的目标:将一组向量分成若干组,组内数据是相似的,而组间数据是有较明显差异。 与分类区别:分类与聚类最大的区别在于分类的目标事先已知,聚类也被称为无监督机器学习 聚类手段:传统聚类算法 ①划分法 ②层次方法 ③基于密度方法 ④基于网络方法 ⑤基于模型方法 第三页,共三十四页。 什么是Kmeans算法? Q1:K是什么?A1:k是聚类算法当中类的个数。 Summary:Kmeans是用均值算法把数据分成K个类的算法! Q2:means是什么?A2:means是均值算法。 第四页,

文档评论(0)

1亿VIP精品文档

相关文档