常用机器学习算法简单介绍.docxVIP

  • 5
  • 0
  • 约4.38千字
  • 约 6页
  • 2021-12-05 发布于江苏
  • 举报
常用机器学习算法简单介绍 一、 分类 K—最近邻算法(K-NN) 存在一个样本数据集合,也称作训练样本集,并且样本集中的每个数据都存在标签,即我们知道样本集 中每一数据与所述分类的对应关系。输入没有标签的新数据后,将新数据的每个特征与样本集中数据对应的特征进行比较,然后算法提取样本集中特征最相似数据(最近邻)的分类标签。一般来说,选择样本数据集中的前 k 个相似的数据.最后选择 k 个最相似数据中出现次数最多的分类,作为新数据的分类。 伪代码: 对未知类别属性的数据集中的每个点依次执行以下操作: 计算已知类别数据集中的点与当前点之间的距离; 按照距离递增依次排序; 选取与当前点距离最小的k 个

文档评论(0)

1亿VIP精品文档

相关文档