机器学习学术报告.pptVIP

  • 26
  • 0
  • 约6.98千字
  • 约 58页
  • 2023-05-24 发布于重庆
  • 举报
1 任务T-密度估计 密度估计:在密度估计问题中, 机器学习算法学习样本采样空间的概率密度函数(样本连续)或者概率质量函数(样本离散)。要做好这样的任务,学习算法需要学习观测到的数据的结构。算法必须知道什么情况下样本聚集出现,什么情况下不太可能出现。 密度估计可以让我们显式地捕获该分布。原则上,我们可以在该分布上计算以便解决其他任务。例如,如果我们通过密度估计得到了概率分布 p(x),我们可以用该分布解决缺失值填补任务(转化为条件概率)。 第十八页,共五十八页。 1 性能度量 P 为了评估机器学习算法的能力,我们必须设计其性能的定量度量。通常性能度量 P 是特定于系统执行的任务 T 而言的。 对于诸如分类、缺失输入分类和转录任务,我们通常度量模型的 准确率(accuracy)。准确率是指该模型输出正确结果的样本比率。我们也可以通过 错误率(error rate)得到相同的信息。 错误率是指该模型输出错误结果的样本比率。我们通常把错误率称为 0 - 1损失的期望。在一个特定的样本上,如果结果是对的,那么 0 - 1损失是 0;否则是 1。 第十九页,共五十八页。 1 性能度量P 通常,我们在 训练集(train set)上学习算法,但我们更加关注机器学习算法在未观测数据上的性能如何,因为这将决定其在实际应用中的性能。因此,

文档评论(0)

1亿VIP精品文档

相关文档