数据挖掘模型评价.pptxVIP

  • 6
  • 0
  • 约3.26千字
  • 约 48页
  • 2022-11-24 发布于上海
  • 举报
数据挖掘模型评价;2;17.1基于损失函数的标准;;; 当分类数m为3时,对角线给出正确的预测。如表17-23个类的混淆矩阵所示。 在本例中,总共是150个检验样本。有6类误差(m2-m=32-3=6), 在表中它们以粗体字表示。 可以看到,这个分类器对于属于B类的46中的38个样本给出了正确的分类;8个样本给出了错误的分类,其中2个分到了A类,6个分到了C类。 ;;;因此当不同类型的误差对应不同的权值时,我们要将每个误差乘以对应的权值因子cij 如果混淆矩阵中的误差元素为eij,那么总成本函数C(替代精度计算中的误差数)可以计算为: (17-3 );要描述模型的质量,必须有更加复杂和全局性的度量。为此我们引入5个参数:敏感性(sensitivity),特异性(specificity),精度(precision),错误正例(false positives),错误负例(false negatives)。 敏感性(sensitivity)= (17-4) 特异性(specificity)= (17-5) ;以上两个参数分别评估分类器识别正样本的情况和识别负样本的情况。 精度(precision)= (1

文档评论(0)

1亿VIP精品文档

相关文档