《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 12-噪声数据处理.ppt

《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 12-噪声数据处理.ppt

基于熵采样通过熵来度量,它衡量了在每个类别归属概率上的不确定。选择熵最大的样本作为需要人工判定的样本。基于委员会的采样当主动学习中采用集成学习模型时,这种选择策略考虑到每个基分类器的投票情况。相应地,通过基于投票熵和平均KL散度来选择样本。基分类器样本(p1,p2,..pn)c1c2cn样本x的投票熵计算时,把x的每个类别的投票数当作随机变量,衡量该随机变量的不确定性。其中V(y)表示投票给y的分类器的个数,C表示分类器总数。投票熵越大,就越有可能被选择出来。当每个基分类器为每个样本输出分类概率时,可以使用平均KL散度来计算各个分类器的分类概率分布与平均分布的平均偏差

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档