人工智能技术导论课件 第6章-模型后门攻击与防御.pptxVIP

  • 1
  • 0
  • 约1.4万字
  • 约 112页
  • 2026-09-08 发布于山东
  • 举报

人工智能技术导论课件 第6章-模型后门攻击与防御.pptx

;;;后门攻击定义;后门攻击示意图;后门攻击的三种场景;后门攻击相关概念;后门攻击相关概念;攻击者目标(Attacker’sObjective):攻击者目标描述了后门攻击者的最终意图和期望达到的效果。通常,攻击者的目标是设计出一个被感染模型,该模型在良性测试样本上表现良好,同时实现高攻击成功率。

能力(Capabilities):在后门攻击和防御的上下文中,能力指攻击者或防御者可以执行的操作和限制。攻击者的能力可能包括修改训练数据集、操控模型训练过程、访问模型内部参数等。防御者的能力可能包括监控训练过程、清洗数据集、修改模型结构或应用对抗性防御策略等。

攻击/防御方法(Attack/DefenseMethods):攻击方法描述了如何设计和执行后门攻击的过程,包括选择触发器、生成投毒样本、修改训练数据集和训练被感染模型等步骤。防御方法则描述了如何检测和防御后门攻击的策略,包括检测投毒样本、清洗训练数据集、修改模型结构、引入对抗性训练等。;后门攻击与数据投毒、对抗攻击的对比;基于投毒的后门攻击(Poisoning-BasedBackdoorAttack)

基于非投毒行为的后门攻击(Nonpoisoning-BasedBackdoorAttacks);面向权重的后门攻击;;基于数据投毒的后门攻击;根据构造毒化数据集时是否需要修改毒化样本的标签,攻击被划分为毒化标签攻击以及干净

文档评论(0)

1亿VIP精品文档

相关文档