人工智能技术导论课件 第2章-人工智能安全框架.pptxVIP

  • 1
  • 0
  • 约5.64千字
  • 约 60页
  • 2026-09-08 发布于山东
  • 举报

人工智能技术导论课件 第2章-人工智能安全框架.pptx

;;数据驱动的人工智能;通用AI模型训练过程;安全的基本属性;广义人工智能安全涉及的范畴;本课程定义的人工智能安全模型;;人工智能安全维度;威胁模型;人工智能安全模型中包含了非常多的任务,针对不同任务不同攻击有不同的敌手目标。可以用四个指标来概括人工智能模型中不同任务的准测:机密性、完整性、隐私性以及可用性。

机密性威胁:指攻击者获取模型或模型训练数据的隐私信息;

完整性威胁:指攻击者有目的地诱导模型输出攻击者的预期结果;

隐私性威胁:指在数据原始信息没有发生直接泄露的情况下,人工智能模型计算产生的新消息会间接暴露数据;

可用性威胁:指攻击者阻止或妨碍普通用户对模型的正常请求。

;数据投毒攻击:攻击者通过将精心制作的样本插入训练集中来改变训练数据分布,从而改变模型行为,降低模型性能。

后门攻击:攻击者试图在模型训练时将带有触发器的恶意数据加入训练集中从而在模型中植入后门。这使得模型在推理阶段对带有触发器的输入数据敏感,导致模型输出错误的结果,甚至输出攻击者指定的目标结果。

对抗样本攻击:攻击者通过对原始的输入数据添加微小的、人类肉眼几乎无法察觉的扰动,生成对抗样本,对模型进行恶意攻击,从而实现两种目标。①目标攻击,限定攻击范围和效果;②无目标/无差别攻击,即诱使目标模型犯错,而不限定结果。;深度伪造攻击:借助深度学习技术进行大样本学习,从而将目标任务的声音、面部图像以及身体动作替换

文档评论(0)

1亿VIP精品文档

相关文档