模型攻击与防御第五章
对抗攻击与防御5.1后门攻击与防御5.2能量延迟攻击5.3提取攻击5.4
对抗攻击与防御5.1
5.1.1对抗攻击的定义Szegedy等人早在2013年便已经敏锐地指出,即便是人类肉眼难以察觉的微小对抗性扰动,也能够显著破坏机器学习模型的推理能力。定义在大模型(如大型语言模型、扩散模型等)的背景下,攻击者通过在模型的推理阶段精心设计和构造微小但是具有针对性的扰动,并将其注入到输入数据中,以欺骗或者误导模型产生不正确、与预期不符的有害输出。对抗攻击旨在利用模型对输入数据微小变化的敏感性来引发模型的不当行为。
对抗攻击的场景和流程攻击者目的5.1.2
您可能关注的文档
最近下载
- 绍兴漫步走在中国文化脉络上.doc VIP
- 2025年阳江市江城区招聘专职人民调解员笔试真题.docx VIP
- 湿法静电除尘器使用说明书.doc VIP
- 海龟汤题库完整版本.doc VIP
- 半导体物理与器件(第4版)尼曼课后答案.pdf
- 续性肾替代治疗容量评估与管理专家共识PPT课件.pptx VIP
- CSCO小细胞肺癌诊疗指南(2026版).docx
- 辽宁省大连市第24中学2025-2026学年高一上学期期中考试语文试卷.pdf VIP
- 辽宁省大连市第二十四中学2025-2026学年高二上学期期中英语试卷(含答案,无听力原文及音频).docx VIP
- 中国地质大学北京第六届创新杯大学生创业计划竞赛暨首都挑战杯.DOC VIP
原创力文档

文档评论(0)