- 1
- 0
- 约5.64千字
- 约 60页
- 2026-09-08 发布于山东
- 举报
;;数据驱动的人工智能;通用AI模型训练过程;安全的基本属性;广义人工智能安全涉及的范畴;本课程定义的人工智能安全模型;;人工智能安全维度;威胁模型;人工智能安全模型中包含了非常多的任务,针对不同任务不同攻击有不同的敌手目标。可以用四个指标来概括人工智能模型中不同任务的准测:机密性、完整性、隐私性以及可用性。
机密性威胁:指攻击者获取模型或模型训练数据的隐私信息;
完整性威胁:指攻击者有目的地诱导模型输出攻击者的预期结果;
隐私性威胁:指在数据原始信息没有发生直接泄露的情况下,人工智能模型计算产生的新消息会间接暴露数据;
可用性威胁:指攻击者阻止或妨碍普通用户对模型的正常请求。
;数据投毒攻击:攻击者通过将精心制作的样本插入训练集中来改变训练数据分布,从而改变模型行为,降低模型性能。
后门攻击:攻击者试图在模型训练时将带有触发器的恶意数据加入训练集中从而在模型中植入后门。这使得模型在推理阶段对带有触发器的输入数据敏感,导致模型输出错误的结果,甚至输出攻击者指定的目标结果。
对抗样本攻击:攻击者通过对原始的输入数据添加微小的、人类肉眼几乎无法察觉的扰动,生成对抗样本,对模型进行恶意攻击,从而实现两种目标。①目标攻击,限定攻击范围和效果;②无目标/无差别攻击,即诱使目标模型犯错,而不限定结果。;深度伪造攻击:借助深度学习技术进行大样本学习,从而将目标任务的声音、面部图像以及身体动作替换
您可能关注的文档
最近下载
- 05R417-1 室内管道支吊架.pptx VIP
- 2026全科医学科基层医师专项特训题目及答案(基层医师专项特训版).doc VIP
- 传染病学(第10版)第一章 总论.pptx
- 化工装置控制系统SIS安全联锁调试方案(含+联锁逻辑图+阀门动作测试+响应时间测定).docx VIP
- 清晰版 JJF(苏) 309-2025 经皮黄疸测试仪校准规范.docx VIP
- T∕CAEC 011-2026 工程监理企业信用评价标准.docx VIP
- KA 40-2026 煤矿冲击地压解危措施效果检验方法.docx VIP
- T∕CCGA 50018-2025 医用混合气体 医用氧气医用氦气.docx VIP
- KA 42.3-2026 矿山安全专业服务机构能力要求第3部分:煤矿灾害等级鉴定.docx VIP
- 清晰版 JJF(苏) 306-2025 油水界面仪校准规范.docx VIP
原创力文档

文档评论(0)