【百度】包沉浮-大模型原生安全构建之路.docxVIP

  • 2
  • 0
  • 约3.98千字
  • 约 20页
  • 2026-03-27 发布于浙江
  • 举报

【百度】包沉浮-大模型原生安全构建之路.docx

大模型原生安全构建之路百度安全技术委员会主席包沉浮

大模型原生安全构建之路

百度安全技术委员会主席

包沉浮模型的安全风险大模型安全的实现路径

01

02

03

04

大模型的安全风险

大模型安全的实现路径

大模型原生安全体系的构建

总结和展望

一、大模型的安全风险

一、大模型的安全风险

Claude3.5ComputerUse

Claude3.5ComputerUse

大模型的核心安全风险模型训练内容风险文本/图像/视频/音频用户直接输入大模型间接输入(应用预置Pr

大模型的核心安全风险

模型训练

内容风险

文本/图像/视频/音频

用户直接输入

大模型

间接输入

(应用预置Prompt,文档,..)

代码/可执行对象

执行风险

内容风险利用AIGC进行网络诈骗、网络钓鱼、黑客攻击等恶意行为恶意利用输出内容带有负面情绪引导、AI自我意识产生的唯饭主流价值观的内容违反社会价值观可能涉及个人隐私,如生成包含真实个人信息的文本或合成真实人物的图像隐私泄漏国家、区域等政策、法律法规等潜在问题其它风险性别、种族、地域、信仰、年龄等各方面偏见、歧视类偏见/歧视类AI生成的内容可能包含暴力、色情、煽动性、低俗、或其他违反法律法规的内容违法违规内容生成不准确、拥有误导性、干扰性等虚假信息误导/虚假信息利用AIGC生成模仿受版权保护的作品等内容侵权

内容风险

利用AI

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档