AI安全评估:模型能力升级与纵深防御产业观察.pptx

AI安全评估:模型能力升级与纵深防御产业观察.pptx

产业观察报告AI安全评估:模型能力升级与纵深防御产业观察能力边界·风险敞口·纵深防御·算力负载作者公众号:哔咘的科技笔记·2026年10月

内容导航01能力升级与风险敞口模型能力边界外移,智能体扩大风险面02纵深防御体系训练、评估、运行、治理四层控制03产业趋势与算力负载安全投入改变研发门槛与算力需求04产业观察与风险提示价值扩散方向与行业风险因素

01CHAPTER能力升级与风险敞口能力跑得比控制体系快从内容风险到行动风险,安全评估需覆盖完整调用链

模型能力边界快速外移模型能力边界快速外移,风险性质由内容生成扩展到行动执行。风险性质由内容生成扩展到行动执行能力边界外移行动执行前沿模型初级网络安全任务成功率来源:AISI连续测评AISI连续测评显示,2025年前沿模型首次完成通常需十年以上经验的专家级任务风险边界随能力扩展早期风险事实错误、有害内容、偏见、隐私泄露与版权争议扩展工具接入浏览器、代码执行器、企业知识库,具备连续规划与修改外部状态能力评估覆盖完整调用链:系统提示词、检索数据、身份权限、工具配置都会改变最终风险

长任务翻倍周期持续缩短任务集持续扩容METR以人类专家完成任务所需时间衡量智能体自主任务能力。2026年TH1.1将任务集由170项增至228项,需8小时以上的长任务由14项增至31项。翻倍周期加速缩短按50%成功率计算,任务时长翻倍周期约130.8天,较上一

文档评论(0)

1亿VIP精品文档

相关文档