《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 10-防御与治理的共性技术.ppt

《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 10-防御与治理的共性技术.ppt

评估与验证MUSE(MachineUnlearningSix-WayEvaluation)是一个全面的机器遗忘评估基准,旨在系统评估大语言模型在删除特定训练数据后的性能。该框架由华盛顿大学、普林斯顿大学等机构的研究人员在2024年提出,针对语言模型在隐私保护和版权合规方面的挑战,定义了六项关键评估要求,以平衡数据删除效果与模型可用性。R-TOFU(ReasoningTOFU)体系将最终的事实评估扩展到模型的中间推理链,测试模型是否能在实现遗忘目标的同时,遗忘推导出该目标的中间推理步骤。机器遗忘带来的防御挑战攻击者可能伪造遗忘请求,要求模型遗忘合理的数据,实施定向删除。机器遗

您可能关注的文档

文档评论(0)

1亿VIP精品文档

相关文档