评估与验证MUSE(MachineUnlearningSix-WayEvaluation)是一个全面的机器遗忘评估基准,旨在系统评估大语言模型在删除特定训练数据后的性能。该框架由华盛顿大学、普林斯顿大学等机构的研究人员在2024年提出,针对语言模型在隐私保护和版权合规方面的挑战,定义了六项关键评估要求,以平衡数据删除效果与模型可用性。R-TOFU(ReasoningTOFU)体系将最终的事实评估扩展到模型的中间推理链,测试模型是否能在实现遗忘目标的同时,遗忘推导出该目标的中间推理步骤。机器遗忘带来的防御挑战攻击者可能伪造遗忘请求,要求模型遗忘合理的数据,实施定向删除。机器遗
您可能关注的文档
- 《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 3-网络安全中的AI应用与对抗场景.ppt
- 《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 4-AIGC的滥用与伦理风险.ppt
- 《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 5-机器学习系统的攻击者.ppt
- 《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 6-对抗样本的理论与方法.ppt
- 《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 7-典型的对抗攻击方法与实例.ppt
- 《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 8-智能系统的数据隐私攻击.ppt
- 《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 9-聚类模型的攻击.ppt
- 《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 11-非平衡数据分类.ppt
- 《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 12-噪声数据处理.ppt
- 《人工智能安全》 第2版 曾剑平教材(复旦大学) ppt课件 13-小样本学习方法.ppt
原创力文档

文档评论(0)