提升大语言模型推理能力.pptx

提升大语言模型推理能力的研究汇报

——利用自我纠错和跨学科数据增强泛化能力汇报人:蔡奇栩汇报时间:2025/04/10

1.推理模型都喜欢犯一些什么样的错误?

CPL:CriticalPlanStepLearningBoostsLLMGeneralizationinReasoningTasks

错误数据是有价值的!!!

LEMMA:LearningfromErrorsforMatheMaticalAdvancementinLLMs提出利用错误数据来提升LLM数学推理能力的新方法。作者首先对模型生成的错误进行细粒度分类(如“问题误解”、“公式应用错误”、“

文档评论(0)

1亿VIP精品文档

相关文档