提升大语言模型推理能力的研究汇报
——利用自我纠错和跨学科数据增强泛化能力汇报人:蔡奇栩汇报时间:2025/04/10
1.推理模型都喜欢犯一些什么样的错误?
CPL:CriticalPlanStepLearningBoostsLLMGeneralizationinReasoningTasks
错误数据是有价值的!!!
LEMMA:LearningfromErrorsforMatheMaticalAdvancementinLLMs提出利用错误数据来提升LLM数学推理能力的新方法。作者首先对模型生成的错误进行细粒度分类(如“问题误解”、“公式应用错误”、“
原创力文档

文档评论(0)