Logic-RL:通过基于规则的强化学习释放大模型推理能力.docx

Logic-RL:通过基于规则的强化学习释放大模型推理能力.docx

ML-Summit2025

CSDNBoolan全球机器学习技术大会

2025全球机器学习技术大会

Logic-RL:通过规则强化学习

释放大模型推理能力

微软亚洲研究院邱凯

ML-Summit2025

全球机器学习技术大会

背景与动机

数据与算法

实验与分析

总结与展望

ML-Summit2025

全球机器学习技术大会

01背景与动机

2025全球机器学习技术大会背景

2025

全球机器学习技术大会

研究动机

·如何在大

文档评论(0)

1亿VIP精品文档

相关文档