Logic-RL:通过基于规则的强化学习释放大模型推理能力.pdf

Logic-RL:通过基于规则的强化学习释放大模型推理能力.pdf

ML-Summit2025

CSDNBoolan全球机器学习技术大会

2025全球机器学习技术大会

Logic-RL:通过规则强化学习

释放大模型推理能力

微软亚洲研究院邱凯

文档评论(0)

1亿VIP精品文档

相关文档