- 10
- 0
- 约4.17万字
- 约 22页
- 2022-05-29 发布于广东
- 举报
权
益
量
化
研
究
2021 年 09 月 22 日 超越 AlphaGo ,自我学习规则的
权 MuZero 有何突破?
益
量
化 ——机器学习系列报告之三
研
究
相关研究
本期投资提示:
《量化投资新起点——机器学习系列报
证 告之一》2020 年 9 月 1 日 ⚫ MuZero 自我学习规则,降低了对环境信息的依赖,具有更强的泛化能力。2020 年底,
券 《机器学习合成非线性因子,增强效果
研 如何?——机器学习系列报告之二》 DeepMind 提出 MuZero。MuZero 取得的一项突破进展是可以对规则进行自我学习,降
究 2021 年 3 月 12 日 低了对环境信息的依赖。在之前的几个版本中,应用场景主要还是棋类游戏。而 MuZero
报 在 Atari 游戏中,也可以取得很好的效果。
告
⚫ AlphaGo 成功地将深度神经网
原创力文档

文档评论(0)