20210922-申万宏源-机器学习系列报告之三:超越AlphaGo,自我学习规则的MuZero有何突破?.pdfVIP

  • 10
  • 0
  • 约4.17万字
  • 约 22页
  • 2022-05-29 发布于广东
  • 举报

20210922-申万宏源-机器学习系列报告之三:超越AlphaGo,自我学习规则的MuZero有何突破?.pdf

权 益 量 化 研 究 2021 年 09 月 22 日 超越 AlphaGo ,自我学习规则的 权 MuZero 有何突破? 益 量 化 ——机器学习系列报告之三 研 究 相关研究 本期投资提示: 《量化投资新起点——机器学习系列报 证 告之一》2020 年 9 月 1 日 ⚫ MuZero 自我学习规则,降低了对环境信息的依赖,具有更强的泛化能力。2020 年底, 券 《机器学习合成非线性因子,增强效果 研 如何?——机器学习系列报告之二》 DeepMind 提出 MuZero。MuZero 取得的一项突破进展是可以对规则进行自我学习,降 究 2021 年 3 月 12 日 低了对环境信息的依赖。在之前的几个版本中,应用场景主要还是棋类游戏。而 MuZero 报 在 Atari 游戏中,也可以取得很好的效果。 告 ⚫ AlphaGo 成功地将深度神经网

文档评论(0)

1亿VIP精品文档

相关文档