巨存AI产业_Sec_3_从RL领会如何与不确定性共舞.pdfVIP

  • 3
  • 0
  • 约3.7千字
  • 约 6页
  • 2023-08-05 发布于广东
  • 举报

巨存AI产业_Sec_3_从RL领会如何与不确定性共舞.pdf

Sec.3 :从RL 领会如何与不确定性共舞 (Reinforcement learning for dealing with decision making under uncertainty) 1. 前言 在上一期里,说明了人类的慢想(创意)与AI 的快思(直觉)互相平衡,最能展现协 同创造力。有了AI 经验直觉来协助去芜存菁,人类更敢超越经验去进行大跨度的联 想和探索。 这样的协同组织体系,非常适合与高度不确定的外在环境(Environment)互动,并 从外在环境获取最大的报酬。这是自然界生物(有机体系) 的天赋学习本质,非常接近 于AI 强化学习(Reinforcement Learning ,简称RL)机制。例如,AlphaGo Zero 增添了RL , 就具有更强大的探索能力,能够在不确定性极大的围棋上打败人类的顶尖高手。如图-1: 1 深圳巨存信息技术有限公司 (yelan2003@126.com ) 图-1 本文就藉由RL 来说明上述的协同创新力,如何表现于不确性环境里的决策。也 进一步阐述其探索全局最优解(Global optimum)的思维过程。 2. 认识强

文档评论(0)

1亿VIP精品文档

相关文档