- 3
- 0
- 约3.7千字
- 约 6页
- 2023-08-05 发布于广东
- 举报
Sec.3 :从RL 领会如何与不确定性共舞
(Reinforcement learning for dealing with decision making under uncertainty)
1. 前言
在上一期里,说明了人类的慢想(创意)与AI 的快思(直觉)互相平衡,最能展现协
同创造力。有了AI 经验直觉来协助去芜存菁,人类更敢超越经验去进行大跨度的联
想和探索。
这样的协同组织体系,非常适合与高度不确定的外在环境(Environment)互动,并
从外在环境获取最大的报酬。这是自然界生物(有机体系) 的天赋学习本质,非常接近
于AI 强化学习(Reinforcement Learning ,简称RL)机制。例如,AlphaGo Zero 增添了RL ,
就具有更强大的探索能力,能够在不确定性极大的围棋上打败人类的顶尖高手。如图-1:
1
深圳巨存信息技术有限公司 (yelan2003@126.com )
图-1
本文就藉由RL 来说明上述的协同创新力,如何表现于不确性环境里的决策。也
进一步阐述其探索全局最优解(Global optimum)的思维过程。
2. 认识强
您可能关注的文档
- DB4404∕T 42.1—2023 产后母婴服务 第1部分:基本要求.pdf
- 巨存AI产业_Sec_0_介绍生成对抗网络(GAN).pdf
- 巨存AI产业_Sec_1_从GAN领悟人机协同创新之道.pdf
- 巨存AI产业_Sec_2_人机协同如何激发创新力.pdf
- 巨存AI产业_Sec_4_从因果律看人机协同创新.pdf
- 巨存AI产业_Sec_5_从因果律看人机协同创新(续篇).pdf
- 巨存AI产业_Sec_6_人机协同决策.pdf
- 巨存AI产业_Sec_7_人机协同决策(续).pdf
- 融资计划书模版 -简约.pdf
- YDT -2023接入网技术要求 50Gbits无源光网络(50G-PON) 第2部分:物理媒质相关(PMD).pdf
最近下载
- 耳鼻喉科患者扁桃体术后出血应急预案演练脚本.docx
- 作业完成情况分析与改进策略调查报告.docx VIP
- 乙炔炭黑生产作业指导书实用版.pdf
- 标准图集-14J938-抗爆、泄爆门窗及屋盖、墙体建筑构造.pdf VIP
- 章建跃-核心素养理念下的数学教学变革-广东-.ppt VIP
- 数学核心素养统领下的数学教学变革(章建跃.pptx VIP
- JJG(交通)055-2004 沥青标准粘度计检定规程.pdf VIP
- 《直观想象》课件.ppt VIP
- AWS D1.1-2020钢结构制造最新标准 Structural Welding Code_Steel.pdf VIP
- SigmaI SGDA User 操作说明书手册.pdf VIP
原创力文档

文档评论(0)