- 1
- 0
- 约小于1千字
- 约 13页
- 2026-08-23 发布于福建
- 举报
主讲:张静人工智能机器学习概念及发展简史
案例引入
案例引入AlphaGo结合了监督学习和强化学习的优势,通过训练形成一个策略网络,阿尔法狗团队从在线围棋对战平台KGS上获取了16万局人类棋手的对弈棋谱,并从中采样了3000万个样本作为训练样本。将棋盘上的局势作为输入信息,并对所有可行的落子位置生成一个概率分布。然后,训练出一个价值网络对自我对弈进行预测,预测所有可行落子位置的结果。
案例引入一副棋盘和黑白两子4个TPU(TensorProcessingUnit)左右互搏490万棋局以100:0打败哥哥AlphaGoAlphaZero算法可以通过8小时训练击败AlphaGo;再用4小时训
原创力文档

文档评论(0)