7.2.1拓展阅读:围棋人工智能程序——AlphaGo.docxVIP

  • 0
  • 0
  • 约1.13千字
  • 约 1页
  • 2026-07-30 发布于黑龙江
  • 举报

7.2.1拓展阅读:围棋人工智能程序——AlphaGo.docx

围棋人工智能程序——AlphaGo

阿尔法围棋(AlphaGo)是一款围棋人工智能程序。其主要工作原理是深度学习。深度学习是指多层的人工神经网络和训练它的方法。一层神经网络会把大量矩阵数字作为输入,通过非线性激活方法取权重,再产生另一个数据集合作为输出。这就像生物神经大脑的工作机理一样,通过合适的矩阵数量,多层组织链接一起,形成神经网络大脑进行精准复杂的处理,就像人们识别物体标注图片一样。

阿尔法围棋用到了很多新技术,如神经网络、深度学习、蒙特卡洛树搜索法等,使其实力有了实质性飞跃。美国脸书公司黑暗森林围棋软件的开发者田渊栋在网上发表分析文章说,阿尔法围棋系统主要由几个部分组成:一、策略网络(PolicyNetwork),给定当前局面,预测并采样下一步的走棋;二、快速走子(Fastrollout),目标和策略网络一样,但在适当牺牲走棋质量的条件下,速度要比策略网络快1000倍;三、价值网络(ValueNetwork),给定当前局面,估计是白胜概率大还是黑胜概率大;四、蒙特卡洛树搜索(MonteCarloTreeSearch),把以上这三个部分连起来,形成一个完整的系统。

2016年3月,阿尔法围棋与围棋世界冠军、职业九段棋手李世石进行围棋人机大战,以4比1的总比分获胜;2016年末2017年初,该程序在中国棋类网站上以大师(Master)为注册帐号与中日韩数

文档评论(0)

1亿VIP精品文档

相关文档