新版阿尔法狗再进化让柯洁感叹人类是多余的,仅自学3天100:0完虐前任

指微微 指微微      2017年10月19日 15:12

看到了新版的alphago,人类震惊了,柯洁震惊了,人类简直就是多余的

DeepMind公布了AlphaGo的最新升级版本AlphaGo Zero,并于最新一期的《自然》杂志上,对其使用的相应技术做出详解。

DeepMind称,“AlphaGo Zero与AlphaGo最大的不同是做到了真正的自我学习,经过3天的训练,就以100:0的战绩完胜前代AlphaGo。

顶  3 踩  0


  • 指微微 指微微

    之所以 AlphaGo Zero 比通过人类数据学习获得更好的成绩,是因为:

    首先,AlphaGo Zero 仅用棋盘上的黑白子作为输入,而前代则包括了小部分人工设计的特征输入。

    其次,AlphaGo Zero 仅用了单一的神经网络。在此前的版本中,AlphaGo用到了“策略网络”来选择下一步棋的走法,以及使用“价值网络”来预测每一步棋后的赢家。而在新的版本中,这两个神经网络合二为一,从而让它能得到更高效的训练和评估。

    第三,AlphaGo Zero 并不使用快速、随机的走子方法。在此前的版本中,AlphaGo用的是快速走子方法,来预测哪个玩家会从当前的局面中赢得比赛。相反,新版本依靠地是其高质量的神经网络来评估下棋的局势。

    阿尔法狗的学习围棋知识的过程


  • 指微微 指微微

    阿尔法狗的学习曲线,如何3天快速掌握围棋的

登录 后才能发表回复哦~