御风
2017年5月,千年水乡乌镇迎来了一场举世瞩目的围棋峰会,世界第一的中国九段棋手柯洁以0︰3输给了阿尔法狗。中国围棋协会向阿尔法狗授予中国职业九段称号,这是中国迄今为止最年轻的九段。早些时候,聂卫平曾评价阿尔法狗的围棋水平相当于职业围棋二十段。
阿尔法狗是什么?它是由英国谷歌深度学习部门开发出来的围棋人工智能程序,是迄今为止最强大的围棋棋手,让我们看看它是如何下围棋的。
围棋的难在于如何分析看似无限的信息与可能。在一局围棋中,平均每一步围棋的下法大约有200种可能,棋盘上可能出现的局面总数远大于宇宙中原子的总数。要想通过暴力、直接手段预测所有情况,并从中筛选出最优走法的思路并不可行。阿尔法狗在围棋中取胜的秘诀有三个:深度神经网络、监督/强化学习、蒙特卡罗树搜索。
深度神经网络是一种模拟人类思维方式的计算机神经网络,它可以通过大量数据信息,寻找到最合适的解决方式和算法。阿尔法狗包含两种深度神经网络:数值网络和策略网络。数值网络是对于盘面优势的判断机制,它计算预测每种不同下法带来的胜率变化。如果在试走两三步棋后,發现胜率不足,就会放弃这个走法,改试其他可能。这使得阿尔法狗能够明晰局势判断,左右全局“战略”,抛弃不合适的路线,可有效减少分析深度;而策略网络则是学习人类的棋谱,通过分析数十万个棋谱,选出20个胜率最高的下一步走法。……