2016 年 3 月,首尔。DeepMind 的 AlphaGo 和李世石下五盘,都在规定时间内结束,且都以投子认输收场。公开对局表写得很清楚:9 日第一盘 AlphaGo 胜;10 日第二盘 AlphaGo 胜;12 日第三盘 AlphaGo 胜;13 日第四盘李世石胜;15 日第五盘 AlphaGo 胜。总比分 4–1。
DeepMind 自己的页面写:这场比赛有超过两亿人观看;李世石是当时公认的顶尖棋手之一。2015 年 10 月,AlphaGo 已经 5–0 赢过欧洲冠军樊麾。对李世石这一轮,才是对「职业顶尖」的公开检验。
机制上它不是 Deep Blue 那种专用象棋芯片。公开论文和技术说明写的是:深度神经网络加蒙特卡洛树搜索,再用自我对弈强化学习补训练。围棋合法局面远多于国际象棋,穷举走不通。
第二盘 AlphaGo 执黑的第 37 手,被许多职业棋手说「不像人会下的」。第四盘李世石的第 78 手,又把机器拉回一场人类胜利。两手都能在对局记录里核对,不要把它们写成传说。
3 月 17 日,韩国政府宣布未来五年向人工智能投入 1 万亿韩元。这是比赛之后的政策反应,不是比赛本身的一部分。DeepMind 后来把 AlphaGo 的后续版本写成 AlphaGo Zero、AlphaZero,训练更少依赖人类棋谱。那些是 2017 年的论文,不要和 2016 年 3 月这五盘混成一次发布。
能核对的是对局日期、比分和基金会自己的页面。把第五盘当成「人类再也赢不了围棋」会过满——职业棋手后来仍在和更强的程序训练,但公开世界冠军对抗赛这一档,2016 年 3 月已经翻过一页。
