VASTOCE
RSS
行情
正在读取公开行情
人工智能

2016 年 3 月 9 日至 15 日:AlphaGo 在首尔 4–1 赢了李世石

2016 年 3 月 9 日到 15 日,DeepMind 的 AlphaGo 在首尔与李世石下五盘,总比分 4–1。第二盘的第 37 手、第四盘李世石的第 78 手,后来都成了被单独拿出来讲的棋。

1 分钟阅读 Vastoce

2016 年 3 月,首尔。DeepMind 的 AlphaGo 和李世石下五盘,都在规定时间内结束,且都以投子认输收场。公开对局表写得很清楚:9 日第一盘 AlphaGo 胜;10 日第二盘 AlphaGo 胜;12 日第三盘 AlphaGo 胜;13 日第四盘李世石胜;15 日第五盘 AlphaGo 胜。总比分 4–1。

DeepMind 自己的页面写:这场比赛有超过两亿人观看;李世石是当时公认的顶尖棋手之一。2015 年 10 月,AlphaGo 已经 5–0 赢过欧洲冠军樊麾。对李世石这一轮,才是对「职业顶尖」的公开检验。

机制上它不是 Deep Blue 那种专用象棋芯片。公开论文和技术说明写的是:深度神经网络加蒙特卡洛树搜索,再用自我对弈强化学习补训练。围棋合法局面远多于国际象棋,穷举走不通。

第二盘 AlphaGo 执黑的第 37 手,被许多职业棋手说「不像人会下的」。第四盘李世石的第 78 手,又把机器拉回一场人类胜利。两手都能在对局记录里核对,不要把它们写成传说。

3 月 17 日,韩国政府宣布未来五年向人工智能投入 1 万亿韩元。这是比赛之后的政策反应,不是比赛本身的一部分。DeepMind 后来把 AlphaGo 的后续版本写成 AlphaGo Zero、AlphaZero,训练更少依赖人类棋谱。那些是 2017 年的论文,不要和 2016 年 3 月这五盘混成一次发布。

能核对的是对局日期、比分和基金会自己的页面。把第五盘当成「人类再也赢不了围棋」会过满——职业棋手后来仍在和更强的程序训练,但公开世界冠军对抗赛这一档,2016 年 3 月已经翻过一页。

常见问题

哪一天打完?

第五盘在 2016 年 3 月 15 日。李世石赢的是 13 日第四盘。

是不是从未输过?

不是。五盘里输了一盘。

和樊麾那盘是一回事吗?

不是。樊麾是 2015 年 10 月,5–0。

参考资料

  1. DeepMind — AlphaGo
  2. Wikipedia — AlphaGo versus Lee Sedol

本站作者做的阅读器

Kite RSS

用 Kite RSS 订一份自己的时间线

本站的文章会进订阅源。你也可以把别的公开源放进去,在自己的设备上读,不经过推荐流。