跳转到主要内容

12 · 09学会玩游戏智能究竟从何而来

🔊 全文章节朗读

09学会玩游戏智能究竟从何而来

第九章,学会玩游戏,智能究竟从何而来。本章梳理人工智能征服游戏的历程。DeepMind把强化学习的Q学习与深度网络结合成深度Q学习,在四十九款雅达利游戏上,超过一半胜过人类测试员,打砖块的得分是人类的十倍以上,还自己悟出了在砖墙边缘打隧道的高招,谷歌随即以约六点五亿美元收购DeepMind。作者回顾了历史:塞缪尔的跳棋程序奠定了博弈树、评估函数和自对弈学习三个概念;深蓝靠暴力搜索击败卡斯帕罗夫,却被认为并不智能。围棋每步平均有二百五十种走法,没人能写出评估函数,曾预言要一百年才能被攻克。2016年AlphaGo击败李世石,第二局走出被誉为神之一手的一步棋,全球超过两亿人观看。它的秘诀是深度Q学习加蒙特卡洛树搜索,经过约五百万局自我对弈训练,神经网络起到了直觉的作用。


自动同步自湛庐有声书管线 · HedgeDoc 原页