Facebook首次開源超級圍棋AI,復(fù)現(xiàn)AI高手AlphaZero
最近,F(xiàn)acebook的人工智能研究所(以下簡稱FAIR)宣布,他們開源了自研的圍棋AI訓練模型和代碼。這意味著,你可以隨時隨地和Facebook的人工智能下圍棋了,而且此圍棋AI程序重現(xiàn)的是名噪一時的AI高手AlphaZero。
去年5月,F(xiàn)AIR發(fā)布了ELF Open GO,ELF OpenGo是FAIR依照DeepMind在《自然》上發(fā)表的和AlphaGo Zero以及AlphaZero相關(guān)的論文,做出的開源計算機圍棋程序,也就是說,ELF OpenGo不使用人類棋譜與累積的圍棋知識,僅使用單一類神經(jīng)網(wǎng)絡(luò)從自我對弈中學習。
該圍棋AI之前在和韓國棋院的專業(yè)圍棋選手對弈中,都取得不錯的成績。據(jù)悉,OpenGo 的最新版本使用2000塊GPU訓練了15天后,在一塊GPU的情況下與4個排名前30的職業(yè)選手進行比賽時,取得了20:0全勝的戰(zhàn)績,可謂是戰(zhàn)無不勝。
在這次開源的論文中,F(xiàn)AIR研究人員全面披露了ELF OpenGo的訓練過程,包括取得的是三個突破。
一是為ELF OpenGo訓練了一個超人類棋藝的模型,他們在2000個GPU上運行類AlphaZero的訓練軟件9天后,有20個模塊的模型超越了人類水平。
二是提供了模型在訓練過程中的行為分析,包括和其他模型的對比、學習速度、學習難度等等。
三是通過實施ablation實驗,以研究AlphaZero風格算法的性質(zhì),他們發(fā)現(xiàn)對于最終模型而言,對局中加倍rollout水平大約提升200 ELO,AI的發(fā)揮會受到模型容量的限制。
最后,此次論文的主要作者為田淵棟,他一直負責Facebook的圍棋AI相關(guān)研究,在此前的一篇知乎文章中,他提到:DeepMind不開源也不透露細節(jié),文章里面一些地方也沒有寫得很清楚。沒有第一手經(jīng)驗總不是很踏實。所以本著研究目的,我們需要復(fù)現(xiàn)一下,先有復(fù)現(xiàn),才有創(chuàng)新,這個是做研究的習慣。而且如果我們?nèi)タ?ELF OpenGo 的代碼,會發(fā)現(xiàn)其完全適用于其它方向的工作。而圍棋對我們來說,只是一個把算法和平臺做好的手段。在這一點上,花點時間把圍棋做好是值得的。
最后,關(guān)于ELF OpenGo最新訓練模型的具體數(shù)據(jù)可以閱讀原文獲取論文鏈接了解。
請輸入評論內(nèi)容...
請輸入評論/評論長度6~500個字
最新活動更多
-
10月31日立即下載>> 【限時免費下載】TE暖通空調(diào)系統(tǒng)高效可靠的組件解決方案
-
即日-11.13立即報名>>> 【在線會議】多物理場仿真助跑新能源汽車
-
11月28日立即報名>>> 2024工程師系列—工業(yè)電子技術(shù)在線會議
-
12月19日立即報名>> 【線下會議】OFweek 2024(第九屆)物聯(lián)網(wǎng)產(chǎn)業(yè)大會
-
即日-12.26火熱報名中>> OFweek2024中國智造CIO在線峰會
-
即日-2025.8.1立即下載>> 《2024智能制造產(chǎn)業(yè)高端化、智能化、綠色化發(fā)展藍皮書》
推薦專題
- 高級軟件工程師 廣東省/深圳市
- 自動化高級工程師 廣東省/深圳市
- 光器件研發(fā)工程師 福建省/福州市
- 銷售總監(jiān)(光器件) 北京市/海淀區(qū)
- 激光器高級銷售經(jīng)理 上海市/虹口區(qū)
- 光器件物理工程師 北京市/海淀區(qū)
- 激光研發(fā)工程師 北京市/昌平區(qū)
- 技術(shù)專家 廣東省/江門市
- 封裝工程師 北京市/海淀區(qū)
- 結(jié)構(gòu)工程師 廣東省/深圳市