《電子技術應用》
您所在的位置:首頁 > 可編程邏輯 > 業界動態 > 被成為“圍棋上帝”的AlphaGo,真的在機器學習領域無敵?

被成為“圍棋上帝”的AlphaGo,真的在機器學習領域無敵?

2017-06-05

這幾日,只要提起AlphaGo,相信大家想起的一定是在前幾日的圍棋大賽中,無論是單人戰,雙人戰,還是群毆戰,AlphaGo都無一例外的身居“常勝將軍”位,而AlphaGo的創作團隊公司Deep mind在官網宣布這次的圍棋峰會將是AlphaGo的最后一次比賽。那么,不進行圍棋賽的AlphaGo還可以做什么呢?OpenAI研究科學家,斯坦福大學的CS博士生Andrej Karpathy就AlphaGo在機器人領域的應用發表了一些他的看法,機器人圈整理編譯如下:

我有機會和幾個人聊了一聊近期與AlphaGo柯潔等人的比賽。尤其是,媒體報道內容大部分是大眾科學+PR的混合體,所以我看到的最常見的問題是“AlphaGo的突破性表現在哪里”,“AI的研究人員如何看待它的勝利?”和“勝利將取得什么樣的影響”。我把我的一些想法寫成文章與大家分享。

很酷的部分

AlphaGo由許多相對標準的技術組成:行為克隆(對人類展示的數據進行監督學習)、強化學習(REINFORCE)、價值函數和蒙特卡洛樹搜索(MCTS)。然而,這些組件的組合方式是極具創新,并不是完全標準的。特別是,AlphaGo使用SL(監督學習)策略來初始化RL(強化學習)策略得到完善自我發揮,然后他們預估價值函數,然后將其插入到MCTS中使用(更糟糕但更多樣化的)SL策略展示出來。另外,策略/價值網是深度神經網絡,所以使一切正常工作都能呈現自己獨特的挑戰(例如,價值功能以一種棘手的方式進行培訓以防止過度擬合)。在所有這些方面,DeepMind都執行得很好。話雖如此,AlphaGo本身并沒有使用任何基本的算法突破來解決強化學習的難題。

狹義范疇

AlphaGo還是一個狹義的AI系統,會下圍棋,但也僅此而已。來自DeepMind的ATARI玩家不會使用AlphaGo所采取的方法,神經圖靈機(Neural Turing Machines)與AlphaGo無關,Google數據中心的改進也絕對不會使用AlphaGo,同時,Google搜索引擎也不會使用AlphaGo。因此,AlphaGo不會推廣到圍棋以外的任何地方,但是人們和潛在的神經網絡組件做的比這些過去的人工智能要好得多,每個演示都需要專門的顯式代碼的存儲庫。

圍棋的便利屬性

我想通過明確地列出圍棋所具有的特定屬性來擴展AlphaGo的狹義性,AlphaGo從中受益匪淺。這可以幫助我們考慮是否推廣AlphaGo。圍棋是:

1、完全確定性。游戲規則中沒有噪音;如果兩位玩家采取相同的動作順序,那么后面的狀態將永遠是一樣的。

2、充分觀察。每個玩家都有完整的信息,沒有隱藏的變量。例如,德州撲克(Texas hold’em)對該屬性不滿意,因為看不到其他玩家的牌。

3、動作空間是離散的。一些獨特的棋子移動是很有效的。相比之下,在機器人技術中,你可能希望在每個節點都需要具有連續性的控制。

4、我們有一個完美的模擬器(游戲本身),所以任何動作的效果都是公開透明的。這是一個強有力的假設,AlphaGo依然非常強大,但這種情形在現實世界中也是相當罕見的。

5、每一盤棋時間相對較短,約200手。相對于強化學習階段,與其他可能涉及每局的數千(或更多)手相比,這是一個相對較短的時間范圍。

6、評估清晰、快速,允許大量的試錯體驗。換句話說,玩家可以體驗數百萬次的勝利/失敗,這樣就可以慢慢而可靠地深入學習,就像深度神經網絡優化一樣。

7、有大量的人類玩游戲棋譜數據可用于引導學習,所以AlphaGo不必從頭開始。

AlphaGo應用于機器人技術?

以上列舉了圍棋的一些吸引人的屬性,讓我們來看一下機器人問題,看看我們如何將AlphaGo應用到機器人中,例如亞馬遜揀選機器人中。這個問題只是想想就覺得有點滑稽。

·首先,你的動作(高維度、連續)由機器人的電機笨拙/嘈雜地執行。(違反1、3)

·機器人可能必須環顧要移動的物品,因此并不總是能感知所有相關信息,并且有時需要根據需要收集。(違反2)

·我們可能有一個物理模擬器,但是這些模擬器是非常不完美的(尤其是模擬接觸力的東西);這帶來了自己的一些挑戰(違反4)。

·取決于你的行動空間抽象程度(原始扭矩 - >夾子的位置),一個成功的動作片段可能比200個動作長得多(即5取決于設置)。更長的動作片段增加了信用分配問題,學習算法難以在任何結果的行動中分配責任。

·由于我們在現實世界中運作,機器人在數百萬次的時間內(成功/失敗)會變得更加困難。方法之一是并聯機器人,但這可能非常昂貴。此外,機器人失敗可能涉及機器人本身的損害。另一種方法是使用模擬器,然后轉移到現實世界中,但這會在域名轉移中帶來自己的一套新的、不平凡的挑戰。(違反6)

·最后,很少有數百萬可以展示的人類數據源。(違反7)

簡而言之,基本上每個單一的假設,即圍棋的便利屬性都被AlphaGo違背了,任何成功的方法都將看起來都不一樣了。更普遍的是,上面圍棋的一些屬性與當前的算法(例如1、2、3)并不是不可克服的,有些是存在問題(5、7),但是有些對于AlphaGo的訓練是非常關鍵的,但是很少存在于其他真實世界的應用(4、6)。

結論

雖然AlphaGo并沒有在AI算法中并沒有實現根本性的突破,雖然它仍然是狹隘人工智能的一個例子,但AlphaGo也象征著Alphabet的AI能力:公司的人才數量/質量、他們掌握的計算資源,以及公司高層對AI的關注。

AlphaGo是Alphabet在人工智能領域設置的一場賭局,但AlphaGo是安全的,毋庸置疑。

本站內容除特別聲明的原創文章之外,轉載內容只為傳遞更多信息,并不代表本網站贊同其觀點。轉載的所有的文章、圖片、音/視頻文件等資料的版權歸版權所有權人所有。本站采用的非本站原創文章及圖片等內容無法一一聯系確認版權者。如涉及作品內容、版權和其它問題,請及時通過電子郵件或電話通知我們,以便迅速采取適當措施,避免給雙方造成不必要的經濟損失。聯系電話:010-82306118;郵箱:aet@chinaaet.com。
亚洲一区二区欧美_亚洲丝袜一区_99re亚洲国产精品_日韩亚洲一区二区
一本大道久久a久久精品综合| 亚洲欧美日韩另类| 一区二区免费在线观看| 亚洲风情亚aⅴ在线发布| 国产一区二区三区四区| 国产精品一区一区三区| 国产精品久久久爽爽爽麻豆色哟哟| 欧美日韩成人激情| 欧美精品电影| 欧美激情一区二区三区高清视频| 免费成人高清视频| 久久亚洲国产精品日日av夜夜| 久久久精品tv| 久久午夜电影| 久热精品视频在线观看一区| 久久伊人亚洲| 蜜臀va亚洲va欧美va天堂| 免费成人激情视频| 欧美黄色aa电影| 欧美日韩不卡视频| 欧美午夜剧场| 国产精品理论片在线观看| 国产精品实拍| 国产偷国产偷亚洲高清97cao| 国产亚洲欧洲997久久综合| 国产在线乱码一区二区三区| 激情视频亚洲| 亚洲激情专区| 亚洲作爱视频| 亚洲综合首页| 亚洲第一区中文99精品| 亚洲欧洲日韩在线| 夜夜嗨av色综合久久久综合网| 亚洲图片欧美日产| 亚洲女人天堂av| 久久精品夜色噜噜亚洲aⅴ| 久久综合一区二区三区| 欧美激情综合五月色丁香小说 | 午夜久久资源| 久久国产一区二区| 美女精品在线| 欧美无乱码久久久免费午夜一区| 国产精品国产成人国产三级| 国产视频欧美视频| 亚洲国产精品高清久久久| 一本一本久久| 久久国产福利国产秒拍| 亚洲精选一区二区| 午夜在线a亚洲v天堂网2018| 久久欧美中文字幕| 欧美日韩亚洲一区三区| 国产视频欧美| 亚洲精品影院| 欧美影院成人| 亚洲一级黄色片| 久久亚洲综合| 国产精品久久久久久妇女6080| 国内精品久久久久久久果冻传媒 | 99视频有精品| 久久福利精品| 这里只有精品在线播放| 久久精品一区二区三区四区 | 男男成人高潮片免费网站| 欧美丝袜一区二区三区| 好吊色欧美一区二区三区四区| 亚洲人成人一区二区三区| 亚洲欧美制服另类日韩| 亚洲美洲欧洲综合国产一区| 午夜视频一区二区| 欧美成人视屏| 国产日产欧产精品推荐色| 亚洲精品一区久久久久久| 久久福利资源站| 午夜精彩视频在线观看不卡| 欧美国产日韩免费| 国产一区清纯| 亚洲免费影视| 中文欧美日韩| 免费成人激情视频| 国产日韩欧美在线| 在线亚洲一区| 99re6这里只有精品| 久久免费99精品久久久久久| 国产精品爱久久久久久久| 亚洲国产精品免费| 久久不射网站| 午夜影院日韩| 欧美调教视频| 亚洲人被黑人高潮完整版| 久久www成人_看片免费不卡| 翔田千里一区二区| 欧美日韩不卡| 亚洲国产你懂的| 久久狠狠久久综合桃花| 亚洲欧美偷拍卡通变态| 欧美精品色网| 在线日韩欧美视频| 亚洲第一区在线| 久久精品一二三区| 国产精品一区二区黑丝| 一区二区三区欧美| 一区二区三区视频观看| 欧美sm视频| 亚洲第一福利视频| 亚洲国产成人午夜在线一区| 久久久福利视频| 国产私拍一区| 欧美伊人久久| 久久久亚洲欧洲日产国码αv | 欧美日韩国产综合在线| 亚洲国产成人不卡| 亚洲国产精品久久久| 久久精品女人| 国产在线欧美| 久久精品国产精品 | 麻豆久久久9性大片| 国产综合色产| 久久狠狠婷婷| 久久手机免费观看| 一区二区在线观看视频在线观看| 亚洲大胆人体视频| 久久亚洲综合网| 激情成人在线视频| 久久精品国产第一区二区三区最新章节 | 亚洲午夜精品国产| 性欧美1819sex性高清| 国产精品久久久久久久久动漫| 亚洲午夜精品久久久久久浪潮 | 欧美一区二区精品久久911| 久久不见久久见免费视频1| 国产三区精品| 亚洲福利专区| 欧美大片在线看免费观看| 亚洲人午夜精品免费| 一区二区三区四区五区精品视频| 欧美日韩精品伦理作品在线免费观看| 亚洲精品影院| 午夜精彩视频在线观看不卡 | 蜜臀99久久精品久久久久久软件| 在线精品一区| 一本色道久久88亚洲综合88| 欧美香蕉大胸在线视频观看| 亚洲综合日韩| 老色批av在线精品| 亚洲日韩中文字幕在线播放| 亚洲天堂av在线免费| 国产精品久久影院| 欧美一区二区三区播放老司机| 麻豆精品传媒视频| 亚洲乱码精品一二三四区日韩在线| 亚洲永久在线| 国产一区二区主播在线| 亚洲精品久久久久久下一站| 欧美片网站免费| 亚洲欧美文学| 欧美99在线视频观看| 亚洲免费av观看| 欧美一级在线视频| 在线观看精品| 亚洲视频在线观看| 国产日韩在线视频| 日韩视频在线免费| 国产精品天天看| 亚洲精品国产系列| 国产精品日韩欧美大师| 久久精品三级| 欧美色另类天堂2015| 久久国产精品久久久| 欧美日韩成人一区二区| 亚洲欧美精品中文字幕在线| 美国成人毛片| 亚洲小说欧美另类社区| 乱中年女人伦av一区二区| 一区二区日韩伦理片| 久久综合狠狠综合久久综合88| 日韩一级免费| 久久网站免费| 亚洲午夜在线视频| 欧美成人激情视频免费观看| 亚洲字幕一区二区| 欧美电影免费观看高清完整版| 亚洲一区欧美激情| 欧美精品久久久久久久免费观看| 亚洲欧美国产高清va在线播| 欧美岛国在线观看| 性欧美激情精品| 欧美日韩一区二区三区四区在线观看 | 在线观看欧美成人| 欧美亚洲在线播放| 亚洲精品自在久久| 久久亚洲一区二区| 亚洲综合大片69999| 欧美精品综合| 久久精品噜噜噜成人av农村| 欧美色视频一区| 亚洲国产三级在线| 国产亚洲日本欧美韩国| 午夜精品剧场| 99综合在线| 欧美精彩视频一区二区三区|