《電子技術(shù)應(yīng)用》
您所在的位置:首頁 > 可編程邏輯 > 業(yè)界動態(tài) > 被成為“圍棋上帝”的AlphaGo,真的在機(jī)器學(xué)習(xí)領(lǐng)域無敵?

被成為“圍棋上帝”的AlphaGo,真的在機(jī)器學(xué)習(xí)領(lǐng)域無敵?

2017-06-05

這幾日,只要提起AlphaGo,相信大家想起的一定是在前幾日的圍棋大賽中,無論是單人戰(zhàn),雙人戰(zhàn),還是群毆戰(zhàn),AlphaGo都無一例外的身居“常勝將軍”位,而AlphaGo的創(chuàng)作團(tuán)隊公司Deep mind在官網(wǎng)宣布這次的圍棋峰會將是AlphaGo的最后一次比賽。那么,不進(jìn)行圍棋賽的AlphaGo還可以做什么呢?OpenAI研究科學(xué)家,斯坦福大學(xué)的CS博士生Andrej Karpathy就AlphaGo在機(jī)器人領(lǐng)域的應(yīng)用發(fā)表了一些他的看法,機(jī)器人圈整理編譯如下:

我有機(jī)會和幾個人聊了一聊近期與AlphaGo柯潔等人的比賽。尤其是,媒體報道內(nèi)容大部分是大眾科學(xué)+PR的混合體,所以我看到的最常見的問題是“AlphaGo的突破性表現(xiàn)在哪里”,“AI的研究人員如何看待它的勝利?”和“勝利將取得什么樣的影響”。我把我的一些想法寫成文章與大家分享。

很酷的部分

AlphaGo由許多相對標(biāo)準(zhǔn)的技術(shù)組成:行為克隆(對人類展示的數(shù)據(jù)進(jìn)行監(jiān)督學(xué)習(xí))、強化學(xué)習(xí)(REINFORCE)、價值函數(shù)和蒙特卡洛樹搜索(MCTS)。然而,這些組件的組合方式是極具創(chuàng)新,并不是完全標(biāo)準(zhǔn)的。特別是,AlphaGo使用SL(監(jiān)督學(xué)習(xí))策略來初始化RL(強化學(xué)習(xí))策略得到完善自我發(fā)揮,然后他們預(yù)估價值函數(shù),然后將其插入到MCTS中使用(更糟糕但更多樣化的)SL策略展示出來。另外,策略/價值網(wǎng)是深度神經(jīng)網(wǎng)絡(luò),所以使一切正常工作都能呈現(xiàn)自己獨特的挑戰(zhàn)(例如,價值功能以一種棘手的方式進(jìn)行培訓(xùn)以防止過度擬合)。在所有這些方面,DeepMind都執(zhí)行得很好。話雖如此,AlphaGo本身并沒有使用任何基本的算法突破來解決強化學(xué)習(xí)的難題。

狹義范疇

AlphaGo還是一個狹義的AI系統(tǒng),會下圍棋,但也僅此而已。來自DeepMind的ATARI玩家不會使用AlphaGo所采取的方法,神經(jīng)圖靈機(jī)(Neural Turing Machines)與AlphaGo無關(guān),Google數(shù)據(jù)中心的改進(jìn)也絕對不會使用AlphaGo,同時,Google搜索引擎也不會使用AlphaGo。因此,AlphaGo不會推廣到圍棋以外的任何地方,但是人們和潛在的神經(jīng)網(wǎng)絡(luò)組件做的比這些過去的人工智能要好得多,每個演示都需要專門的顯式代碼的存儲庫。

圍棋的便利屬性

我想通過明確地列出圍棋所具有的特定屬性來擴(kuò)展AlphaGo的狹義性,AlphaGo從中受益匪淺。這可以幫助我們考慮是否推廣AlphaGo。圍棋是:

1、完全確定性。游戲規(guī)則中沒有噪音;如果兩位玩家采取相同的動作順序,那么后面的狀態(tài)將永遠(yuǎn)是一樣的。

2、充分觀察。每個玩家都有完整的信息,沒有隱藏的變量。例如,德州撲克(Texas hold’em)對該屬性不滿意,因為看不到其他玩家的牌。

3、動作空間是離散的。一些獨特的棋子移動是很有效的。相比之下,在機(jī)器人技術(shù)中,你可能希望在每個節(jié)點都需要具有連續(xù)性的控制。

4、我們有一個完美的模擬器(游戲本身),所以任何動作的效果都是公開透明的。這是一個強有力的假設(shè),AlphaGo依然非常強大,但這種情形在現(xiàn)實世界中也是相當(dāng)罕見的。

5、每一盤棋時間相對較短,約200手。相對于強化學(xué)習(xí)階段,與其他可能涉及每局的數(shù)千(或更多)手相比,這是一個相對較短的時間范圍。

6、評估清晰、快速,允許大量的試錯體驗。換句話說,玩家可以體驗數(shù)百萬次的勝利/失敗,這樣就可以慢慢而可靠地深入學(xué)習(xí),就像深度神經(jīng)網(wǎng)絡(luò)優(yōu)化一樣。

7、有大量的人類玩游戲棋譜數(shù)據(jù)可用于引導(dǎo)學(xué)習(xí),所以AlphaGo不必從頭開始。

AlphaGo應(yīng)用于機(jī)器人技術(shù)?

以上列舉了圍棋的一些吸引人的屬性,讓我們來看一下機(jī)器人問題,看看我們?nèi)绾螌lphaGo應(yīng)用到機(jī)器人中,例如亞馬遜揀選機(jī)器人中。這個問題只是想想就覺得有點滑稽。

·首先,你的動作(高維度、連續(xù))由機(jī)器人的電機(jī)笨拙/嘈雜地執(zhí)行。(違反1、3)

·機(jī)器人可能必須環(huán)顧要移動的物品,因此并不總是能感知所有相關(guān)信息,并且有時需要根據(jù)需要收集。(違反2)

·我們可能有一個物理模擬器,但是這些模擬器是非常不完美的(尤其是模擬接觸力的東西);這帶來了自己的一些挑戰(zhàn)(違反4)。

·取決于你的行動空間抽象程度(原始扭矩 - >夾子的位置),一個成功的動作片段可能比200個動作長得多(即5取決于設(shè)置)。更長的動作片段增加了信用分配問題,學(xué)習(xí)算法難以在任何結(jié)果的行動中分配責(zé)任。

·由于我們在現(xiàn)實世界中運作,機(jī)器人在數(shù)百萬次的時間內(nèi)(成功/失敗)會變得更加困難。方法之一是并聯(lián)機(jī)器人,但這可能非常昂貴。此外,機(jī)器人失敗可能涉及機(jī)器人本身的損害。另一種方法是使用模擬器,然后轉(zhuǎn)移到現(xiàn)實世界中,但這會在域名轉(zhuǎn)移中帶來自己的一套新的、不平凡的挑戰(zhàn)。(違反6)

·最后,很少有數(shù)百萬可以展示的人類數(shù)據(jù)源。(違反7)

簡而言之,基本上每個單一的假設(shè),即圍棋的便利屬性都被AlphaGo違背了,任何成功的方法都將看起來都不一樣了。更普遍的是,上面圍棋的一些屬性與當(dāng)前的算法(例如1、2、3)并不是不可克服的,有些是存在問題(5、7),但是有些對于AlphaGo的訓(xùn)練是非常關(guān)鍵的,但是很少存在于其他真實世界的應(yīng)用(4、6)。

結(jié)論

雖然AlphaGo并沒有在AI算法中并沒有實現(xiàn)根本性的突破,雖然它仍然是狹隘人工智能的一個例子,但AlphaGo也象征著Alphabet的AI能力:公司的人才數(shù)量/質(zhì)量、他們掌握的計算資源,以及公司高層對AI的關(guān)注。

AlphaGo是Alphabet在人工智能領(lǐng)域設(shè)置的一場賭局,但AlphaGo是安全的,毋庸置疑。

本站內(nèi)容除特別聲明的原創(chuàng)文章之外,轉(zhuǎn)載內(nèi)容只為傳遞更多信息,并不代表本網(wǎng)站贊同其觀點。轉(zhuǎn)載的所有的文章、圖片、音/視頻文件等資料的版權(quán)歸版權(quán)所有權(quán)人所有。本站采用的非本站原創(chuàng)文章及圖片等內(nèi)容無法一一聯(lián)系確認(rèn)版權(quán)者。如涉及作品內(nèi)容、版權(quán)和其它問題,請及時通過電子郵件或電話通知我們,以便迅速采取適當(dāng)措施,避免給雙方造成不必要的經(jīng)濟(jì)損失。聯(lián)系電話:010-82306118;郵箱:aet@chinaaet.com。
亚洲一区二区欧美_亚洲丝袜一区_99re亚洲国产精品_日韩亚洲一区二区
亚洲精品综合在线| 欧美在线亚洲在线| 欧美一级理论片| 99国产精品99久久久久久粉嫩| 曰本成人黄色| 好男人免费精品视频| 国产久一道中文一区| 国产精品久久国产三级国电话系列| 欧美精品久久一区| 欧美激情1区| 欧美激情国产日韩精品一区18| 老司机精品福利视频| 久久久久久黄| 久久综合九色欧美综合狠狠| 久久久中精品2020中文| 久久蜜臀精品av| 久久综合导航| 欧美成人国产va精品日本一级| 久久亚洲国产精品日日av夜夜| 欧美自拍偷拍| 久久久久高清| 你懂的一区二区| 欧美成人免费全部| 欧美巨乳在线| 欧美色欧美亚洲高清在线视频| 欧美日韩免费观看中文| 欧美日韩精品免费看| 欧美日韩亚洲不卡| 国产精品久久久久久久久久久久久久 | 亚洲大片av| 亚洲精品免费一二三区| 一区二区三区高清| 亚洲你懂的在线视频| 午夜一区二区三视频在线观看 | 夜夜嗨av色一区二区不卡| 中文精品视频一区二区在线观看| 亚洲在线观看| 久久久久久久网站| 欧美v日韩v国产v| 欧美日韩在线另类| 国产欧美日韩| 伊人春色精品| 亚洲麻豆国产自偷在线| 亚洲一区在线免费观看| 久久av一区二区三区亚洲| 亚洲精品国久久99热| 亚洲尤物在线| 久久婷婷蜜乳一本欲蜜臀| 欧美片在线播放| 国产精品一级二级三级| 激情亚洲一区二区三区四区| 亚洲精品网站在线播放gif| 亚洲一区激情| 亚洲激情不卡| 亚洲欧美日韩精品| 久久综合色8888| 欧美三级在线视频| 国产资源精品在线观看| 日韩视频永久免费观看| 性色av一区二区三区红粉影视| 99re66热这里只有精品4 | 久久久久久久久综合| 欧美人成在线| 国产视频在线观看一区二区三区 | 午夜影院日韩| 嫩草成人www欧美| 国产精品视频免费观看www| 在线观看国产成人av片| 亚洲一区久久久| 亚洲日本中文字幕| 久久福利影视| 亚洲欧美日韩视频一区| 亚洲麻豆视频| 久久久久免费| 国产精品久久久999| 在线观看欧美日韩国产| 亚洲午夜视频| 99视频一区二区| 久久亚洲一区二区三区四区| 欧美日韩一区在线视频| 一区二区三区在线观看欧美| 亚洲免费人成在线视频观看| 亚洲伦理网站| 久久久亚洲高清| 国产精品午夜国产小视频| 亚洲精选视频免费看| 亚洲高清免费| 久久精品一级爱片| 国产精品美女黄网| 亚洲久久一区二区| 亚洲人成网站精品片在线观看 | 国产日韩欧美成人| 亚洲图片欧美日产| 99精品国产热久久91蜜凸| 久久手机免费观看| 国产欧美一区二区色老头| 99在线热播精品免费| 亚洲精品久久嫩草网站秘色| 欧美在线网站| 国产精品一二| 亚洲手机成人高清视频| 一本大道久久精品懂色aⅴ| 欧美成人高清| 在线免费观看欧美| 久久精品国产亚洲5555| 欧美一区网站| 国产精品最新自拍| 亚洲欧美大片| 午夜精品久久久久久久99水蜜桃 | 日韩午夜激情av| 亚洲国产片色| 久久久久久久精| 国产视频一区二区在线观看| 亚洲欧美国产va在线影院| 亚洲欧美乱综合| 欧美日韩中字| 一卡二卡3卡四卡高清精品视频 | 久久亚洲欧美| 狠狠久久亚洲欧美专区| 久久aⅴ国产欧美74aaa| 久久精品国产亚洲5555| 国产日韩精品在线播放| 香蕉视频成人在线观看 | 国产一区欧美日韩| 久久国产手机看片| 久久人人爽人人| 激情偷拍久久| 亚洲国产精品久久91精品| 美女脱光内衣内裤视频久久影院| 激情懂色av一区av二区av| 亚洲国产精品电影在线观看| 噜噜噜在线观看免费视频日韩| 黑人巨大精品欧美一区二区| 亚洲精品乱码久久久久久蜜桃麻豆| 亚洲精品影院| 欧美日韩免费观看一区三区| 一区二区欧美国产| 亚洲欧美一区二区原创| 国产日产高清欧美一区二区三区| 欧美一级大片在线观看| 久久久久九九九九| 一区二区三区在线看| 亚洲精品免费一区二区三区| 欧美剧在线免费观看网站| 一区二区三区久久精品| 欧美一级在线播放| 黄色国产精品| 日韩午夜一区| 国产精品高潮久久| 欧美一区国产在线| 美女国产一区| 日韩午夜电影av| 欧美一区日韩一区| 影音先锋在线一区| 一区二区三区日韩在线观看| 国产精品美女一区二区在线观看| 香蕉久久夜色精品| 欧美成人精品在线| 亚洲视频免费在线观看| 久久久国产视频91| 亚洲欧洲一级| 香蕉av福利精品导航| 一区免费观看| 亚洲视频一二区| 国产亚洲免费的视频看| 亚洲美女电影在线| 国产女主播一区| 日韩午夜三级在线| 国产噜噜噜噜噜久久久久久久久| 亚洲激情视频网站| 欧美午夜精品久久久久久久| 欧美一区二区三区在线视频| 欧美另类人妖| 欧美一区二区三区四区在线| 欧美精品videossex性护士| 亚洲午夜精品久久| 蜜桃av噜噜一区| 亚洲女人天堂成人av在线| 麻豆亚洲精品| 亚洲男人的天堂在线| 欧美韩日一区二区| 香蕉av777xxx色综合一区| 欧美二区不卡| 亚洲欧美中日韩| 欧美日韩精品综合| 久久精品国产免费| 国产精品红桃| 亚洲精品久久| 国产一区二区三区久久精品| 一区二区三区国产精品| 狠狠色丁香婷婷综合| 亚洲综合成人婷婷小说| 在线视频成人| 久久久在线视频| 亚洲一区二区三区在线观看视频| 蜜臀av国产精品久久久久| 亚洲资源在线观看| 欧美日韩亚洲免费| 欧美在线免费一级片| 国产精品毛片va一区二区三区 |