《電子技術(shù)應(yīng)用》
您所在的位置:首頁 > 人工智能 > 業(yè)界動態(tài) > Arm Ethos-U85 NPU:利用小語言模型在邊緣側(cè)實現(xiàn)生成式 AI

Arm Ethos-U85 NPU:利用小語言模型在邊緣側(cè)實現(xiàn)生成式 AI

2025-02-23
來源:Arm
關(guān)鍵詞: ARM AI Ethos-U85

  隨著人工智能 (AI) 的演進(jìn),利用小語言模型 (SLM) 在嵌入式設(shè)備上執(zhí)行 AI 工作負(fù)載成為業(yè)界關(guān)注的焦點。Llama、Gemma 和 Phi3 等小語言模型,憑借其出色的成本效益、高效率以及在算力受限設(shè)備上的易部署性,贏得了廣泛認(rèn)可。Arm 預(yù)計這類模型的數(shù)量將在 2025 年繼續(xù)增長。

  Arm 技術(shù)以其高性能與低功耗的顯著優(yōu)勢,為小語言模型提供了理想的運(yùn)行環(huán)境,能夠有效提升運(yùn)行效率,并進(jìn)一步優(yōu)化用戶體驗。為了直觀展示端點 AI 在物聯(lián)網(wǎng)和邊緣計算領(lǐng)域的巨大潛力,Arm技術(shù)團(tuán)隊近期打造了一場技術(shù)演示。在演示中,當(dāng)用戶輸入一個句子后,系統(tǒng)將基于該句擴(kuò)展生成一個兒童故事。這項演示受到了微軟 “Tiny Stories” 論文和 Andrej Karpathy 的 TinyLlama2 項目的啟發(fā),TinyLlama2 項目使用了 2,100 萬個故事來訓(xùn)練小語言模型生成文本。

  該演示搭載了 Arm Ethos-U85 NPU,并在嵌入式硬件上運(yùn)行小語言模型。盡管大語言模型 (LLM) 更加廣為人知,但由于小語言模型能夠以更少的資源和較低的成本提供出色的性能,而且訓(xùn)練起來也更為簡易且成本更低,因此越來越受到關(guān)注。

  在嵌入式硬件上實現(xiàn)基于 Transformer 的小語言模型

  Arm 的演示展示了 Ethos-U85 作為一個小型低功耗平臺,具備運(yùn)行生成式 AI 的能力,并凸顯了小語言模型在特定領(lǐng)域中的出色表現(xiàn)。TinyLlama2 模型相較 Meta 等公司的大模型更為簡化,很適合用于展示 Ethos-U85 的 AI 性能,可作為端點 AI 工作負(fù)載的理想之選。

  為開發(fā)此演示,Arm 進(jìn)行了大量建模工作,包括創(chuàng)建一個全整數(shù)的 INT8(和 INT8x16)TinyLlama2 模型,并將其轉(zhuǎn)換為適合 Ethos-U85 限制的固定形狀 TensorFlow Lite 格式。

  Arm 的量化方法表明,全整數(shù)語言模型在取得高準(zhǔn)確度和輸出質(zhì)量之間實現(xiàn)了良好平衡。通過量化激活、歸一化函數(shù)和矩陣乘法,Arm 無需進(jìn)行浮點運(yùn)算。由于浮點運(yùn)算在芯片面積和能耗方面成本較高,這對于資源受限的嵌入式設(shè)備來說是一個關(guān)鍵考量。

  Ethos-U85 在 FPGA 平臺上以 32 MHz 的頻率運(yùn)行語言模型,其文本生成速度可達(dá)到每秒 7.5 到 8 個詞元 (token),與人類的閱讀速度相當(dāng),同時僅消耗四分之一的計算資源。在實際應(yīng)用的系統(tǒng)級芯片 (SoC) 上,該性能最多可提高十倍,從而顯著提升了邊緣側(cè) AI 的處理速度和能效。

  兒童故事生成特性采用了 Llama2 的開源版本,并結(jié)合了 Ethos NPU 后端,在 TFLite Micro 上運(yùn)行演示。大部分推理邏輯以 C++ 語言在應(yīng)用層編寫,并通過優(yōu)化上下文窗口內(nèi)容,提高了故事的連貫性,確保 AI 能夠流暢地講述故事。

  由于硬件限制,團(tuán)隊需要對 Llama2 模型進(jìn)行適配,以確保其在 Ethos-U85 NPU 上高效運(yùn)行,這要求對性能和準(zhǔn)確性進(jìn)行仔細(xì)考量。INT8 和 INT16 混合量化技術(shù)展示了全整數(shù)模型的潛力,這有利于 AI 社區(qū)更積極地針對邊緣側(cè)設(shè)備優(yōu)化生成式模型,并推動神經(jīng)網(wǎng)絡(luò)在如 Ethos-U85 等高能效平臺上的廣泛應(yīng)用。

  Arm Ethos-U85 彰顯卓越性能

  Ethos-U85 的乘法累加 (MAC) 單元可以從 128 個擴(kuò)展至 2,048 個,與前一代產(chǎn)品 Ethos-U65 相比,其能效提高了 20%。另外相較上一代產(chǎn)品,Ethos-U85 的一個顯著特點是能夠原生支持 Transformer 網(wǎng)絡(luò)。

  Ethos-U85 支持使用前代 Ethos-U NPU 的合作伙伴能夠?qū)崿F(xiàn)無縫遷移,并充分利用其在基于 Arm 架構(gòu)的機(jī)器學(xué)習(xí) (ML) 工具上的既有投資。憑借其卓越能效和出色性能,Ethos-U85 正愈發(fā)受到開發(fā)者青睞。

  如果在芯片上采用 2,048 個 MAC 配置,Ethos-U85 可以實現(xiàn) 4 TOPS 的性能。在演示中,Arm 使用了較小的配置,即在 FPGA 平臺上采用 512 個 MAC,并以 32 MHz 的頻率運(yùn)行具有 1,500 萬個參數(shù)的 TinyLlama2 小語言模型。

  這一能力凸顯了將 AI 直接嵌入設(shè)備的可能性。盡管內(nèi)存有限(320 KB SRAM 用于緩存,32 MB 用于存儲),Ethos-U85 仍能高效處理此類工作負(fù)載,為小語言模型和其他 AI 應(yīng)用在深度嵌入式系統(tǒng)中的廣泛應(yīng)用奠定了基礎(chǔ)。

  將生成式 AI 引入嵌入式設(shè)備

  開發(fā)者需要更加先進(jìn)的工具來應(yīng)對邊緣側(cè) AI 的復(fù)雜性。Arm 通過推出 Ethos-U85,并支持基于 Transformer 的模型,致力于滿足這一需求。隨著邊緣側(cè) AI 在嵌入式應(yīng)用中的重要性日益增加,Ethos-U85 正在推動從語言模型到高級視覺任務(wù)等各種新用例的實現(xiàn)。

  Ethos-U85 NPU 提供了創(chuàng)新前沿解決方案所需的卓越性能和出色能效。Arm 的演示顯示了將生成式 AI 引入嵌入式設(shè)備的重要進(jìn)展,并凸顯了在 Arm 平臺上部署小語言模型便捷可行。

  Arm 正為邊緣側(cè) AI 在廣泛應(yīng)用領(lǐng)域帶來新機(jī)遇,Ethos-U85 也因此成為推動新一代智能、低功耗設(shè)備發(fā)展的關(guān)鍵動力。




更多精彩內(nèi)容歡迎點擊==>>電子技術(shù)應(yīng)用-AET<<

3952966954c9c6c308355d1d28d750b.jpg

本站內(nèi)容除特別聲明的原創(chuàng)文章之外,轉(zhuǎn)載內(nèi)容只為傳遞更多信息,并不代表本網(wǎng)站贊同其觀點。轉(zhuǎn)載的所有的文章、圖片、音/視頻文件等資料的版權(quán)歸版權(quán)所有權(quán)人所有。本站采用的非本站原創(chuàng)文章及圖片等內(nèi)容無法一一聯(lián)系確認(rèn)版權(quán)者。如涉及作品內(nèi)容、版權(quán)和其它問題,請及時通過電子郵件或電話通知我們,以便迅速采取適當(dāng)措施,避免給雙方造成不必要的經(jīng)濟(jì)損失。聯(lián)系電話:010-82306118;郵箱:aet@chinaaet.com。
亚洲一区二区欧美_亚洲丝袜一区_99re亚洲国产精品_日韩亚洲一区二区
久久电影一区| 亚洲欧美激情诱惑| 亚洲小视频在线| 亚洲美女中文字幕| 亚洲黄色一区| 亚洲国产高清一区| 亚洲电影免费观看高清完整版在线| 国产伊人精品| 国内伊人久久久久久网站视频 | 亚洲国产精品一区二区第四页av | 一区二区日韩伦理片| 99re66热这里只有精品4| 亚洲黄一区二区| 亚洲黄色成人| 亚洲国产天堂久久综合| 亚洲高清资源综合久久精品| 久久精品视频99| 91久久精品久久国产性色也91| 亚洲高清免费在线| 亚洲精品1234| 999亚洲国产精| 亚洲一区二区三区在线播放| 亚洲一区精彩视频| 亚洲欧美成人精品| 久久成人免费视频| 久久综合给合| 欧美精品日日鲁夜夜添| 欧美精品在线极品| 欧美色欧美亚洲另类七区| 国产精品成人一区二区三区夜夜夜| 欧美午夜视频网站| 国产欧美一区二区精品仙草咪| 国产一区二三区| 亚洲高清视频一区| 99在线|亚洲一区二区| 亚洲视频在线二区| 欧美一级视频精品观看| 亚洲第一天堂av| 日韩亚洲国产欧美| 亚洲欧美一区二区激情| 久久久久91| 欧美精品久久久久久久久老牛影院| 欧美人在线观看| 国产精品入口尤物| 黄色成人在线网址| 亚洲美女av在线播放| 亚洲视频一区在线| 亚洲国产欧美另类丝袜| 国产精品99久久久久久久久久久久| 欧美一区二区三区四区在线观看 | 亚洲一区二区在线| 久久精品欧美| 欧美激情久久久| 国产精品男女猛烈高潮激情| 极品日韩av| 亚洲另类黄色| 午夜精品视频在线观看一区二区| 亚洲国产精品一区在线观看不卡| 亚洲午夜精品在线| 狼狼综合久久久久综合网| 欧美日韩免费一区二区三区| 国产日韩精品一区二区三区在线| 91久久精品国产91久久性色| 亚洲女人小视频在线观看| 亚洲国产毛片完整版| 亚洲欧美高清| 欧美成人午夜免费视在线看片| 国产精品二区在线| 亚洲第一色在线| 亚洲欧美日韩中文视频| 日韩图片一区| 久久理论片午夜琪琪电影网| 欧美色网一区二区| 经典三级久久| 亚洲一区二区三区在线播放| 亚洲三级色网| 久久久av水蜜桃| 欧美性淫爽ww久久久久无| 一区精品久久| 亚洲欧美99| 一区二区av在线| 美国成人直播| 国产色综合网| 亚洲网址在线| 一本一本久久a久久精品牛牛影视| 久久久久综合网| 国产精品久久久久天堂| 日韩视频专区| 亚洲日本在线观看| 久久久久久久波多野高潮日日| 国产精品成人在线观看| 亚洲人成人一区二区在线观看| 久久riav二区三区| 欧美中文字幕不卡| 国产精品爽爽ⅴa在线观看| 99亚洲视频| 99亚洲精品| 欧美激情精品久久久六区热门| 免费在线成人| 欧美一级理论性理论a| 一区二区三区久久| 免费欧美在线视频| 国模精品一区二区三区| 亚洲女人小视频在线观看| 亚洲午夜精品久久| 欧美片在线观看| 亚洲国内欧美| 91久久国产综合久久91精品网站| 久久精品一二三区| 国产欧美精品日韩区二区麻豆天美| 一区二区国产在线观看| 一区二区国产日产| 欧美日韩国产麻豆| 亚洲精品美女久久久久| 亚洲精品人人| 欧美精品18+| 亚洲国产精品一区| 亚洲精品一区二| 欧美国产乱视频| 亚洲欧洲精品天堂一级| 亚洲美女av网站| 欧美久久久久久久久| 亚洲精品久久久久久下一站| 亚洲精选一区二区| 欧美久久电影| 一区二区三区 在线观看视频| 亚洲视频精品| 国产精品高潮粉嫩av| 亚洲一区二区三区视频播放| 午夜精品久久久久久久久| 国产精品免费看| 性欧美暴力猛交69hd| 久久精品99国产精品日本| 国产日韩欧美精品综合| 欧美一区二区三区播放老司机| 久久久噜噜噜久久| 依依成人综合视频| 日韩视频一区二区在线观看| 欧美日韩精品一二三区| 日韩视频一区二区在线观看 | 国产精品久久午夜夜伦鲁鲁| 亚洲午夜在线视频| 欧美一区二区高清在线观看| 国产一级揄自揄精品视频| 久久av免费一区| 欧美**人妖| 亚洲美女在线一区| 午夜精品久久久久久久久| 国产欧美日韩精品一区| 久久成人在线| 欧美黑人国产人伦爽爽爽| 夜夜嗨av一区二区三区网页| 先锋影音网一区二区| 国产综合精品一区| 亚洲国产视频一区二区| 欧美日韩国产一区二区三区地区 | 亚洲免费av网站| 欧美午夜精品久久久久久超碰| 亚洲欧美精品在线观看| 免费久久99精品国产| 一本色道久久综合亚洲精品不 | 韩国三级电影久久久久久| 亚洲国产欧美一区二区三区丁香婷| 欧美精品乱码久久久久久按摩| 亚洲视频在线观看| 久久人人97超碰国产公开结果| 亚洲欧洲一二三| 亚洲欧美激情一区二区| 国模 一区 二区 三区| 9人人澡人人爽人人精品| 国产精品一区二区久久国产| 亚洲福利国产| 欧美午夜美女看片| 久久激情综合| 欧美性理论片在线观看片免费| 欧美专区日韩专区| 欧美精品在线观看一区二区| 亚洲一区二区在线观看视频| 久久一区二区视频| 在线视频欧美日韩精品| 久久亚洲欧洲| 在线亚洲国产精品网站| 麻豆久久久9性大片| 亚洲一区二区在线看| 欧美成人免费在线视频| 午夜精品久久久久影视| 欧美日韩精品免费观看视一区二区| 欧美一区二区三区免费观看视频| 欧美精品一区二区高清在线观看| 午夜日韩激情| 欧美日韩在线综合| 亚洲国产清纯| 国产欧美精品一区| 亚洲深爱激情| 亚洲国产精品精华液网站| 欧美一区二区久久久| 亚洲免费观看在线视频| 另类综合日韩欧美亚洲| 亚洲欧美国产精品va在线观看 | 国产亚洲欧洲|