午夜dj在线观看免费视频,把腿抬高我要添你下面小说,国产v亚洲v天堂无码久久久,亚洲偷偷自拍高清

行業(yè)資訊行業(yè)財報市場標準研發(fā)新品會議盤點政策本站速遞

深圳先進院科研團隊在大模型AI芯片設計領域取得突破

研發(fā)快訊 2025年04月16日 13:27:22來源:中國科學院深圳先進技術研究院 2284
摘要研究成功攻克人工智能大語言模型(LLM)在資源受限邊緣設備部署的核心難題,為智能機器人、便攜設備等場景的實時AI應用提供了創(chuàng)新解決方案。

  【儀表網 研發(fā)快訊】近日,中國科學院深圳先進技術研究院醫(yī)學成像全國重點實驗室、醫(yī)工所醫(yī)學人工智能研究中心黃明強團隊在大模型AI芯片領域取得重要進展,其研究成果在電路與系統(tǒng)領域頂級期刊IEEE Transactions on Circuits and Systems I: Regular Papers上在線發(fā)表,論文題目為"EdgeLLM: A Highly Efficient CPU-FPGA Heterogeneous Edge Accelerator for Large Language Models"。該研究成功攻克人工智能大語言模型(LLM)在資源受限邊緣設備部署的核心難題,為智能機器人、便攜設備等場景的實時AI應用提供了創(chuàng)新解決方案。
 
  自2017年以來,Transformer算法在自然語言處理和計算機視覺(CV)研究領域迅速成為人工智能領域的主導力量。通過引入自注意力機制,Transformer改變了傳統(tǒng)的序列建模方法,不再依賴卷積神經網絡或循環(huán)神經網絡進行特征提取和序列處理。這一創(chuàng)新不僅增強了模型的并行化能力,使得大規(guī)模模型的訓練成為可能,還顯著提升了模型性能。在Transformer取得成功之后,研究人員開始探索更大的模型,這些模型通常擁有數百億甚至更多的參數,被稱為“大語言模型”。大語言模型不僅增強了人工智能的語言處理能力,還推動了AI更廣泛的技術進步,為教育、娛樂、醫(yī)療和商業(yè)等行業(yè)帶來了革命性的變革。
 
  但是大語言模型在資源受限的端側系統(tǒng)部署仍存在較大的困難。首先,大語言模型計算量龐大以及內存訪問需求極高,F有解決方案通常將這些權重參數量化為INT4格式。然而,為了確保計算精度,模型中的激活函數仍然保持FP16格式。因此,在前饋神經網絡(FFN)層中,系統(tǒng)需要支持FP16INT4格式的矩陣乘法。另一方面,在多頭注意力(MHA)模塊中,KV緩存作為激活數據動態(tài)生成,因此涉及KV緩存的矩陣乘法需要FP16FP16格式。因此,設計混合精度計算單元以加速LLM變得尤為重要。我們分析了前饋網絡(FFN)和多頭注意力(MHA)的計算需求,提出了高效率的混合精度計算單元以及組脈動陣列架構。此外,我們還提出了對數尺度結構化稀疏性和塊級量化方法,以在硬件效率和算法精度之間取得平衡。
 
  此外,在大語言模型中,定義計算流程的算子圖極其復雜,包含數百甚至數千個以復雜方式相互連接的算子,確保從一個算子到另一個算子的過渡無縫且高效成為了一項重大挑戰(zhàn)。該團隊分析了大語言模型中的編譯需求,設計了一種統(tǒng)一且通用的數據格式,適用于所有算子和AI算法中的高維張量結構,使系統(tǒng)能夠快速執(zhí)行算子操作而無需任何數據重排。隨后,開發(fā)了端到端的編譯方案,其中動態(tài)編譯用于處理不同輸入token長度,指令流水線策略用于減少延遲。該方案能夠動態(tài)編譯所有算子,并將整個模型映射到CPU-FPGA異構系統(tǒng)上。
 
  最終,整個設計成功部署在AMDXilinx VCU128 FPGA上。與GPU相比,該系統(tǒng)的吞吐量提高了1.91倍,能效提高了7.55倍;與最先進的FPGA加速器FlightLLM相比,整體性能提升了10%到24%。該成果有望應用于新一代具身智能機器人、手機AI大模型等應用場景中。
 
  中國科學院深圳先進技術研究院黃明強研究員為第一作者,南方科技大學深港微電子學院為合作單位。該研究得到了醫(yī)學成像科學與技術系統(tǒng)全國重點實驗室、科技創(chuàng)新-2030重大科技項目的資助。

我要評論
文明上網,理性發(fā)言。(您還可以輸入200個字符)

所有評論僅代表網友意見,與本站立場無關。

延伸閱讀
版權與免責聲明
  • 凡本網注明"來源:儀表網"的所有作品,版權均屬于儀表網,未經本網授權不得轉載、摘編或利用其它方式使用上述作品。已經本網授權使用作品的,應在授權范圍內使用,并注明"來源:儀表網"。違反上述聲明者,本網將追究其相關法律責任。
  • 本網轉載并注明自其它來源的作品,目的在于傳遞更多信息,并不代表本網贊同其觀點或證實其內容的真實性,不承擔此類作品侵權行為的直接責任及連帶責任。其他媒體、網站或個人從本網轉載時,必須保留本網注明的作品來源,并自負版權等法律責任。
  • 如涉及作品內容、版權等問題,請在作品發(fā)表之日起一周內與本網聯系,否則視為放棄相關權利。
  • 合作、投稿、轉載授權等相關事宜,請聯系本網。聯系電話:0571-87759945,QQ:1103027433。
廣告招商
今日換一換
新發(fā)產品更多+

客服熱線:0571-87759942

采購熱線:0571-87759942

媒體合作:0571-87759945

  • 儀表站APP
  • 微信公眾號
  • 儀表網小程序
  • 儀表網抖音號
Copyright ybzhan.cn    All Rights Reserved   法律顧問:浙江天冊律師事務所 賈熙明律師   儀表網-儀器儀表行業(yè)“互聯網+”服務平臺
意見反饋
我知道了
蜜桃传媒一区二区亚洲av婷婷| 国产成人精品日本亚洲专区61| 发电俏娇娃在线观看| 国产成人18黄网站在线观看软件| 久久精品中文字幕第一页| 丰满老女人a片| 公交车被cao得合不拢腿视频| 涩涩av视频一区二区三区| 亚洲v欧美v国产v在线观看| 久久久久久久久久久国产| 国产成人一区二区三区在线| 性欧美xxxxx乱极品少妇| 日韩av无码| 无码人妻AⅤ一区二区三区蜜桃| 欧美高清vivoes69| 粗大挺进朋友人妻身体里国产电影| 无码熟妇人妻AV在线影片| 国产美女在线精品免费观看| 亚洲中文字幕无码爆乳av| 哈尔滨老熟女啪啪嗷嗷叫| 门卫老头吸允校花奶头| 国产一区二区三区成人欧美日韩在线观看| 凹凸国产熟女精品视频国语| 少妇乳大丰满高潮喷水| 青苹果乐园在线观看| 人妻办公室被强奷hd| 国产美女精品视频线免费播放软件| 色欲色香天天天综合网WWW| 欧美黑人又粗又大的性格特点| 一边捏奶头一边高潮视频| 国产精品18久久久久久vr| 国产人妻777人伦精品hd| 蜜臀av在线| 被多人玩弄的烂货| 被六个男人躁到一夜同性| 喜爱夜蒲未删减版| 精品久久久久精品亚洲av| 双腿被绑成m型调教play| 门卫老李干了校花琦琦| 人妻出轨系列38部分阅读| 公与淑婷厨房猛烈进出|