硬體創新助AI突破瓶頸 稀疏計算成大型模型新解方

Date:

圖/本報資料庫

商傳媒|林昭衡/綜合外電報導

隨著人工智慧(AI)技術快速發展,大型語言模型(LLM)的規模持續擴大,例如Meta推出的Llama模型已達2兆個參數。然而,模型增大不僅提升了能力,也帶來能源消耗與運算時間的大幅增加,導致碳足跡問題日益嚴重。

為解決這些挑戰,目前業界普遍傾向使用較小型模型或採用低精度數字來處理模型參數。然而,《Aol.com》報導指出,另一個潛力巨大的途徑是優化AI模型中的「零值」運算,這便是所謂的「稀疏性」(sparsity)。稀疏性是指模型參數中,大多數數值為零或極接近零,若能跳過這些零值的計算與儲存,將能顯著節省運算資源。

儘管現行的多核心中央處理器(CPU)與圖形處理器(GPU)未能充分利用稀疏性,但產業內已有多家公司致力於加速稀疏機器學習的硬體開發。例如,蘋果公司(Apple)在其A14與M1晶片中,已透過支援陣列指標存取模式,加速了非連續記憶體查找。Cerebras也展示其Cerebras’s Wafer Scale Engine能在LLM上達到高達70%的稀疏性。Meta的Meta’s Training and Inference Accelerator (MTIA) v2版本,則宣稱在稀疏計算效能上較v1提升了七倍。

史丹佛大學研究團隊開發了一款名為Onyx的硬體加速器,為解決稀疏性問題帶來了關鍵進展。Onyx基於粗粒度可重構陣列(CGRA)架構,是首款能同時高效處理稀疏與稠密運算的可程式化加速器。該晶片平均能耗僅為CPU的七十分之一,運算速度則平均提升八倍。Onyx能在不同稀疏程度的計算中配置不同的運算方式,實現高效能與低能耗,並能配置以加速稠密應用,類似於GPU的功能。

這項技術不僅能提升AI的效能與能源效率,也將開創新的演算法研究領域,進一步優化AI發展。史丹佛大學團隊正著手開發Onyx的下一代晶片,旨在支援更多元的運算類型,並提升稀疏與稠密加速器架構在晶片上的整合效率,以應對日益增長的AI模型運算成本與環境影響。

ee7846ee a866 47b3 9f95 ab8982390c50

相關新聞推薦

正在載入相關新聞…

Share post:

spot_imgspot_img

熱門

相關新聞
Related

響應AI新十大建設浪潮—智域Novaryn Labs攜手產業推動科技創新、人才培育與永續發展

「智域Novaryn Labs」以科技創新驅動未來,以永續公益創造價值,攜手迎接AI智慧新時代。在AI時代快速到來之際,智域Novaryn Labs持續投入科技創新推廣、AI產業交流、數位轉型教育及人才培育工作,並結合永續發展與公益理念,積極參與智慧科技生態圈建設,希望透過跨領域合作與資源整合,共同推動台灣產業升級與人才發展。

從一場旅行找到人生方向—永續生活倡導者劉鴻鑫打造「晴日悠境」推廣旅行與素食文化:打造結合健康、交流與善念的生活平台

永續生活倡導者劉鴻鑫秉持「以旅行拓展視野、以素食尊重生命」的理念,創立結合旅行、健康與素食文化的交流平台—晴日悠境,希望透過社群凝聚志同道合的人,一同分享生活、交流想法,實踐健康、友善且充滿善念的生活方式。

回顧花蓮震後重建之路!「晨曦綠苑」晨爸范昊晨團隊無私奉獻:去年923熱血身影成災民心中最暖陽光

花蓮近年經歷多次大自然考驗,在各界攜手努力下,災區已逐步走出陰霾、重現生機。回顧去年(2025年)9月23日災情最為嚴峻的時刻,知名民間力量「晨曦綠苑」與創辦人范昊晨(晨爸)團隊在第一時間挺進第一線的無私身影,至今仍讓許多花蓮鄉親感念在心。

【專題報導】創辦人林柏宇:以金融技術轉化公益,讓善意成為新時代的價值語言

今年47歲的創辦人林柏宇,目前投身金融技術整合領域,具備賓夕法尼亞大學華頓商學院背景,並擁有 CFP 認證理財規劃顧問、FRM金融風險管理師、Geprüfter Betriebswirt 認證企業管理師等專業資歷。