陽明交大葉宗泰團隊連奪 ISCA 榮譽攻克 AI 耗電與記憶體瓶頸
- Published on
- Author
- 林珮雯

文/林珮雯
在計算機科學界,有一座被譽為「電腦架構奧林匹克」的聖殿——ISCA(國際電腦架構交談會)。這項會議的入選門檻極高,代表了全球硬體設計與晶片架構的最前瞻思維。過去十年,整個台灣在該會議的發表量寥寥可數,平均一年不到一篇。然而,這項學術天花板,在近兩年被陽明交通大學資訊工程系葉宗泰教授的研究團隊連續打破。
葉宗泰老師團隊憑藉 Omni-LUT 研究再次挺進 ISCA 2026,這不僅是該團隊連續第二年插旗這座聖殿,更是在機器人頂級會議 ICRA 同時發表了突破性成果。這項成就背後,關鍵在於這兩篇論文分別解決了當前科技界最頭痛的兩個問題:「AI 太吃記憶體」與「高畫質運算太耗電」。
產業界當前最頭痛的痛點是資料搬移量過大導致的運算瓶頸。葉教授深入淺出地指出,無論是當紅的大語言模型(LLM)還是追求極致真實的 3D 影像渲染技術,核心難題都在於必須頻繁地在晶片與記憶體之間搬動龐大資料。這就像交通堵塞一樣,耗費了絕大部分的電力與時間,導致運算又慢又發燙。因此,如何「搬動更少的資料」卻能達到同樣精準的結果,成為未來半導體與 AI 產業最關鍵的技術轉型方向,這也是當前全球科技巨頭都在競爭的技術制高點。
在針對大語言模型的 Omni-LUT 研究中,團隊挑戰了當前長文本處理的極限。雖然先前 Microsoft Research 已提出利用「查表法」(Look-up Table)搭配超低精度量化來取代傳統計算,藉此縮減晶片面積,但該技術尚未能解決「KV Cache」的量化難題。由於 KV Cache 是在模型執行時動態生成的,難以預先處理,導致在面對超長文件時,記憶體需求仍會急劇攀升。葉老師團隊針對這一缺口,研發出與 Google 策略不同、且能與查表加速器完美契合的新型量化機制,並改良了硬體架構。這項突破讓 AI 在處理超長文本時,能大幅降低 KV Cache 對記憶體的壓迫,讓長文本運算在常規硬體上跑得更快、更穩。
而在 3D 影像渲染領域,光線追蹤技術雖然能生成逼真影像,卻因需要模擬海量光線並頻繁搬移資料,即便是當前市面上最高階的顯示卡運算起來也相當吃力。葉老師團隊研發出的 AQB8 技術,突破了業界過去習慣的高精度計算框架,找到了一套全新的算法,能將資料大幅降至低精度卻幾乎不失真。這項技術透過大幅減少資料搬移量,讓行動裝置也能以低功耗跑出電影等級的細緻畫面,去年在國際展示時更吸引了多家晶片大廠的高度關注,驚訝於這項能顯著降低功耗且不影響影像品質的新型算法。
展望未來,葉宗泰老師正積極將這兩項核心技術——「光線追蹤加速架構」與「硬體感知量化壓縮」——推向更寬廣的應用領域。團隊目前嘗試將光線追蹤的加速邏輯轉化為量子電腦電路模擬的利器,並同步將記憶體壓縮技術投入資訊安全領域。葉老師與Qualcomm合作的創新計畫已榮獲 2025 Qualcomm Innovation Fellowship in East Asia ,其目標是利用量化壓縮特性優化「同態加密」的運算效率,讓 AI 在處理加密資料時,既能保證隱私不外洩,又能維持極高的運算速度。連續兩年插旗 ISCA,證明了台灣團隊不僅具備世界級的晶片製造實力,更有能力在「軟硬體協同設計」上定義未來的算力規則,並將這套節能高效的架構推展至量子運算與數位安全等更多元的應用場景。