台灣新竹,2026年8月3日 —— 晶心科技(Andes Technology)是一家高性能、低功耗32/64位RISC-V處理器核心及AI加速方案的領先供應商,同時也是RISC-V International的創始白金會員。日前,該公司正式宣布其AI產品線迎來重大同步升級:AndesAIRE(TM) AnDLA(TM) I370 v2.0深度學習加速器IP與AndesAIRE(TM) NN SDK v1.2.0正式推出。此次發布旨在解決業界一大核心難題——如何讓資源消耗較高的Transformer架構(包括視覺Transformer(ViT)、視覺語言模型(VLM)及小型語言模型(SLM))在功耗與成本受限的邊緣平台上高效運行。
突破硬體瓶頸:AnDLA(TM) I370 v2.0
為釋放多模態VLM與生成式SLM工作負載所需的算力,I370 v2.0加速器IP在架構層面引入了多項重要增強:
可擴展算力,最高支持2048個MAC:可配置的MAC陣列(規模從32擴展至2048)為開發者提供靈活的可擴展性,以應對現代神經網路所需的大規模矩陣乘法運算。
超寬AXI總線,位寬最高達512位:AXI總線數據位寬可擴展至512位,同時增強了DMA未完成請求處理能力,有效消除重負載場景下的內存頻寬瓶頸。
原生支持多模態VLM與生成式SLM:基於可編程張量算子集架構設計,在硬體層面提供對Transformer網路的原生支持。
豐富的硬體加速算子:集成除法(DIV)與平方根(SQRT)運算的原生執行能力,並支持算子融合,確保複雜的非線性函數完全在加速器內部完成計算。
解鎖Transformer能力:AndesAIRE(TM) NN SDK v1.2.0
硬體算力的提升離不開強大軟體編譯工具鏈的配合。AndesAIRE(TM) NN SDK v1.2.0正是這一關鍵使能組件,其成熟的工具鏈專為應對Transformer網路的結構複雜性而優化,主要特性包括:
邊緣Transformer優化:SDK原生支持注意力機制,並通過SLM預填充/解碼階段拆分,優化KV緩存的放置與內存調度策略。
完善的Linux與RTOS生態系統:通過提供Linux核心態驅動與用戶態運行時,以及支持AnDLA任務搶占的RTOS環境,增強了平台的靈活性,滿足時延敏感型實時響應需求。
協同設計工具與知識蒸餾:內置模型顧問(Model Advisor)與硬體顧問(Hardware Advisor),用於繪製性價比帕累托前沿,並結合詞級知識蒸餾技術,將大型教師模型無縫壓縮為可部署於AnDLA的學生模型。
上游框架集成:將AnDLA驅動及NN庫封裝函數更新至最新版LiteRT及面向微控制器的LiteRT AI框架基線。此外,SDK通過與面向微控制器的LiteRT集成,支持MLCommons MLPerf Tiny v1.4基準測試,並取得了優異的性能成績。
"將Transformer模型和VLM引入成本敏感型邊緣設備,可以說是當前AI領域最具挑戰性的工程難題之一,"晶心科技總裁暨技術長蘇泓萃博士表示,"藉助搭載可編程張量算子集架構的I370 v2.0,以及NN SDK v1.2.0的強力支撐,我們已成功實現Transformer模型的端側運行。開發者現在可以在RTOS和Linux雙環境下本地運行ViT、VLM和SLM,為更智能的下一代邊緣設備鋪平了道路。"
此次全面升級重新定義了邊緣計算的能力邊界,使智能攝影機、工業自動化系統、機器人、可穿戴設備及邊緣網關能夠在本地完成語言與視覺模型的推理處理。如需了解AndesAIRE(TM) AnDLA(TM) I370 v2.0與NN SDK v1.2.0的更多資訊,請訪問 www.andestech.com 或發送郵件至官方聯繫郵箱。
關於晶心科技
晶心科技(台證所:6533)是RISC-V International的創始白金會員,也是商用CPU IP領域的領軍企業,積極推動RISC-V在全球的廣泛應用。晶心科技擁有完整的RISC-V處理器IP產品線,覆蓋從超高效32位CPU到高性能64位亂序多處理器一致性集群的廣泛應用場景。憑藉先進的向量處理能力、DSP功能、強大的Andes自動化定製擴展(ACE)框架、端到端AI軟硬體協同棧、ISO 26262認證及完整合規支持,以及完善的軟體生態系統,晶心科技充分釋放了RISC-V的潛力,助力客戶在AI、汽車、通信、消費電子、數據中心及移動設備等領域加速創新。目前,全球已有超過200億顆搭載晶心科技方案的SoC晶片,持續驅動各行業創新發展。歡迎訪問 www.andestech.com 了解更多,並通過LinkedIn、X(原Twitter)、YouTube及Bilibili與晶心科技保持聯繫。
Q&A
Q1:AnDLA I370 v2.0在硬體層面做了哪些升級?
A:I370 v2.0主要有四項核心升級:一是MAC陣列可擴展至2048個,大幅提升矩陣運算能力;二是AXI總線位寬最高達512位,搭配增強的DMA處理,解決內存頻寬瓶頸;三是基於可編程張量算子集架構,在硬體層面原生支持Transformer、VLM和SLM網路;四是集成DIV和SQRT等算子的原生執行及算子融合,確保複雜非線性函數無需離開加速器即可完成計算。
Q2:NN SDK v1.2.0如何支持Transformer模型在邊緣端的部署?
A:NN SDK v1.2.0通過多項機制支持Transformer的邊緣部署:原生支持注意力機制,並針對SLM的預填充與解碼階段進行拆分,優化KV緩存調度;提供Linux核心態驅動與用戶態運行時,以及支持任務搶占的RTOS運行環境;內置模型顧問和硬體顧問工具,輔助開發者進行性價比評估;並通過詞級知識蒸餾將大模型壓縮為適合邊緣部署的小模型,同時與最新版LiteRT框架保持集成同步。
Q3:晶心科技的邊緣AI方案適用於哪些應用場景?
A:此次發布的AnDLA I370 v2.0與NN SDK v1.2.0面向多類邊緣計算場景,包括智能攝影機、工業自動化系統、機器人、可穿戴設備和邊緣網關等。這些設備可藉助該方案在本地完成視覺和語言模型的推理,無需依賴雲端,從而降低時延、保護數據隱私,並在功耗和成本受限的條件下實現較強的AI處理能力。






