2025年9月10日,上海的秋風中夾雜著一絲技術革命的熾熱氣息。
就在這一天,arm將其全新的ai技術領導力峰會——「arm unlocked 2025」的亞洲首站設在了這座充滿活力的東方都市。
這不僅是一場簡單的技術交流,更是一次集結了頂尖科技公司、晶元合作夥伴及生態系統領袖的技術發布。arm在會上正式發布了其面向移動終端的新一代css平台——arm lumex,為端側ai體驗帶來全面優化與提升,並進一步釋放終端場景的全部潛能。

(圖源:雷科技)
雷科技此次也受邀來到活動現場,為大家帶來現場、立體和一手報道。
arm lumex:名字變了,效率倍增
有的讀者可能會問,arm lumex是什麼?
想要了解這個問題,你需要先搞清楚什麼是arm css產品。
arm css,全稱compute subsystems(計運算元系統),是arm提供的一種「硬體全家桶」解決方案。
它是將arm最新的cpu、gpu以及相關的系統ip(如互連匯流排、內存控制器)預先集成、配置並驗證好,打包成一個完整的高性能平台。
對於晶元設計公司而言,直接採用css方案,就無需從零開始進行複雜的ip集成和驗證工作。這能極大地縮短soc的開發周期,降低研發風險,幫助合作夥伴更快地將搭載最新技術的產品推向市場。它本質上是一個高性能、高效率的「晶元半成品」。

(圖源:雷科技)
而這次發布的arm lumex,便是包含新一代arm c1 ultra「超大核」與arm c1 pro「大核」cpu以及mali g1-ultra gpu,並支持sme2可擴展矩陣延伸指令集的全新css平台。
c位登場的,自然是支撐起lumex的全新armv9.3 cpu集群。

(圖源:雷科技)
根據官方介紹,lumex css平台支持3nm製程,實現了兩位數百分比的cpu ipc性能提升,其中arm c1-ultra超大核相較上代cortex-x925,單線程峰值性能提升25%、arm c1-pro大核,與上一代的 arm cortex-a725 cpu 相比,在相同主頻下持續性能提升 16%,在同等性能下能效提高多達12%,在單線程和多線程性能上均實現了一次重要的躍遷。
除此以外,這次arm還帶來了適用於次旗艦移動設備的arm c1-premium核心和適用於可穿戴設備的arm c1-nano核心,前者的等面積效率更優,後者更是主打極致能效,廠商們可以根據自身需求靈活調整。
眾所周知,armv9架構本身就是專為ai和安全而設計的。在過去幾年的演進中,arm不斷為其增添針對機器學習(ml)等領域的計算能力。
正因如此,這次armv9.3在ai性能上也得到了大幅度的強化。它通過對底層微架構的深度優化,尤其是對sme2(第二代可伸縮矩陣擴展)指令的硬體級支持,為實際場景中的 ai 驅動型任務帶來了顯著的ai性能提升。
具體來說,就是ai性能提升高達五倍;語音類工作負載延遲降低4.7倍;音頻生成速度提升2.8 倍。

(圖源:雷科技)
舉個例子,通過arm、支付寶與vivo的三方合作下,大語言模型 (llm) 的交互響應時間縮短了多達40%,現場展示的通義2.5b體驗機就能很好地展現出這個效果。
全新的arm cpu在ai計算能力上的飛躍,讓實時的端側ai推理成為現實,以往需要依賴雲端才能完成的複雜ai推理任務,如今在設備端就能流暢運行。無論是更聰明的離線語音助手,還是能夠實時理解畫面的ai影像系統,都將得益於sme2帶來的算力解放。
現如今,sme2已經廣受業界領先生態夥伴的採用,包括阿里巴巴、支付寶、三星system lsi、騰訊及vivo,力求在本地實現更快、更安全且隨時可用的智能體驗。

(圖源:雷科技)
作為圖像核心的新一代mali g1-ultra gpu,其表現同樣突出:
在各類圖形基準測試中,mali g1-ultra較前代產品實現了20%的性能提升,ai推理性能提升最高 20%,同時得益於全新的第二代光線追蹤技術,其光線追蹤性能相較前代提升了兩倍,為《暗區突圍:無限》、《原神》等主流遊戲帶來了全面的性能增強。
此外,mali g1-premium與mali g1-pro兩款gpu,也為硬體資源受限的設備提供了更出色的性能與能效表現,能在更低的功耗下,為中高端設備提供持久且高效的支持。
arm的ai觀:旗艦設計為何要「ai優先」?
在arm unlocked 2025上海站峰會的主題演講結束後,我們受邀參加了持續半天的技術分享會。
在這次分享會中,arm終端事業部產品管理副總裁james mcniven和arm 終端事業部產品管理總監ronan naughton為我們更深度地解讀了arm lumex的技術價值。
james首先帶我們回顧了行業發展所面對的挑戰,從工藝節點/封裝技術/發布周期帶來的壓力,到用戶關注的遊戲、性能和應用,都和如今的ai技術息息相關。

(圖源:雷科技)
雖然ai被公認為最具顛覆性的新技術,但想要完全釋放其潛力,尤其是在數十億計的終端設備上實現普惠,正面臨著嚴峻的挑戰。ai對性能、功耗和安全性的極致要求,正在迫使整個半導體行業進行一次從硬體到軟體的系統性重構。
而這,也就是為什麼arm lumex平台會以「ai優先」的原因。
從設計之初,arm lumex就將ai和安全置於核心。本次峰會上亮相的全新armv9.3 cpu和gpu,其設計的根本出發點,就是為了高效執行ai工作負載。
他特彆強調了sme2技術的重要性,讓cpu以遠超以往的效率處理神經網路運算,是實現高能效端側ai的關鍵,雷科技也在現場體驗到了基於sme2實現的端側語音生成0.3b、端側文字交互2.5b以及實時翻譯/瑜伽指導功能。

(圖源:雷科技)
你別說,效果都挺驚艷的,特別是這個語音生成,蠻期待這些端側應用落地的一天。
再來看看gpu方面的解析,ronan表示,與前一代arm immortalis-g925 gpu相比,mali g1-ultra的光線追蹤性能提升高達兩倍,並在主流圖形基準測試中,性能表現提升20%,全新引入的矩陣乘法單元 (mmul) fp16 指令,更可加速如語義分割、去噪、深度估計、物體檢測、語音識別和圖像增強等端側關鍵ai工作負載。
然而,強大的硬體只是故事的一半。
有與會者提問:目前ai生態面臨的更大挑戰在於軟體層面,開發者們迫切需要一個簡單、高效的方式來利用底層硬體的ai能力,而不是為每一款晶元都進行複雜的底層優化,arm在這方面有做出什麼努力嗎?
james答道,arm推出的kleidiai,正是為了解決這「最後一公里」的難題。目前kleidi適配了從arm neon到armv9.3 sme2的擴展指令集,通過這款軟體包,開發者無需成為硬體專家,也能確保自己的ai應用在arm平台上跑得又快又省電,這極大地降低了ai技術的應用門檻。

(圖源:雷科技)
雷科技在體驗時也問了一下工作人員,「在雲端ai算力如此強大的今天,arm為何如此堅持大力投入資源,去提升終端設備上的ai處理能力?」
工作人員對此解釋道,他認為端側ai與雲端ai並非取代關係,而是互補共生。將更多的ai計算放在設備端處理,不但能帶來極致的響應速度與體驗,更能保證用戶的隱私與安全,而且寄希望於設備永遠在線並連接雲端進行ai計算是不現實的,高能效的端側ai是實現萬物智能的必由之路。
在我看來,整個ai時代的競爭,本質上是生態的競爭。
arm的機遇在於,憑藉其在半導體行業的核心地位和廣泛的生態系統,他們不但可以提供高性能的ip,更是能夠成為連接硬體創新與軟體應用之間的「橋樑」,讓科技的進步真正惠及每一個人。
說在最後
毫無疑問,ai的需求使得智能終端生態在過去的一年裡迎來了新的爆髮式增長,人們正在不停地嘗試、開拓新的應用範例、探索新的硬體形態,尋找著能夠為消費者帶來更好體驗的產品——
不管是軟體還是硬體的。
個人認為,相較於以往用「cortex-a/x/r/m」覆蓋所有領域的做法,arm如今的思路更為清晰:為不同的垂直市場,打造專屬的品牌和技術平台。

與arm lumex一同浮出水面的,還有面向pc市場的 niva、面向汽車市場的zena和面向物聯網市場的orbis css平台。這一系列動作,清晰地勾勒出arm意圖在每一個細分賽道上,都建立起無可撼動的技術領導力和品牌辨識度。
隨著未來的ai生態繼續發展,我們無疑將會看到更多基於arm css平台打造的新一代智能終端產品,而ai生態的需求也將繼續驅動arm開發更高性能、更具效率的新產品。
arm lumex css,正是他們為這個未來交出的第一份,也是最重要的一份答卷。
9月5日-9日,世界最大家電與消費電子展ifa2025在柏林盛大舉辦。
雷科技派出了史上最大規模海外報道團「雷科技ifa25報道團」飛赴柏林,對ifa2025進行現場、立體、一手報道。共輸出40+內容,在雷科技300萬微信粉絲矩陣、1000萬新媒體矩陣傳播,全網閱讀量/播放量預估超500萬。我們對ifa2025的報道,再一次得到了deepseek的ai認證「全網最強」。
期待26年1月ces,我們拉斯維加斯再見。
