
文 | 人文社
編輯 | 人文社
«——【引言】——»
2025年7月26日,上海WAIC大會的現場,華為的「昇騰384超節點」真機亮相,消息引起了科技圈一陣不小的討論。
把這整台超級算力系統擺出來,還被大會組委會當成「鎮館之寶」推薦,連國際媒體都緊盯着報。
可千萬別以為這是場普通展會,其實這是華為甩出的一個算力核彈,國產AI這次真把天捅破了,英偉達後悔也晚了。
今天我們就來好好扒一扒這背後的故事。

國產AI「放大招」
其實,我們已經能從那些專業報道里能看到端倪,這套系統官方叫CloudMatrix 384,用了384塊昇騰AI芯片(Ascend 910C),配合192塊鯤鵬CPU,搭建成一台真正意義上的超級「AI服務器」。
對比英偉達的NVL72(用了72塊GB200/B200芯片),國產廠商這一做法是徹底把「牌數」打上去。
網上有人一陣見血,人家單芯片能力比NVL72弱,但系統設計好,就能贏得漂亮。
而這「全對等架構」聽起來不太像科大講堂的高冷概念,更像鄰居老王家突然燒了個大轟趴,大家串門不用找門衛審批。

具體什麼意思?
傳統AI集群都還在沿用幾十年前主從結構,數據從NPU傳給CPU再傳回去,每一步都要審批,效率極低。
這種結構瓶頸嚴重時常導致大模型訓練成本飛漲、時間翻倍。
CloudMatrix384的MatrixLink就是關鍵,NPU、CPU、內存、DPU這些芯片直接通過高速總線互聯,無中轉,無審批,數據像滑索一樣直線飛過去。
整套系統帶寬達到約 269 TB/s,延遲從傳統2微秒降到200納秒,快整整十倍。

更吸睛的數字說,新系統算力大約300 Pflops,是NVL72的1.7倍,網絡通訊帶寬高出107%,內存帶寬高出 113%。
單卡推理吞吐量能跑出2300tokens/s,一台機器吃數據快得像吃喝二合一。
顯然這些數字不是糊弄人的,其實官方早已明確表示CloudMatrix384把資源利用率提升了50%以上,NPU利用率提高了40%,模型推理效率在真實業務場景中提升超過一倍。
多個試點客戶反饋,推理速度提升2.7倍,模型上線時間減半。

在HDC 2025開發者大會當天,國產大廠雲計算CEO張平安還宣布,他們已經在安徽、內蒙古、貴州等地部署了CloudMatrix384,這個系統正在全面服務企業客戶,提供「訓推一體化」雲能力。
這種變化非常重要,一個極為普通的比喻就夠說明。
過去訓練一個千億參數級模型,動不動就得耗費幾百萬塊錢幾十台服務器,訓練時間長,成本高。
現在用CloudMatrix384,一台機可以出力乃至擴展成上萬卡的「超級集群」(Atlas 900 SuperCluster),訓練時間縮短30%以上,許多任務從半年變成幾個月。

如此之高效率提升,不只是技術上的突破,更直接帶來市場震動。
市場分析指出,在大會新聞刺激下,相關國產硬件、散熱設備、光模塊、系統集成商都受到提振,這可不是炒作,而是源自產業鏈預期的升級。
更厲害的還在後面,這不是升騰芯片單打獨鬥,而是帶動生態「小浪潮」形成的系統工程。
現在昇騰生態里已有超過80個主流大模型適配,方案數量多達6000多個,覆蓋金融、醫療、交通、教育等多個行業。
舉個簡單的例子,醫院用昇騰訓練醫學影像模型,CT圖識別診斷時間從半小時降到幾分鐘,油氣公司做地質勘探,先前幾口井才找到油田,現在AI算出來三口就搞定。
AI場景從「想像」變為「落地」。

這才是真正有煙火味的國產科技成果。
再看看國際背景,美國對華為一直限制技術出口,但恰恰是這種壓力把華為逼成了系統設計高手。
已經有行業大佬指出,國產廠商在架構層面用更多芯片、更精細系統設計頂住了英偉達更先進但芯片數量少的方案。
就在今年4月,美國剛宣布將Nvidia H20芯片出口禁令延伸到中國市場,結果中國在隔天就公布了Ascend 920芯片,預計2025年下半年量產,性能甚至趕上甚至超過英偉達H20的水準。

雖然Ascend 910C每片性能不如H100,但系統搭配加上未來920架構補位,我們國產廠商已經有意圖、有節奏地在算盤上硬剛。
這種體系的爆發力,可以粗淺地理解為,以前大家都在趕英超車,用更好的材料追趕別人造的大樓。
這波操作不是追而是改賽道,自己造模板、自己搭支架、不再循環用舊設計。
等你還在按老方子施工,它已經把未來的樓建得比你還高。
從普通人角度說未來會怎樣?

AI服務真的有可能降價、變智能。
有了更低成本的訓練平台,中小型AI公司也能擁有頂級算力,大模型服務不再是巨頭專屬。
你寫稿、翻譯、定製內容,對接AI方案,對你來說成本更低、性能更好。
AI技術像網絡、像電力一樣逐漸進入千家萬戶。
對整個中國科技行業而言,這意味着算力基礎不再依賴進口芯片,底座平台由華為和國產生態掌控。

從「跟跑者」變成「規則制定者」,產業自主性增強,數字經濟自主權越來越強,這一切,從CloudMatrix384在WAIC上真機亮相那刻開始鋪展開來。
總之一句話,這不只是一台機器的發佈,更是中國科技體系底層工程思維的一次躍遷。
我們正在用實打實的系統工程能力,讓國內AI算力真正實現「換道超車」式前行。
英偉達硬是被甩在後頭,連氣氛都顯得有點慌。
結語:
未來幾年,看國產 AI 應用變得越來越普及,看 AI 服務變得越來越親民,甚至看到我們能夠在自家的技術土壤上訓練、部署大模型和 AI 應用。

這些都離不開華為這次「天捅破」的算力底盤。
科技不是一夜之間長成,但每一次架構突破,都可能成為後來者翻盤的起點。
昇騰384就是這樣一個起點。
讓人期待的不僅是一篇技術報道,而是中國從此掌起規則的那股底氣。
參考資料:TechWeb——華為首次線下展出昇騰384超節點 更好滿足模型訓練和推理需求