英偉達正式宣布,下一代ai數據中心平台vera rubin的首批樣品,已經送到客戶手裡了。在本周的財報電話會議上,英偉達cfo科萊特・克雷斯親自確認了這件事:首批vera rubin樣品,本周早些時候就已經交付完成。
部署時間預計在2026年下半年,最晚也不會超過2027年初。這也就意味著,vera rubin的性能、功耗這些關鍵指標用不了多久就能和大家正式見面。

圖片來源:法新社
作為專為超大規模ai訓練打造的全新平台,vera rubin的硬體規格相當亮眼。整套系統搭載88核vera cpu,並配備rubin gpu。單顆rubin gpu最高可搭載288gb hbm4高帶寬內存,搭載128gb gddr7的rubin cpx gpu。除此之外,平台還集成了nvlink6.0交換晶元、bluefield‑4 dpu、新一代光子乙太網和高速智能網卡等全套組件,相當於一套從頭到腳都拉滿配置的完整方案。

圖片來源:英偉達
為了讓合作夥伴更快落地,英偉達做了不少優化。不同的合作夥伴,會拿到不同的組件;有的客戶更省心,甚至能直接收到集成了所有硬體的nvl72 vr200整機機架。像富士康、廣達、超微、緯創這些我們熟悉的伺服器大廠,也都拿到了晶元樣品,已經開始著手做整機開發。
英偉達還準備了預裝cpu、gpu、散熱和介面的計算托盤,工程團隊大包大攬了屬於是。

圖片來源:推特
和上一代 blackwell 系統比起來,vera rubin在設計上聰明了很多。它採用模塊化、無線纜的托盤結構,晶元可以快速插拔,幾秒鐘就能完成更換。英偉達直言,新機架的可靠性和易用性都會明顯提升。
如果把整機拆開看,你會更直觀感受到它的 「誇張」。一台機架里就有72個rubin gpu+ 36個vera cpu,整機零部件總數高達130萬個,晶元數量從上一代的864個增加到1300個,整機重量接近2噸。英偉達稱,在特定ai訓練場景下,其每瓦性能相比上一代grace blackwell最高可提升至10倍。雖然新系統耗電量將是前代的兩倍,但能效提升非常顯著。

圖片來源:newstecnicas
它也是英偉達首個全面採用液冷設計的系統平台。相比傳統散熱更省水,對大型數據中心非常友好。這些核心晶元主要由台積電生產,整機的零部件來自全球20個國家、80多家供應商,供應鏈覆蓋中國、美國、墨西哥、越南等地,算得上是真正的世界級工程。
目前,vera rubin正在推進量產。meta表示,計劃在未來數據中心建設中採用rubin架構。除此之外,openai、anthropic、亞馬遜、谷歌、微軟等科技巨頭,也都是它的潛在客戶。

圖片來源:推特
至於大家最關心的價格,英偉達暫時沒有公開。但行業機構futurum group預估,單台機架的價格會比上一代上漲約25%,大概在350萬到400萬美元之間。

圖片來源:cnbc
當然,一路高歌的英偉達也不是沒有挑戰。全球ai熱潮讓內存供不應求,成本一路上漲;amd即將推出對標vera rubin的產品helios,而且已經拿到了meta的大訂單;亞馬遜、谷歌也在大力推廣自家研發的ai晶元,越來越多客戶開始選擇多供應商路線,不再只依賴英偉達。但無論如何,隨著vera rubin首批樣品交付,英偉達似乎還會繼續領跑算力硬體這條賽道。