GTC 大會上,NVIDIA 今日推出 NVIDIA Vera CPU,這是全球首款專為自主型 AI 及強化學習時代打造的處理器,效能比傳統機架式 CPU 快 50%,效率提升兩倍。

隨著推理與自主型 AI 的進步,模型在規劃任務、運行工具、與資料互動、執行程式碼及驗證結果時,所依賴的基礎架構在規模、效能與成本上扮演越來越重要的角色。

NVIDIA Vera CPU 建立在 NVIDIA Grace™ CPU 的成功基礎上,讓各行各業的組織能打造大規模 AI 工廠,釋放自主型 AI 的潛力。Vera 擁有最高的單線程效能與每核心頻寬,是一款新型 CPU,能為大型 AI 服務如程式碼助理及消費者與企業代理人提供更高的 AI 吞吐量、反應速度與效率。

與 NVIDIA 合作部署 Vera 的領先超大規模雲端服務商包括阿里雲、CoreWeave、Meta 與 Oracle Cloud Infrastructure,以及全球系統製造商 Dell Technologies、HPE、聯想、Supermicro 等。這種廣泛採用確立了 Vera 成為開發者、新創公司、公私機構及企業最重要 AI 工作負載的新 CPU 標準,有助於普及 AI 存取並加速創新。

NVIDIA 創辦人兼執行長黃仁勳表示:「Vera 正在 AI 的轉折點到來之際問世。隨著智慧變得自主,能夠推理與行動,協調這些工作的系統重要性提升。CPU 不再只是支援模型,而是推動模型。Vera 以突破性的效能與能源效率,解鎖更快思考與更大規模的 AI 系統。」

可配置於各種資料中心 NVIDIA 同時宣布一款整合 256 顆液冷 Vera CPU 的新型 Vera 機架,能維持超過 22,500 個獨立且全效能運行的 CPU 環境。AI 工廠可快速部署並擴展至數萬個同時執行的實例與自主工具於單一機架。新 Vera 機架採用 NVIDIA MGX™ 模組化參考架構,獲得全球 80 家生態系夥伴支持。

作為 NVIDIA Vera Rubin NVL72 平台的一部分,Vera CPU 與 NVIDIA GPU 透過 NVIDIA NVLink™-C2C 互連技術配對,提供 1.8 TB/s 的一致性頻寬,是 PCIe Gen 6 的 7 倍,實現 CPU 與 GPU 之間的高速資料共享。此外,NVIDIA 推出以 Vera 作為主 CPU 的 NVIDIA HGX™ Rubin NVL8 系統新參考設計,協調 GPU 加速工作負載的資料移動與系統控制。

Vera 系統合作夥伴提供雙插槽與單插槽 CPU 伺服器配置,適合強化學習、自主推理、資料處理、協調、儲存管理、雲端應用及高效能運算等工作負載。

所有配置中,Vera 系統整合 NVIDIA ConnectX® SuperNIC 卡與 NVIDIA BlueField®-4 DPU,強化網路、儲存與安全功能,這對自主型 AI 至關重要。此設計讓客戶可針對特定工作負載優化,同時維持 NVIDIA 平台上的單一軟體堆疊。

為自主型擴展而設計 Vera 結合高效能、節能的 CPU 核心、高頻寬記憶體子系統與第二代 NVIDIA 可擴展一致性架構,能在自主型 AI 與強化學習常見的極端使用條件下,提供更快的自主回應。

Vera 採用 88 顆 NVIDIA 自行設計的 Olympus 核心,為編譯器、執行引擎、分析管線、自主工具與協調服務提供高效能。每個核心可使用 NVIDIA 空間多線程技術同時執行兩個任務,提供穩定且可預測的效能,非常適合同時執行多項工作的多租戶 AI 工廠。

為進一步提升能源效率,Vera 採用第二代 NVIDIA 低功耗記憶體子系統,基於 LPDDR5X 記憶體,頻寬高達 1.2 TB/s,是通用 CPU 的兩倍頻寬且功耗減半。

廣泛的生態系支持 AI 原生軟體開發創新者 Cursor 採用 NVIDIA Vera 以提升其 AI 程式碼代理的效能。

Cursor 共同創辦人兼執行長 Michael Truell 表示:「我們很高興使用 NVIDIA Vera CPU 提升整體吞吐量與效率,為客戶帶來更快速、更靈敏的程式碼代理體驗。」

領先的串流資料與 AI 平台 Redpanda 使用 Vera 大幅提升效能。

Redpanda 創辦人兼執行長 Alex Gallego 表示:「Redpanda 最近測試 NVIDIA Vera 執行 Apache Kafka 相容工作負載,效能遠超其他系統,延遲降低高達 5.5 倍。Vera 代表 CPU 架構的新方向,擁有更多記憶體與更低核心開銷,讓客戶能將即時串流工作負載擴展到前所未有的規模,並開啟新的 AI 與自主應用。」

計畫部署 Vera CPU 的國家實驗室包括 Leibniz 超級電腦中心、洛斯阿拉莫斯國家實驗室、勞倫斯伯克利國家實驗室的國家能源研究科學計算中心及德州先進計算中心(TACC)。

TACC 高效能運算主管 John Cazes 表示:「我們近期測試 NVIDIA Vera CPU 平台,為即將部署的 Horizon 系統做準備,執行六個科學應用時取得令人印象深刻的初步成果。Vera 的每核心效能與記憶體頻寬對科學運算是巨大進步,我們期待今年稍晚在 Horizon 系統為 CPU 使用者引入基於 Vera 的節點。」

計畫部署 Vera CPU 的領先雲端服務提供商包括阿里雲、字節跳動、Cloudflare、CoreWeave、Crusoe、Lambda、Nebius、Nscale、Oracle Cloud Infrastructure、Together.AI 與 Vultr。

採用 Vera CPU 的基礎設施供應商包括 Aivres、ASRock Rack、華碩、仁寶、思科、戴爾、鴻海、技嘉、HPE、Hyve、英業達、聯想、MiTAC Computing、微星、和碩、廣達、Supermicro、緯創與 Wiwynn。

供貨情況 NVIDIA Vera 已全面量產,將於今年下半年由合作夥伴供應。