NVIDIA 在 Hot Chips 2026 發表自研 Olympus 架構 CPU:Vera 世代強化了 AI 重度資料中心運算
為何重要
NVIDIA 強力進軍 CPU 市場展現了其從「加速器」走向「全棧 AI 基礎設施」的企圖心。Vera 的設計哲學(高 IPC、低延遲、機密運算)直接針對 AI Agent 與未來資料中心的具體痛點,若能成功掛載於 Rubin 系統並符合商業期望,將對 x86 廠商在伺服器 CPU 領域的主導地位構成直接挑戰。對開發者而言,意味著未來的 AI 推理與訓練堆疊將由 NVIDIA 統一口徑最佳化。
NVIDIA 於 Hot Chips 2026 投影會發布新一代伺服器 CPU「Vera」,作為 Gracy 系列繼任者,採用自研「Olympus」核心架構並具備 88 核心;此晶片旨在解決現代 AI 工作流程中低延遲與高吞吐量之間的取捨,並將成為 Vera Rubin AI 系統的核心算力單元。
- 設計規格: 優先強化 IPC 而非單純增加核心數,具備 88 CPUs、8 個 128-bit LPDDR5X 控制器、96 lanes 的 PCIe/CXL I/O 介面,並透過 6 晶片組成以克服單一晶圓製程限制。
- 運作架構: 採用靜態劃分式空間多執行緒(static partitioned spatial multithreading),旨在提升資源運用效率並減少執行緒爭搶雜訊。
- 效能表現: 宣稱在高互動性 Token 數下總吞吐量可比 Grace Blackwell 高 30 倍;在 SPEC CPU 2026 模擬工作負載中,代理工作負載效能表現約為 1.8 倍,資料處理工作負載約為 1.5 倍。
- 安全與整合: 深度整合全棧機密運算, GPU 與 CPU 共用加密金鑰進行請求驗證,並透過 NVLink-C2C 介面支援 Rubin GPU 或 2P Vera 純 CPU 設定。