Nvidia 展示 Vera Rubin 平臺,主打每瓦特 token 數最佳化
為何重要
這代表 Nvidia 從追逐算力堆疊轉向單位能耗最佳化的戰略,直接回應電力與基礎設施擴張成為 AI 產業瓶頸的痛點。對於 Cloud 運營商與企業端而言,硬體的推理效率將成為爭奪 Token 市場份額的關鍵,進而影響其資本支出與利潤結構。
Nvidia 發表 Vera Rubin 平臺,核心目標在於最佳化 AI Factory 的 token 產能與效率,旨在讓客戶在固定的電力預算下產出更多通證以增加收入。該平臺包含 Vera CPU、Rubin GPU 等六款晶片,主打針對 Agent 工作負載的低延遲與高吞吐量需求,並宣稱能透過減少人為介入來加速部署。
- 透過自動化組裝,Vera Rubin NVL72 算力託盤的安裝時間從 GB200 的 90 分鐘大幅縮短至 1 分鐘,達成 90 倍的改善。
- 在 CoreWeave 搭載 DeepSeek-R1 的初步測試中,Vera Rubin 平臺較 GB200 NVL72 每瓦特產出多達 10 倍的通證。
- Vera CPU 配備 Olympus Core,可將 Agent 執行速度提升 2 倍,透過 LPDDR5X 實現 3 倍核心間頻寬與 40% 的延遲降低。