ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

Nvidia 展示 Vera Rubin 平臺,主打每瓦特 token 數最佳化

硬體 1 個來源 · 16 天前
為何重要

這代表 Nvidia 從追逐算力堆疊轉向單位能耗最佳化的戰略,直接回應電力與基礎設施擴張成為 AI 產業瓶頸的痛點。對於 Cloud 運營商與企業端而言,硬體的推理效率將成為爭奪 Token 市場份額的關鍵,進而影響其資本支出與利潤結構。

Nvidia 發表 Vera Rubin 平臺,核心目標在於最佳化 AI Factory 的 token 產能與效率,旨在讓客戶在固定的電力預算下產出更多通證以增加收入。該平臺包含 Vera CPU、Rubin GPU 等六款晶片,主打針對 Agent 工作負載的低延遲與高吞吐量需求,並宣稱能透過減少人為介入來加速部署。

  • 透過自動化組裝,Vera Rubin NVL72 算力託盤的安裝時間從 GB200 的 90 分鐘大幅縮短至 1 分鐘,達成 90 倍的改善。
  • 在 CoreWeave 搭載 DeepSeek-R1 的初步測試中,Vera Rubin 平臺較 GB200 NVL72 每瓦特產出多達 10 倍的通證。
  • Vera CPU 配備 Olympus Core,可將 Agent 執行速度提升 2 倍,透過 LPDDR5X 實現 3 倍核心間頻寬與 40% 的延遲降低。
NvidiaVera RubinTokens-per-wattDeepSeek-R1AI Factory

來源 · 1 篇報導

首發 The Register theregister.com 23:00