據測試,Vera Rubin NVL72 在 1.6T DeepSeek 模型下,每 MW Token 流量比優於 Blackwell,達 7 倍,超越黃仁勳在 1T-3T LLM 上所言 3 倍上限。
為何重要
此測試結果打破了市場對於新品出貨初期效能保守的預期的上限,暗示「Vera Rubin」架構(BP100/200 群)在軟硬體協同最佳化下具備驚人的獲利效率。對於受電力成本驅動的 AI 基礎設施投資人而言,每 MW Token 數的提升直接對應營運效益的再平衡,這可能代表該架構在未來推理市場具備更強的溢價定價能力。
針對 Vera Rubin NVL72 系列進行的推理測試顯示,在 1.6T DeepSeek 模型運作下,其每瓦特(百萬瓦)的 Token 流量比(throughput/mW)高達 7 倍,顯著優於 Blackwell 架構。
- 成功超越 Jensen Huang 預先宣稱的 1T-3T LLM 流量比上限 3 倍。
- 測試資料顯示每項單位功率的處理效能能有顯著提升。
- 測試背後原理被指涉於「Extreme Co-Design」(高極度共同設計)策略。