ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

據測試,Vera Rubin NVL72 在 1.6T DeepSeek 模型下,每 MW Token 流量比優於 Blackwell,達 7 倍,超越黃仁勳在 1T-3T LLM 上所言 3 倍上限。

晶片 1 個來源 · 8 天前
為何重要

此測試結果打破了市場對於新品出貨初期效能保守的預期的上限,暗示「Vera Rubin」架構(BP100/200 群)在軟硬體協同最佳化下具備驚人的獲利效率。對於受電力成本驅動的 AI 基礎設施投資人而言,每 MW Token 數的提升直接對應營運效益的再平衡,這可能代表該架構在未來推理市場具備更強的溢價定價能力。

針對 Vera Rubin NVL72 系列進行的推理測試顯示,在 1.6T DeepSeek 模型運作下,其每瓦特(百萬瓦)的 Token 流量比(throughput/mW)高達 7 倍,顯著優於 Blackwell 架構。

  • 成功超越 Jensen Huang 預先宣稱的 1T-3T LLM 流量比上限 3 倍。
  • 測試資料顯示每項單位功率的處理效能能有顯著提升。
  • 測試背後原理被指涉於「Extreme Co-Design」(高極度共同設計)策略。
NVL72Vera RubinBlackwellDeepSeekInferenceXExtreme Co-Design

來源 · 1 篇報導

首發 Techmeme techmeme.com 08:40