ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

NVLink 第六代:打造 AI 工廠的規模擴充套件網路

硬體 1 個來源 · 17 天前
為何重要

AI Factory 的設計核心已從單顆 GPU 的極限效能轉變為協同運算的效率,Scale-up Network 是決定 MoE 模型訓練與推論吞吐量的關鍵基礎設施。NVLink 的高頻寬與低延遲優勢不僅解決了分散式運算的瓶頸,更透過減少通訊開銷提升 ROI,這將迫使雲端服務商與開發者在未來的 AI 平臺選型中,必須重新評估硬體網路基礎設施的重要性。

為應對 AI 模型規模與運算量的爆炸性成長,NVIDIA 發布第六代 NVLink,旨在以專門設計的高頻寬、低延遲網路,讓資料中心的加速器能如同單一運算單元般高效協作。

  • 每 GPU 頻寬最高可達 3.6 TB/s,機架級總頻寬高達 260 TB/s,並提供 130 TFLOPS 的網內運算能力(In-network Compute)。
  • 在動態專家混合模型(MoE)與 LLM workload 下,相比主流 Ethernet 方案,實現高達 50X 的 token per watt 效能提升(從 Hopper 到 Blackwell 架構)。
  • 針對推斷場景,NVLink 可為 DeepSeek-R1 和 Qwen 235B 等模型提供 2.3 倍於領先後出即用(OTS)Ethernet 的解碼吞吐量。
  • 軟體棧採極致協同設計(NVIDIA Dynamo, TensorRT-LLM 等),支援分散式推理、專家並行與動態資源分配,並具備控制平面彈性、熱插拔託盤與雲端級維運功能。
NVLinkAI FactoriesMoENVIDIAScale-up NetworkingHopper

來源 · 1 篇報導

首發 NVIDIA Technical Blog developer.nvidia.com 23:46