ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

d-Matrix 採納 NVIDIA NVLink Fusion 與 MGX 封裝設計,加速推論基礎設施佈局

硬體 1 個來源 · 13 天前
為何重要

此舉標誌著 AI 基礎設施建置正從單純的晶片競賽轉向「生態系整合」,業界為了避免建立自成一格的叢集網路,正在大量採用 NVIDIA 的封裝標準。對投資人來看,這凸顯了 NVIDIA 目前正在進行的巨額授權與投資策略,即便不銷售 GPU 也能透過軟硬體授權維持利潤。

AI 推理公司 d-Matrix 本週宣佈將匯入 NVIDIA 的 NVLink Fusion 介面技術與 MGX 橫架設計,藉此簡化大型叢集的擴充套件挑戰並與 GPU 大廠生態接軌。這讓該公司與 Qualcomm、Marvell、Amazon 等業者同列,透過授權商業公模來打造高度可擴充的伺服器系統。

  • d-Matrix 計畫在未來的 Raptor 加速器中整合 NVLink Fusion,並預期於明年底推出單機架容納多達 144 塊 Raptor 的系統。
  • Raptor 加速器搭載 32GB 3D-堆疊 DRAM,記憶體頻寬達 100 TB/s,約為 NVIDIA Rubin GPU 的 4.5 倍。
  • 由此打造的 NVL144 系統含 144 顆為節省空間的縮小版 XPU,提供約 2.3TB 快取與 7.2 PB/s 峰值聚合頻寬,足以執行 4 兆引數模型。
  • 與 Groq 相比,d-Matrix 在維持高頻寬的同時容量提升 64 倍,安裝同等規模模型所需的晶片數大幅減少。
d-MatrixNVIDIANVLink FusionMGXRaptor AcceleratorIn-memory compute

來源 · 1 篇報導

首發 The Register theregister.com 21:00