華為詳細 AI 加速器路線圖,新一代 Ascend NPU 出貨提前,Ascend 960PR FP4 效能翻倍
為何重要
華為在低精度計算效能上的飛躍,顯示其在面臨先進製程限制的環境下,透過架構創新(SIMD+SIMT)抵銷效能落差的策略有所成果。這直接改變了中國國內 AI 開發者在晶片選擇上的生態,從依賴 NVIDIA 轉向支援本土方案。然而,供給不足與新架構所需的軟體生態重構仍是市場普及的主要隱憂。
華為於 Connect 活動更新 AI 硬體路線圖,宣佈從純 SIMD 架構轉型為結合向量運算與執行緒級並行的 SIMD+SIMT 結構,並大幅加速下一代 Ascend 960 系列的推出時程。
- 架構轉變:華為將 NPU 設計從純 SIMD 過渡到 SIMD+SIMT 架構,以提升各種 AI 工作負載的硬體利用率。
- 上市時程:Ascend 960DT 預計於 2027 年 Q1 正式供貨(提早三季);Ascend 960PR 預計於 2027 年 Q3 發表(提早一季)。
- 規格與效能:Ascend 960PR 於推理階段的 FP4 效能將達 8 GFLOPS(比原公告翻倍),960DT 推理效能為 4 FP4 PFLOPS,並配備 288 GB HiZQ 記憶體。
- 路線圖未來:Ascend 970 預計 2028 年推出,980 預計 2029 年推出,展現一年一代的研發節奏。