Hot Chips 週報重點:新架構攻防與記憶體瓶頸解方
為何重要
這週的產業動態揭示從單一模型競賽轉向「系統層級整合」與「記憶體效能」的硬體決勝點。輝達不僅靠晶片效能領先,還透過併購 Hugging Face 與協定 NVIDIA GPU 出貨,試圖控管 AI 開發的底層生態與基礎設施。對開發者而言,高通對 HBM 或 LPDDR 架構的挑戰意味著未來伺服器設計可能不再單純堆疊 HBM,而是出現更多邊緣運算導向的混合記憶體解決方案。
這週是《熱度晶片》技術研討會(Hot Chips)的訊息高峰期,各大廠紛紛披露 2nm 與 18A 架構的 AI 處理器細節,並透過硬體架構創新與市場佈局來應對記憶體供給不足的產業危機。
- 新架構部署: IBM 與 Arm 聯手推出可執行雙指令集的 2nm 雙架構處理器;蘋果發表針對 AI 的 2nm M6 SoC(Mac mini)與 M5 Ultra 處理器;微軟推出搭載 216GB HBM3E 與 10 PFLOPS 級 FP4 效能的 Maia 200 加速器。
- 運算效率提升: 輝達宣佈 Groq 3 LPX 進入全面量產,以延續 Vera Rubin 系統的令牌生成速率;Cerebras 詳述 CS-4 加速器如何在接合層平臺上實現高 tokens/sec 速度;高通提出將計算晶片置於 LPDDR 電陣列前方的解決方案,以直接挑戰 HBM 加介面路徑。
- 資本與收購動向: 輝達宣佈以 129 億美元收購開源 AI 模型庫 Hugging Face;輝達與 AWS 確認將在 2027 年至 2028 年部署額外 200 萬片 GPU;Infineon 收購 C2i Semiconductors 以擴張 AI 資料中心軟體定義控制器。
- 市場與供應鏈預期: Gartner 預測全球半導體營收 2026 年將成長 92% 至 1.6 兆美元;Lam Research 在俄勒岡州啟動年投資額 30 億美元以上的 R&D 實驗室,預計 2028 年營運。