Everpure 推動儲存層解決方案,防止 AI 算力在資料等待中空轉
為何重要
這顯示出 AI 基礎建設的「轉折點」正從單純的算力囤積(GPU),轉向解決算力邊緣的 I/O 頓塞問題。Everpure 與 NVIDIA 的深層整合,打破了傳統儲存與 GPU 之間的距離障礙,證明瞭在 AI Factory 時代,能提供「資料即服務」且具備極致低延遲(納秒級)能力的儲存解決方案,將取代單一硬體供應商,成為決定 AI 生產效率的關鍵性橋樑。
針對 NVIDIA SuperPOD 系統中 AI Agents 面臨的資料存取延遲問題,Everpure 提出一套專為 GPU 加速設計的儲存架構,以避免昂貴的 GPU 閒置與計算酬金損失。
- 為維持數千顆 GPU 高負載執行,儲存尚未端需具備跨越 10 TB/sec 以上的頻寬。
- 認證 NVIDIA AI Data Platform 的 FlashBlade//EXA,可提供 400-450 百萬 IOPS 與 220 GB/sec 頻寬。
- 金鑰值加速器 (KVA) 透過 GPUDirect Storage (GDS) 將 KV cache 解除安裝至快閃儲存,避免 GPU 重新計算預填充資料。
- Data Stream 平臺整合 NeMo Retriever,利用 RAG 機制即時為模型注入來自儲存層的最新知識。