ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

NVIDIA 推出 Nemotron 3.5 Lightning 與 NeMo Switchyard 串聯開源與智慧體生態

模型 1 個來源 · 8/11
為何重要

NVIDIA 強勢推動開源與本地部署,試圖在雲端 API 成本高昂下,為企業開發者提供「不失前沿智慧」的成本優勢解決方案。這驗證了邊緣運算與混合模型路由的商業化可行性,將加速企業端 AI 應用從大模型 API 向私有化、自管算力邁進。

NVIDIA 於八月擴大開源生態,推出適合本地部署的高效能通用 AI 智慧體模型與工具。重點包含 Nemotron 3.5 Lightning 與 NeMo Switchyard 的釋出,重點改寫了開源模型的效能與成本結構。

  • Nemotron 3.5 Lightning 是一個開源 30B 專家混合(MoE)模型,相比同級別開源模型,代幣生成速度快 4 倍,完成時間快 30%。
  • 此模型支援 vLLM、Ollama、llama.cpp 等平臺的 NVFP4 和 GGUF 格式,允許開發者在 RTX PC、DGX Spark 或 DGX Station 等多種硬體上本地執行。
  • NeMo Switchyard 可自動路由智慧體工作流程至最佳合適模型;內部基準測試顯示,該方法將任務完成成本降至單一 Opus 4.8 模型的約三分之一。
Nemotron 3.5 LightningNeMo SwitchyardAgentOpen SourceEdge AINVIDIA

來源 · 1 篇報導

首發 NVIDIA Blog blogs.nvidia.com 21:00