ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

6天耗資3.5億!小米MiMo-V2.6拿下開源第一,RL訓練里程碑

模型 1 個來源 · 1 天前
為何重要

MiMo-V2.6 不僅敲定了「高強度 RL Scaling」在工程上的可行性,更透過極致的成本效益打破了「智慧越強成本越高」的定律,直接衝擊現有閉源原廠的定價權與估值邏輯。它為產業提供了從硬體叢集配置到 RSI(自我改進)訓練流水線的具體實踐範本,迫使競爭者重新評估 RL 路徑的投入產出比。

小米透過史無前例的直播呈現了近億美元規模的 RL 訓練,MiMo-V2.6 系列在 Artificial Analysis 指數上獲得 46 分,登頂全球開源王座。

MiMo-V2.6-Pro 在 30 步訓練中處理約 81B-111B Tokens,完成一項 Index 任務成本僅 0.13 美元,僅為競品 Grok-4.7 的 1/29。

訓練過程首次實現生成、執行、評分與模型更新四步並行,評分系統耗費約 33 萬美元,並開源了 7000+ RL 環境及 Distill-Qwen-9B 模型。

除程式碼外,模型展現了在 MOF 材料科學及全模態(3D建模、音樂、機械臂遙控)的強大泛化能力。

小米MiMoRL訓練Open SourceSOTA

來源 · 1 篇報導

首發 量子位 QbitAI qbitai.com 19:50