ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

任少卿與蔚來發表 MM-Future:多模式世界-動作聯合模型

研究 1 個來源 · 1 小時前
為何重要

世界模型在端到端自動駕駛中的角色正從單純預測轉向「假設-評估」的規劃環節,讓模型有能力計算不同行為對環境的互動影響。MM-Future 驗證了多模式假設在處理複雜交通路口互動時,能有效排除高風險軌跡(如 TTC 指標的顯著提升),這對開發者理解和製作能處理真實多結果的模擬能力具有重要參考價值。

  • 任少卿發起研究團隊發表新論文,提出 MM-Future 架構,解決級聯模型單向傳遞資訊與聯合模型結果單一的問題,實現車輛行為與未來環境的雙向耦合推演。
  • 該方法基於 GMM Noise 與 MM-Tokens,透過建立動作先驗並壓縮視覺特徵,成功在單次前向過程中生成 64 組場景-動作假設。
  • 在 NAVSIM benchmark 上,該模式的最佳導航模式分數達 94.0,超越了 DriveFuture 與 E2E 方案;16 與 32 種模式下的收斂步數僅需 3.8k steps,而單模式需 17.5k steps。
任少卿NIOMM-FutureWorld-Action Model自動駕駛World Model

來源 · 1 篇報導

首發 量子位 QbitAI qbitai.com 20:58