ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

Flux 3 發表:統一架構下的實體世界多模態模型

工具 1 個來源 · 13 天前
為何重要

這顯示生成式 AI 正從模組化疊加轉向統一基礎架構,有助於降低多模態應用開發門檻。對投資與產業而言,該模型在對齊物理事件與人臉表情方面的強大效能,證明瞭「生成式物理 AI」商業化的潛力,也暗示了競爭對手必須加速整合動態與物理模擬能力才可生存。

Flux 3 是一款新發布的多模態基礎模型,透過 Self-Flow 架構同時學習影像與音訊,強調對真實世界物理法則的模擬;目前處於早期訪問階段。

  • 在競賽評測中,於 93% 的對比勝過 Lumalabs Ray 3.2,並在 77% 的對比中優於 Runway Gen-4.5。
  • 模型能生成最高 20 秒帶有原生音訊的影片,或從文字、影像、影片生成輸出,並具備文字排版渲染能力。
  • 已與 mimic robotics 合作開發 FLUX-mimic,並在 Audi 進行機器人物理操控與實體 AI 任務的實際部署測試。
Flux 3MultimodalAI Video with AudioSelf-FlowPhysical AI

來源 · 1 篇報導

首發 Hacker News Front Page bfl.ai 14:17