智象未來發布原生全模態視訊模型 HiDream‑O1‑Video‑1.0,全球權威榜單均列前茅
為何重要
對於技術決策者而言,HiDream‑O1‑Video 顯示行業競爭焦點已從「畫素疊代」轉向「預設義理與物理模擬」,其自主敘事規劃能力為高維度影片創作提供了更可控的底層邏輯。對投資人來說,C+ 輪資本不僅看重其單一模型效能,更著眼於其與影像、3D 及具身模型併發的「世界模型」戰略佈局,顯示資本市場正重新評估具備全模態底座的 AI 公司估值邏輯。
智象未來正式發布原生全模態視訊生成模型 HiDream‑O1‑Video‑1.0(HD‑V1),主打依據物理規律導向的渲染與音畫一體生成技術。該模型憑藉在兩項國際權威評測中的頂尖表現,為中國 AI 企業首次確立了在圖生視訊領域的全球第一梯隊地位。
- 規格與輸出:支援 5–20 秒 1080p 高保真視訊生成,具備多模態意圖理解能力,能對鏡頭、運鏡與音效進行結構化規劃。
- 國際榜單排名:在 *Artificial Analysis Image to Video Leaderboard (With Audio)* 排名全球第 4,在 *Arena.ai Image-to-Video* 排名全球第 8。
- 架構與技術:採用原生全模態架構對文本、視訊與音訊訊號進行聯合建模,並透過 Diffusion Reinforcement Learning 對齊人類認知,解決音畫不同步問題。
- 技術生態閉環:與 *HiDream‑O1* 系列的影像、3D 互動及具身領域模型共同構建成原生全模態世界模型矩陣。