Hunyuan3D-Buffalo 1.0:統一多模態 3D 風格生成、理解與編輯模型
為何重要
該模型將零散的 3D 分析與生成技術統一於單一架構,大幅降低了開發者進行 Schema-driven 應用層 3D 資產生產的門檻,代表了通用 3D AI 的一項重要進展。不過,其 8,700 萬規模的訓練庫與複雜架構對算力需求極高,目前仍多屬於基礎技術展示。
- 騰訊推出統一 3D 框架 Hunyuan3D-Buffalo 1.0,能在單一架構中支援 3D 理解、文生 3D 及指令導向的結構保留式編輯。
- 訓練語料庫達 8,700 萬(87M) 規模,包含 2,500 萬 理解樣本、5,000 萬 文生 3D 對以及 1,200 萬 使用 Nano3D-v2 生成的編輯對。
- 模型架構整合 Hunyuan3D-VLM 負責語意與空間理解,並搭配 Hunyuan3D DiT 進行高保真合成。