ai.doge.tg 繁體 AI 情報 最新 專案 搜尋 Telegram ↗

Hunyuan3D-Buffalo 1.0:統一多模態 3D 風格生成、理解與編輯模型

研究 1 個來源 · 1 天前
為何重要

該模型將零散的 3D 分析與生成技術統一於單一架構,大幅降低了開發者進行 Schema-driven 應用層 3D 資產生產的門檻,代表了通用 3D AI 的一項重要進展。不過,其 8,700 萬規模的訓練庫與複雜架構對算力需求極高,目前仍多屬於基礎技術展示。

  • 騰訊推出統一 3D 框架 Hunyuan3D-Buffalo 1.0,能在單一架構中支援 3D 理解、文生 3D 及指令導向的結構保留式編輯。
  • 訓練語料庫達 8,700 萬(87M) 規模,包含 2,500 萬 理解樣本、5,000 萬 文生 3D 對以及 1,200 萬 使用 Nano3D-v2 生成的編輯對。
  • 模型架構整合 Hunyuan3D-VLM 負責語意與空間理解,並搭配 Hunyuan3D DiT 進行高保真合成。
Hunyuan3DTencent3D GenerationUnified MultimodalNano3D-v2VLM

來源 · 1 篇報導

首發 Hugging Face Daily Papers huggingface.co 04:00