驚見 AI「走進」實體世界:京東發布 JoyAI 全系列模型與具身資料生態
為何重要
此次展示驗證了「具身智慧」的商業化關鍵在於構建「資料飛輪」(採集—訓練—驗證—反哺)。京東透過整合家庭與零售真實場景資料,解決了物理世界 AI 評估難的問題,打破單純模型能力競爭的邊界,轉向資料、系統與硬體為核心的賽道。
WAIC 展現 AI 從螢幕走向實體場景的趨勢,京東展示了從感知、理解到執行的完整物理 AI 模型「全家桶」與大規模具身資料建設成果。
- 京東發布 JoyAI 全系模型,包含視覺(JoyAI-Echo, JoyAI-Video-Edit)、語音(JoyAI-Talker)與機械臂控制(JoyAI-RA)等模組,提供從長時一致性到毫秒級互動的能力。
- 京東發起 60萬人 協同資料收集,目標 2 年內 採集 1000 萬小時 真實人類資料,並開源 EgoLive 第一人視角資料集(2000 小時、65866 個 Episode、覆蓋 346 項任務)。
- 將大模型能力封裝成硬體底層 JoyInside,已在睡眠監測、學習投影等場景實現任務準確率提升雙位數,且接入裝置的對話輪次平均提升超過 120%。