Gemini Robotics 2:實現全身協調與具身智慧的下一代機器人模型
為何重要
此舉標誌著 AI 從「認知模擬」走向「物理執行」的重要驗證,強調未來機器人的核心價值在於具備理解全身物理世界並自主決策的「具身推理能力」。 對開發者而言,Google 展示了 LLM 高度泛化至不同機器人架構的可能性,縮短了開發者從模型到實體部署的週期;對投資人來說,這代表產業正從單一硬體競爭轉向軟體定義機器人與標準化生態的戰場。
Google 發布 Gemini Robotics 2,透過具身智慧讓機器人具備全身協調、高靈巧度以及多機器人協作能力,以突破單一遠端操作的侷限。
- 推出三大核心模型:最高階全身 VLA 模型、負責長時間任務規劃與通訊的 embodied reasoning 模型,以及優先支援本地部署的高效能 On-Device 模型。
- 宣佈發布
ASIMOV-Agentic新基準,用於評估具身代理的安全性管理與遭遇不確定性時的緊急處置能力。 - 首度展示全形態控制能力,例項成功讓 Apptronik Apollo 2 人形機器人執行走下蹲姿、取物並精準放置於櫃子等多步驟全身協調動作。