SIMA 2
SIMA 2: A Generalist Embodied Agent for Virtual Worlds (Google DeepMind)SIMA进阶谷歌 DeepMind 基于 Gemini、能在各种 3D 游戏世界里听指令、推理并自学的智能体
Google DeepMind 于 2025 年 11 月以有限研究预览的形式发布,12 月公开技术报告。前作 SIMA(Scalable Instructable Multiworld Agent,2024 年发布)能在多款商业 3D 游戏里执行 600 多项「向左转」「爬梯子」之类的简单技能指令。SIMA 2 以 Gemini 模型为核心,不只照指令执行,还能理解高层目标、和用户对话、说明自己打算怎么做,也能接受图片、草图甚至表情符号形式的指令。它还能自我提升:由 Gemini 给它出任务、打分,智能体用自己玩出来的经验数据训练下一版,不再依赖人类演示。在 Genie 3 实时生成的、从未见过的世界里,它也能辨明方向、按指令行动。DeepMind 把它看作走向通用具身智能体、最终用于真实机器人的一步。
例子用户让它「去那栋颜色像熟番茄的房子」,SIMA 2 会先推理出熟番茄是红色,再去找红色的房子。
- 也叫
- Scalable Instructable Multiworld Agent 2
- 相关
- Genie 3、具身智能体、自我提升、Gemini 系列(谷歌多模态大模型)、谷歌 DeepMind、指令跟随
- 来源
- SIMA 2: An agent that plays, reasons, and learns with you in virtual 3D worlds (Google DeepMind blog)
SIMA 2: A Generalist Embodied Agent for Virtual Worlds (arXiv 2512.04797) - 信息截至
- 2025-12