Wayve GAIA-2
GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving (Wayve)GAIA进阶英国自动驾驶公司 Wayve 2025 年的驾驶世界模型,可控地生成多路摄像头驾驶视频。
GAIA-2 是英国自动驾驶公司 Wayve 在 2025 年 3 月 26 日发布的生成式世界模型,是 GAIA-1 的后续。这里的世界模型指能按给定条件「想象」出驾驶场景未来画面的视频生成模型。GAIA-2 从 GAIA-1 的自回归 token 生成改为视频分词器加潜在扩散(先把视频压缩到隐空间,再在隐空间里去噪生成)的架构,原生支持多个摄像头同时生成且彼此在时间和空间上一致,数据覆盖英国、美国、德国。生成时可以控制自车的速度和转向、其他车辆和行人的行为、天气和时段、车道和路口等道路结构。用途是批量制造合成数据、在真实行车记录上改出变体,以及生成罕见的危险场景来测试驾驶模型。它是世界模型在物理 AI 中较早落地的案例之一。
例子拿一段真实的多摄像头行车记录,把天气改成大雨,再加一辆突然切入的车,生成一组新的环视视频,用来检验驾驶模型遇到这种少见情况时的反应。
- 也叫
- GAIA-2
- 相关
- 世界模型、自动驾驶、潜在扩散模型、合成数据、Waymo 世界模型、Cosmos
- 来源
- GAIA-2: A Controllable Multi-View Generative World Model for Autonomous Driving (arXiv 2503.20523)
GAIA-2(Wayve 官方博客) - 信息截至
- 2025-03