Project Genie 街景集成
Google DeepMind 已将 Google 街景图像集成到 Project Genie 中,使通用世界模型能够生成以真实地点为锚点的交互式环境。此更新让 AI 代理和机器人能够在模拟空间中导航并与真实世界的复杂性互动,同时为用户提供通过生成式风格重新构想实体地点的工具。
通过街景实现真实世界落地
Project Genie 现在使用地图影像落地技术,以实际物理位置为基础生成世界。用户可以通过地图标记选择美国的某个地点,并结合特定风格——如“沙漠之砂”“石器时代”或“黑白电影”——将真实地点转化为富有想象力的环境。
此落地功能的关键能力包括:
- 基于位置的生成:模型使用街景图像作为创建交互式世界的起点。
- 风格化环境:用户可以对真实地点应用主题叠加,例如以“海洋世界”风格呈现金门大桥,或使用“黑白电影”风格将沃斯堡牛仔城呈现为1920年代的样子。
- 角色集成:用户可以描述一个角色(例如漫画英雄或黏土动画怪物),让其居住在这些落地环境中。
目前,街景图像集成仅在美国境内可用,未来计划扩展至其他地区。
Project Genie 作为世界模型
Genie 作为通用世界模型研究的基础工具。其生成多样化交互式环境的能力已被应用于多个高影响力的案例:
- 代理训练:使 AI 代理能够在复杂的虚拟环境中学习和推理(如 SIMA 2 所示)。
- 自动驾驶:帮助 Waymo 在超真实道路环境的仿真中。
可用性与访问
Project Genie(包括新的街景落地功能)是托管在 Google Labs 的实验性研究原型。目前正向符合条件的 Google AI Ultra 订阅者(年龄 18 岁以上)在全球范围内逐步推出。
由于仍处于原型阶段,Google DeepMind 正在持续优化模型,以提升生成环境的清晰度和准确性。