发布于2026-08-04 阅读(0)
扫一扫,手机访问
Google DeepMind 的「Project Genie」终于向公众敞开了大门。本周四起,美国地区的 Google AI Ultra 订阅用户就可以抢先体验这项新功能——你只需要输入一句简短的话,或者上传一张图片,系统就会在几秒钟内生成一个可以自由探索、交互的3D游戏世界。
这背后整合的是 Google 最新发布的 Genie 3 世界模型、Nano Banana Pro 图像生成模型,还有 Gemini 智能系统。DeepMind 这次开放测试,目的很明确:获取真实用户的使用反馈和高质量训练数据,用来优化世界模型,加速迭代速度。

先解释一下「世界模型」这个概念——它指的是能对物理或虚拟环境建立内部表征的AI系统,能够预测未来状态、规划智能行为。DeepMind 选择从电子游戏这类轻量级娱乐场景切入,后续则会逐步向高保真模拟环境拓展,用于机器人感知与决策训练,最终服务于通用人工智能(AGI)的长期目标。
目前全球世界模型领域的竞争已经白热化。李飞飞创立的 World Labs 去年底发布了首款商用产品 Marble;AI 视频生成公司 Runway 近期也公开了自己的世界模型;Meta 前首席科学家杨立昆联合创办的 AMI Labs,同样将这一方向列为战略级核心技术。各路玩家都在加速布局。
不过,DeepMind 团队也坦诚相告:Project Genie 目前还处于早期实验阶段。系统表现波动很大——有时能生成逻辑严密、细节丰富的沉浸式世界,有时却会跑出一些让人摸不着头脑的异常结果。具体的操作流程是这样的:用户先用文字描述基础环境和主角特征,完成所谓的「世界素描(World sketch)」;接着 Nano Banana Pro 会根据描述生成初始图像,Genie 再以此为起点构建完整的互动世界。实测下来,局部修改功能基本能用,但偶尔偏差还挺明显——比如你明确要求「绿色头发」,它给你输出一个紫色发色。
用户也可以上传真实照片作为生成基底,但效果因图而异,完全看运气。一旦图像通过审核,Project Genie 只需几秒就能输出一个可以实时探索的三维世界。不过受限于高昂的算力开销,目前每轮体验严格限定为 60 秒。项目负责人弗鲁赫特解释,Genie 3 属于自回归模型,推理过程资源密集,限时机制是为了让更多用户有机会公平参与体验。
安全层面,系统已经部署了多重内容过滤和合规审查机制,明确禁止生成裸露内容,以及受版权保护的 IP 元素(比如迪士尼角色)。与此同时,交互自然度也是当前重点攻坚的方向——测试中曾出现角色穿墙、碰撞检测失效等问题,WASD 导航键响应有时也会延迟或方向错位。弗鲁赫特强调,这还只是一个初步原型,团队后续会持续提升画面的写实性、物理一致性以及人机交互的流畅度。
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
售后无忧
立即购买>office旗舰店
正版软件
正版软件
正版软件
正版软件
正版软件
1
2
3
4
5
6
7
8
9