一个可以核对的节点:Genie 3 与 Project Genie

Google DeepMind 在2025年8月发布的 Genie 3,可以根据文本提示生成能够实时交互的世界,公开信息给出的规格是约24帧每秒、720p,画面一致性能保持数分钟。2026年1月29日,它以“Project Genie”的形式向美国的 AI Ultra 订阅用户开放。

同一批公开信息也提到了限制:体验会话较短,量级在60秒左右;角色动作主要是移动和跳跃;物理模拟并不完美。这些限制值得原样记下来,因为它们恰好说明“可交互”和“可玩”之间还有距离。

素材生成与世界生成,差在哪里

素材生成的产物是静态的,用完即止;世界生成的产物必须在被操作时持续成立。下面的对照是笔者的归纳,不是任何产品的实测结果。

维度 素材生成世界生成
交付物图片、模型、文本 可操作的场景
检验方式 看一眼是否好看 操作几分钟是否自洽
出错代价 换一张 整段体验崩掉
主要瓶颈 画质与风格 一致性与因果

第三行最关键。素材出错,设计师删掉重来即可;世界出错,玩家已经走进去了,墙突然消失、道具凭空变样,体验就断了。

另一条路线:把一句话拆成流水线

CHI 2026 上的 RPGAgent 走的是另一条路:多智能体的“故事到可玩”流水线,把一句自然语言概念扩展成世界、角色和对话,再走向可玩原型。它不追求画面实时生成,而是靠分工与流程,让每一步产物成为下一步的输入。

两条路线的差别很直观:前者把世界压缩进模型的连续预测里,后者把世界拆成可以检查的结构化部分。前者的画面感强,后者的可控性强。举个假设的场景:设计师说“做一座雨夜港口,主角要在天亮前找到一封信”。世界模型路线更擅长先让人看到雨夜港口;流水线路线更擅长把“天亮前”变成一条会倒计时的规则。

对游戏内容创作的三点影响

其一,评审对象变了。过去评审一份素材,现在要评审一段体验。检验标准从“像不像”变成“撑不撑得住”,这要求创作流程里必须有试玩环节,生成很多内容并不等于生成了一款游戏,这个判断在世界生成时代只会更突出。

其二,一致性成为第一约束。世界一旦可以走进去,设定冲突就会被玩家亲手撞到。世界圣经、实体关系、冲突检测这类结构化手段,会从后台辅助变成生成过程本身的一部分。

其三,设计师的杠杆点上移。当内容可以按需生成,稀缺的是边界:哪些能被改变、目标是什么、失败意味着什么。

金沙娱乐的思路

以下是方向,不是已经量化的产品结果。金沙娱乐AI这条线的设想,是让世界生成同时带着两样东西:一是画面或场景层面的可见结果,二是以结构化形式保存的设定与规则,方便后续修改时只动该动的部分。游戏创作大模型需要的也不只是一个会想象画面的模块,而是能调用地图、角色、试玩校验等工具并互相对账的一整套编排。

眼下更实际的问题是:当一个世界只能稳定维持一分钟,创作者该拿这一分钟去验证什么?我们倾向于先验证目标与反馈是否成立,再谈画面有多逼真。