今年世界模型赛道正式“上桌”了。在2026年世界人工智能大会(WAIC)上,考明万维的董事长方涵宣布2026年是“世界模型元年”,并一口气推出三款新品:Matrix-Game3.5世界模型、Mureka v9.5和O3音乐模型。从行业视角看,这一动作标志着生成式AI从“静态内容生成”向“动态交互理解”的关键跃迁——过去两年大模型主要卷语言和图像,而世界模型试图让AI理解物理世界的因果律和时序逻辑,这恰恰是游戏、具身智能和自动驾驶等领域的核心痛点。

最吸睛的当属Matrix-Game3.5。考明万维为这个世界模型配备了“Patch级记忆注入”能力——简单说,模型在生成时能携带并检索视觉片段记忆,从而把交互推到了实时级别。性能数字很硬核:一个5B参数的小模型,在单张显卡上就能以720p分辨率实现20FPS的实时生成速度。更关键的是其核心架构已经开源,这意味着做游戏开发和具身智能的开发者可以直接下载尝试。对比一下,目前业界主流的世界模型(如谷歌的Genie、OpenAI的Sora)要么参数规模巨大,要么实时性不足,而Matrix-Game3.5在轻量化和实时性上找到了一个不错的平衡点。

两个音乐模型则更聚焦于把AI创作变成清晰的工具形态。Mureka v9.5和O3首次将AI音乐带入“版本化创作”阶段——用户可以像写代码一样,对同一段音乐迭代不同版本,随时对比、挑选。相比之前“一次生成,不好重来”的生成式范式,这种工具化体验提升了一个量级。从音乐创作的实际场景来看,专业制作人最需要的就是可控性和迭代能力,而不仅仅是“好听”的随机结果。
从世界模型的实时交互到音乐创作的版本化管理,考明万维这次发布的核心逻辑很明确:2026年,模型不再只是“生成内容”,而是开始“理解并生成可交互的世界”。这或许才是真正的“世界模型元年”该有的样子——不是画饼,而是让开发者能亲手摸到、跑起来的东西。客观来说,当前世界模型在长时推理和复杂物理模拟上仍有明显短板,但开源社区的参与可能会加速这一进程。