“L1相对成熟、L2已见曙光”:通用世界模型的发展卡在哪里?

第一财经
2026-10-11 21:39

来源:第一财经

“L1相对成熟、L2已见曙光”:通用世界模型的发展卡在哪里?

通用世界模型正在逐渐从企业产品发展成为城市级科研平台关注的重点。

10月11日,第一财经记者从2026世界模型高峰论坛现场获悉,通用世界模型北京市重点实验室正式揭牌。据介绍,该实验室于今年5月获批,是国内首个世界模型方向的省部级重点实验室。

其中,北京极佳视界科技有限公司(以下简称“极佳视界”)是该实验室的依托建设单位。清华大学自动化系长聘教授、系副主任鲁继文受聘担任实验室学术委员会主任,极佳视界联合创始人、首席科学家朱政受聘担任实验室主任。

近两年世界模型已经从学术概念转变成为产业风口,前瞻布局者覆盖互联网大厂、具身智能企业、自动驾驶车企、游戏与内容公司等。

鲁继文在演讲中介绍,世界模型是一个预测模型,其通过计算合理预测事物在特定动作下的演变,包括跨模态、跨时空及跨场景等维度的信息。他还提到“通用认知模型”的概念,认为这是物理AI发展到较高水平的阶段,即能够做到理解状态、预测变化以及判断后果等。

极佳视界创始人兼CEO黄冠认为,AGI不能只停留在语言智能,更需要在物理三维空间中理解、生成、预测和行动的能力,而这些能力的实现有赖于通用世界模型的突破。

“现在世界模型L1水平相对成熟,L2阶段还没有实现突破、但已经看到曙光了。”黄冠在接受记者采访时称,相比于语言模型,世界模型整体上可能落后3-4年的水平。如果要再向前迈一步,还是要先Scalingup(扩大规模), 至少要先拥有100万小时的动作数据。

此前极佳曾提出通用世界模型L1-L5分级体系。其中L1层级能够根据输入生成视觉真实的通用视频;L2层级能够生成高效、合理的通用执行动作,把环境理解转化为可执行的动作序列。

有嘉宾在参加圆桌论坛讨论时提到,虽然数据很重要,但也不能盲目扩大数据规模,而是要注重并明确数据的密度信息,以及世界模型要学习的表征。

除了数据上的瓶颈,世界模型的发展还受到算力上的制约。

北京智源人工智能研究院副院长兼总工程师林咏华表示,世界模型对计算的要求超过了语言模型。她解释称,“世界模型空间维度多,还涉及多个信息的生成,这些决定其训练和推理的计算复杂程度都远高于语言模型。”这也意味着,世界模型计算的需求不再只是Token数量增长,而是在目标、维度与约束上的逐级升级。

林咏华介绍称,目前市面上有多家芯片企业推出相关产品,但厂商们专用的、碎片化的软件生态成为使用者尝试其他AI芯片的一大障碍,比如机器人企业。为此,智源研究院近几年投入研发AI系统软件栈,让AI模型和应用可以无缝运行在多个硬件芯片和平台上。

她还提到,由于世界模型技术路线暂未收敛,目前这一范式对芯片计算架构的最终影响还无法完全确定,但她相信下一个计算的战场将会是世界模型。

(来源:第一财经 编辑:张明艳)