世界模型能否为AI叩开物理世界之门
当大语言模型在数字世界不断刷新能力边界,人工智能的下一个攻坚方向,已然转向更为纷繁复杂的物理现实世界。2026 Inclusion外滩大会见解论坛之一便围绕”世界模型是AI走向物理世界的新大陆吗?”这一前沿命题展开深度思辨。
香港大学计算与数据科学学院创始院长马毅指出,世界模型早已超越传统三维重建与计算机视觉范畴,可以为机器人赋能,使其像人一样,在开放的物理世界进行交互,进行感知、认知、学习、探索和创造价值。
生数科技联合创始人兼CEO骆怡航提出,通用世界模型应当构建”理解-想象-行动”的完整闭环。单纯的视频生成、三维重建只是世界模型的局部环节,只有能够完成预测推演、输出面向物理实体的行动决策,才算具备完整的世界模型能力。
大晓机器人董事长王晓刚从产业实践视角补充,世界模型的核心不在于生成像素完美的画面,而是习得现实世界的因果规律。世界模型要学到三种核心能力:生成智能、物理智能和认知智能。
忆生科技联合创始人杨言超提出世界模型需要满足三个条件:能够理解和预测未来;能够从数据中抓到可预测的结构并形成记忆;能够依赖形成的记忆持续不断地自我进化。
在落地方面,杨言超表示,在试错代价极高、获取训练数据成本高昂的场景,世界模型能够充分释放价值。极佳视界联合创始人朱政认为,家庭环境中对世界模型的需求更多,而无人咖啡店等操作对象固定的场景短期不需要。
王晓刚指出,高质量真实数据是世界模型的基石,他提出环境式真人异构数据采集方式,通过穿戴式多传感器设备采集人类行为真实数据作为支撑。
香港大学计算与数据科学学院副院长罗平表示:”世界模型或许不是通往物理智能唯一的门票,但它绝对是目前人类赋予机器空间想象力、常识推演与行动预测最具希望的核心基建。”
原文来源:解放日报/上观新闻