据《科创板日报》不完全统计,2026 年前 7 个月,国内世界模型相关融资超过 666 亿元,逾 50 家企业获投。这条赛道挤满了钱:李飞飞的 World Labs 在 2 月完成 10 亿美元融资;杨立昆离开 Meta 创办的 AMI Labs 以 10.3 亿美元种子轮刷新欧洲 AI 创业史纪录;极佳视界三个月内三轮融资合计约 35 亿元。但智源研究院院长王仲远在接受《科创板日报》专访时的判断要冷静得多:“现在谈世界模型有稳定现金流,还有点早。”

[1]

热潮与冷水同时存在。一位头部 VC 合伙人直言,严格按照预训练标准筛选,真正在做世界模型的创业公司最多不过 3 至 5 家,多数项目只是把融资书上的赛道名称从仿真、3D、视频生成换成了世界模型。李飞飞 6 月也称,世界模型是当今 AI 领域“最重要、也最被滥用的术语之一”。

王仲远的核心判断是:VLA 是当下,世界模型是未来。他拆解了最可能的付费方——自动驾驶与工业数字孪生对物理真实性要求最高、付费意愿最强,但当前模型能力不足以满足其核心环节;游戏与影视对幻觉更宽容,可能最先出现付费案例,但更多是辅助工具;机器人的瓶颈在于先解开硬件、数据、模型的循环悖论。他给出的结论是:第一条稳定现金流可能最早出现在工业仿真与影视游戏的交织地带,用世界模型做合成数据与预演评估。

如何区分“能签合同的世界模型”和“能发论文的世界模型”?王仲远给出一个他认为最不会骗人的指标——闭环成功率:把世界模型当作策略评估器接进一个 policy,看它在模型内成功执行的概率,与在真机上执行的概率是否高度一致。“如果这个指标对不上,说再多都没用。”

他同时在做概念祛魅。“一群猪能在天上和飞机一起飞吗?现实世界不行,但视频生成模型可以。”他反复强调视频生成不等于世界模型:视频模型训练数据里有大量科幻电影,物体凭空消失、违背重力,在内容创作里是想象力,放进物理世界就是错误。他归纳当下被冠以世界模型的四条路线——语言中心、像素中心、三维结构中心、视觉表征中心——距离真正面向物理世界的基座模型都还有距离。

背景上,智源孵化的逆矩阵团队(北大陈博远、吉嘉铭等)6 月发布了悟界·Physis-v0.1,定位全球首个通用世界基座模型,以预测下一物理状态为核心,并计划年底发布旗舰模型、放出开源切片。智源作为新型研发机构不融资,但王仲远对中美差距的回答很干脆:“世界模型方向上没有差距。”

热钱把“世界模型”推向风口,一线研究者则试图把同一个词从融资叙事里拆回技术定义。演示很强、收入很弱是今年这一赛道公司的通病——而区分两者的标尺,不是发布会,是闭环成功率。

[1]
黄昏的创业公司办公室,年轻创业者侧影站在白板前手持马克笔正要落笔,白板上画着城市与工业设施的简笔示意,玻璃窗外是晚霞下的城市天际线与起重机剪影,同事围坐讨论
资本涌向物理世界,而研究者把“世界模型”拆回技术定义, AI 生成插画,非新闻照片