
AI 挺进真实物理世界,世界模型成焦点
下一代 AI 公司未必诞生在参数、论文和算力最强处,也可能在真实场景密集、产业反馈频繁、工程迭代快的地方。因为 AI 改变世界需进入产业现场,提升世界运行效率。如今,AI 正“逃离”纯文本,挺进真实物理世界。
1 月 8 日,北京智源研究院发布《2026 十大 AI 技术趋势》,将世界模型列为通向 AGI 的重要共识方向,提出从预测下一个词向预测世界下一个状态的范式迁移。随后,产业界动作不断。大额资金涌向有“世界模型”标签的企业,如 3 月份极佳视界完成约 15 亿元融资,其 GigaWorld - 1 在 WorldArena 评测中登顶;从 3 月至今,吸金 35 亿,被称为“国内首个世界模型独角兽”。此外,智平方 B 轮系列融资超 10 亿元,估值过百亿;千寻智能 2026 年开年三个月内完成四轮融资、吸金 45 亿元;星海图继 2 月近 10 亿元 B 轮后,4 月再拿近 20 亿元 B + 轮。二级市场也表现出“偏爱”,4 月 17 日,“物理 AI”新股群核科技上市首日大涨 144%;生数科技两个月累计融资 26 亿元,投后估值超 120 亿元,传出最快 2026 年启动港股 IPO 的消息。
各个领域玩家也纷纷行动。4 月 16 日,腾讯和阿里同日发布世界模型产品,腾讯推出开源的混元 3D 世界模型 2.0(HY - World 2.0),阿里端出主打实时交互的 HappyOyster。车企动作更激进,吉利发布 WAM 世界行为模型,华为乾崑坚持 WA 路线,Momenta 押宝世界模型。机器人领域,英伟达、智元、星海图等也有相关布局。海外同样火热,图灵奖得主 Yann LeCun 创立专注世界模型的 AMI Labs,获 10.3 亿美元巨额种子轮融资;李飞飞创立的 World Labs 完成 10 亿美元融资,首款商业产品 Marble 上线;OpenAI 宣布进入机器人赛道。那么,世界模型为何突然成为必争之地?
Scaling Law 放慢,行业寻找语言之外的答案
AI 巨头达成新共识:只靠文本似乎到不了 AGI。过去,大语言模型靠预测下一个词实现能力跃迁,行业认为扩大参数、增加数据、堆积算力就能迎来 AGI。然而 2026 年,Scaling Law 开始失灵。以 OpenAI 为例,GPT - 4.5 在模型迭代中“更大预训练”有提升,但不是最有效能力来源。同时,数据墙出现,互联网高质量文本数据几乎被采集殆尽,Epoch AI 估计,语言模型将在 2026 - 2032 年用尽可用于训练的高质量人类公共文本。而且,即便有最大语料库,AI 也无法真正理解物理常识,因为语料库记录的是人类描述世界,而非物体运动,物理常识在文本中稀缺,导致大型预训练模型在物理常识题上能力较低。
多模态模型也未解决问题。BLINK 基准显示,GPT - 4V 和 Gemini 在深度、空间对应、多视角推理任务上表现不佳;PhysBench 测试表明,AI 对物理的理解不会随模型大小、训练数据量或视频帧数稳定提升。这种局限性体现为企业落地 AI 时的幻觉问题,在高容错成本场景中,LLM 无法建立稳定可靠的物理因果推理能力,这也是许多企业级应用停留在辅助层的原因。从“语义理解”到“物理推理”存在鸿沟,这是世界模型被关注的底层原因,而具身智能发展到瓶颈期则是更直接原因。世界模型为具身智能提供了新解法,它本质是“可学习的物理模拟器和渲染引擎”,让 AI 通过“视觉思维链”预测物理环境变化,赋予 AI 看懂时空、感受重力、理解现实的能力,是 AI 转化为生产力的必经之路。
不同阵营的物理 AI 卡位战,抢占下一份生产力入口
如果上一阶段大模型竞争比的是文本理解与生成,那么世界模型竞争核心变为将 AI 带进可计算、可交互、可训练的物理世界。当前产业界对世界模型的集体押注,是各行各业寻找 AI 下一份生产力入口。然而,世界模型远未成熟,既无统一技术路线,也非短期内能替代大语言模型的万灵药,甚至定义都未统一。如智源研究院院长王仲远提出四大分类,李飞飞团队给出三类功能框架。
业内处于不同行业向“理解物理世界”靠拢的产业初试阶段。视频生成派凭借强大视频生成引擎行动起来,生数科技、阿里、快手、字节及海外的 Sora、Runway 构成这股力量,这得益于 AR - DiT 等实时交互技术突破,但该路线隐患是学到的画面连贯而非物理为真,缺乏真实三维结构。空间智能玩家主张“先重建,再理解”,代表有李飞飞的 World Labs 和国内的群核科技,腾讯混元也切入此路。具身智能领域对世界模型需求极度迫切,因为世界模型能让机器人在“想象”中演练技能,这解释了资金为何涌向有“世界模型”标签的企业,但该领域路线分歧深,各条路线正走向技术融合。车企与智驾厂商把世界模型开上了路,智驾有海量真实路测数据和明确付费场景,自动驾驶仿真已落地应用,用其合成危险场景测试效率更高。从不同角度看,各行业向物理 AI 收敛,短期创意设计最快变现,中期智能驾驶拉开差距,长期世界模型将成为连接数据、仿真与行动的物理 AI 基础设施,是 AI 从数字世界走向物理世界的关键中间层。当产业入口跑通,市场竞争将向产业链深处沉降。
下一代 AI 公司,理解世界、模拟世界、行动于世界
世界模型重要,不仅因为它代表新模型路线,更因为它将 AI 战场推向物理世界。大语言模型主要战场是数字世界,而世界模型目标是预测、生成、干预和改造物理世界,其竞争发生在产业链深处,如谁拥有高质量物理数据、掌握仿真和评测平台、能连接真实设备、形成反馈闭环。世界模型是 AI 进入物理世界需重建的基础设施,未来物理 AI 技术栈可能包括物理数据采集、数据清洗与合成等多个层面。它将成为物理 AI 时代的操作系统,连接芯片、传感器、机器人本体和 Agent、行业软件、企业业务系统,接收真实世界数据,生成虚拟世界。
世界模型让 AI 具备进入物理产业的可能,这使中国公司在竞争中更值得关注。在物理 AI 时代,场景密度、工程能力等同样重要,而这是中国公司的优势。中国有完整制造业体系、复杂交通场景、快速增长的机器人产业链等,是世界模型所需物理数据来源和落地土壤。世界模型竞争不仅在实验室和云端,也在车间、道路等真实场景中,谁能更快接入场景、获得反馈,谁就可能建立工程闭环和数据飞轮。这意味着,下一代 AI 公司可能诞生在真实场景密集、产业反馈频繁、工程迭代快的地方,因为 AI 改变世界需进入产业现场,提升运行效率。那么,哪些中国公司能在这场竞争中脱颖而出呢?

318

被折叠的 条评论
为什么被折叠?



