智源大会重磅发布悟界Physis:全球首个通用世界基座模型让AI真正读懂物理世界

大模型📰综合整理📅2026-06-13 6 阅读

当人工智能学会理解重力、惯性与碰撞,技术革命的下一幕已然拉开。

2026年6月12日,为期两天的第八届北京智源大会在海淀正式启幕。开幕式上,智源研究院院长王仲远向全球发布了该院历时数年攻关的核心成果——悟界·Physis-v0.1,这是业界首个具备通用物理世界理解能力的基座模型。它的问世,意味着AI不再局限于文本符号的排列组合,而是真正开始向真实世界的运行法则靠拢。

从Token到物理状态的范式跃迁

过去数年,大语言模型的演进始终围绕一个核心逻辑展开:预测下一个词元(Token)。无论是GPT系列还是国产大模型,其本质都是在海量文本中学习概率分布,进而生成连贯的语句。然而,这种范式存在一个根本性瓶颈——文本世界与物理世界之间存在一道难以逾越的鸿沟。一台AI可以流畅地描述苹果落地的过程,却无法真正理解重力加速度的含义。

悟界·Physis的架构设计直击这一痛点。据王仲远在报告中介绍,该模型采用了全新的物理感知编码器-世界动力学解码器架构,将视觉输入、物理参数与时空序列统一映射到同一隐空间。换言之,模型不仅能看见物体,还能推断其质量、速度、受力状态,并预测下一时刻的运动轨迹。

多模态融合与因果推理的双重突破

在技术实现层面,悟界·Physis展现了两大核心能力。其一是跨模态物理对齐:模型可同时处理视频流、传感器数据与文本描述,并将三者统一到物理一致性框架下。例如,当输入一段球体滚动的视频与一段关于摩擦力的文字说明时,模型能够自动建立两者之间的因果关联。

其二是反事实推理能力。传统视觉模型只能预测单一未来,而悟界·Physis可以在给定初始状态的条件下,推演多种可能的物理演化路径。这一特性使其在机器人操作、自动驾驶决策等需要前瞻性规划的场景中具备显著优势。

开源生态与产业应用的并行推进

智源研究院在发布模型的同时,也公布了其开源计划。悟界·Physis的基础权重将向学术研究社区开放,并配套发布包含百万级物理场景视频的数据集Physics-1M。这一举措被业内解读为中国AI研究机构在全球基础模型竞争中的一次战略卡位。

从产业视角观察,世界模型的商业化前景正在快速展开。在工业质检领域,具备物理理解能力的AI可以更准确地识别装配缺陷;在自动驾驶领域,模型能够预判复杂交通场景中的物体交互;在具身智能领域,机器人将获得更接近人类的常识推理能力。

全球竞速中的中国路径

世界模型并非智源独有的研究方向。谷歌DeepMind的Genie、Meta的World Model项目均在同期推进。然而,悟界·Physis的差异化在于其通用性定位——它不针对特定物理域进行优化,而是试图构建一个覆盖刚体动力学、流体力学、电磁学等多领域的统一表征框架。

这一技术路线选择背后,折射出中国AI研究界的深层考量:在底层架构层面实现弯道超车,而非在应用层进行同质化竞争。正如王仲远在报告中所言,理解物理世界是通往通用人工智能的必经之路,而悟界·Physis正是这条道路上的第一块里程碑。

随着第八届智源大会的持续推进,悟界·Physis的更多技术细节与评测结果将陆续公开。可以预见,世界模型将成为2026年下半年全球AI竞赛的核心赛道之一,而物理世界的数字化理解,也将由此进入一个全新的发展阶段。

标签:大模型世界模型智源大会悟界Physis物理AI基座模型AGI