智源大会重磅发布悟界Physis:全球首个通用世界基座模型让AI真正读懂物理世界

大模型📰综合整理📅2026-06-13 48 阅读

当人工智能学会理解重力、惯性与碰撞,技术革命的下一幕已然拉开。

2026年6月12日,为期两天的第八届北京智源大会在海淀正式启幕。开幕式上,智源研究院院长王仲远向全球发布了该院历时数年攻关的核心成果——悟界·Physis-v0.1,这是业界首个具备通用物理世界理解能力的基座模型。它的问世,意味着AI不再局限于文本符号的排列组合,而是真正开始向真实世界的运行法则靠拢。

从Token到物理状态的范式跃迁

过去数年,大语言模型的演进始终围绕一个核心逻辑展开:预测下一个词元(Token)。无论是GPT系列还是国产大模型,其本质都是在海量文本中学习概率分布,进而生成连贯的语句。然而,这种范式存在一个根本性瓶颈——文本世界与物理世界之间存在一道难以逾越的鸿沟。一台AI可以流畅地描述苹果落地的过程,却无法真正理解重力加速度的含义。

悟界·Physis的架构设计直击这一痛点。据王仲远在报告中介绍,该模型采用了全新的物理感知编码器-世界动力学解码器架构,将视觉输入、物理参数与时空序列统一映射到同一隐空间。换言之,模型不仅能看见物体,还能推断其质量、速度、受力状态,并预测下一时刻的运动轨迹。

多模态融合与因果推理的双重突破

在技术实现层面,悟界·Physis展现了两大核心能力。其一是跨模态物理对齐:模型可同时处理视频流、传感器数据与文本描述,并将三者统一到物理一致性框架下。例如,当输入一段球体滚动的视频与一段关于摩擦力的文字说明时,模型能够自动建立两者之间的因果关联。

其二是反事实推理能力。传统视觉模型只能预测单一未来,而悟界·Physis可以在给定初始状态的条件下,推演多种可能的物理演化路径。这一特性使其在机器人操作、自动驾驶决策等需要前瞻性规划的场景中具备显著优势。

开源生态与产业应用的并行推进

智源研究院在发布模型的同时,也公布了其开源计划。悟界·Physis的基础权重将向学术研究社区开放,并配套发布包含百万级物理场景视频的数据集Physics-1M。这一举措被业内解读为中国AI研究机构在全球基础模型竞争中的一次战略卡位。

从产业视角观察,世界模型的商业化前景正在快速展开。在工业质检领域,具备物理理解能力的AI可以更准确地识别装配缺陷;在自动驾驶领域,模型能够预判复杂交通场景中的物体交互;在具身智能领域,机器人将获得更接近人类的常识推理能力。

全球竞速中的中国路径

世界模型并非智源独有的研究方向。谷歌DeepMind的Genie、Meta的World Model项目均在同期推进。然而,悟界·Physis的差异化在于其通用性定位——它不针对特定物理域进行优化,而是试图构建一个覆盖刚体动力学、流体力学、电磁学等多领域的统一表征框架。

这一技术路线选择背后,折射出中国AI研究界的深层考量:在底层架构层面实现弯道超车,而非在应用层进行同质化竞争。正如王仲远在报告中所言,理解物理世界是通往通用人工智能的必经之路,而悟界·Physis正是这条道路上的第一块里程碑。

随着第八届智源大会的持续推进,悟界·Physis的更多技术细节与评测结果将陆续公开。可以预见,世界模型将成为2026年下半年全球AI竞赛的核心赛道之一,而物理世界的数字化理解,也将由此进入一个全新的发展阶段。

标签:大模型世界模型智源大会悟界Physis物理AI基座模型AGI

相关阅读

一周之内五家巨头轮番出手:9月的大模型市场,为什么突然卷成这样

一周之内五家巨头轮番出手:9月的大模型市场,为什么突然卷成这样

OpenAI、Anthropic、谷歌、Muse、DeepSeek、Kimi、阶跃星辰在9月上旬密集发布新模型,全球大模型迭代进入白热化。从旗舰到轻量,各家在推理、编程、智能体等赛道上贴身肉搏。

2026-09-20 2
GPT-6 Astra正式发布:把报税表填完、把数学难题解完,OpenAI这代旗舰冲着'干活'去的

GPT-6 Astra正式发布:把报税表填完、把数学难题解完,OpenAI这代旗舰冲着'干活'去的

9月4日凌晨,OpenAI发布新一代旗舰大模型GPT-6 Astra,号称迄今最智能、对齐程度最高的模型。它在数学、网络安全、计算机操作与自动化任务上实现代际跃升,能独立完成填税表、更新CRM、搭网站等复杂工作。

2026-09-20 3
9月大模型混战十天连发四款旗舰:GPT-6 Astra灰度放量,DeepSeek V4.1 Flash卷性价比

9月大模型混战十天连发四款旗舰:GPT-6 Astra灰度放量,DeepSeek V4.1 Flash卷性价比

9月1日至10日,Claude 5.1、Gemini 3.8 Flash、GPT-6 Astra与DeepSeek V4.1 Flash接连发布,大模型竞争从参数比拼转向Agent执行、语音交互与性价比的多维战场,开发者选型逻辑正在重写。

2026-09-12 25
72小时五款旗舰混战:GPT-6 Astra宣告AGI时代来临

72小时五款旗舰混战:GPT-6 Astra宣告AGI时代来临

9月初OpenAI发布GPT-6 Astra并宣告AGI时代来临,72小时内五家头部厂商密集迭代旗舰模型,编程与Agent能力成为竞争焦点;RSI递归自我改进机制登场,最强模型的保质期正以「周」为单位计算。

2026-09-06 45
2026大模型API价格剧烈分化:DeepSeek低价突围,行业从价格战转向智能战

2026大模型API价格剧烈分化:DeepSeek低价突围,行业从价格战转向智能战

2026年大模型API价格剧烈分化,DeepSeek低价突围、多家涨价,行业从价格战转向智能战与生态卡位。

2026-08-20 81
2026国产大模型诸神之战:Qwen3.8-Max开源、DeepSeek V4与Kimi K3如何重划Agent时代

2026国产大模型诸神之战:Qwen3.8-Max开源、DeepSeek V4与Kimi K3如何重划Agent时代

从聊天模型到智能体模型,2026年国产大模型在参数、开源与Agent能力三维全面突围,格局生变。

2026-08-15 157
万亿权重开源潮:Qwen3.8如何重划2026年大模型格局

万亿权重开源潮:Qwen3.8如何重划2026年大模型格局

2026年8月,国产大模型迎来密集发布窗口:DeepSeek V4-Pro正式版静默上线并强化Agent能力,阿里首次开放Qwen-Max级别权重推出总参数达2.4T的混合专家模型,此前Kimi K3已以三万亿级参数规模落地开源。海外方面,Grok新版本与谷歌轻量旗舰同期更新,价格战持续。过去万亿级MoE旗舰权重基本闭源锁死,中小团队与政企难以本地部署;如今顶级底座陆续开放,意味着全行业都能基于其做私有化二次开发。本文梳理这轮开源潮的技术特征、许可证变化与选型策略。

2026-08-14 88
开源双响炮:2026国产大模型集体突围

开源双响炮:2026国产大模型集体突围

2026年8月,DeepSeek V4 Pro正式上线、阿里首次开源Qwen3.8旗舰权重,国产大模型迎来开源双响炮。本文盘点Kimi K3、GLM-5.2等国产开源模型的密集迭代,分析开源模型如何以Agent能力与极致性价比挤压闭源阵营,并解读'小而精'端侧路线与开放权重博弈。

2026-08-13 93
英伟达发布Nemotron 3.5 Lightning:300亿参数开源MoE大模型,本地GPU即可运行

英伟达发布Nemotron 3.5 Lightning:300亿参数开源MoE大模型,本地GPU即可运行

英伟达近日发布开源大模型Nemotron 3.5 Lightning,采用300亿参数(30B)混合专家(MoE)架构,权重完全开放。该模型既能在配备英伟达显卡的本地设备直接运行,也可平滑扩展到数据中心与云端,将开源大模型的「本地部署加弹性扩展」能力推向新高度,对企业私有化AI与端侧智能具有重要参考价值。

2026-08-12 99
GPT-5.2 对阵 Claude 4:2026 顶级大模型实测,谁更懂中文长文?

GPT-5.2 对阵 Claude 4:2026 顶级大模型实测,谁更懂中文长文?

我们横向测评了 GPT-5.2 与 Claude 4 在中文长文档理解、代码生成、多轮对话三项任务上的表现,并给出不同场景下的选型建议。

2026-08-07 88