OpenAI时隔六年重启机器人赛道,具身智能产业迈入平台化落地新阶段

大模型📰综合整理📅2026-06-07 7 阅读

六年蛰伏,一朝亮剑。2026年6月初,OpenAI首席执行官Sam Altman在社交平台发布多则招聘信息,宣告公司正式组建名为"OpenAI Robotics"的全新事业部。这一动作意味着,这家以ChatGPT闻名全球的AI巨头,在时隔六年后重新杀回实体机器人赛道,且此次选择了一条与过去截然不同的路径——不再依赖外部硬件厂商合作,而是亲自下场,从算法研发到硬件制造全链条自主掌控。

据公开信息,OpenAI Robotics的短期目标是打造能够与人类协同作业的协作型机器人,长期愿景则是实现AI算法与物理实体的深度融合。招聘信息中明确提及,团队正在招募全栈硬件工程师、运营专家、系统架构师以及机器学习研究员,岗位覆盖范围之广,透露出OpenAI对机器人业务的高度重视与长期投入决心。

英伟达同步落子,开放平台降低研发门槛。几乎在同一时间窗口,芯片巨头NVIDIA在GTC Taipei大会上推出了Isaac GR00T Reference Humanoid Robot——首款面向学术研究的开放式人形机器人参考设计。该平台基于宇树H2 Plus机器人本体,搭载Sharpa五指灵巧手,并完整运行NVIDIA自研的Isaac GR00T合成数据生成与机器人学习技术栈。

与OpenAI的封闭自研路线不同,NVIDIA选择了开放平台策略。通过提供标准化的硬件参考设计与软件工具链,英伟达意图降低整个人形机器人行业的研发门槛,让更多学术机构与创业公司能够快速入局。这一"卖铲子"的商业模式,与英伟达在AI算力领域的成功路径如出一辙。

中国标准先行,产业进入规范化发展期。就在OpenAI和NVIDIA相继发声的同时,中国市场传来另一则重磅消息:两项具身智能与人形机器人关键行业标准于6月初正式发布并实施。标准的落地,意味着中国在该赛道已从早期的技术探索阶段,正式迈入规范化、规模化应用的新阶段。

标准的确立对于产业发展具有深远意义。它不仅为产品设计、安全测试、性能评估提供了统一依据,更重要的是为资本投入和市场拓展扫清了不确定性障碍。当行业有了明确的游戏规则,企业才敢加大产能投入,消费者才敢放心购买使用。

自然语言编程,工业自动化的颠覆性变量。在创业公司阵营,一家名为Mbodi AI的YC W25孵化项目正在探索另一条极具想象力的路径。该公司构建了一套通过自然语言对话让机器人自主学习新技能的平台,用户只需用日常语言向机器人描述任务,系统便能在几分钟内完成技能部署并投入生产环境。

Mbodi AI的核心创新在于将大语言模型的语义理解能力转化为机器人的"自然语言接口",从而大幅降低工业自动化的编程复杂度。其团队由Google前员工与宾夕法尼亚大学GRASP机器人实验室成员组成,目前已与ABB及多家财富100强制造企业建立合作关系。如果这一技术路线得以大规模验证,未来工厂里的机器人部署将不再需要专业的自动化工程师,普通操作工人通过说话就能完成编程。

产业拐点已至,三大趋势交汇共振。纵观2026年6月具身智能领域的密集动态,三个清晰的产业趋势正在交汇:头部AI公司亲自下场做硬件,标志着技术成熟度已足以支撑商业化落地;芯片巨头推出开放平台,意味着产业链基础设施趋于完善;行业标准正式发布,则表明监管框架与生态规则逐步建立。

这三股力量的叠加,正在将具身智能从"看起来很酷的Demo"推向"能够创造真实价值的生产力工具"。对于关注这一方向的产品团队和工程团队而言,当前正是建立技术判断、筛选合作伙伴、布局应用场景的关键窗口期。错过这一波,可能就要再等一个技术周期。

标签:OpenAI具身智能人形机器人NVIDIA机器人标准自然语言编程

相关阅读

Kimi K3开源引爆AI圈:2.8万亿参数中文大模型刷新开源纪录,1M上下文+多模态能力全面开放

Kimi K3开源引爆AI圈:2.8万亿参数中文大模型刷新开源纪录,1M上下文+多模态能力全面开放

2026年7月17日,月之暗面正式发布旗舰大模型Kimi K3并全面开源,这款拥有2.8万亿参数的模型不仅是当前参数量最大的开源中文大模型,更支持1M超长上下文和视觉理解能力。Kimi K3的开源标志着国产大模型进入万亿参数开源时代,将深刻改变AI应用开发生态。

2026-07-29 2
月之暗面Kimi K3完整开源:2.8万亿参数MoE大模型重塑开源AI生态格局

月之暗面Kimi K3完整开源:2.8万亿参数MoE大模型重塑开源AI生态格局

2026年7月27日,月之暗面正式开源Kimi K3完整模型权重,这款2.8万亿参数的MoE超大模型全面开放商用权限,原生支持百万Token超长上下文。此举标志着国产大模型在开源领域迈出里程碑式一步,将深刻影响全球AI产业竞争格局,推动大模型技术从闭源垄断向开源普惠加速转型。

2026-07-28 136
智谱GLM-5.2全量开放,国产大模型推理性能突破百亿token大关

智谱GLM-5.2全量开放,国产大模型推理性能突破百亿token大关

智谱AI宣布GLM-5.2系列模型全量开放,新一代模型在推理性能上实现重大突破,支持百亿级token上下文窗口,同时保持高效的推理速度。

2026-06-17 13
国产大模型代码能力跃升:2026年技术突围窗口全面开启

国产大模型代码能力跃升:2026年技术突围窗口全面开启

第三方评测数据显示,国产大模型在SWE-bench、HumanEval等标准化编码基准上的得分正快速逼近海外顶尖水平。DeepSeek、阿里通义千问、月之暗面等头部厂商密集迭代Agent与多模态能力,大模型国产化适配测试同步启动,标志着2026年成为国产AI实现系统性突破的关键年份。

2026-06-16 16
Anthropic估值首超OpenAI,GPT-5.6蓄势待发:大模型赛道进入白热化博弈阶段

Anthropic估值首超OpenAI,GPT-5.6蓄势待发:大模型赛道进入白热化博弈阶段

2026年6月,AI大模型领域迎来戏剧性转折。Anthropic估值飙升至9650亿美元,历史性地超越OpenAI的8520亿美元。与此同时,GPT-5.6即将发布并可能大幅降价,Claude 4系列与GPT-5系列展开全方位较量。国产阵营中,MiniMax M3、DeepSeek V4 Pro等模型持续突破,全球大模型竞争格局正经历深刻重构。

2026-06-16 20
DeepSeek首轮融资超500亿创纪录,国产大模型格局进入资本驱动新阶段

DeepSeek首轮融资超500亿创纪录,国产大模型格局进入资本驱动新阶段

2026年6月,坚持三年零外部融资的DeepSeek正式完成首轮融资,募资总额突破500亿元人民币,投后估值超500亿美元,创下中国AI行业单轮融资纪录。与此同时,国产大模型编码能力评测格局生变,GPT-5与Claude的激烈角逐持续升温,大模型价格战正深刻重塑行业生态。

2026-06-16 10
LLM架构革命悄然降临:MoE架构主导六成开源模型,推理模型从加分项变为入场券

LLM架构革命悄然降临:MoE架构主导六成开源模型,推理模型从加分项变为入场券

2025年至2026年中,大语言模型领域正经历一场深刻的范式转移。单纯堆叠参数的传统路径正在被淘汰,取而代之的是MoE稀疏架构的全面普及和推理模型的标配化。arXiv平台LLM相关论文年增长率突破110%,超过60%的开源模型已采用MoE架构,NVIDIA报告称MoE实现了近70倍的模型智能提升。与此同时,推理模型的输出中有高达52.5%的内容可被压缩且精度不降反升,暴露出当前大模型普遍存在的过度思考问题。从Transformer到Mamba等非注意力架构的探索,从对话助手到自主Agent的演进,大模型技术正从暴力计算走向效率优先的新时代。

2026-06-15 17
微软七模齐发宣告独立造模时代:从OpenAI依赖到全栈自研的战略转身

微软七模齐发宣告独立造模时代:从OpenAI依赖到全栈自研的战略转身

微软在Build大会上一次性发布7个自研AI模型,涵盖推理、图像、语音、编程和转录五大领域,其中MAI-Thinking-1推理模型在数学基准测试中取得97%的惊人成绩。这标志着微软正式从AI模型的消费者转变为制造者,一场围绕AI基础设施控制权的深层博弈正在展开。

2026-06-14 12
智源大会重磅发布悟界Physis:全球首个通用世界基座模型让AI真正读懂物理世界

智源大会重磅发布悟界Physis:全球首个通用世界基座模型让AI真正读懂物理世界

2026年6月12日,第八届北京智源大会上,智源研究院院长王仲远正式发布全球首个通用世界基座模型悟界·Physis-v0.1。该模型标志着人工智能从传统的大语言模型范式向物理世界理解迈出关键一步,实现了从预测下一个Token到预测下一个物理状态的跨越式转变。

2026-06-13 7
ChatGPT份额跌破七成:Gemini与Claude联手改写AI聊天机器人竞争版图

ChatGPT份额跌破七成:Gemini与Claude联手改写AI聊天机器人竞争版图

法国巴黎银行最新追踪报告揭示了一个不容忽视的趋势:ChatGPT在全球AI聊天机器人市场的流量份额已从年初的九成以上持续下滑,而谷歌Gemini和Anthropic Claude正以各自独特的竞争优势加速蚕食这块蛋糕。整个市场虽仍在快速扩张,但那个由OpenAI一手缔造的近乎垄断的时代,正在走向终结。

2026-06-13 8