AI Agent军备竞赛全面升级:OpenAI Codex合体ChatGPT搅动办公生态,国内大模型融资潮折射产业新格局
六月初的AI圈,两件事几乎同时引爆了行业讨论。一边是OpenAI在其线上发布会上宣布将Codex深度嵌入ChatGPT,两个分别拥有近10亿和500万周活的AI产品正式合体;另一边则是国内大模型赛道融资消息密集释放,月之暗面、DeepSeek、无问芯穹等公司接连传出大额融资进展。
表面上看,这是两条各自独立的热点。但把它们放在一起观察,会发现一个清晰的趋势:AI行业的竞争重心,正在从模型参数的堆叠,转向实际交付能力的较量。
Codex入局ChatGPT:从问答工具到执行系统
OpenAI这次更新的核心,不是让ChatGPT变得更会聊天,而是让它变得更会干活。首批上线的六个Agent插件分别覆盖数据分析、创意制作、销售支持、产品设计、投资分析和投行业务,一口气接入了62个主流企业应用。
其中最受关注的场景是数据分析。产品负责人只需用自然语言描述业务问题,Agent就能自主理解数据结构、编写查询语句、生成分析报告,甚至将结果转化为可视化演示文稿。这意味着AI不再停留在给出建议的层面,而是直接介入了工作流的执行环节。
另一个值得注意的功能是Annotations批注系统。过去让AI修改图表或文档,往往需要推倒重来,格式和布局全乱。新机制允许用户精确选中需要修改的部分,Agent只动选中的区域,其余内容保持不变。这种精准干预能力,大幅降低了人机协作的摩擦成本。
更关键的变化在于分发策略。Codex不再是一个独立的编程工具,而是成为ChatGPT的默认能力之一。当Agent功能被嵌入一个拥有近10亿用户的超级应用时,分发层本身就成了竞争壁垒。
国内融资热潮:Token经济催生新赛道
几乎在同一时间窗口,国内大模型赛道出现了密集的资本动作。月之暗面完成约20亿美元新一轮融资,投后估值突破200亿美元,半年内累计融资超39亿美元。DeepSeek启动首次外部融资后,估值从最初曝出的100亿美元迅速攀升至450亿美元,腾讯、阿里及国家集成电路产业投资基金等均在洽谈投资。
AI原生基础设施公司无问芯穹也宣布获得超7亿元融资,累计融资规模超22亿元,位居国内同类企业首位。该公司提出了一个值得关注的概念框架:AI生产力等于智能规模乘以Token生产效率,再乘以Token价值转化。
Token正在从一个技术术语演变为衡量AI产业健康度的核心指标。据业内人士透露,与Token调用相关的产业链公司,订单相较去年同期普遍增长了5到10倍。月之暗面的年度经常性收入在4月已超过2亿美元。
竞争格局的深层变化
把国内外两条线合并来看,会发现几个值得关注的结构性变化。
首先,AI公司的竞争维度正在发生根本性迁移。OpenAI、Anthropic、Google三家的最新动作都指向同一个方向:让AI从回答问题转向完成任务。Cla Code在开发者群体中建立口碑后,Anthropic迅速推出Cowork扩展到知识工作者;Google则将Gemini嵌入搜索、Android、Workspace等全产品线。比拼的不再是谁的模型跑分更高,而是谁的Agent能在真实工作场景中稳定产出。
其次,中美大模型之间的估值差距正在收敛。2023年和2024年,美国大模型公司的估值普遍是中国同行的百倍以上。但随着DeepSeek、MiniMax、智谱等国产模型在多项基准测试中取得突破性成绩,这一差距正在快速缩小。
第三,开源与闭源的路线之争进入新阶段。OpenAI的Codex完全运行在闭源企业授权框架下,而Anthropic则选择了开源其knowledge-work-plugins。两种策略各有逻辑:闭源靠分发规模建立壁垒,开源靠社区生态降低准入门槛。
对从业者的实际影响
对于普通开发者和内容创作者而言,这场变革意味着工作方式需要随之调整。长上下文窗口的扩展使AI能够处理更完整的素材包,Agent能力的成熟让多步骤任务可以端到端执行。但这也意味着,简单的提示词技巧正在贬值,真正稀缺的是对工作流程的系统化梳理能力。
一个值得参考的思路是:不要把任务外包给AI,而是把自己的工作拆解成AI可以接手的标准化流程。保留历史作品作为风格样本,建立明确的验收标准,记录失败案例以便模型学习。当模型能力趋近时,这些流程资产将成为真正的竞争差异。
六月这场没有硝烟的AI军备竞赛,最终的赢家可能不是跑分最高的模型,而是最先把Agent能力转化为真实生产力的那一个。
相关阅读

9月大模型混战十天连发四款旗舰:GPT-6 Astra灰度放量,DeepSeek V4.1 Flash卷性价比
9月1日至10日,Claude 5.1、Gemini 3.8 Flash、GPT-6 Astra与DeepSeek V4.1 Flash接连发布,大模型竞争从参数比拼转向Agent执行、语音交互与性价比的多维战场,开发者选型逻辑正在重写。

72小时五款旗舰混战:GPT-6 Astra宣告AGI时代来临
9月初OpenAI发布GPT-6 Astra并宣告AGI时代来临,72小时内五家头部厂商密集迭代旗舰模型,编程与Agent能力成为竞争焦点;RSI递归自我改进机制登场,最强模型的保质期正以「周」为单位计算。

2026大模型API价格剧烈分化:DeepSeek低价突围,行业从价格战转向智能战
2026年大模型API价格剧烈分化,DeepSeek低价突围、多家涨价,行业从价格战转向智能战与生态卡位。

2026国产大模型诸神之战:Qwen3.8-Max开源、DeepSeek V4与Kimi K3如何重划Agent时代
从聊天模型到智能体模型,2026年国产大模型在参数、开源与Agent能力三维全面突围,格局生变。

万亿权重开源潮:Qwen3.8如何重划2026年大模型格局
2026年8月,国产大模型迎来密集发布窗口:DeepSeek V4-Pro正式版静默上线并强化Agent能力,阿里首次开放Qwen-Max级别权重推出总参数达2.4T的混合专家模型,此前Kimi K3已以三万亿级参数规模落地开源。海外方面,Grok新版本与谷歌轻量旗舰同期更新,价格战持续。过去万亿级MoE旗舰权重基本闭源锁死,中小团队与政企难以本地部署;如今顶级底座陆续开放,意味着全行业都能基于其做私有化二次开发。本文梳理这轮开源潮的技术特征、许可证变化与选型策略。

开源双响炮:2026国产大模型集体突围
2026年8月,DeepSeek V4 Pro正式上线、阿里首次开源Qwen3.8旗舰权重,国产大模型迎来开源双响炮。本文盘点Kimi K3、GLM-5.2等国产开源模型的密集迭代,分析开源模型如何以Agent能力与极致性价比挤压闭源阵营,并解读'小而精'端侧路线与开放权重博弈。

英伟达发布Nemotron 3.5 Lightning:300亿参数开源MoE大模型,本地GPU即可运行
英伟达近日发布开源大模型Nemotron 3.5 Lightning,采用300亿参数(30B)混合专家(MoE)架构,权重完全开放。该模型既能在配备英伟达显卡的本地设备直接运行,也可平滑扩展到数据中心与云端,将开源大模型的「本地部署加弹性扩展」能力推向新高度,对企业私有化AI与端侧智能具有重要参考价值。

GPT-5.2 对阵 Claude 4:2026 顶级大模型实测,谁更懂中文长文?
我们横向测评了 GPT-5.2 与 Claude 4 在中文长文档理解、代码生成、多轮对话三项任务上的表现,并给出不同场景下的选型建议。

国产大模型八周连发五款 开源生态重划定全球AI价格体系
2026年8月,智谱GLM-5.2、月之暗面Kimi K3、字节Seedance 2.5、DeepSeek V4 Flash、阿里Qwen3.8-Max在八周内密集发布。国产开源模型以不到美国同类20%的均价,在OpenRouter全球调用量榜单包揽前六,正在系统性瓦解硅谷定价权。
2026年7月大模型“混战”:Claude Opus 5、GPT-5.6、Grok 4.5、DeepSeek V4集中发布,价格战同步打响
2026年7月成为全球大模型发布的“最繁忙月份”之一:Anthropic发布Claude Opus 5,OpenAI将GPT-5.6全面开放并大幅降价,xAI推出Grok 4.5,DeepSeek上线V4 Flash(0731版),阿里通义Qwen3.8预览。前沿模型不仅能力逼近,价格也进入下行通道。
