一周之内五家巨头轮番出手:9月的大模型市场,为什么突然卷成这样

大模型综合整理2026-09-2028 阅读

9月刚过完第一周,AI圈就给人一种'过年'的感觉。OpenAI、Anthropic、谷歌、Muse、DeepSeek、Kimi、阶跃星辰,数得上名字的大厂几乎在同一时间窗口里轮番出手,新模型一个接一个往外端。有从业者在社交平台上感叹:这哪是发新品,分明是集体抢头条。

最先引爆的是9月1日Anthropic的Claude Fable 5.1,紧随其后是Muse的Spark 1.3,然后是9月3日OpenAI的GPT-6 Astra——这一周里谷歌的Gemini 3.8 Flash也低调上线。国内这边也没闲着,DeepSeek发布了V4.1 Flash,Kimi放出K2.8 Preview,阶跃星辰在9月中旬突然发布新一代旗舰模型Step 5 Preview。

密集到什么程度?有媒体统计,光是9月第一周,全球头部厂商发布的旗舰和准旗舰模型就超过五个。放在一年前,任何一个名字单独出现都能霸榜好几天,现在大家连发布会都挤在一起开。

为什么突然这么卷?拆开看,几个原因叠在一起。一是技术路线的分化期到了。GPT-6 Astra把宝押在智能体执行能力和深度推理上,在ARC-AGI-3上拿到99.9%的近乎满分;Claude Fable 5.1在综合能力和知识广度上继续打磨;谷歌的Gemini 3.8 Flash则走轻量高性价比路线,用更低的成本覆盖高频场景。各家不再往同一个方向堆参数,而是各占一个山头。

二是成本战已经打到了明面上。DeepSeek V4.1 Flash把价格压到每百万输入token 0.15美元、输出0.6美元(非高峰时段),几乎是白菜价。这种定价策略倒逼其他厂商在同等价位上拿出更强的模型,价格和性能的平衡点成了新的竞争维度。

三是智能体(Agent)成了公认的下一个主战场。OpenAI这次专门推出Agents API,让开发者可以更简单地构建能自主完成任务的AI应用。Astra的OSWorld 2.0得分72.6%,Automation Bench上41.4%,都是冲着'替代人干活'去的。谁家的模型能更可靠地操作电脑、调用工具、完成任务,谁就在企业市场占了先手。

不过,密集发布也带来一个问题:用户真的需要这么多'最强模型'吗?从评测数据看,Astra在数学和计算机操作上领先,但在创意写作、综合知识这些维度跟Claude Fable 5.1打平甚至略逊。没有谁是六边形战士。对用户来说,选择反而变简单了——按场景选模型,而不是追着'最强'的名头跑。

这一轮大混战还透露出另一个信号:大模型竞争正在从'拼参数'转向'拼落地'。发布只是起点,能不能被开发者和企业真正用起来才是关键。OpenAI把Astra的API定价定在GPT-5.6 Sol的2.5倍,说明它赌的就是企业愿意为'能干活'付更高溢价。

这一轮发布潮还有个容易被忽略的背景:各家都在押注'推理时计算'(inference-time compute)这条新路线。以前模型的能力主要靠训练时堆算力,现在越来越多的厂商发现,让模型在回答问题前'多想一会儿',也能显著提升复杂任务的准确率。GPT-6 Astra的五级推理强度调节、Claude系列的深度思考模式,本质都是把推理时的算力变成可调用的'思考预算'。这条路线的成熟,让'小模型+长思考'的组合开始威胁'大模型+短回答'的传统打法,模型竞争的维度被彻底改写了。

对开发者来说,选择变多的同时,兼容成本也在上升。不同模型的提示词习惯、工具调用规范、上下文处理方式各不相同,切换模型往往意味着重写一批prompt和适配代码。也正因如此,这一波发布潮催热了另一类工具——模型路由和统一API层。它们把多家大模型封装成统一接口,按任务类型自动选择最合适的模型,既省成本又保质量。'用哪家模型'正在从一个技术决策变成一道成本优化的数学题。

回到普通用户这一侧,大模型这波'卷'带来的实惠其实更直接:免费额度变多了,价格变低了,能干的活变多了。DeepSeek把API价格打到每百万token一毛五的水平,其他厂商也不得不跟进降价,就连高端旗舰的价格也在被一步步挤压。行业里那句话越来越应验:大模型正在变成像水电一样的基础设施,便宜、可靠、随处可取。至于'谁是最强模型'的争论,大概会一直持续下去——但这恰恰说明,这个行业正处在最有活力的时期。

接下来值得关注的是这些模型的实际表现——吹得再响,也要在真实业务里见真章。对开发者来说,眼下反而是个好时候:模型选择空前丰富,价格在下探,能力在上涨。至于'谁家最强'这个问题,恐怕要等这波发布潮消化完,市场才会给出真正的答案。

信息加载中
相关阅读
CNNIC报告显示我国生成式人工智能用户突破7亿,AI普及率超过五成
CNNIC报告显示我国生成式人工智能用户突破7亿,AI普及率超过五成
CNNIC最新报告显示,我国生成式人工智能用户规模突破7亿,普及率超过50%。同期特朗普签署行政令将AI更名超级智能,OpenAI发布平价模型GPT-6.1 Sol,行业迎来密集变化期。
大模型2026-10-014
OpenAI开发者日一口气放出二十多项更新:GPT-6.1 Sol与全天候智能体Dots正式登场
OpenAI开发者日一口气放出二十多项更新:GPT-6.1 Sol与全天候智能体Dots正式登场
9月29日,OpenAI在DevDay 2026上发布二十多项更新,推出接近Astra能力、价格仅五分之一的新模型GPT-6.1 Sol,以及能够24小时自主推进工作的智能体Dots,还上线了每月500美元的高级订阅计划。
大模型2026-09-307
AMD约550亿元收购李飞飞创办的世界实验室 李飞飞出任执行副总裁兼首席科学家
AMD约550亿元收购李飞飞创办的世界实验室 李飞飞出任执行副总裁兼首席科学家
9月28日,超威半导体AMD宣布以全股票形式收购由李飞飞创办的AI模型与研究实验室世界实验室,交易总价值约82亿美元,预计2026年底前完成。李飞飞将加入AMD担任执行副总裁兼首席科学家。
大模型2026-09-2912
Anthropic发布Claude Opus 5.5:首个邀请外部机构预测试的前沿模型
Anthropic发布Claude Opus 5.5:首个邀请外部机构预测试的前沿模型
9月22日Anthropic推出Claude 5.5家族首款模型Opus 5.5,运行成本比Opus 5低四成,多数工作负载追平Fable 5.1。这是Anthropic宣布放缓前沿步伐后首款经过外部评估机构测试再发布的模型。
大模型2026-09-2427
DeepSeek V4-Flash开源与腾讯Hy Image 3.5:大模型竞争进入场景细分阶段
DeepSeek V4-Flash开源与腾讯Hy Image 3.5:大模型竞争进入场景细分阶段
9月20日DeepSeek发布V4-Flash开源284B MoE,主打Agent和长上下文;腾讯发布Hy Image 3.5 Preview图像生成模型;华为Peerium架构重新定义算力底座。大模型竞争从比参数转向比场景。
大模型2026-09-2229
GPT-6 Astra正式发布:从聊天工具到数字劳动力的代际跃迁
GPT-6 Astra正式发布:从聊天工具到数字劳动力的代际跃迁
9月3日OpenAI发布GPT-6 Astra,使用超10万块GPU在得州Stargate基地训练,重点提升软件工程、科学推理与计算机操作能力。奥特曼首次明确将自研人形机器人。
大模型2026-09-2230
小米MiMo-V2.6-Pro全模态旗舰发布:开源权重首次跨入万亿俱乐部
小米MiMo-V2.6-Pro全模态旗舰发布:开源权重首次跨入万亿俱乐部
9月22日小米正式发布并开源MiMo-V2.6-Pro全模态旗舰与Flash高效推理版,同步上线Ultraspeed超高速模式与桌面客户端。Artificial Analysis综合智能指数跻身全球第一梯队。
大模型2026-09-2226
GPT-6 Astra正式发布:把报税表填完、把数学难题解完,OpenAI这代旗舰冲着'干活'去的
GPT-6 Astra正式发布:把报税表填完、把数学难题解完,OpenAI这代旗舰冲着'干活'去的
9月4日凌晨,OpenAI发布新一代旗舰大模型GPT-6 Astra,号称迄今最智能、对齐程度最高的模型。它在数学、网络安全、计算机操作与自动化任务上实现代际跃升,能独立完成填税表、更新CRM、搭网站等复杂工作。
大模型2026-09-2034
9月大模型混战十天连发四款旗舰:GPT-6 Astra灰度放量,DeepSeek V4.1 Flash卷性价比
9月大模型混战十天连发四款旗舰:GPT-6 Astra灰度放量,DeepSeek V4.1 Flash卷性价比
9月1日至10日,Claude 5.1、Gemini 3.8 Flash、GPT-6 Astra与DeepSeek V4.1 Flash接连发布,大模型竞争从参数比拼转向Agent执行、语音交互与性价比的多维战场,开发者选型逻辑正在重写。
大模型2026-09-1243
72小时五款旗舰混战:GPT-6 Astra宣告AGI时代来临
72小时五款旗舰混战:GPT-6 Astra宣告AGI时代来临
9月初OpenAI发布GPT-6 Astra并宣告AGI时代来临,72小时内五家头部厂商密集迭代旗舰模型,编程与Agent能力成为竞争焦点;RSI递归自我改进机制登场,最强模型的保质期正以「周」为单位计算。
大模型2026-09-0665