万亿权重开源潮:Qwen3.8如何重划2026年大模型格局

大模型综合整理2026-08-1426 阅读

2026年8月的大模型圈被从业者称为“疯狂星期四”——短短一天之内,国内外厂商出现新模型三连发的局面。据公开报道,DeepSeek的V4-Pro正式版静默上线,阿里Qwen团队首次开放Max级别权重推出总参数达2.4T的模型,海外的Grok新版本同期发布,另有厂商的新一代模型接近发布。如果把时间轴再拉长一点,此前已有三万亿级参数的开源模型落地。万亿级权重从“闭源锁死”走向“公开下载”,正在改写整个行业的游戏规则。

参数规模跃升,但重点已经不是参数

据官方模型卡信息,新开源的旗舰级模型总参数达到2.4T量级,每个Token激活约950亿参数,原生支持约26万Token上下文并可扩展到百万级;其混合专家层包含数百个专家,每个Token选择少量路由专家并同时激活共享专家。这种“总量巨大、激活克制”的架构,正是当下万亿级模型能够被实际部署的前提。

但真正值得注意的不是参数数字,而是能力侧重的变化。据官方说明,新版本延续了前代的混合架构,重点提升编程、办公、科研与长周期智能体任务的端到端完成能力。官方公布的评测覆盖编程智能体、通用智能体、专业工作与长上下文等方向,与前一代相比在多项智能体任务上提升明显。换句话说,模型厂商的优化目标已经从“回答得漂亮”转向“任务能做完”。

与之呼应的是另一条产品线的分层策略。据官方信息,某厂商的旗舰版模型支持百万级上下文、最大输出达数十万Token,同时支持思考与非思考模式,思考模式默认开启;而其轻量版本在并发限制上明显更高,价格约为旗舰版的三分之一。这种分层不是简单的高低配,而是针对“高价值决策”与“高频批量处理”两类完全不同的场景做的产品切割。

许可证的微妙变化:开源不等于随便用

这轮开源潮里最容易被忽略的细节是许可证。据官方模型卡说明,新开放的权重版本与云端商用版本并不完全等同:开源版原生支持约26万上下文、可扩展到百万级、支持调节推理强度,但当前版本仅支持文本输入且必须开启思考模式;云端版本才额外支持视觉输入、非思考模式、默认百万上下文以及官方内置工具。

更关键的是,许可证从此前的宽松开源协议改为厂商自定义许可。据官方说明,普通用户仍可下载、修改和部署,但部分大规模商业使用需要另行取得授权。此前也有消息指出,厂商计划向大型商业用户设置额外收费或授权条件。这提醒所有打算基于开源权重做产品的团队:下载之前先读许可证,比调好参数更重要。

这种“权重开放、商用分层”的模式,大概会成为接下来的主流。厂商既要靠开源换取生态与人才,又必须在商业化上找到闭环,折中方案就是把大客户的商用授权单独定价。对中小团队来说影响有限,对准备大规模商用的企业则必须提前把授权成本算进模型。

价格战与涨价并存:算力成本的真实压力

2026年的定价局面有些矛盾:一边是海外厂商持续降价,据公开信息,某轻量旗舰模型的引导价被下调至前代的一半,但明确注明次年将恢复原价;另一边是国内厂商公告整体上调API服务定价。同一时期出现相反方向的动作,说明定价已经不再单纯反映成本,而是竞争策略的一部分。

据公布的价格信息,不同定位模型之间的价差相当悬殊:轻量版每百万Token的输入输出价格可以低到旗舰版的三分之一甚至更低,而海外顶级模型的输出价格可能是同类竞品的数倍。对开发者而言,这意味着“选对模型”带来的成本差异,往往远大于优化提示词带来的收益。

缓存机制的价值也在被重新认识。据官方定价页面信息,命中缓存的输入价格可以低到未命中价格的百分之一以下。对于需要反复携带同一份长文档或系统提示的智能体场景,把缓存用好几乎等于直接砍掉大部分成本。这类工程细节,正在成为拉开产品毛利差距的关键。

开源的真实红利:政企私有化终于可行

过去万亿级混合专家旗舰权重基本闭源锁死,中小团队与政企客户很难做本地部署,只能通过云端API调用。这在数据敏感场景里几乎是死结——不能出网的数据,就用不上最强的模型。如今顶级底座陆续开放,意味着全行业都能基于这套架构做私有化二次开发。

不过要泼一盆冷水:万亿参数的本地部署门槛依然很高。即便采用稀疏激活,推理所需的显存、互联带宽与运维能力都不是普通团队能轻松承担的。现实中的落地路径更可能是“开源权重加行业微调加小规模集群”,或者由具备算力的服务商提供私有化交付。据公开预告,同系列还将推出参数量小得多的版本,这类模型对多数场景更实用。

评测的可信度问题

随着厂商纷纷公布智能体类评测成绩,如何解读这些数字成了新难题。据官方模型卡的说明,各项评测在运行框架、超时时间、采样参数与上下文长度上并不完全一致;不同模型在不同评测上的结果互有高低,很难得出单一的高下判断。第三方分析机构给出的综合智能指数也显示,头部模型之间的差距在收窄,而排序会随评测口径变化。

更务实的做法是建立自己的评测集。挑二三十个真实业务任务,固定框架与参数,记录成功率、平均耗时与Token消耗,跑一遍候选模型。这套工作量不大,但得到的结论比任何榜单都更贴近实际收益,也更容易在团队内部形成共识。

格局判断:两条互补路线同时成熟

从这一轮发布可以看出,国内厂商正在走两条互补的路线。一条侧重云端API的规模化服务,依靠分层定价与高并发承载企业线上生产流量,主打开箱即用的商用推理;另一条以开放权重为核心,通过释放顶级底座换取生态位置,同时逐步探索商业化闭环。两条路线同步成熟,让整个生态不再单一依赖某家企业或某条技术路径。

对开发者与企业的启示很直接:不要把架构绑死在单一模型上。做好接口抽象、保留切换能力、把评测流程固化下来,这样无论下个月哪家发布新版本、哪家调整价格,迁移成本都是可控的。在一个每几周就会出现新旗舰的行业里,可替换性本身就是最重要的技术资产。

信息加载中
相关阅读
2026国产大模型诸神之战:Qwen3.8-Max开源、DeepSeek V4与Kimi K3如何重划Agent时代
2026国产大模型诸神之战:Qwen3.8-Max开源、DeepSeek V4与Kimi K3如何重划Agent时代
从聊天模型到智能体模型,2026年国产大模型在参数、开源与Agent能力三维全面突围,格局生变。
大模型2026-08-1534
开源双响炮:2026国产大模型集体突围
开源双响炮:2026国产大模型集体突围
2026年8月,DeepSeek V4 Pro正式上线、阿里首次开源Qwen3.8旗舰权重,国产大模型迎来开源双响炮。本文盘点Kimi K3、GLM-5.2等国产开源模型的密集迭代,分析开源模型如何以Agent能力与极致性价比挤压闭源阵营,并解读'小而精'端侧路线与开放权重博弈。
大模型2026-08-1328
英伟达发布Nemotron 3.5 Lightning:300亿参数开源MoE大模型,本地GPU即可运行
英伟达发布Nemotron 3.5 Lightning:300亿参数开源MoE大模型,本地GPU即可运行
英伟达近日发布开源大模型Nemotron 3.5 Lightning,采用300亿参数(30B)混合专家(MoE)架构,权重完全开放。该模型既能在配备英伟达显卡的本地设备直接运行,也可平滑扩展到数据中心与云端,将开源大模型的「本地部署加弹性扩展」能力推向新高度,对企业私有化AI与端侧智能具有重要参考价值。
大模型2026-08-1234
GPT-5.2 对阵 Claude 4:2026 顶级大模型实测,谁更懂中文长文?
GPT-5.2 对阵 Claude 4:2026 顶级大模型实测,谁更懂中文长文?
我们横向测评了 GPT-5.2 与 Claude 4 在中文长文档理解、代码生成、多轮对话三项任务上的表现,并给出不同场景下的选型建议。
大模型2026-08-0747
国产大模型八周连发五款 开源生态重划定全球AI价格体系
国产大模型八周连发五款 开源生态重划定全球AI价格体系
2026年8月,智谱GLM-5.2、月之暗面Kimi K3、字节Seedance 2.5、DeepSeek V4 Flash、阿里Qwen3.8-Max在八周内密集发布。国产开源模型以不到美国同类20%的均价,在OpenRouter全球调用量榜单包揽前六,正在系统性瓦解硅谷定价权。
大模型2026-08-0667
2
2026年7月大模型“混战”:Claude Opus 5、GPT-5.6、Grok 4.5、DeepSeek V4集中发布,价格战同步打响
2026年7月成为全球大模型发布的“最繁忙月份”之一:Anthropic发布Claude Opus 5,OpenAI将GPT-5.6全面开放并大幅降价,xAI推出Grok 4.5,DeepSeek上线V4 Flash(0731版),阿里通义Qwen3.8预览。前沿模型不仅能力逼近,价格也进入下行通道。
大模型2026-08-0444
2
《2026中国AI大模型竞争力TOP20》发布:字节豆包登顶,阿里通义第二,国产模型进入第一梯队
中国数据研究中心2026年7月28日正式发布《2026中国AI大模型竞争力TOP20》研究报告,首次从技术能力、商业落地、生态建设、发展潜力四个维度对国产大模型进行全面评估。字节跳动豆包/Seed以96.2分排名第一,阿里巴巴通义千问Qwen3.7+以94.8分位列第二,百度文心一言、腾讯混元、DeepSeek等表现亮眼。国产大模型综合能力已跻身全球第一梯队。
大模型2026-07-31284
Kimi K3开源引爆AI圈:2.8万亿参数中文大模型刷新开源纪录,1M上下文+多模态能力全面开放
Kimi K3开源引爆AI圈:2.8万亿参数中文大模型刷新开源纪录,1M上下文+多模态能力全面开放
2026年7月17日,月之暗面正式发布旗舰大模型Kimi K3并全面开源,这款拥有2.8万亿参数的模型不仅是当前参数量最大的开源中文大模型,更支持1M超长上下文和视觉理解能力。Kimi K3的开源标志着国产大模型进入万亿参数开源时代,将深刻改变AI应用开发生态。
大模型2026-07-2956
月之暗面Kimi K3完整开源:2.8万亿参数MoE大模型重塑开源AI生态格局
月之暗面Kimi K3完整开源:2.8万亿参数MoE大模型重塑开源AI生态格局
2026年7月27日,月之暗面正式开源Kimi K3完整模型权重,这款2.8万亿参数的MoE超大模型全面开放商用权限,原生支持百万Token超长上下文。此举标志着国产大模型在开源领域迈出里程碑式一步,将深刻影响全球AI产业竞争格局,推动大模型技术从闭源垄断向开源普惠加速转型。
大模型2026-07-28341
智谱GLM-5.2全量开放,国产大模型推理性能突破百亿token大关
智谱GLM-5.2全量开放,国产大模型推理性能突破百亿token大关
智谱AI宣布GLM-5.2系列模型全量开放,新一代模型在推理性能上实现重大突破,支持百亿级token上下文窗口,同时保持高效的推理速度。
大模型2026-06-1755