国产大模型六月开源潮:华为盘古、百度文心、腾讯混元集体开放核心权重,AI生态格局悄然重塑
2025年6月,中国大模型行业迎来了一场前所未有的开源风暴。华为、百度、腾讯三家头部科技企业在短短数周内相继宣布开放各自的核心模型权重与推理代码,这一密集动作在业内引发了强烈震荡。如果说过去两年的大模型竞争主要围绕参数规模和基准跑分展开,那么这个六月传递出的信号则截然不同——生态共建正在取代封闭竞赛,成为产业演进的新主轴。
华为盘古5.5:718B参数MoE架构首次开源
6月20日,华为在开发者大会上正式发布盘古大模型5.5,同步宣布首次开源盘古Pro MoE 72B模型。这款采用混合专家架构的大模型包含完整的预训练权重、推理代码以及针对昇腾芯片的优化技术栈。盘古5.5本身在自然语言处理领域推出了718B参数的Ultra MoE版本,创新性地引入自适应快慢思考融合机制——面对简单查询时快速响应,遇到复杂推理任务则切换至深度思考模式,据官方数据,推理效率较上一代提升了8倍。
值得关注的是,华为此次开源并非简单的代码释放,而是将昇腾推理技术体系一并打包开放。这意味着开发者在获取模型权重的同时,也能直接使用经过验证的国产算力适配方案,大幅降低了从模型到部署的工程门槛。在盘古世界模型层面,华为为智能驾驶和具身智能构建了数字训练空间,已帮助车企实现端到端模型两天一迭代的开发节奏。
百度文心4.5:十款模型双层开源
百度在6月30日宣布开源文心大模型4.5系列,涵盖从0.3B参数的轻量稠密模型到47B激活参数的混合专家模型共10款不同规格。此次开源采用框架与模型双层策略——飞桨3.0深度学习框架与文心模型同步开放,开发者可以基于统一的技术栈进行模型微调和部署。
在多模态能力方面,文心4.5-VL-28B-A3B在视觉常识推理任务中的表现超越了OpenAI的o1模型,这一结果在一定程度上打破了国产模型在多模态领域落后于国际同行的固有认知。百度智能云千帆平台同步提供API调用服务,形成了开源+云服务的双轨交付模式。在产业落地层面,百度已与65%的央企建立深度合作,推出的行业场景智能体覆盖金融、能源、交通等关键领域。
腾讯混元:混合推理MoE模型降低部署门槛
腾讯在6月27日开源了首款混合推理MoE模型Hunyuan-A13B。这款模型总参数量80B,但激活参数仅13B,设计目标是在保持推理能力的前提下,让单张中低端GPU即可运行。在数学推理 benchmark 上,Hunyuan-A13B的表现显著优于同等规模的模型。腾讯同时发布了ArtifactsBench和C3-Bench两个全新评测数据集,填补了行业在代码生成和复杂推理评估方面的空白。
在3D生成领域,腾讯开源了混元3D 2.1工业级模型,支持PBR材质生成并适配消费级显卡,将3D资产生产推进到超高清时代。混元T1深度思考模型和Turbo S高速模型则分别面向复杂任务处理和实时交互场景,已全量接入腾讯元宝等C端产品。腾讯云TI平台提供从数据标注到模型部署的全链路工具,支持混元、DeepSeek、Llama等多模型一键调用,目前已服务超过30万家企业。
开源潮背后的产业逻辑
三大巨头同步开源并非巧合。从竞争策略来看,开放核心模型能够快速扩大开发者生态规模,而生态规模反过来又会吸引更多企业客户选择对应的技术栈。百度与65%央企的合作、腾讯服务30万家企业的数据,都说明大模型的价值兑现路径已经从卖模型转向卖生态。
从技术趋势来看,混合专家架构正在成为行业共识。华为盘古的718B MoE、百度文心的47B激活参数MoE、腾讯混元的80B总参13B激活MoE,都在用稀疏激活的方式平衡模型能力与推理成本。这种技术路线的趋同,也降低了不同模型之间的迁移成本,为开发者提供了更灵活的选择空间。
与此同时,国产算力的成熟为开源生态提供了底层支撑。深圳团队依托昇腾910C集群完成了1.6万亿参数DeepSeek-V4-Pro的全参数训练,证明国产AI芯片已具备承担顶级大模型训练任务的能力。华为云发布的CloudMatrix 384超节点架构将384颗NPU全互联,单卡吞吐量达2300 Tokens/s,为大规模模型推理提供了基础设施保障。
竞争格局的深层变化
火山引擎的数据同样印证了行业规模的爆发式增长——豆包大模型日均tokens调用量突破16.4万亿,较去年同期增长137倍,在中国公有云大模型市场占有率达46.4%。豆包1.6采用23B激活参数的稀疏MoE架构,支持256K长文本推理,已渗透汽车、金融、教育等场景,覆盖4亿终端设备。
在国际层面,Anthropic罕见地公开发文呼吁全球暂缓前沿AI研发,指出AI系统正朝着递归式自我改进方向演进,可能很快在无需人类干预的情况下实现自主优化。这一表态从侧面反映了当前AI技术迭代速度之快,已让从业者自身产生了紧迫感。而DeepSeek在面临海外数据合规压力的同时,其升级版R1模型仍获汇丰、沙特阿美等国际机构采用,医疗大模型以70B参数实现3300 token/s的处理速度,创下千万级智慧医疗项目的落地纪录。
当开源成为共识,大模型产业的竞争维度正在从谁能做出最大的模型,转向谁能构建最繁荣的生态、谁能将技术最深地嵌入产业场景。这个六月或许会被视为一个分水岭——国产大模型不再只是在追赶国际前沿,而是在用自己的方式重新书写竞争规则。
相关阅读

9月大模型混战十天连发四款旗舰:GPT-6 Astra灰度放量,DeepSeek V4.1 Flash卷性价比
9月1日至10日,Claude 5.1、Gemini 3.8 Flash、GPT-6 Astra与DeepSeek V4.1 Flash接连发布,大模型竞争从参数比拼转向Agent执行、语音交互与性价比的多维战场,开发者选型逻辑正在重写。

72小时五款旗舰混战:GPT-6 Astra宣告AGI时代来临
9月初OpenAI发布GPT-6 Astra并宣告AGI时代来临,72小时内五家头部厂商密集迭代旗舰模型,编程与Agent能力成为竞争焦点;RSI递归自我改进机制登场,最强模型的保质期正以「周」为单位计算。

2026大模型API价格剧烈分化:DeepSeek低价突围,行业从价格战转向智能战
2026年大模型API价格剧烈分化,DeepSeek低价突围、多家涨价,行业从价格战转向智能战与生态卡位。

2026国产大模型诸神之战:Qwen3.8-Max开源、DeepSeek V4与Kimi K3如何重划Agent时代
从聊天模型到智能体模型,2026年国产大模型在参数、开源与Agent能力三维全面突围,格局生变。

万亿权重开源潮:Qwen3.8如何重划2026年大模型格局
2026年8月,国产大模型迎来密集发布窗口:DeepSeek V4-Pro正式版静默上线并强化Agent能力,阿里首次开放Qwen-Max级别权重推出总参数达2.4T的混合专家模型,此前Kimi K3已以三万亿级参数规模落地开源。海外方面,Grok新版本与谷歌轻量旗舰同期更新,价格战持续。过去万亿级MoE旗舰权重基本闭源锁死,中小团队与政企难以本地部署;如今顶级底座陆续开放,意味着全行业都能基于其做私有化二次开发。本文梳理这轮开源潮的技术特征、许可证变化与选型策略。

开源双响炮:2026国产大模型集体突围
2026年8月,DeepSeek V4 Pro正式上线、阿里首次开源Qwen3.8旗舰权重,国产大模型迎来开源双响炮。本文盘点Kimi K3、GLM-5.2等国产开源模型的密集迭代,分析开源模型如何以Agent能力与极致性价比挤压闭源阵营,并解读'小而精'端侧路线与开放权重博弈。

英伟达发布Nemotron 3.5 Lightning:300亿参数开源MoE大模型,本地GPU即可运行
英伟达近日发布开源大模型Nemotron 3.5 Lightning,采用300亿参数(30B)混合专家(MoE)架构,权重完全开放。该模型既能在配备英伟达显卡的本地设备直接运行,也可平滑扩展到数据中心与云端,将开源大模型的「本地部署加弹性扩展」能力推向新高度,对企业私有化AI与端侧智能具有重要参考价值。

GPT-5.2 对阵 Claude 4:2026 顶级大模型实测,谁更懂中文长文?
我们横向测评了 GPT-5.2 与 Claude 4 在中文长文档理解、代码生成、多轮对话三项任务上的表现,并给出不同场景下的选型建议。

国产大模型八周连发五款 开源生态重划定全球AI价格体系
2026年8月,智谱GLM-5.2、月之暗面Kimi K3、字节Seedance 2.5、DeepSeek V4 Flash、阿里Qwen3.8-Max在八周内密集发布。国产开源模型以不到美国同类20%的均价,在OpenRouter全球调用量榜单包揽前六,正在系统性瓦解硅谷定价权。
2026年7月大模型“混战”:Claude Opus 5、GPT-5.6、Grok 4.5、DeepSeek V4集中发布,价格战同步打响
2026年7月成为全球大模型发布的“最繁忙月份”之一:Anthropic发布Claude Opus 5,OpenAI将GPT-5.6全面开放并大幅降价,xAI推出Grok 4.5,DeepSeek上线V4 Flash(0731版),阿里通义Qwen3.8预览。前沿模型不仅能力逼近,价格也进入下行通道。
