国产大模型六月开源潮:华为盘古、百度文心、腾讯混元集体开放核心权重,AI生态格局悄然重塑

大模型📰综合整理📅2026-06-06 75 阅读

2025年6月,中国大模型行业迎来了一场前所未有的开源风暴。华为、百度、腾讯三家头部科技企业在短短数周内相继宣布开放各自的核心模型权重与推理代码,这一密集动作在业内引发了强烈震荡。如果说过去两年的大模型竞争主要围绕参数规模和基准跑分展开,那么这个六月传递出的信号则截然不同——生态共建正在取代封闭竞赛,成为产业演进的新主轴。

华为盘古5.5:718B参数MoE架构首次开源

6月20日,华为在开发者大会上正式发布盘古大模型5.5,同步宣布首次开源盘古Pro MoE 72B模型。这款采用混合专家架构的大模型包含完整的预训练权重、推理代码以及针对昇腾芯片的优化技术栈。盘古5.5本身在自然语言处理领域推出了718B参数的Ultra MoE版本,创新性地引入自适应快慢思考融合机制——面对简单查询时快速响应,遇到复杂推理任务则切换至深度思考模式,据官方数据,推理效率较上一代提升了8倍。

值得关注的是,华为此次开源并非简单的代码释放,而是将昇腾推理技术体系一并打包开放。这意味着开发者在获取模型权重的同时,也能直接使用经过验证的国产算力适配方案,大幅降低了从模型到部署的工程门槛。在盘古世界模型层面,华为为智能驾驶和具身智能构建了数字训练空间,已帮助车企实现端到端模型两天一迭代的开发节奏。

百度文心4.5:十款模型双层开源

百度在6月30日宣布开源文心大模型4.5系列,涵盖从0.3B参数的轻量稠密模型到47B激活参数的混合专家模型共10款不同规格。此次开源采用框架与模型双层策略——飞桨3.0深度学习框架与文心模型同步开放,开发者可以基于统一的技术栈进行模型微调和部署。

在多模态能力方面,文心4.5-VL-28B-A3B在视觉常识推理任务中的表现超越了OpenAI的o1模型,这一结果在一定程度上打破了国产模型在多模态领域落后于国际同行的固有认知。百度智能云千帆平台同步提供API调用服务,形成了开源+云服务的双轨交付模式。在产业落地层面,百度已与65%的央企建立深度合作,推出的行业场景智能体覆盖金融、能源、交通等关键领域。

腾讯混元:混合推理MoE模型降低部署门槛

腾讯在6月27日开源了首款混合推理MoE模型Hunyuan-A13B。这款模型总参数量80B,但激活参数仅13B,设计目标是在保持推理能力的前提下,让单张中低端GPU即可运行。在数学推理 benchmark 上,Hunyuan-A13B的表现显著优于同等规模的模型。腾讯同时发布了ArtifactsBench和C3-Bench两个全新评测数据集,填补了行业在代码生成和复杂推理评估方面的空白。

在3D生成领域,腾讯开源了混元3D 2.1工业级模型,支持PBR材质生成并适配消费级显卡,将3D资产生产推进到超高清时代。混元T1深度思考模型和Turbo S高速模型则分别面向复杂任务处理和实时交互场景,已全量接入腾讯元宝等C端产品。腾讯云TI平台提供从数据标注到模型部署的全链路工具,支持混元、DeepSeek、Llama等多模型一键调用,目前已服务超过30万家企业。

开源潮背后的产业逻辑

三大巨头同步开源并非巧合。从竞争策略来看,开放核心模型能够快速扩大开发者生态规模,而生态规模反过来又会吸引更多企业客户选择对应的技术栈。百度与65%央企的合作、腾讯服务30万家企业的数据,都说明大模型的价值兑现路径已经从卖模型转向卖生态。

从技术趋势来看,混合专家架构正在成为行业共识。华为盘古的718B MoE、百度文心的47B激活参数MoE、腾讯混元的80B总参13B激活MoE,都在用稀疏激活的方式平衡模型能力与推理成本。这种技术路线的趋同,也降低了不同模型之间的迁移成本,为开发者提供了更灵活的选择空间。

与此同时,国产算力的成熟为开源生态提供了底层支撑。深圳团队依托昇腾910C集群完成了1.6万亿参数DeepSeek-V4-Pro的全参数训练,证明国产AI芯片已具备承担顶级大模型训练任务的能力。华为云发布的CloudMatrix 384超节点架构将384颗NPU全互联,单卡吞吐量达2300 Tokens/s,为大规模模型推理提供了基础设施保障。

竞争格局的深层变化

火山引擎的数据同样印证了行业规模的爆发式增长——豆包大模型日均tokens调用量突破16.4万亿,较去年同期增长137倍,在中国公有云大模型市场占有率达46.4%。豆包1.6采用23B激活参数的稀疏MoE架构,支持256K长文本推理,已渗透汽车、金融、教育等场景,覆盖4亿终端设备。

在国际层面,Anthropic罕见地公开发文呼吁全球暂缓前沿AI研发,指出AI系统正朝着递归式自我改进方向演进,可能很快在无需人类干预的情况下实现自主优化。这一表态从侧面反映了当前AI技术迭代速度之快,已让从业者自身产生了紧迫感。而DeepSeek在面临海外数据合规压力的同时,其升级版R1模型仍获汇丰、沙特阿美等国际机构采用,医疗大模型以70B参数实现3300 token/s的处理速度,创下千万级智慧医疗项目的落地纪录。

当开源成为共识,大模型产业的竞争维度正在从谁能做出最大的模型,转向谁能构建最繁荣的生态、谁能将技术最深地嵌入产业场景。这个六月或许会被视为一个分水岭——国产大模型不再只是在追赶国际前沿,而是在用自己的方式重新书写竞争规则。

标签:大模型开源华为盘古百度文心腾讯混元MoE架构AI生态

相关阅读

D

DeepSeek V4-Flash开源与腾讯Hy Image 3.5:大模型竞争进入场景细分阶段

9月20日DeepSeek发布V4-Flash开源284B MoE,主打Agent和长上下文;腾讯发布Hy Image 3.5 Preview图像生成模型;华为Peerium架构重新定义算力底座。大模型竞争从比参数转向比场景。

2026-09-22 1
GPT-6 Astra正式发布:从聊天工具到数字劳动力的代际跃迁

GPT-6 Astra正式发布:从聊天工具到数字劳动力的代际跃迁

9月3日OpenAI发布GPT-6 Astra,使用超10万块GPU在得州Stargate基地训练,重点提升软件工程、科学推理与计算机操作能力。奥特曼首次明确将自研人形机器人。

2026-09-22 2
小米MiMo-V2.6-Pro全模态旗舰发布:开源权重首次跨入万亿俱乐部

小米MiMo-V2.6-Pro全模态旗舰发布:开源权重首次跨入万亿俱乐部

9月22日小米正式发布并开源MiMo-V2.6-Pro全模态旗舰与Flash高效推理版,同步上线Ultraspeed超高速模式与桌面客户端。Artificial Analysis综合智能指数跻身全球第一梯队。

2026-09-22 2
一周之内五家巨头轮番出手:9月的大模型市场,为什么突然卷成这样

一周之内五家巨头轮番出手:9月的大模型市场,为什么突然卷成这样

OpenAI、Anthropic、谷歌、Muse、DeepSeek、Kimi、阶跃星辰在9月上旬密集发布新模型,全球大模型迭代进入白热化。从旗舰到轻量,各家在推理、编程、智能体等赛道上贴身肉搏。

2026-09-20 9
GPT-6 Astra正式发布:把报税表填完、把数学难题解完,OpenAI这代旗舰冲着'干活'去的

GPT-6 Astra正式发布:把报税表填完、把数学难题解完,OpenAI这代旗舰冲着'干活'去的

9月4日凌晨,OpenAI发布新一代旗舰大模型GPT-6 Astra,号称迄今最智能、对齐程度最高的模型。它在数学、网络安全、计算机操作与自动化任务上实现代际跃升,能独立完成填税表、更新CRM、搭网站等复杂工作。

2026-09-20 9
9月大模型混战十天连发四款旗舰:GPT-6 Astra灰度放量,DeepSeek V4.1 Flash卷性价比

9月大模型混战十天连发四款旗舰:GPT-6 Astra灰度放量,DeepSeek V4.1 Flash卷性价比

9月1日至10日,Claude 5.1、Gemini 3.8 Flash、GPT-6 Astra与DeepSeek V4.1 Flash接连发布,大模型竞争从参数比拼转向Agent执行、语音交互与性价比的多维战场,开发者选型逻辑正在重写。

2026-09-12 30
72小时五款旗舰混战:GPT-6 Astra宣告AGI时代来临

72小时五款旗舰混战:GPT-6 Astra宣告AGI时代来临

9月初OpenAI发布GPT-6 Astra并宣告AGI时代来临,72小时内五家头部厂商密集迭代旗舰模型,编程与Agent能力成为竞争焦点;RSI递归自我改进机制登场,最强模型的保质期正以「周」为单位计算。

2026-09-06 50
2026大模型API价格剧烈分化:DeepSeek低价突围,行业从价格战转向智能战

2026大模型API价格剧烈分化:DeepSeek低价突围,行业从价格战转向智能战

2026年大模型API价格剧烈分化,DeepSeek低价突围、多家涨价,行业从价格战转向智能战与生态卡位。

2026-08-20 87
2026国产大模型诸神之战:Qwen3.8-Max开源、DeepSeek V4与Kimi K3如何重划Agent时代

2026国产大模型诸神之战:Qwen3.8-Max开源、DeepSeek V4与Kimi K3如何重划Agent时代

从聊天模型到智能体模型,2026年国产大模型在参数、开源与Agent能力三维全面突围,格局生变。

2026-08-15 164
万亿权重开源潮:Qwen3.8如何重划2026年大模型格局

万亿权重开源潮:Qwen3.8如何重划2026年大模型格局

2026年8月,国产大模型迎来密集发布窗口:DeepSeek V4-Pro正式版静默上线并强化Agent能力,阿里首次开放Qwen-Max级别权重推出总参数达2.4T的混合专家模型,此前Kimi K3已以三万亿级参数规模落地开源。海外方面,Grok新版本与谷歌轻量旗舰同期更新,价格战持续。过去万亿级MoE旗舰权重基本闭源锁死,中小团队与政企难以本地部署;如今顶级底座陆续开放,意味着全行业都能基于其做私有化二次开发。本文梳理这轮开源潮的技术特征、许可证变化与选型策略。

2026-08-14 93