DeepSeek订购16万颗昇腾950DT:国产AI算力格局改写
中国AI算力市场的天平正在加速倾斜。据彭博社报道,DeepSeek已向华为订购16万颗昇腾950DT芯片,用于其位于内蒙古的新建1GW数据中心。按照每颗约11.1万元人民币的市场价格估算,这批订单总额可能达到约25.6亿美元。面对英伟达面向中国市场的特供版H20(售价约1.5万至2.5万美元),DeepSeek此次选择华为,被外界视为国产算力从「备选项」变为「首选」的标志性事件。
公开资料显示,昇腾950DT采用华为自研第三代达芬奇架构,基于中芯国际N+3工艺打造,属于7纳米级制程,每颗配备144GB高带宽内存、内存带宽达4.0TB/s,芯片间互联速度2.0TB/s,原生支持FP8、FP4等低精度格式。华为还将其用于Atlas 950 SuperPoD超节点方案,最多可连接8192颗芯片,峰值AI算力达8 EFLOPS,这种大规模集群方案将成为华为争夺中国AI算力市场的重要基础。不过产能仍是现实约束:昇腾950DT年产量目前仅几十万颗,完成这笔订单可能需要长达一年时间。
DeepSeek创始人梁文锋此前曾坦率比较两大路线:英伟达GB300能完成的任务,华为超节点同样可以完成,延迟没有明显差别,但华为需要约4颗GPU才能达到英伟达1颗的性能水平,技术上落后约两年。换言之,这笔订单并非「性能信仰」,而是对成本、供应链安全与本土化服务的综合权衡。有市场分析认为,英伟达如今似乎已开始将中国市场视为「失去的市场」,不再像过去那样积极争取。
宏观层面的数据同样印证了这一趋势。行业调研显示,2026年国产AI芯片需求约400万颗,实际交付约300万颗,存在百万级缺口,「一芯难求」成为常态;IDC数据显示2025年中国AI加速卡出货中本土厂商占比已达41%,TrendForce更预计2026年国产方案在中国高端AI芯片市场的份额将接近90%。资本市场的反馈直接而热烈:寒武纪上半年营收59.96亿元、同比增长108.1%,摩尔线程营收17.36亿元、同比增长147.4%,部分高端产品排产已排到2029年。
供给瓶颈的另一端,指向先进制程与先进封装的产能竞赛。HBM存储与CoWoS类先进封装是AI芯片量产的关键环节,全球产能虽有扩张但依然供不应求;国产厂商在7纳米及以下制程的量产能力仍在爬坡,短期内供给紧张难以根本缓解。英伟达也没有坐视:8月31日,英伟达宣布以35亿美元认购联发科可转换债券,双方将在AI基础设施、本地AI计算与汽车平台三大领域深化合作,联发科将采用NVLink Fusion平台为云厂商开发定制XPU,接入英伟达的机架级算力架构。一边是本土超节点集群的加速铺开,一边是巨头生态绑定的合纵连横,AI算力竞争正从单点芯片战,升级为覆盖芯片、互联、整机柜与数据中心的体系战。
软件生态的短板也在快速补齐。DeepSeek-V4实现九种国产芯片Day0适配,华为CANN全面开源,智谱GLM-5.3-Flash率先在大规模流量场景中依托国产芯片集群对外提供服务,单Token成本已与主流英伟达GPU相当。从「可用」到「好用」,国产算力正跨越最关键的一道门槛。与此同时,字节跳动传出将银团贷款规模扩至296亿美元加码AI算力基础设施,需求端的扩张远未见顶。芯片竞争的下半场,比拼的已经不只是单卡性能,而是系统、生态与交付能力的全面较量。









