DeepSeek登顶企业AI支出增速榜首,OpenAI内部喊出"聊天已死":大模型行业正经历一场静悄悄的权力转移
六月的第一周,一份来自海外金融平台的AI支出指数报告在开发者社区引发了连锁反应。这份追踪超过五万家企业真实支出的数据揭示了一个令硅谷巨头不安的事实:DeepSeek以强劲的增长势头,首次登上了企业AI支出趋势榜的榜首位置,增速全面超越OpenAI、Anthropic和谷歌。
这并非一次偶然的排名波动。几乎在同一时间,OpenRouter发布的全球大模型调用量周报显示,中国AI大模型的周调用量已连续六周稳居全球首位。上周全球大模型总调用量达到36.1万亿Token,其中中国模型贡献了14.19万亿Token,环比增长27.49%,而同期美国模型的调用量为3.2万亿Token,环比下滑24.53%。更值得关注的是,全球调用量前五名中,前四席全部被中国大模型占据。
DeepSeek-V4-Flash:性价比重新定义竞争规则
DeepSeek-V4-Flash已经连续三周蝉联全球调用量榜首,周调用量达到3.69万亿Token,环比增长19%。紧随其后的是腾讯Hy3 preview,周调用量2.94万亿Token。新晋入榜的MiniMax M3冲进前三,周调用量达2.5万亿Token,这款国内首个同时具备前沿编程能力、百万级超长上下文和原生多模态的大模型,上线首周便展现出强劲的市场吸引力。小米MiMo-V2.5位居第四,周调用量2.19万亿Token,环比暴涨50%。
DeepSeek的崛起逻辑并不复杂。V4-Flash的输入价格仅为Claude Opus 4.7的三十六分之一,输出价格不到GPT-5.5的百分之一。整整一个数量级的成本差距,让越来越多的企业做出了理性选择。有企业直接将全部API调用从Anthropic迁移至DeepSeek-V4,单季度节省了数百万美元的支出。性能差距在可接受范围内,价格却相差十倍——这道选择题的答案,对于任何一家关注成本控制的企业来说都不难做出。
OpenAI的战略焦虑:从聊天机器人到超级应用
面对来自前后两个方向的挤压,OpenAI正在经历自2022年ChatGPT发布以来最大规模的战略转型。据内部人士透露,公司高管已公开表示"Chat is dead"——聊天已死。ChatGPT将不再只是一个对话工具,而是要进化为一个整合编码工具Codex、AI Agent和第三方应用的超级应用平台。Canva和Booking等外部服务已开始接入,预计几周内正式上线。
这一转型的背后是实实在在的财务压力。尽管ChatGPT月活跃用户已突破十亿,年化营收超过250亿美元,但2026年预计净亏损仍高达140亿美元。十亿用户带来的不是利润,而是越烧越多的算力成本。与此同时,GitHub Copilot在六月全面改为token计费后,开发者月账单从29美元飙升至750美元甚至3000美元,Uber公司的AI编程工具年度预算在四个月内便消耗殆尽。大补贴时代正在终结,token开始论个卖钱。
Anthropic同样在加速抢占企业市场。四月数据显示,34.4%的企业在使用Anthropic的产品,首次反超OpenAI的32.3%。Claude系列在企业知识工作和代码工作流方面建立了坚实的商业壁垒。然而在最新的OpenRouter周报中,Claude Sonnet 4.6和Claude Opus 4.7双双跌出前五,调用量分别环比下滑9%和38%。开发者正在用脚投票,在性能、价格和任务适配度之间寻找最优解。
开源生态的集体突围
中国大模型的集体崛起并非孤立现象。DeepSeek V4预览版分为Pro和Flash两个版本,均支持百万Token超长上下文,总参数规模分别达到1.6T和284B。在百万Token上下文场景下,V4 Pro的单Token推理计算量仅为上一代的27%,KV缓存压缩至10%。这意味着处理超长文档时,模型不仅"装得下",而且"跑得快、花得少"。
DeepSeek正以超过200亿美元的估值寻求新一轮融资,阿里和腾讯据称正在洽谈投资。V4的发布被视为这一融资节点上的关键筹码。Qwen、GLM、Kimi等国产模型也都在向Agentic Coding、工具调用和长任务执行方向快速迭代。Hugging Face的下载数据显示,DeepSeek和阿里Qwen系列的下载量已占热门新模型总下载量的44%以上。
这场变革的深层含义在于,AI行业的竞争维度正在从单纯的模型能力比拼,扩展到成本效率、交付能力和生态整合的综合较量。当性能不再是唯一标尺,性价比开始主导决策,整个行业的权力结构便不可避免地迎来重组。对于开发者和企业用户而言,这无疑是一个好消息——更多选择、更低成本、更务实的工具,正在让AI从昂贵的实验品变成触手可及的生产力基础设施。