小米MiMo-V2.6-Pro全模态旗舰发布:开源权重首次跨入万亿俱乐部

大模型📰综合整理📅2026-09-22 0 阅读

9月22日,小米正式对外发布并开源全新一代大模型家族——Xiaomi MiMo-V2.6-Pro全模态旗舰、Xiaomi MiMo-V2.6-Flash高效推理模型,同时推出V2.6-Pro的超高速推理模式Ultraspeed,以及MiMo Desktop桌面客户端正式版。这是小米自去年首次公开MiMo系列以来,在模型能力与产品化上跨度最大的一次升级。

根据全球权威大模型测评平台Artificial Analysis公布的综合智能指数榜单,MiMo-V2.6-Pro在推理、代码、多语言理解、视觉与音频联合推理等多个维度进入全球第一梯队。与上一代相比,Pro版的上下文窗口扩展至百万token级别,能够一次性处理数百页文档、整本书稿或长篇代码仓库;Flash版则主打低延迟场景,在保持中文能力接近Pro版的前提下,推理成本压到了原来的三成。

全模态是这一代最显著的变化。此前MiMo系列主要在文本与图像两个模态上发力,而V2.6-Pro首次把音频、视频、3D场景理解统一到同一个Transformer骨干网络中。官方演示中,模型可以同时观看一段产品演示视频、听其中的英文讲解、读取屏幕上的代码,并直接生成带注释的总结报告。这意味着过去需要先ASR转写、再OCR识别、最后LLM推理的多步流水线,现在可以在一次前向传播里完成。

开源策略同样值得关注。小米此次直接开放了Pro与Flash两个版本的模型权重,允许研究者和企业在非商用场景自由使用。这一举动在国产大模型圈并不多见——多数厂商仍把旗舰版能力保留在API层,仅放出中小尺寸的开源版本。小米选择开源旗舰,背后是其AIoT生态的布局:手机、汽车、智能家居设备上的端侧模型,需要一个开放、可被工程化裁剪的基座。

从技术路线看,MiMo-V2.6-Pro延续了MoE混合专家架构,但把激活参数从去年的220亿提升到了560亿,总参数规模据传突破万亿。训练数据首次大规模使用了合成数据与自我反思蒸馏,尤其是在数学推理和代码生成两个困难任务上,模型通过先生成草稿、再自我评审、最后修正的循环,把Pass@1指标提高了近15个百分点。

Ultraspeed模式则面向C端应用。它通过推测解码配合小米自研的端侧小模型,把首token延迟压到了200毫秒以内,接近人类对话的反应速度。MiMo Desktop桌面客户端同步上线,支持在本地文件夹上建立索引,用户可以直接用自然语言问上周那个合同里关于违约金的条款是怎么写的,客户端会在本地检索后调用云端模型回答,兼顾隐私与能力。

行业层面,小米此次发布恰逢国产大模型竞争白热化的节点:本月初阿里在云栖大会上披露Qwen4已在训练中,智源、月之暗面、DeepSeek等团队也都在为四季度的新版本蓄力。小米MiMo-V2.6-Pro的入场,意味着手机厂商做大模型这一路线已经从早期的套壳调用进化到了自研基座加生态落地的新阶段。

从开发者生态角度看,小米此次开源的另一个看点是定价策略。过去国产大模型厂商的开源模式,往往是开放一个能力较弱的小模型,而把真正的旗舰能力锁在付费API里。小米这次直接开放Pro版权重,等于是用开源换生态——吸引开发者在MiMo基座上做行业微调、做垂直应用,最终反哺小米的端侧落地。这种思路和Meta的Llama系列如出一辙,开源社区的力量往往比一支研发团队更强大。

对普通消费者而言,最直观的变化会体现在小米汽车和手机上。未来小米汽车的智能座舱、小米手机的系统级AI助手,都会基于MiMo-V2.6-Pro做端云协同。你在车里说一句帮我找附近评分最高的粤菜馆,系统不只是返回一个搜索结果,而是直接订好位、规划路线、同步到手机日历。这种跨设备的智能体验,是单做大模型或单做硬件都做不出来的。

对于普通开发者而言,这次开源最实际的意义在于:多了一个可以免费商用测试的强基座模型。无论你是想在本地部署一个私有知识库,还是在自己的App里加一个智能助手,MiMo-V2.6-Flash都是当前性价比很高的选择。预计未来一到两个月内,社区会出现大量基于这套权重的微调版本与行业适配模型,值得持续关注。

最后给开发者三个建议:一是第一时间下载权重体验,用本地部署工具Ollama或vLLM在消费级显卡上跑起来,感受万亿参数模型的实际速度;二是关注小米AI实验室后续发布的技术报告,这次开源的训练细节、数据配比、MoE路由设计都会公开,是学习国产大模型工程实践的一手资料;三是结合自己的业务场景做一个小Demo——无论是智能客服、代码助手还是内容生成,新一代模型的能力边界比一年前大幅扩展,值得重新评估。从2023年小米第一次公布大模型至今,仅用三年时间就走到了全球第一梯队,这背后是手机厂商用端侧数据反哺云端模型的独特优势。

标签:小米MiMo大模型开源全模态

相关阅读

G

GPT-6 Astra正式发布:从聊天工具到数字劳动力的代际跃迁

9月3日OpenAI发布GPT-6 Astra,使用超10万块GPU在得州Stargate基地训练,重点提升软件工程、科学推理与计算机操作能力。奥特曼首次明确将自研人形机器人。

2026-09-22 1
一周之内五家巨头轮番出手:9月的大模型市场,为什么突然卷成这样

一周之内五家巨头轮番出手:9月的大模型市场,为什么突然卷成这样

OpenAI、Anthropic、谷歌、Muse、DeepSeek、Kimi、阶跃星辰在9月上旬密集发布新模型,全球大模型迭代进入白热化。从旗舰到轻量,各家在推理、编程、智能体等赛道上贴身肉搏。

2026-09-20 9
GPT-6 Astra正式发布:把报税表填完、把数学难题解完,OpenAI这代旗舰冲着'干活'去的

GPT-6 Astra正式发布:把报税表填完、把数学难题解完,OpenAI这代旗舰冲着'干活'去的

9月4日凌晨,OpenAI发布新一代旗舰大模型GPT-6 Astra,号称迄今最智能、对齐程度最高的模型。它在数学、网络安全、计算机操作与自动化任务上实现代际跃升,能独立完成填税表、更新CRM、搭网站等复杂工作。

2026-09-20 8
9月大模型混战十天连发四款旗舰:GPT-6 Astra灰度放量,DeepSeek V4.1 Flash卷性价比

9月大模型混战十天连发四款旗舰:GPT-6 Astra灰度放量,DeepSeek V4.1 Flash卷性价比

9月1日至10日,Claude 5.1、Gemini 3.8 Flash、GPT-6 Astra与DeepSeek V4.1 Flash接连发布,大模型竞争从参数比拼转向Agent执行、语音交互与性价比的多维战场,开发者选型逻辑正在重写。

2026-09-12 30
72小时五款旗舰混战:GPT-6 Astra宣告AGI时代来临

72小时五款旗舰混战:GPT-6 Astra宣告AGI时代来临

9月初OpenAI发布GPT-6 Astra并宣告AGI时代来临,72小时内五家头部厂商密集迭代旗舰模型,编程与Agent能力成为竞争焦点;RSI递归自我改进机制登场,最强模型的保质期正以「周」为单位计算。

2026-09-06 49
2026大模型API价格剧烈分化:DeepSeek低价突围,行业从价格战转向智能战

2026大模型API价格剧烈分化:DeepSeek低价突围,行业从价格战转向智能战

2026年大模型API价格剧烈分化,DeepSeek低价突围、多家涨价,行业从价格战转向智能战与生态卡位。

2026-08-20 87
2026国产大模型诸神之战:Qwen3.8-Max开源、DeepSeek V4与Kimi K3如何重划Agent时代

2026国产大模型诸神之战:Qwen3.8-Max开源、DeepSeek V4与Kimi K3如何重划Agent时代

从聊天模型到智能体模型,2026年国产大模型在参数、开源与Agent能力三维全面突围,格局生变。

2026-08-15 163
万亿权重开源潮:Qwen3.8如何重划2026年大模型格局

万亿权重开源潮:Qwen3.8如何重划2026年大模型格局

2026年8月,国产大模型迎来密集发布窗口:DeepSeek V4-Pro正式版静默上线并强化Agent能力,阿里首次开放Qwen-Max级别权重推出总参数达2.4T的混合专家模型,此前Kimi K3已以三万亿级参数规模落地开源。海外方面,Grok新版本与谷歌轻量旗舰同期更新,价格战持续。过去万亿级MoE旗舰权重基本闭源锁死,中小团队与政企难以本地部署;如今顶级底座陆续开放,意味着全行业都能基于其做私有化二次开发。本文梳理这轮开源潮的技术特征、许可证变化与选型策略。

2026-08-14 92
开源双响炮:2026国产大模型集体突围

开源双响炮:2026国产大模型集体突围

2026年8月,DeepSeek V4 Pro正式上线、阿里首次开源Qwen3.8旗舰权重,国产大模型迎来开源双响炮。本文盘点Kimi K3、GLM-5.2等国产开源模型的密集迭代,分析开源模型如何以Agent能力与极致性价比挤压闭源阵营,并解读'小而精'端侧路线与开放权重博弈。

2026-08-13 95
英伟达发布Nemotron 3.5 Lightning:300亿参数开源MoE大模型,本地GPU即可运行

英伟达发布Nemotron 3.5 Lightning:300亿参数开源MoE大模型,本地GPU即可运行

英伟达近日发布开源大模型Nemotron 3.5 Lightning,采用300亿参数(30B)混合专家(MoE)架构,权重完全开放。该模型既能在配备英伟达显卡的本地设备直接运行,也可平滑扩展到数据中心与云端,将开源大模型的「本地部署加弹性扩展」能力推向新高度,对企业私有化AI与端侧智能具有重要参考价值。

2026-08-12 102