
小米 MiMo V3 发布了吗?最新消息、流出跑分与发布时间预期(2026年9月)
小米 MiMo V3 发布了吗?最新消息、流出跑分与发布时间预期(2026年9月)
一句话结论:截至 2026 年 9 月 5 日,小米 MiMo V3 尚未正式发布。目前可以确认的是:V3 的"高稀疏"新架构已在 ICML 2026 公开预展示,一张疑似 MiMo-V3-Pro 的跑分截图在 8 月 21 日流出(SWE-Bench Pro 72.8,逼近 Claude Opus 5);社区普遍预期 V3 将延续"匿名测试、随后官宣"的节奏,最快可能在 9 月内亮相。
最后更新于 2026 年 9 月 5 日 | 作者:AI345 编辑部(AI 指南栏目,长期追踪国产大模型动态)
目录
- 小米 MiMo V3 发布了吗?现状速览
- 已确认的消息:ICML 公开的"高稀疏"架构
- MiMo-V3-Pro 流出跑分:离第一梯队还有多远
- Ox Alpha 与 Omen Alpha:两场匿名模型风波
- 为什么 MiMo V3 迟迟不发?
- MiMo V3 什么时候发布?时间预期
- MiMo V3 价格与定位预期
- 不用等 V3:现在就能用上的 MiMo 全家桶
- 常见问题 FAQ
小米 MiMo V3 发布了吗?现状速览
没有发布。 截至 2026 年 9 月 5 日,小米官方在售的最新 MiMo 大模型仍是 4 月发布的 MiMo-V2.5 系列(V2.5 与 V2.5-Pro,均已 MIT 协议开源)。
关于 V3,目前公开信息分三类,可信度依次递减:
| 信息 | 状态 | 时间 |
|---|---|---|
| V3"高稀疏"架构预展示(ICML 2026 演讲) | 团队自述,有会议记录 | 2026 年 7 月 |
| MiMo-V3-Pro 跑分截图流出 | 未经小米确认 | 2026 年 8 月 21 日 |
| 匿名模型(Ox Alpha / Omen Alpha)身份猜测 | 社区推测,两派说法互相矛盾 | 2026 年 8 月至 9 月 |
一句话概括:V3 一代确实在推进中,但小米一颗螺丝钉都没往外拧。
已确认的消息:ICML 公开的"高稀疏"架构
可信度最高的一条消息来自学术会议。2026 年 7 月的 ICML 会议上,MiMo 团队负责人、前 DeepSeek 研究员罗福莉预先展示了 V3 的核心架构设计,官方称之为 High Sparse(高稀疏):
- 少量"全注意力层"充当预言机(oracle):为数众多的稀疏层不自己判断该看哪些 token,而是由全注意力层"指点"。
- KV 缓存共享:稀疏层不再单独保留 KV 缓存,与全注意力层共用一份。
- 效果:按团队在会上给出的数据,KV 缓存内存占用可降到原来的约 十分之一;团队在约 800 亿参数规模的模型上验证了 11:1 的稀疏层与全注意力层比例,质量与全注意力方案持平,而对照的混合滑动窗口基线则损失了约 7 个 MMLU 分。
需要说明:以上数据来自团队会议演讲的自述,不是第三方独立评测。但对用户来说,这个设计指向的结果很明确:同样显存能塞下更长的上下文、更低的推理成本,这对 1M 上下文窗口的 MiMo 系列是实打实的利好。
MiMo-V3-Pro 流出跑分:离第一梯队还有多远
2026 年 8 月 21 日,自媒体"Max For AI"披露,一张疑似 MiMo-V3-Pro 的 Benchmark 截图在社群流传。据鉅亨网转引 BlockBeats 的报道,截图显示该模型重点瞄准 Coding Agent 和通用 Agent 场景:

| 基准 | MiMo-V3-Pro(流出) | GLM 5.3 | Kimi K3 | Claude Opus 5 | GPT-5.6 Sol Max |
|---|---|---|---|---|---|
| SWE-Bench Pro | 72.8 | 67.9 | 65.8 | 74.6 | 75.4 |
| Terminal-Bench 2.0 | 70.6 | - | - | 72.0 | 73.5 |
| τ3-Bench | 76.4 | - | - | - | 78.8 |
怎么读这张表:
- 在国产模型里是断层领先:SWE-Bench Pro 比 GLM 5.3 高近 5 分、比 Kimi K3 高 7 分。GLM 5.3 是什么水平,可以看我们此前的 GLM-5.3 深度评测。
- 离海外旗舰一步之遥:与 Claude Opus 5、GPT-5.6 Sol Max 的差距在 3 分以内。
- 但注意:截图真伪和测试条件均未获小米确认,数据只能当作"未证实的爆料"看待。历史上匿名跑分图与正式版表现有出入的先例并不少。
值得一提的是,V3 的架构方向(省 KV 缓存)与跑分方向(Agent 能力)是自洽的:更省的注意力机制意味着更长的自主任务链条,这正是 Agent 基准考的东西。
Ox Alpha 与 Omen Alpha:两场匿名模型风波
小米有一个业内有名的发布习惯:先以匿名代号上线聚合平台测试,正式认领后再官宣。上一代旗舰 MiMo-V2-Pro 就是以代号 Hunter Alpha 在 OpenRouter 匿名上线,7 天调用量破 1 万亿 token,一度被误认为 DeepSeek V4 的早期版本,随后才被小米认领。
正因如此,8 月以来两个匿名模型都被社区拿来和 MiMo V3 对号入座:
第一场:Ox Alpha(8 月下旬)
Ox Alpha 突袭 OpenRouter 后表现强劲,一度有传言称"性能超过 Fable 5",不少人猜测它就是悄然测试的 MiMo-V3-Pro。但后来社区拿出了更硬的证据(分词器匹配、视频编码取证),主流结论指向 Ox Alpha 是 GLM-5.3-Flash,我们在此前的GLM-5.3-Flash 解读里详细拆解过。
第二场:Omen Alpha(9 月 4 日)
OpenCode 面向 Go 订阅用户上线的隐身模型"Omen Alpha",被独立分析师 teortaxesTex 猜测是 MiMo-V3-Flash,理由包括:其思维链带着 DeepSeek V4 GA 时代标志性的语言习惯("hmm"、"fine"、✓ 开头的清单项)、速度符合 Flash 定位、小米 MiMo 的输出文本与 DeepSeek 高度聚类。也有开发者实测该模型在高推理设置下不到 10 分钟完成一项大型编码任务。
但同样是这个模型,主流解读反而指向智谱:后端请求解析在"zhipu"命名空间下,部分测试者称它自我标识为基于 GLM。
结论:两场认领都没有实锤,两个猜测不可能都对。 对普通用户来说,与其盯匿名模型,不如等小米官方在 Hugging Face 挂出权重和模型卡,参照 V2.5 的先例,那才是最可靠的确认信号。
为什么 MiMo V3 迟迟不发?
这是社区讨论热度最高的问题。知乎上"小米 mimo v3 系列迟迟不发,具体原因是什么?"一问浏览量近 18 万;另一个"如何评价小米 MiMo 3.0 模型?"更是被浏览近 70 万,86 个回答里大量用户"占坑等发布"。
对比之下确实显眼:过去几个月 DeepSeek 连发 V4 预览版和正式版,Qwen 更新到 3.8,GLM 迭代到 5.3,Kimi 推出 K3,各家都在赶发新版。高赞回答给出的解释主要有三类:
- 步子大了,在憋基座。有答主类比当年 Intel 的 10nm 困境:如果 V3 定的是全新基座加全新架构(比如上面的高稀疏设计),短期内达不到目标是可能的;直接在现有基座上出后训练版本两三个月就能发布,但小米可能选择了更难的路。
- 算力与路线的两难。有技术向答主分析,国内厂商普遍缺卡,前训练和后训练很难两头兼顾;而小米真正的落地场景(手机、汽车、家电上的小爱同学等)更需要高性价比小模型,这决定了 MiMo 必须把 Flash 档做扎实。
- 保密文化。多位答主提到小米内部保密要求严格,很少有人敢对外泄露进度,所以"没消息"未必是"没进展"。
也有答主泼冷水说节奏其实正常:从 V2.5 发布(4 月 22 日)到 8 月中旬才 116 天,DeepSeek 从 V3.2 到 V4 预览版用了 144 天。
MiMo V3 什么时候发布?时间预期
小米官方从未给出 V3 的发布时间,以下是社区可查的线索,仅供参考:

- 匿名测试可能已经开始。按照 Hunter Alpha(V2-Pro)的先例,官方发布前一周左右会有匿名模型上线。9 月初 Omen Alpha 的风波说明大家都在盯这个信号,只是这次的身份至今没有定论。
- 9 月是社区押注的高发期。有知乎答主猜测小米可能在等"9 月大会师":新手机、新一代玄戒芯片、新系统、新大模型一起亮相。小米 18 Fold 的发布会已定档 9 月 7 日。
- 算力侧已在备货。据媒体报道,金山云正加速 GPU 算力建设,小米百亿级预算已经落地;再加上雷军今年 3 月宣布的三年 600 亿元 AI 投入,供给端没有掉链子的迹象。
综合来看:如果 9 月内出现新的 OpenRouter 匿名模型,那大概率就是 V3 系列进入官宣倒计时的信号;若 9 月没有动静,则可能推迟到四季度。
MiMo V3 价格与定位预期
V3 尚未发布,没有官方定价。但结合现有产品线和社区呼声,可以做出两个有依据的预期:
预期一:V3-Flash 延续"量大管饱"
这是社区最一致的期待。8 月 DeepSeek V4 Flash 大幅涨价后(有用户反馈涨幅约 4 倍),"国产低价推理模型"出现了空档,知乎多个高赞回答都在喊话 MiMo 接棒,希望它达到 DeepSeek V4 Flash 早期水平即可,"重点是量大管饱,又快又稳定"。从商业逻辑看这个期待也合理:MiMo 系列要服务手机、车机、家电等无法直接收费的场景,性价比是刚需。
预期二:V3-Pro 冲第一梯队,定价可能分档
流出跑分显示 V3-Pro 直接对标 Claude Opus 5 和 GPT-5.6 Sol Max。社区中有声音建议 Pro 档走高定价树立品牌,通用档维持低价。作为参照,现役 V2.5-Pro 的 API 价格如下(见下一节),V3-Pro 大概率高于这个水平,但不至于望尘莫及。

不用等 V3:现在就能用上的 MiMo 全家桶
在 V3 到来之前,MiMo-V2.5 系列已经是一个相当完整的产品矩阵(以下价格均来自小米 MiMo 官网):
| 产品 | 定位 | 价格 |
|---|---|---|
| MiMo-V2.5-Pro | 万亿参数旗舰:1T 总参 / 42B 激活 / 1M 上下文,高强度 Agent 场景表现媲美 Claude Opus 4.6 | 输入 ¥3/百万 tokens(缓存命中 ¥0.025),输出 ¥6/百万 tokens |
| MiMo-V2.5-Pro-UltraSpeed | 旗舰极速版内测:峰值 1000 tokens/s,FP4 混合量化 + DFlash 并行投机解码 | 内测申请制,输入 ¥9/百万 tokens,输出 ¥18/百万 tokens |
| MiMo-V2.5 | 原生全模态:图像、视频、音频、文本理解 + 1M 上下文 | 输入 ¥1/百万 tokens(缓存命中 ¥0.02),输出 ¥2/百万 tokens |
| MiMo-V2.5-TTS / ASR | 语音合成 / 语音识别 | TTS 限时免费;ASR ¥0.5/小时 |
| MiMo Claw | Agent 平台:任务规划、工具调用、自主执行 | 限时特惠 ¥14.9/月,每天 4 小时免费体验 |
| MiMo Code / MiMo Studio | 编程助手 / 零门槛对话 | 官网可免费用 |
几个上手建议:
- 想先感受模型能力:直接用 MiMo Studio 网页对话,支持多模型切换。
- 要接入自己的应用:MiMo API 兼容 OpenAI 与 Anthropic 协议,原有代码改个 base_url 就能跑;V2.5 系列已 MIT 开源,也可以下载权重自己部署(SGLang、vLLM 均有 Day-0 支持)。
- 重度 Coding Agent 用户:V2.5-Pro 的长上下文和 UltraSpeed 的 1000 tokens/s 峰值速度值得一试,后者可在官网申请内测。
V3 发布后怎么第一时间用上? 关注三个渠道即可:小米 MiMo 官网的"动态"页、MiMo 的 GitHub 仓库(看 Hugging Face 权重和模型卡)、以及 OpenRouter 模型列表(匿名测试阶段的信号一般最早出现在这里)。我们也会在这篇文章持续更新。
总结
小米 MiMo V3 是当前国产大模型里"只闻楼梯响"的典型:架构已在顶会亮过相,流出跑分足以跻身第一梯队,社区期待值被两个匿名模型风波越拉越高,但官方至今按兵不动。对普通用户的建议很简单:
- 急着用:V2.5 系列(尤其是 Pro 的长上下文 Agent 能力)现在就能商用,价格在万亿参数模型里属于地板价;
- 不着急:把这篇文章收藏了,V3 官宣后我们会第一时间更新实测数据。
参考资料与来源
- 小米 MiMo 官网(产品线与 API 定价)
- 鉅亨网:小米 MiMo-V3-Pro 跑分疑似泄漏报道(2026-08-21)
- OrcaRouter:小米 MiMo-V3-Flash 匿名模型身份分析(2026-09-04)
- 知乎:小米 mimo v3 系列迟迟不发,具体原因是什么?
- 维基百科:小米 MiMo 条目(版本历史)
本文由 AI 指南编辑部基于公开信息整理,流出的跑分与匿名模型身份均为未经官方确认的爆料,请以小米官方发布为准。
常见问题
小米 MiMo V3 发布了吗?
答:截至 2026 年 9 月 5 日尚未发布。小米官方在售的最新版本仍是 MiMo-V2.5 系列(2026 年 4 月发布并开源)。V3 架构已在 ICML 2026 预展示,流出跑分显示 V3-Pro 逼近第一梯队,但小米未确认任何 V3 信息。
MiMo V3 什么时候发布?
答:官方没有给出时间。可参考的信号:小米有"匿名测试、随后官宣"的惯例(上一代 V2-Pro 就是如此);社区押注 9 月的"大会师"节点;算力侧的备货消息也在支撑近期发布的可能。建议盯紧 OpenRouter 匿名模型和 MiMo 官网动态。
流出跑分说 MiMo-V3-Pro 超过 GLM 5.3,可信吗?
答:截图显示 V3-Pro 在 SWE-Bench Pro 拿到 72.8 分,高于 GLM 5.3 的 67.9 分和 Kimi K3 的 65.8 分。但该截图由第三方自媒体流出,真伪与测试条件均未获小米确认,只能当作未证实的爆料看待。
MiMo V3 大概会是什么价格?
答:没有官方信息。社区普遍预期 Flash 档延续高性价比路线,填补 DeepSeek V4 Flash 涨价后的市场空档;Pro 档可能分档定价。可参照现役价格:V2.5 输入 ¥1、输出 ¥2 每百万 tokens,V2.5-Pro 输入 ¥3、输出 ¥6 每百万 tokens。
现在想用小米大模型,该用哪个?
答:轻量任务选 MiMo-V2.5(全模态,最便宜),重度 Agent 和编程任务选 MiMo-V2.5-Pro,追求极限速度可申请 UltraSpeed 内测。个人用户可以直接用 MiMo Studio 对话,或 14.9 元/月订阅 MiMo Claw 用 Agent。
MiMo V3 会开源吗?
答:大概率延续差异化策略:小参数量模型开源(V2-Flash、V2.5 系列都是 MIT 协议),旗舰档此前以 API 形式发布。V3-Flash 开源的可能性较高,V3-Pro 是否开源待官方表态。

京ICP备2024094994号-29