小米 MiMo V3 发布了吗?最新消息、流出跑分与发布时间预期(2026年9月)封面图
AI 入门约 9 分钟

小米 MiMo V3 发布了吗?最新消息、流出跑分与发布时间预期(2026年9月)

AI 指南··0 浏览

小米 MiMo V3 发布了吗?最新消息、流出跑分与发布时间预期(2026年9月)

一句话结论:截至 2026 年 9 月 5 日,小米 MiMo V3 尚未正式发布。目前可以确认的是:V3 的"高稀疏"新架构已在 ICML 2026 公开预展示,一张疑似 MiMo-V3-Pro 的跑分截图在 8 月 21 日流出(SWE-Bench Pro 72.8,逼近 Claude Opus 5);社区普遍预期 V3 将延续"匿名测试、随后官宣"的节奏,最快可能在 9 月内亮相。

最后更新于 2026 年 9 月 5 日 | 作者:AI345 编辑部(AI 指南栏目,长期追踪国产大模型动态)

目录

  1. 小米 MiMo V3 发布了吗?现状速览
  2. 已确认的消息:ICML 公开的"高稀疏"架构
  3. MiMo-V3-Pro 流出跑分:离第一梯队还有多远
  4. Ox Alpha 与 Omen Alpha:两场匿名模型风波
  5. 为什么 MiMo V3 迟迟不发?
  6. MiMo V3 什么时候发布?时间预期
  7. MiMo V3 价格与定位预期
  8. 不用等 V3:现在就能用上的 MiMo 全家桶
  9. 常见问题 FAQ

小米 MiMo V3 发布了吗?现状速览

没有发布。 截至 2026 年 9 月 5 日,小米官方在售的最新 MiMo 大模型仍是 4 月发布的 MiMo-V2.5 系列(V2.5 与 V2.5-Pro,均已 MIT 协议开源)。

关于 V3,目前公开信息分三类,可信度依次递减:

信息 状态 时间
V3"高稀疏"架构预展示(ICML 2026 演讲) 团队自述,有会议记录 2026 年 7 月
MiMo-V3-Pro 跑分截图流出 未经小米确认 2026 年 8 月 21 日
匿名模型(Ox Alpha / Omen Alpha)身份猜测 社区推测,两派说法互相矛盾 2026 年 8 月至 9 月

一句话概括:V3 一代确实在推进中,但小米一颗螺丝钉都没往外拧。

已确认的消息:ICML 公开的"高稀疏"架构

可信度最高的一条消息来自学术会议。2026 年 7 月的 ICML 会议上,MiMo 团队负责人、前 DeepSeek 研究员罗福莉预先展示了 V3 的核心架构设计,官方称之为 High Sparse(高稀疏)

  • 少量"全注意力层"充当预言机(oracle):为数众多的稀疏层不自己判断该看哪些 token,而是由全注意力层"指点"。
  • KV 缓存共享:稀疏层不再单独保留 KV 缓存,与全注意力层共用一份。
  • 效果:按团队在会上给出的数据,KV 缓存内存占用可降到原来的约 十分之一;团队在约 800 亿参数规模的模型上验证了 11:1 的稀疏层与全注意力层比例,质量与全注意力方案持平,而对照的混合滑动窗口基线则损失了约 7 个 MMLU 分。

需要说明:以上数据来自团队会议演讲的自述,不是第三方独立评测。但对用户来说,这个设计指向的结果很明确:同样显存能塞下更长的上下文、更低的推理成本,这对 1M 上下文窗口的 MiMo 系列是实打实的利好。

MiMo-V3-Pro 流出跑分:离第一梯队还有多远

2026 年 8 月 21 日,自媒体"Max For AI"披露,一张疑似 MiMo-V3-Pro 的 Benchmark 截图在社群流传。据鉅亨网转引 BlockBeats 的报道,截图显示该模型重点瞄准 Coding Agent 和通用 Agent 场景:

小米 MiMo-V3-Pro 流出跑分与竞品对比图

基准 MiMo-V3-Pro(流出) GLM 5.3 Kimi K3 Claude Opus 5 GPT-5.6 Sol Max
SWE-Bench Pro 72.8 67.9 65.8 74.6 75.4
Terminal-Bench 2.0 70.6 - - 72.0 73.5
τ3-Bench 76.4 - - - 78.8

怎么读这张表:

  • 在国产模型里是断层领先:SWE-Bench Pro 比 GLM 5.3 高近 5 分、比 Kimi K3 高 7 分。GLM 5.3 是什么水平,可以看我们此前的 GLM-5.3 深度评测
  • 离海外旗舰一步之遥:与 Claude Opus 5、GPT-5.6 Sol Max 的差距在 3 分以内。
  • 但注意:截图真伪和测试条件均未获小米确认,数据只能当作"未证实的爆料"看待。历史上匿名跑分图与正式版表现有出入的先例并不少。

值得一提的是,V3 的架构方向(省 KV 缓存)与跑分方向(Agent 能力)是自洽的:更省的注意力机制意味着更长的自主任务链条,这正是 Agent 基准考的东西。

Ox Alpha 与 Omen Alpha:两场匿名模型风波

小米有一个业内有名的发布习惯:先以匿名代号上线聚合平台测试,正式认领后再官宣。上一代旗舰 MiMo-V2-Pro 就是以代号 Hunter Alpha 在 OpenRouter 匿名上线,7 天调用量破 1 万亿 token,一度被误认为 DeepSeek V4 的早期版本,随后才被小米认领。

正因如此,8 月以来两个匿名模型都被社区拿来和 MiMo V3 对号入座:

第一场:Ox Alpha(8 月下旬)

Ox Alpha 突袭 OpenRouter 后表现强劲,一度有传言称"性能超过 Fable 5",不少人猜测它就是悄然测试的 MiMo-V3-Pro。但后来社区拿出了更硬的证据(分词器匹配、视频编码取证),主流结论指向 Ox Alpha 是 GLM-5.3-Flash,我们在此前的GLM-5.3-Flash 解读里详细拆解过。

第二场:Omen Alpha(9 月 4 日)

OpenCode 面向 Go 订阅用户上线的隐身模型"Omen Alpha",被独立分析师 teortaxesTex 猜测是 MiMo-V3-Flash,理由包括:其思维链带着 DeepSeek V4 GA 时代标志性的语言习惯("hmm"、"fine"、✓ 开头的清单项)、速度符合 Flash 定位、小米 MiMo 的输出文本与 DeepSeek 高度聚类。也有开发者实测该模型在高推理设置下不到 10 分钟完成一项大型编码任务。

但同样是这个模型,主流解读反而指向智谱:后端请求解析在"zhipu"命名空间下,部分测试者称它自我标识为基于 GLM。

结论:两场认领都没有实锤,两个猜测不可能都对。 对普通用户来说,与其盯匿名模型,不如等小米官方在 Hugging Face 挂出权重和模型卡,参照 V2.5 的先例,那才是最可靠的确认信号。

为什么 MiMo V3 迟迟不发?

这是社区讨论热度最高的问题。知乎上"小米 mimo v3 系列迟迟不发,具体原因是什么?"一问浏览量近 18 万;另一个"如何评价小米 MiMo 3.0 模型?"更是被浏览近 70 万,86 个回答里大量用户"占坑等发布"。

对比之下确实显眼:过去几个月 DeepSeek 连发 V4 预览版和正式版,Qwen 更新到 3.8,GLM 迭代到 5.3,Kimi 推出 K3,各家都在赶发新版。高赞回答给出的解释主要有三类:

  1. 步子大了,在憋基座。有答主类比当年 Intel 的 10nm 困境:如果 V3 定的是全新基座加全新架构(比如上面的高稀疏设计),短期内达不到目标是可能的;直接在现有基座上出后训练版本两三个月就能发布,但小米可能选择了更难的路。
  2. 算力与路线的两难。有技术向答主分析,国内厂商普遍缺卡,前训练和后训练很难两头兼顾;而小米真正的落地场景(手机、汽车、家电上的小爱同学等)更需要高性价比小模型,这决定了 MiMo 必须把 Flash 档做扎实。
  3. 保密文化。多位答主提到小米内部保密要求严格,很少有人敢对外泄露进度,所以"没消息"未必是"没进展"。

也有答主泼冷水说节奏其实正常:从 V2.5 发布(4 月 22 日)到 8 月中旬才 116 天,DeepSeek 从 V3.2 到 V4 预览版用了 144 天。

MiMo V3 什么时候发布?时间预期

小米官方从未给出 V3 的发布时间,以下是社区可查的线索,仅供参考:

小米 MiMo 大版本发布时间线,V3 尚未官宣

  • 匿名测试可能已经开始。按照 Hunter Alpha(V2-Pro)的先例,官方发布前一周左右会有匿名模型上线。9 月初 Omen Alpha 的风波说明大家都在盯这个信号,只是这次的身份至今没有定论。
  • 9 月是社区押注的高发期。有知乎答主猜测小米可能在等"9 月大会师":新手机、新一代玄戒芯片、新系统、新大模型一起亮相。小米 18 Fold 的发布会已定档 9 月 7 日。
  • 算力侧已在备货。据媒体报道,金山云正加速 GPU 算力建设,小米百亿级预算已经落地;再加上雷军今年 3 月宣布的三年 600 亿元 AI 投入,供给端没有掉链子的迹象。

综合来看:如果 9 月内出现新的 OpenRouter 匿名模型,那大概率就是 V3 系列进入官宣倒计时的信号;若 9 月没有动静,则可能推迟到四季度。

MiMo V3 价格与定位预期

V3 尚未发布,没有官方定价。但结合现有产品线和社区呼声,可以做出两个有依据的预期:

预期一:V3-Flash 延续"量大管饱"

这是社区最一致的期待。8 月 DeepSeek V4 Flash 大幅涨价后(有用户反馈涨幅约 4 倍),"国产低价推理模型"出现了空档,知乎多个高赞回答都在喊话 MiMo 接棒,希望它达到 DeepSeek V4 Flash 早期水平即可,"重点是量大管饱,又快又稳定"。从商业逻辑看这个期待也合理:MiMo 系列要服务手机、车机、家电等无法直接收费的场景,性价比是刚需。

预期二:V3-Pro 冲第一梯队,定价可能分档

流出跑分显示 V3-Pro 直接对标 Claude Opus 5 和 GPT-5.6 Sol Max。社区中有声音建议 Pro 档走高定价树立品牌,通用档维持低价。作为参照,现役 V2.5-Pro 的 API 价格如下(见下一节),V3-Pro 大概率高于这个水平,但不至于望尘莫及。

小米 MiMo V2.5 系列 API 官方定价截图

不用等 V3:现在就能用上的 MiMo 全家桶

在 V3 到来之前,MiMo-V2.5 系列已经是一个相当完整的产品矩阵(以下价格均来自小米 MiMo 官网):

产品 定位 价格
MiMo-V2.5-Pro 万亿参数旗舰:1T 总参 / 42B 激活 / 1M 上下文,高强度 Agent 场景表现媲美 Claude Opus 4.6 输入 ¥3/百万 tokens(缓存命中 ¥0.025),输出 ¥6/百万 tokens
MiMo-V2.5-Pro-UltraSpeed 旗舰极速版内测:峰值 1000 tokens/s,FP4 混合量化 + DFlash 并行投机解码 内测申请制,输入 ¥9/百万 tokens,输出 ¥18/百万 tokens
MiMo-V2.5 原生全模态:图像、视频、音频、文本理解 + 1M 上下文 输入 ¥1/百万 tokens(缓存命中 ¥0.02),输出 ¥2/百万 tokens
MiMo-V2.5-TTS / ASR 语音合成 / 语音识别 TTS 限时免费;ASR ¥0.5/小时
MiMo Claw Agent 平台:任务规划、工具调用、自主执行 限时特惠 ¥14.9/月,每天 4 小时免费体验
MiMo Code / MiMo Studio 编程助手 / 零门槛对话 官网可免费用

几个上手建议:

  • 想先感受模型能力:直接用 MiMo Studio 网页对话,支持多模型切换。
  • 要接入自己的应用:MiMo API 兼容 OpenAI 与 Anthropic 协议,原有代码改个 base_url 就能跑;V2.5 系列已 MIT 开源,也可以下载权重自己部署(SGLang、vLLM 均有 Day-0 支持)。
  • 重度 Coding Agent 用户:V2.5-Pro 的长上下文和 UltraSpeed 的 1000 tokens/s 峰值速度值得一试,后者可在官网申请内测。

V3 发布后怎么第一时间用上? 关注三个渠道即可:小米 MiMo 官网的"动态"页、MiMo 的 GitHub 仓库(看 Hugging Face 权重和模型卡)、以及 OpenRouter 模型列表(匿名测试阶段的信号一般最早出现在这里)。我们也会在这篇文章持续更新。

总结

小米 MiMo V3 是当前国产大模型里"只闻楼梯响"的典型:架构已在顶会亮过相,流出跑分足以跻身第一梯队,社区期待值被两个匿名模型风波越拉越高,但官方至今按兵不动。对普通用户的建议很简单:

  • 急着用:V2.5 系列(尤其是 Pro 的长上下文 Agent 能力)现在就能商用,价格在万亿参数模型里属于地板价;
  • 不着急:把这篇文章收藏了,V3 官宣后我们会第一时间更新实测数据。

参考资料与来源

本文由 AI 指南编辑部基于公开信息整理,流出的跑分与匿名模型身份均为未经官方确认的爆料,请以小米官方发布为准。

常见问题

小米 MiMo V3 发布了吗?

答:截至 2026 年 9 月 5 日尚未发布。小米官方在售的最新版本仍是 MiMo-V2.5 系列(2026 年 4 月发布并开源)。V3 架构已在 ICML 2026 预展示,流出跑分显示 V3-Pro 逼近第一梯队,但小米未确认任何 V3 信息。

MiMo V3 什么时候发布?

答:官方没有给出时间。可参考的信号:小米有"匿名测试、随后官宣"的惯例(上一代 V2-Pro 就是如此);社区押注 9 月的"大会师"节点;算力侧的备货消息也在支撑近期发布的可能。建议盯紧 OpenRouter 匿名模型和 MiMo 官网动态。

流出跑分说 MiMo-V3-Pro 超过 GLM 5.3,可信吗?

答:截图显示 V3-Pro 在 SWE-Bench Pro 拿到 72.8 分,高于 GLM 5.3 的 67.9 分和 Kimi K3 的 65.8 分。但该截图由第三方自媒体流出,真伪与测试条件均未获小米确认,只能当作未证实的爆料看待。

MiMo V3 大概会是什么价格?

答:没有官方信息。社区普遍预期 Flash 档延续高性价比路线,填补 DeepSeek V4 Flash 涨价后的市场空档;Pro 档可能分档定价。可参照现役价格:V2.5 输入 ¥1、输出 ¥2 每百万 tokens,V2.5-Pro 输入 ¥3、输出 ¥6 每百万 tokens。

现在想用小米大模型,该用哪个?

答:轻量任务选 MiMo-V2.5(全模态,最便宜),重度 Agent 和编程任务选 MiMo-V2.5-Pro,追求极限速度可申请 UltraSpeed 内测。个人用户可以直接用 MiMo Studio 对话,或 14.9 元/月订阅 MiMo Claw 用 Agent。

MiMo V3 会开源吗?

答:大概率延续差异化策略:小参数量模型开源(V2-Flash、V2.5 系列都是 MIT 协议),旗舰档此前以 API 形式发布。V3-Flash 开源的可能性较高,V3-Pro 是否开源待官方表态。

评论 (0)

?
0/1

还没有评论,来发第一条吧

网站上的服务均为第三方提供,
请用户注意自行甄别。

北京酷讯互动科技有限公司

备案京ICP备2024094994号-29

© 2026 AI345 · All Rights Reserved

用户服务协议·隐私政策