产品简介
小米 MiMo 开放平台是小米 2026/3/18 推出的官方大模型 API 平台,统一承载 MiMo 系列全系模型。4/28 小米宣布旗舰大模型 MiMo-V2.5-Pro 与全模态 MiMo-V2.5 全系开源(MIT 协议),成为首个登顶全球开源大模型榜首的手机厂商。5/27 API 永久降价 99%(缓存命中输入),同步启动 100 万亿 Token 的 Orbit 激励计划。
近期进展密集:6/11 罗福莉团队开源终端编程 Agent「MiMo Code」(5 人 14 天开发,基于 OpenCode 二开,开源首日登顶 GitHub Trending,Star 数快速突破 9000+);6/9 联合 TileRT 推出 MiMo-V2.5-Pro-UltraSpeed,全球首个在万亿参数规模上跑出 1000+ tokens/s 解码速度的模型。6/30 旧版 MiMo-V2-Pro/Omni 下线,自动路由迁移至 MiMo-V2.5-Pro/Omni(沿用 V2.5 定价),MiMo-V2-TTS 同步路由至 V2.5-TTS。9/22 小米发布并开源 MiMo-V2.6 系列(Pro / Flash 双版本原生全模态,均支持 1M 上下文与文本、图像、视频、音频输入,MIT 许可开放),API 价格沿用 V2.5 系列,MiMo Desktop 桌面客户端与会员订阅同期上线。9/24 小米公布面向下一代 MiMo-V3 的核心架构 HySparse2,在 100 万 Token 长度下把预填充计算量降低 5.02 倍、KV 缓存缩小 4.5 倍;同期罗福莉公开直播 MiMo-V2.6 的强化学习后训练过程,持续 6 天。
核心功能
- 全系 MIT 协议开源:Pro/Omni/TTS/ASR 等 8 个模型在 Hugging Face 全量开放权重,支持商用和二次训练;9/22 发布的 MiMo-V2.6 系列 Pro 与 Flash 权重同样按 MIT 许可开放
- Token 效率 +42%:相比同级模型,相同输出所需 Token 数下降近半,Agent 任务成本直接砍半
- 首发适配 7 家国产芯片:覆盖几乎全部国产推理芯片平台,国产替代友好
- 纯浏览器架构:MiMo-V2.5 系列原生设计为浏览器可用,无需 App 绑定;9/22 同期上线 MiMo Desktop 桌面客户端与会员订阅
- 100 万亿 Token 激励计划:Orbit 计划免费给开发者发算力扶持创新
- MiMo Code 终端编程 Agent:6/11 开源,5人14天打造,基于OpenCode二开,配合MiMo-V2.5-Pro三项benchmark优于Claude Code+Sonnet 4.6
- UltraSpeed 极速推理:6/9 联合TileRT发布,万亿参数规模跑出1000+ tokens/s解码速度,全球首个此量级此速度的模型
- MiMo-V2.6 系列(新):9/22 发布并开源,Pro 为 1.02T 总参数 / 42B 激活的稀疏 MoE,Flash 为 309B 总参数 / 15B 激活,均支持 1M 上下文与文本、图像、视频、音频输入;Pro 在 Artificial Analysis 智能指数得 46 分,为开放权重最高,Code Arena WebDev 实测 1628 分
- HySparse2 架构(新):9/24 公布,面向下一代 MiMo-V3,在 100 万 Token 长度下把预填充计算量降低 5.02 倍、KV 缓存缩小 4.5 倍
适合谁用
以下类型的用户会特别受益于 小米 MiMo 开放平台:
- 需要长上下文 + 高性价比的 Agent 应用开发
- 国产化大模型替代(金融、政务、教育等行业)
- 搭配 Claude Code/OpenClaw 等第三方 Agent 框架做编程工作流
- 多模态应用(图/视/音/文统一处理)
优点亮点
- MIT 协议是市面最宽松的开源许可,商用零障碍
- API 永久降价 99% 后是全球最便宜的旗舰模型之一
- 国产芯片适配最完整,本地部署省心
- 雷军三年 600 亿 AI 投入承诺,长期可持续
- 9/22 开源 MiMo-V2.6 系列,Pro 在 Artificial Analysis 智能指数得 46 分,为开放权重最高
价格与方案
Pro ≤256K:输入 $1.00/M、输出 $3.00/M;Pro ≤1M:输入 $2.00/M、输出 $6.00/M。Omni ≤256K:输入 $0.40/M、输出 $2.00/M。TTS 限时免费。新用户注册送 ¥10 体验金,参与 Orbit 计划可获百万级 Token 配额。注:旧版 MiMo-V2-Pro/Omni 已于 6/30 下线,统一按 V2.5 系列定价路由;9/22 发布的 MiMo-V2.6 系列 API 价格沿用 V2.5 系列。
总结与建议
小米 MiMo 是 2026 年国产开源大模型阵营最值得关注的新势力——'登顶开源 + MIT 协议 + 永久降价 + 国产芯片适配'四件事一起做齐,定位非常清晰。6 月凭 MiMo Code(终端编程 Agent)和 UltraSpeed(1000+ tokens/s 极速推理)两次出圈,9/22 又发布并开源 MiMo-V2.6 系列(Pro / Flash 双版本原生全模态,1M 上下文,API 价格沿用 V2.5),9/24 进一步公布下一代 MiMo-V3 核心架构 HySparse2,持续夯实「性价比 + 极致工程」的差异化标签。适合预算敏感的 Agent 开发者、需要国产化方案的企业,以及想用编程旗舰但被 Claude Opus 价格劝退的团队。
版本演进
- 公布 MiMo-V3 核心架构 HySparse2 (2026-09-24):小米公布面向下一代 MiMo-V3 的核心架构 HySparse2,在 100 万 Token 长度下把预填充计算量降低 5.02 倍、KV 缓存缩小 4.5 倍。同期 MiMo 大模型负责人罗福莉公开直播 MiMo-V2.6 的强化学习后训练过程,持续 6 天,RL 后训练合计成本超 347 万美元,累计约 75 万条轨迹。
- 小米发布并开源 MiMo-V2.6 系列,Pro 与 Flash 双版本 (2026-09-22):小米正式发布并开源 Xiaomi MiMo-V2.6 系列,包含 Pro 与 Flash 两个原生全模态模型,官方称这是探索 RSI 递归自我改进路径的关键一步。Pro 为 1.02T 总参数 / 42B 激活的稀疏 MoE,Flash 为 309B 总参数 / 15B 激活,均支持 1M 上下文与文本、图像、视频、音频输入,权重按 MIT 许可开放。Pro 在 Artificial Analysis 智能指数得 46 分,为开放权重最高;Code Arena WebDev 实测 1628 分。训练采用异步 GRPO 大规模强化学习,不到 6 天完成,官方公布成本约 262 万美元与 85 万美元,并开放 7000 多个 RL 任务环境、训练框架与 Distill-Qwen-9B。API 价格沿用 V2.5 系列,MiMo Desktop 桌面客户端与会员订阅同期上线。
- MiMo-V2-Pro/Omni 下线,全量迁移 V2.5 (2026-06-30):旧版模型停止服务,自动路由至MiMo-V2.5-Pro/Omni(沿用V2.5定价),MiMo-V2-TTS同步路由至V2.5-TTS
- MiMo Code 开源 (2026-06-11):罗福莉团队5人14天打造终端编程Agent,基于OpenCode二开,开源首日登顶GitHub Trending,Star数快速突破9000+
- MiMo-V2.5-Pro-UltraSpeed (2026-06-09):联合TileRT发布,全球首个万亿参数规模跑出1000+ tokens/s解码速度的模型