产品简介
MiMo-V2.6-Flash 是 MiMo-V2.6 系列里的效率档,与 Pro 同批发布、同批开源。架构同样是稀疏 MoE,总参数 309B、每次推理激活 15B,上下文窗口 100 万 token,文本、图像、视频、音频四类输入进同一个模型,权重按 MIT 许可开放。
两者共用一套训练配方。官方说这一轮 RL 把编码、通用 Agent、视觉、网络安全等任务混在一起做大规模扩展,Flash 跑了 30 步、约 75 万条轨迹,不到 6 天完成,公布的 RL 成本约 85 万美元。官方自报的长程软件工程 DeepSWE v1.1 成绩从 48.8 提升到 65.7,桌面操作 OSWorld-Verified 80.8,自动化基准 AutomationBench 52.3,均为厂商口径。
对开发者更直接的是价格:输入 1 元、输出 2 元每百万 token,缓存命中 0.02 元,同样沿用 V2.5 系列那一档没涨。适合承接高频、低成本的执行调用,把预算留给需要长链条推理的任务。
核心功能
- 效率档配置:309B 总参数、15B 激活的稀疏 MoE,把单次推理成本压下来,同时保留 1M 上下文。
- 原生全模态:文本、图像、视频、音频统一输入,与 Pro 共用同一套模态接入方式。
- 1M 上下文:长文档与长工具轨迹可以直接整段交给模型,减少切分带来的上下文断裂。
- 与 Pro 同批开源:MIT 许可权重、技术报告与 RL 任务环境一并开放,可自建部署。
- 低计费档:输入 1 元、输出 2 元每百万 token,缓存命中 0.02 元,适合高并发执行类调用。
- 共用 RL 配方:与 Pro 出自同一次大规模强化学习扩展,能力分布保持一致。
适合谁用
以下类型的用户会特别受益于 小米 MiMo-V2.6-Flash:
- 高频执行类 Agent 调用:工具调用、格式转换、批量文件处理
- 长文档处理:合同、报告、代码仓库的整段读取与结构化输出
- 多模态批处理:图片与音视频内容的分批理解与标注
- 预算敏感的自动化流水线:用低成本档承接主要调用量
优点亮点
- 15B 激活的稀疏 MoE 把单价压到输入 1 元档,适合承接大调用量
- 与 Pro 共用同一套训练配方和模态接入方式,切换档位改动小
- 同样是 MIT 许可开源权重,可自建部署
- 1M 上下文在效率档上保留下来,长任务不用降级处理
价格与方案
API 按 Token 计费,价格沿用 V2.5 系列:输入 1 元、输出 2 元每百万 token,缓存命中 0.02 元。权重按 MIT 许可开放。具体价格与配额以官方公示为准。
总结与建议
MiMo-V2.6-Flash 是 MiMo-V2.6 系列的效率档,309B 总参数、15B 激活的稀疏 MoE,保留 1M 上下文与文本、图像、视频、音频的原生输入,与 Pro 同批开源并采用同一套大规模强化学习配方。官方自报 DeepSWE v1.1 从 48.8 提升到 65.7、OSWorld-Verified 80.8、RL 成本约 85 万美元。价格沿用上一代,输入 1 元、输出 2 元每百万 token,适合承接高频执行类调用。
版本演进
- 小米发布 MiMo-V2.6-Flash,效率档承载高频执行调用 (2026-09-22):MiMo-V2.6-Flash 与 Pro 同批发布并开源,是同系列的原生全模态效率档:309B 总参数、15B 激活的稀疏 MoE,1M 上下文,MIT 许可权重。官方公布这一轮 RL 训练 30 步、约 75 万条轨迹、不到 6 天完成,成本约 85 万美元。官方自报长程软件工程 DeepSWE v1.1 从 48.8 提升到 65.7,桌面操作 OSWorld-Verified 80.8,自动化基准 AutomationBench 52.3。API 价格与前代持平,输入 1 元、输出 2 元每百万 token。