产品简介
MiMo-V2.6-Pro-UltraSpeed 是小米 MiMo 在 9 月 22 日随 V2.6 系列一起上线的超高速服务档位。它跑的是和 V2.6-Pro 同一套检查点,总参数 1.0 万亿、激活 42B、100 万 token 上下文、文本图像视频音频输入,能力集完全一致,差别只在推理通道:官方给的口径是最高 20 倍输出速度,用单价换时间。
定价是这套方案里最清楚的一环。国内每百万 token 缓存命中 0.25 元、输入 30 元、输出 60 元,海外对应 0.036、4.35、8.7 美元,整体约为标准 Pro 的十倍。第三方报道里普遍写成约十倍速度对约十倍价格,官方那句最高 20 倍目前还没有独立测量背书。所以是否值得迁移,建议先拿自己的真实任务跑一遍延迟与质量,再决定把关口放在哪一段路径上。
入口有两个。开放平台在 V2.6-Pro 的接口下提供 UltraSpeed 选项,MiMo Desktop 则把这一档标在会员的高阶与尊享两级。批量推理通道覆盖 Pro 与 Flash 两档,UltraSpeed 按实时推理通道计费,缓存写入目前限时免费。
适用边界也由这些数字划出来:需要人机节奏对得上的强实时交互、把首字延迟当作产品指标的语音与对话类应用,以及已经用 V2.6-Pro 但响应时间成了瓶颈的生产工作流。长文写作、批量数据处理这类不赶时间的任务,留在标准档更划算。
核心功能
- 与标准档共用同一检查点:能力集与 V2.6-Pro 一致,迁移只需切换模型名,提示词、工具链与评测基线都不用重做。
- 官方口径最高 20 倍输出速度:面向强实时交互与对响应速度敏感的生产场景,第三方报道多写作约十倍实际速度,独立测量尚未出现。
- 万亿参数全模态底座:1.0T 总参数、42B 激活的稀疏 MoE,100 万 token 上下文,文本图像视频音频输入,输出为文本。
- 分层定价算得清:国内每百万 token 缓存命中 0.25 元、输入 30 元、输出 60 元,用十倍单价换速度,按任务分层选型的账很直接。
- 桌面端与开放平台同步可选:开放平台在 V2.6-Pro 接口下提供该选项,MiMo Desktop 会员的高阶与尊享两级标注专享。
- 实时通道独立计费:批量推理通道覆盖 Pro 与 Flash,UltraSpeed 走实时推理通道,缓存写入限时免费。
适合谁用
以下类型的用户会特别受益于 小米 MiMo-V2.6-Pro-UltraSpeed:
- 语音对话与实时口译这类要求逐字输出跟上人语速的产品
- IDE 内联补全、Agent 长链路执行等交互密集、等待感明显的场景
- 需要即时反馈的智能客服、直播辅助与游戏 NPC 对话
- 已用 V2.6-Pro 且响应时间成为瓶颈的生产工作流,按关键路径局部切换到高速档
优点亮点
- 与 V2.6-Pro 同一检查点,能力不折损,切换成本低
- 输出速度的提升对交互体验是量级上的改变
- 国内定价透明,十倍成本换速度,分层选型依据明确
- 开放平台与桌面端两个入口都能用,接入路径齐备
价格与方案
国内每百万 token 缓存命中 0.25 元、输入 30 元、输出 60 元;海外为 0.036、4.35、8.7 美元。批量推理通道覆盖 Pro 与 Flash 两档,UltraSpeed 走实时推理通道,缓存写入限时免费。MiMo Desktop 会员的高阶与尊享两档标注专享该模型,具体额度与价格以官方公示为准。
总结与建议
MiMo-V2.6-Pro-UltraSpeed 是小米为 V2.6-Pro 开的超高速服务档位,同一检查点、同一套全模态能力,靠推理通道把输出速度拉到官方口径的最高 20 倍,代价是十倍单价。它对交互体验的改善是实在的,同时也改变了成本结构,所以更适合用在关键路径上而不是全量替换。判断依据很简单:如果等待时间本身就在损害产品体验或开发效率,这一档值得试;如果任务不赶时间,标准 Pro 更划算。
版本演进
- MiMo-V2.6-Pro-UltraSpeed 随 V2.6 系列上线,官方口径最高 20 倍输出速度 (2026-09-22):小米随 MiMo-V2.6 系列上线 Pro 的超高速服务档位,与标准档共用 1.0T 总参数、42B 激活的检查点和 100 万 token 上下文,官方口径最高 20 倍输出速度。国内定价每百万 token 缓存命中 0.25 元、输入 30 元、输出 60 元,海外为 0.036、4.35、8.7 美元,约为标准档十倍,官方称相当于用十倍调用成本换取最高 20 倍输出速度。开放平台在 V2.6-Pro 接口下提供该选项,MiMo Desktop 会员高阶与尊享两档标注专享;批量推理通道覆盖 Pro 与 Flash 两档。