小米 MiMo-V2.5 系列将下线:调用将先自动切至 V2.6,随后旧模型名称失效
据 IT之家 10 月 9 日消息,小米今日发布 MiMo-V2.5-Pro、MiMo-V2.5 模型下线通知。来源显示,随着 MiMo V2.6 系列全面上线并稳定运行,小米建议开发者尽快迁移至推理能力更强、性价比更高的新模型。按照安排,MiMo-V2.5-Pro 将替换为 mimo-v2.6-pro,MiMo-V2.5 将替换为 mimo-v2.6-flash。此次调整对已接入 MiMo API 的应用、自动化流程和 AI 工具开发者影响较直接:短期内请求会被自动转发到新版本模型,随后旧模型名称将失效。
下线节奏:先自动切换,再停止旧名称调用
根据小米发布的通知,此次 MiMo-V2.5 系列下线并非立即关停,而是分为两个阶段进行。第一阶段为自动切换,第二阶段为旧模型正式失效。这种安排给开发者预留了迁移和测试窗口,但也意味着依赖旧模型名称的服务不能长期保持不变。
- 2026 年 10 月 14 日 18:00(UTC+8):待下线模型将自动切换为新版本模型。调用 MiMo-V2.5-Pro、MiMo-V2.5 的请求会被自动转发至对应的 V2.6 模型,并按照新版模型计价。
- 2026 年 10 月 21 日 10:00(UTC+8):旧模型下线,旧版本模型名称失效。届时继续调用旧模型名称的请求将收到报错,开发者需要在此之前完成模型替换并做好验证。
具体替换关系为:mimo-v2.5-pro 对应替换为 mimo-v2.6-pro,mimo-v2.5 对应替换为 mimo-v2.6-flash。对于企业内部系统、插件、智能客服、内容生成、数据处理脚本等场景,模型名称通常写入配置文件、环境变量或服务端代码中。如果仅依赖第一阶段的自动转发,而不主动改配置,第二阶段到来后可能出现调用失败。
V2.6 系列:Pro 与 Flash 两个原生全模态模型
IT之家注意到,小米已在 9 月 22 日凌晨正式发布并开源 Xiaomi MiMo-V2.6 系列。该系列包含 Pro 与 Flash 两个版本,并被描述为原生全模态模型。从产品定位看,Pro 更适合对复杂推理、综合能力要求更高的任务,Flash 则更偏向速度、成本与高频调用场景。
这次旧模型下线与 V2.6 全面上线之间关系明确:小米正在推动用户从 V2.5 迁移到 V2.6,以降低版本维护成本,同时让外部开发者集中使用更新一代模型能力。对于模型服务平台而言,旧版本长期并存会增加兼容、计费、监控和质量保障压力;而统一到新版本后,平台可以更快迭代能力,也便于开发者围绕稳定接口构建应用。
来源摘要还提到,MiMo-V2.6 系列沿用 V2.5 系列 API 定价:Flash 为每百万词元输入 1 元、每百万词元输出 2 元;Pro 为每百万词元输入 3 元、每百万词元输出 6 元,并提供 99% 缓存折扣。小米方面还强调,在同等智能水平下,其价格仅为海外模型的 1/20 至 1/60。对于需要大规模调用模型的开发者来说,价格稳定与缓存折扣可能是迁移意愿的重要因素。
影响与解读:模型迁移正在成为 AI 应用运维常态
从中文 AI 生态角度看,小米此次 MiMo-V2.5 系列下线提醒开发者:大模型 API 不再是“一次接入、长期不动”的基础设施。模型版本更新、价格策略调整、接口名称变化、能力边界变化,都可能影响上层应用的稳定性。尤其是当模型被用于生产环境时,迁移不仅是修改模型名称,还应包括提示词回归测试、响应格式检查、成本评估和异常兜底。
对已接入 MiMo-V2.5 系列的团队,建议重点检查几类风险:首先是模型名是否硬编码在代码中;其次是业务是否依赖旧模型的特定输出风格;第三是自动切换后计费是否符合预算预期;第四是 10 月 21 日后是否存在未更新的边缘服务、定时任务或测试环境。
在产业层面,小米持续推进 MiMo 系列开源与商业 API,也显示出手机与 IoT 厂商向 AI 基础能力层延伸的趋势。与只做终端 AI 功能不同,模型 API 和开源模型能够连接开发者生态,进一步服务智能硬件、办公效率、自动化工具和企业应用。随着国内模型厂商竞争加剧,更强推理能力、更低调用成本和更清晰的迁移路径,将成为吸引开发者的重要指标。
总体来看,此次通知的核心并不是单纯“旧模型下线”,而是小米将 MiMo 系列开发者生态向 V2.6 版本集中。对于开发者而言,最稳妥的做法是在自动转发阶段完成替换与验证,避免等到旧模型名称失效后才被动处理生产故障。