小米 MiMo
总参数 309B、激活 15B,小米 MiMo 用 MoE 把成本压下来,又把上下文拉到 1M。7B 推理序列练起家,V2-Flash、V2-Pro、Omni、TTS 铺到 Agent 全栈,V2.5 以 MIT 开源。
总参数 309B、激活 15B,小米 MiMo 用 MoE 把成本压下来,又把上下文拉到 1M。7B 推理序列练起家,V2-Flash、V2-Pro、Omni、TTS 铺到 Agent 全栈,V2.5 以 MIT 开源。
2026年9月22日,小米通过 MiMo 官方 X 账号与微信公众号同步宣布 MiMo-V2.6 系列,包含 MiMo-V2.6-Pro 与 MiMo-V2.6-Flash 两个版本。这次更新最值得关注的不是参数数字,而是小米把多模态从“看懂图片”的能力展示,变成了 Agent 执行任务的底座——编...
一、摘要 Xiaomi MiMo-V2.5 系列已正式开源,采用 MIT License,权重与模型卡发布在 Hugging Face。该系列包含 MiMo-V2.5 与 MiMo-V2.5-Pro,均面向 1M-token 长上下文场景。MiMo-V2.5 偏原生多模态,覆盖文本、图像、视频与音频...
小米MiMo团队上线MiMo-V2-Pro、MiMo-V2-Omni与MiMo-V2-TTS,定位为面向Agent时代的全栈模型家族。现有官方信息可确认,MiMo-V2-Pro已开放API,主打复杂任务编排、代码与长上下文场景;团队相关表述同时提到,后续有开源计划,但需待模型稳定后推进。 已公开资料...
一、性能结论 小米 MiMo 系列中,MiMo-V2-Flash 走“高效能密度”路线:MoE 架构 309B 总参数、约 15B 激活参数。其模型卡显示在多项通用与推理基准上表现强势,代码与 Agent 相关评测尤为突出。 二、速度与成本 官方介绍其采用混合注意力、多词元预测等设计以降低推理开销,...
一、基本信息 Xiaomi MiMo模型是小米团队推出的通用智能基座相关模型与服务体系,围绕语言模型能力构建,并面向网页交互与开发者接入提供可用形态。Xiaomi MiMo模型覆盖不同规模与不同训练阶段的模型版本,既包含以推理任务为目标的稠密模型序列,也包含面向高效率推理与智能体工作流的混合专家模型...