MiMo-V2
聚焦小米 MiMo 的 V2 模型线,逐项对照 Flash、Pro、Omni、TTS 与 V2.5 在参数规模、上下文长度与多模态能力上的差别。
MiMo-V2 是小米 MiMo 的 V2 系列模型线,覆盖 Flash、Pro、Omni 与 TTS 等多个分支。开源版 V2-Flash 用 309B 总参数、15B 激活参数的稀疏结构,在 256K 上下文下压低推理成本;V2-Pro 与 V2.5 把窗口推到 1M,并强化复杂任务编排、代码工程与多模态理解。
聚焦小米 MiMo 的 V2 模型线,逐项对照 Flash、Pro、Omni、TTS 与 V2.5 在参数规模、上下文长度与多模态能力上的差别。
一、摘要 Xiaomi MiMo-V2.5 系列已正式开源,采用 MIT License,权重与模型卡发布在 Hugging Face。该系列包含 MiMo-V2.5 与 MiMo-V2.5-Pro,均面向 1M-token 长上下文场景。MiMo-V2.5 偏原生多模态,覆盖文本、图像、视频与音频...
小米MiMo团队上线MiMo-V2-Pro、MiMo-V2-Omni与MiMo-V2-TTS,定位为面向Agent时代的全栈模型家族。现有官方信息可确认,MiMo-V2-Pro已开放API,主打复杂任务编排、代码与长上下文场景;团队相关表述同时提到,后续有开源计划,但需待模型稳定后推进。 已公开资料...
一、摘要 MiMo-V2-Flash 是小米 MiMo 团队开源的混合专家(MoE)大语言模型,总参数约 309B、推理时激活参数约 15B,主打在较低推理成本下兼顾推理、编程与智能体(Agent)工作流。它强调长上下文能力(最高 256K)与推理效率之间的平衡,并提供可复现的技术报告、权重与推理部...
小米MiMo与小米大模型Core团队发布并开放MiMo-V2-Flash相关资源,定位为面向高速度推理与智能体工作流的基础语言模型,模型权重与推理部署资料同步提供给开发者与研究者使用。 该模型为Mixture-of-Experts(MoE)架构,总参数约309B、推理时激活约15B,并支持最高约25...