开源 LongCat-Flash-Omni:128K 上下文 + 文本/图像/音频/视频到语音输出 一、摘要 LongCat-Flash-Omni 是美团 LongCat 团队开源的全模态(Omni-modal)模型,在 LongCat-Flash 的 ScMoE 架构上扩展了文本、图像、音频、视频的统一建模,参数总量约 560B、激活约 27B,重点面向毫秒级端到端语音对话、128K 上下文及 ... Ai开源 • Admin • 2025/11/1 132