美团 LongCat
560B 总参数只激活 27B,每天再送十万免费 token——LongCat 把门槛压在成本上。ScMoE 与异步 RL 是它的两条主线,模型从文本一路铺到图像、语音和视频。
560B 总参数只激活 27B,每天再送十万免费 token——LongCat 把门槛压在成本上。ScMoE 与异步 RL 是它的两条主线,模型从文本一路铺到图像、语音和视频。
一、摘要 LongCat-Next 是美团 LongCat 团队开源的离散原生自回归多模态模型,目标是在同一框架中统一处理文本、视觉与音频。项目采用 MoE 架构,总参数约 68.5B、激活参数约 3B,强调“看、画、说”在单一离散 token 空间内协同完成,面向工业级多模态场景提供理解、生成和交...
美团LongCat团队发布并上架“LongCat-Flash-Thinking-2601”,定位为面向“深度与通用代理式思考”的版本,主打在Agentic Search、Agentic Tool Use与工具整合推理等任务上的高分表现,并宣称在随机复杂任务中具备更强泛化能力。该版本已提供网页端试用与...
一、摘要 LongCat-Video-Avatar 是基于 LongCat-Video 架构打造的音频驱动 Avatar(虚拟人)视频生成模型,面向“长时序、强一致性、写实动态”场景。它将音频与文本(可选参考图)作为条件,原生支持 Audio-Text-to-Video(AT2V)、Audio-Te...
一、摘要 LongCat-Image 是美团 LongCat 团队开源的中英双语图像生成与编辑模型,参数约 6B,采用混合 DiT 架构,在多项公开基准上可比肩甚至超过部分 20B 级别开源模型。项目重点提升多语言文本渲染、图像一致性和写实效果,并兼顾推理速度与显存占用,适合研究与业务落地。 二、核...
一、摘要 LongCat-Flash-Omni 是美团 LongCat 团队开源的全模态(Omni-modal)模型,在 LongCat-Flash 的 ScMoE 架构上扩展了文本、图像、音频、视频的统一建模,参数总量约 560B、激活约 27B,重点面向毫秒级端到端语音对话、128K 上下文及 ...
LongCat-Flash-Thinking把AI与MoE、异步RL和Agent原生工具结合,在Logic、Math、Coding、Agent任务对齐SOTA;AIME25以更少Token达成高准确,适合企业用低成本获得高质量推理与稳定落地。 一、为什么它值得现在部署 1、架构亮点:MoE动态激活(...
LongCat API Platform 上线:开发者每日领取 100,000 免费 tokens 开头简述:LongCat API Platform 已正式上线,面向开发者每日赠送 100,000 免费 tokens,支持 OpenAI API 与 Anthropic API 双格式兼容。对于 A...
LongCat-Flash-Chat重磅发布:560B参数大模型开启AI推理百TPS新时代 美团团队推出的LongCat-Flash-Chat以560B总参数、动态激活18.6B-31.3B为核心亮点,结合20T训练数据与100+ token/s的推理速度,在TerminalBench与τ²-Ben...