ToolNavs 发现实用AI工具
提交工具 登录
返回AI资讯
中国电信发布 Xing4.0-29B:单卡可跑的轻量 Agent 大模型

中国电信发布 Xing4.0-29B:单卡可跑的轻量 Agent 大模型

AI资讯 Admin 4 次浏览

2026 年 9 月 22 日,中国电信 AI(TeleAI)通过官方新闻稿发布 Xing4.0-29B-A4B,定位为下一代轻量 Agent 大模型。核心参数很直白:290 亿总参数、每 token 只激活 40 亿参数,采用 MoE 架构,上下文窗口 256K。官方强调,配合低比特量化与内存优化,该模型仅需 15GB 显存即可运行,一张消费级显卡就能本地部署。

参数之外:已经进生产环境的 Agent 模型

和很多停留在跑分阶段的发布不同,TeleAI 这次着重讲了落地。Xing4.0-29B-A4B 已接入中国电信集团级客服平台,用多步推理和工具调用处理复杂客户咨询;同时部署在「中屏」互动服务场景,为家庭服务环境提供实时助手。官方口径是,模型在这些真实业务里验证了首解率和处理效率的提升。

跑分方面,新闻稿给出的是 SWE-bench Verified 75.0 分,官方称在同参数量级中处于头部。功能上它对准的是「执行」而非「问答」:自主规划多步任务路径、调用外部工具、处理长上下文输入、输出结构化交付物,覆盖代码开发、数据分析、文档处理等工程场景。

开放生态:GitHub 与 Hugging Face 同步上架

模型已在 GitHub 与 Hugging Face(组织名 XingChen-AGI)同步发布,兼容主流训练、推理与 Agent 开发框架,并适配了多款国产与主流 AI 芯片平台。TeleAI 表示后续还会推出更大参数的 Xing4.0 系列模型。

怎么看:轻量 Agent 正在成为独立赛道

把 Xing4.0-29B 放进最近的行业坐标里看,趋势很清楚:就在同一周,小米发布了 MiMo-V2.6 全模态双版本,主打的同样是 Agent 执行层(小米发布 MiMo-V2.6 全模态双版本:把 Agent 执行层做极致 (/zh/article/2026-xiao-mi-fa-bu-mimo-v-2-6-quan-mo-tai-shuang-ban-ben-ba-agent-zhi-xing-ceng-zuo-j))。NVIDIA 的 Nemotron 3.5 Lightning 也是 30B 总参数、约 3B 激活的思路。各家不约而同地发现,Agent 的高频执行步骤不需要每次都唤醒全部参数,「小激活、大总参」正在成为标准答案。

TeleAI 的差异化不在参数,而在身份:运营商做模型,最大的牌是现成的生产场景。客服平台这种每天处理海量真实工单的环境,是实验室评测给不了的验证。当别家还在讲 benchmark 时,TeleAI 讲的是「已经在我们自己的业务里跑了一阵子」,这对考虑私有化部署的企业客户更有说服力。

对开发者和中小企业而言,最直接的价值是成本:一张消费级显卡、数据不出内网,就能跑起一个能读代码仓库、能调工具、能处理 256K 上下文的 Agent 底座。至于 75.0 的 SWE-bench 分数在实际工程里能兑现多少,还要看社区的真实评测。

推荐工具

更多