返回AI资讯
Qwen3.8-Max发布:2.4万亿参数,开放权重下周到来

Qwen3.8-Max发布:2.4万亿参数,开放权重下周到来

AI资讯 Admin 6 次浏览

2026年8月3日,Qwen 团队在 Qwen 官方博客发布 Qwen3.8-Max,并将其定位为当前家族中能力最强的模型。模型已经可通过 QwenCloud 调用,但官方计划下周才在 Hugging Face 与 ModelScope 发布开放权重,尚不能把它写成权重已经可下载。

规模变大,计算并非全量激活

Qwen3.8-Max 延续 Qwen3.5 的架构基础,总参数达到 2.4 万亿,每次推理激活 950 亿参数。模型保留更大的知识与能力容量,同时只调度部分专家参与计算,可参考站内的混合专家模型说明。不过,950 亿激活参数仍意味着不低的推理负担;显存需求、量化方案、许可条款和本地部署成本,要等权重与模型卡公开后才能判断。

重点从回答代码转向完成项目

官方把编码、真实工作、研究、长程任务和多模态智能体列为主要升级方向。演示包括持续十多天构建并自我迭代一个工程项目,以及约 125 小时完成论文复现和改进。后者累计编写约 7600 行代码、执行超过 1100 次操作并进行 33 轮 GPU 训练。与早期的Qwen3.6-Max-Preview相比,重点从单次编程能力推进到多日自主执行和反馈闭环。

榜单成绩需要放回测试条件

Qwen 公布的结果显示,Qwen3.8-Max 在 PaperBench、OSWorld-Verified、WideSearch 等项目上表现突出,但表格同时包含公开基准与内部基准,不同模型还可能使用不同代理框架、上下文长度和运行时限。这些数字适合判断能力方向,不宜直接当作统一环境下的绝对排名。更有价值的验证将来自开放权重后的第三方复测,以及真实代码库中的成功率、恢复能力与单位任务成本。

开发者现在可以做什么

QwenCloud 已支持兼容 OpenAI 规范的 Chat Completions、Responses 接口以及兼容 Anthropic 的接口。模型提供 xhigh、medium、low 三档 reasoning_effort,默认使用 xhigh,并默认保留思考状态。现阶段适合用固定任务集测试延迟、价格、工具调用稳定性和长任务中断恢复;需要私有化部署或二次训练的团队,则应等下周核对权重文件、许可证和硬件要求。Qwen3.8-Max 的真正分水岭,不是 2.4 万亿这个数字本身,而是开放版本能否把云端演示中的长程可靠性带到可复现环境。

推荐工具

更多