阿里通义发布QwQ-32B:强化学习驱动推理升级,32B参数逼近更大模型表现 阿里通义发布了 QwQ-32B,重点强调通过强化学习进一步提升推理表现。和单纯堆参数规模不同,这次更新的核心看点,是用 320 亿参数模型在复杂推理任务上逼近更大体量模型的效果,让“更轻量但更会思考”的路线更清晰。 从产品意义看,QwQ-32B 不是只服务实验室演示,而是更适合被拿来做推理型问答、复... AI资讯 • Admin • 2026/3/8 87