通义千问 Qwen
跟踪阿里通义千问 Qwen 系列的开源进展,看语言、多模态与编程模型在参数规模、上下文长度和部署成本上的取舍。
Qwen 是阿里通义千问的大模型系列,覆盖语言、多模态与编程方向,并以开放权重为主要策略。这里跟踪 Qwen3 到 Qwen3.8 的迭代,看旗舰模型、Qwen3-VL 多模态与 Qwen3-Coder 在参数规模、上下文长度和落地成本上的取舍。
跟踪阿里通义千问 Qwen 系列的开源进展,看语言、多模态与编程模型在参数规模、上下文长度和部署成本上的取舍。
2026年8月3日,Qwen 团队在 Qwen 官方博客发布 Qwen3.8-Max,并将其定位为当前家族中能力最强的模型。模型已经可通过 QwenCloud 调用,但官方计划下周才在 Hugging Face 与 ModelScope 发布开放权重,尚不能把它写成权重已经可下载。 规模变大,计算并...
一、摘要 Qwen3-Coder-Next 是 Qwen Team 发布的开源权重代码模型,面向 Coding Agent 与本地开发场景。其核心思路是“超稀疏 MoE + 代理式训练”:总参数量约 80B,但每 token 仅激活约 3B 参数,以更低推理成本支撑长时、多轮的工具使用与代码修改工作...
通义千问推出新一代视觉语言模型 Qwen3-VL ,旗舰 Qwen3-VL-235B-A22B 以开源形式提供 Instruct 与 Thinking 两个版本。官方材料显示,Instruct 在多项视觉基准上优于 Gemini 2.5 Pro,Thinking 在多模态推理任务取得领先成绩。模型支...