Qwen a annoncé la mise à niveau de Qwen3-Coder et le lancement de l'interface qwen3-coder-plus dans Alibaba Cloud Model Studio. Cette nouvelle version améliore les fonctionnalités des tâches terminales pour les applications d'ingénierie pratiques (notamment grâce à des métriques Terminal Bench améliorées), atteignant un score SWE-Bench public de 69,6 . Elle introduit également des mécanismes de génération de code et de contraintes plus sécurisés. Les responsables affirment que ce modèle est compatible avec les workflows Qwen Code et Claude Code, ce qui le rend adapté à des scénarios tels que la remédiation à long terme, la revue de code et la collaboration entre outils.
Parallèlement, Qwen Code a ajouté la multimodalité et des sous-agents , permettant la saisie d' images (telles que des captures d'écran et des messages d'erreur) lors de la collaboration. Les sous-agents effectuent ensuite la récupération, la modification et les tests, améliorant ainsi l'efficacité de la boucle fermée entre fichiers et chaînes d'outils. La documentation de l'API et les pages de modèles ont été mises à jour, et les développeurs peuvent les activer et les intégrer dans la console à l'aide d'exemples.
Questions fréquemment posées
Q : Quelle est la différence entre qwen3-coder-plus et les versions précédentes ?
R : Il est plus performant dans les tâches terminales et les processus longs, dispose d'indicateurs SWE-Bench améliorés et a ajouté des politiques de sécurité et de conformité plus strictes.
Q : Peut-il être utilisé avec Claude Code et Qwen Code ?
R : Oui. Le modèle est conçu pour l'encodage proxy et prend en charge l'intégration avec les appels de terminal/outil.
Q : À quoi sert la multimodalité de Qwen Code ?
R : Vous pouvez télécharger directement des captures d'écran ou des images d'interface et les associer à des descriptions textuelles pour localiser le problème. Les sous-agents se répartiront le travail pour effectuer les modifications et les tests.
Q : Où s'appelle qwen3-coder-plus ?
R : Ouvrez la page du modèle dans Alibaba Cloud Model Studio et accédez-y selon l'exemple d'API ; les tests en ligne et la visualisation de l'utilisation sont pris en charge.
Q : Comment comprenez-vous le score SWE-Bench de 69,6 ?
R : Il s'agit de l'une des valeurs les plus élevées lors des évaluations publiques, reflétant la capacité globale du produit à effectuer des tâches de réparation concrètes. Les paramètres spécifiques sont soumis à l'évaluation et à la documentation.