Retour à Informations sur l’IA
Qwen 3.8-Max publié : 2,4 trillions de paramètres, poids ouvert la semaine prochaine

Qwen 3.8-Max publié : 2,4 trillions de paramètres, poids ouvert la semaine prochaine

Informations sur l’IA Admin 6 vues

Le 3 août 2026, l’équipe Qwen a publié le Qwen 3.8-Max sur le blog officiel de Qwen, le positionnant comme le modèle le plus puissant de la famille actuelle. Le modèle est déjà accessible via QwenCloud, mais le plan officiel est de publier des poids ouverts sur Hugging Face et ModelScope la semaine prochaine, il ne peut donc pas encore être écrit sous la rubrique « Les poids sont téléchargeables ».

À mesure que l’échelle augmente, l’informatique n’est pas pleinement activée

Qwen3.8-Max poursuit la base architecturale de Qwen3.5, avec un total de 2,4 billions de paramètres et 95 milliards de paramètres activés par inférence. Le modèle conserve une plus grande capacité de connaissances et de capacités, tout en ne programmant que certains experts pour participer aux calculs. Veuillez consulter la description mixte du modèle expert du site. Cependant, 95 milliards de paramètres d’activation représentent encore un fardeau de raisonnement considérable ; Les exigences en mémoire, les schémas de quantification, les conditions de licence et les coûts de déploiement locaux doivent être reconnus publiquement avec le même poids et les cartes modèles avant jugement.

L’accent s’est déplacé du code répondant à la réalisation de projets

L’accent officiel est mis sur le codage, le travail réel, la recherche, les tâches à long terme et les agents multimodaux comme principales orientations d’amélioration. La démonstration comprenait plus de dix jours de construction et d’auto-itération d’un projet d’ingénierie, ainsi qu’environ 125 heures de reproduction et d’améliorations du papier. Ce dernier a écrit environ 7 600 lignes de code, effectué plus de 1 100 opérations et subi 33 cycles d’entraînement GPU. Comparé au Qwen 3.6-Max-Preview des débuts, l’accent se déplace des capacités de programmation en une seule exécution vers des boucles d’exécution autonomes et de rétroaction sur plusieurs jours.

Les résultats du classement doivent être retournés aux conditions de test

Les résultats publiés par Qwen montrent que Qwen 3.8-Max performe bien sur des projets tels que PaperBench, OSWorld-Verified et WideSearch, mais le tableau contient à la fois des benchmarks publics et internes, et différents modèles peuvent utiliser des cadres de proxy, des longueurs de contexte et des limites d’exécution différents. Ces chiffres sont adaptés pour juger les directions de capacité et ne doivent pas être considérés comme des classements absolus dans un environnement unifié. Des validations plus précieuses viendront des retests tiers après pondération ouverte, ainsi que du taux de réussite, de la capacité de récupération et du coût unitaire des tâches dans les bases de code réelles.

Ce que les développeurs peuvent faire maintenant

QwenCloud prend en charge les complications par chat, les interfaces Responses compatibles avec les spécifications OpenAI, ainsi que les interfaces compatibles avec Anthropic. Le modèle propose trois niveaux reasoning_effort : xhigh, moyen et low, avec xhigh utilisé par défaut et l’état de pensée conservé par défaut. À ce stade, il est approprié d’utiliser des ensembles de tâches fixes pour tester la latence, le prix, la stabilité des appels d’outils et la récupération après de longues interruptions de tâche ; Les équipes nécessitant un déploiement de privatisation ou une formation secondaire doivent attendre la semaine prochaine pour vérifier les documents de poids, les licences et les exigences matérielles. Le véritable tournant pour Qwen 3.8-Max n’est pas le chiffre de 2,4 trillions lui-même, mais la capacité de la version ouverte à apporter une fiabilité à longue portée des démonstrations cloud dans un environnement reproductible.

Outils Recommandés

Plus