GLM-5.3 est officiellement disponible sur Amazon Bedrock. Le 6 octobre 2026, Z.ai, la marque de Zhipu, a annoncé l'arrivée de son modèle phare sur la plateforme d'AWS ; la documentation officielle d'AWS indique une date de lancement au 5 octobre et précise que l'accès est réservé aux clients éligibles. Selon le STAR Market Daily, AWS partagera avec Zhipu les revenus en fonction du volume d'appels : les revenus étrangers de Zhipu naîtront donc de chaque appel API plutôt que de ventes de licences ponctuelles.
Le modèle : 744 milliards de paramètres, pensé pour les agents de code
La page officielle d'AWS décrit GLM-5.3 comme le modèle texte phare à poids ouverts de Zhipu. Son architecture de type mixture-of-experts totalise 744 milliards de paramètres, dont environ 40 milliards activés par token, sur la même base que GLM-5.2, renforcée par un post-entraînement élargi. La fenêtre de contexte atteint un million de tokens, la sortie 128 000 tokens, et l'effort de raisonnement se règle par niveaux, pour arbitrer entre latence, consommation de tokens et qualité.
Les usages mis en avant ne laissent aucun doute sur la cible : codage agentique et ingénierie logicielle autonome, tâches en terminal et en ligne de commande, génération et refactorisation de code à l'échelle d'un dépôt, travaux d'ingénierie longs enchaînant de nombreux appels d'outils. Appels de fonctions, sorties JSON structurées et streaming — y compris du raisonnement — sont de la partie. Ce modèle ne vise pas la conversation légère, mais une place dans les chaînes de développement des entreprises.
Le partage de revenus, la vraie nouvelle
Voir un modèle référencé chez un grand cloud n'a rien d'inédit. La nouveauté est dans le partage de l'argent. Une rémunération à l'usage transforme l'éditeur de modèle en fournisseur sur l'étagère du cloud : le cloud apporte ses régions mondiales, sa conformité, ses relations avec les entreprises et sa facturation ; l'éditeur apporte la capacité et touche une part de l'usage. Selon le reportage, Zhipu a récemment conclu des accords similaires avec plusieurs clouds étrangers ; en Chine, la plateforme Bailian d'Alibaba Cloud a signé un partage comparable, et Huawei Cloud référence déjà GLM-5.3 avec un partenariat en préparation. Ce réseau de partages, domestique et international, remplace les négociations de licences au cas par cas.
Pour Zhipu, l'avantage est la légèreté : pas d'équipes commerciales dans chaque pays, et des revenus qui grandissent avec l'usage réel. La contrepartie : le pouvoir sur les prix et la relation client restent chez le cloud, et le taux de partage n'est pas public. Pour AWS, ajouter un modèle ouvert compétitif retient des clients d'entreprise tentés par les clouds rivaux.
Deux conditions avant de l'utiliser
D'abord, l'éligibilité. AWS indique clairement que GLM-5.3 est réservé aux clients éligibles, invités à contacter leur équipe de compte : on ne s'inscrit pas pour appeler le modèle aussitôt. Ensuite, la forme de déploiement : le modèle n'est proposé qu'en inférence inter-régions, via le profil géographique américain (us.zai.glm-5.3) ou le profil mondial (global.zai.glm-5.3), sans option à la demande dans une région. Pour les entreprises soumises à des règles strictes de résidence des données, la possibilité de requêtes transfrontalières doit être évaluée en amont — c'est une autre question que celle de la puissance du modèle.
À plus grande échelle, les modèles chinois à poids ouverts passent de l'ère des classements à celle des revenus sur les étagères mondiales du cloud. Les benchmarks décident de l'attention ; les canaux de partage décideront si la R&D se finance. Le succès de ce mouvement ne se mesurera pas au bruit du jour de lancement, mais à l'usage réel sur Bedrock dans les prochains trimestres.