ToolNavs Outils IA à découvrir
Proposer Connexion
Retour à Informations sur l’IA
GPT-6 Astra Ultrafast est lancé : génération de tokens jusqu'à 8 fois plus rapide

GPT-6 Astra Ultrafast est lancé : génération de tokens jusqu'à 8 fois plus rapide

Informations sur l’IA • Admin • • 5 vues

GPT-6 Astra Ultrafast a été officiellement lancé le 1er octobre 2026 : le même jour, le blog officiel de NVIDIA a publié « How NVIDIA GPUs Help Accelerate OpenAI's GPT-6 Astra Ultrafast », annonçant que cette nouvelle version exécutée sur des GPU NVIDIA Blackwell est disponible dès aujourd'hui pour les développeurs via l'API OpenAI, et que les utilisateurs éligibles de ChatGPT Work et de Codex y ont également accès en même temps. Par rapport à l'Astra standard, Ultrafast génère des tokens jusqu'à 8 fois plus vite — les boucles de codage tournent plus vite, les appels d'outils s'enchaînent plus fluidement et les applications interactives deviennent nettement plus réactives.

Ce qu'est Ultrafast

Ultrafast n'est pas un modèle entièrement nouveau, mais une variante haute vitesse de GPT-6 Astra, conçue pour Blackwell. Pas de nouvelle architecture à apprendre, pas de nouvelle interface — le même Astra, simplement bien plus rapide à générer.

D'où viennent ces 8 fois plus vite

Ce facteur 8 ne vient pas d'un empilement de matériel : il résulte de la combinaison de l'optimisation de l'inférence d'OpenAI et des capacités de l'architecture Blackwell. Philippe Tillet, responsable de l'inférence chez OpenAI, souligne que les investissements profonds de NVIDIA dans la chaîne d'outils et la documentation ont rendu les modèles d'OpenAI très doués pour écrire des kernels haute performance pour les GPU Blackwell et les futurs GPU Rubin — et qu'Astra Ultrafast transforme cette accélération en réponses tangiblement plus rapides lorsque les agents écrivent du code et appellent des outils. Uday Ruddarraju, CTO du calcul chez OpenAI, ajoute que l'équipe optimise en continu, avec ses propres modèles internes, le logiciel d'inférence exécuté sur les GPU NVIDIA, et que la programmabilité de la plateforme est la clé de cette accélération.

Qui en profite en premier

Les gains de vitesse profitent d'abord à trois types de scénarios : la boucle de codage « écrire du code — lancer les tests — corriger les bugs », où chaque étape attend la génération, si bien qu'une vitesse 8 fois supérieure fait tourner toute la boucle plus vite ; les tâches riches en appels d'outils, où moins d'attente de génération entre les appels maintient le rythme « réfléchir — agir — réfléchir à nouveau » de l'agent ; et les applications interactives sensibles à la latence, comme le chat ou la complétion de code, qui deviennent nettement plus réactives.

Ce que cela signifie pour les développeurs

Fait notable, cette accélération dépasse un simple coup de pouce ponctuel au lancement : OpenAI continue d'affiner son logiciel d'inférence sur GPU NVIDIA avec ses propres modèles, et la plateforme programmable permet de réutiliser la même infrastructure pour l'entraînement, l'inférence et l'apprentissage par renforcement, ce qui améliore l'utilisation — l'avantage de vitesse d'Ultrafast continuera donc probablement de croître avec l'évolution du logiciel. Les développeurs curieux de l'essayer peuvent consulter le guide Ultrafast dans la documentation développeur d'OpenAI, qui détaille l'accès, la tarification et les aspects de mise en œuvre.

Outils Recommandés

Plus