ToolNavs Outils IA à découvrir
Proposer Connexion
Retour à Informations sur l’IA
OpenAI lance GPT-6 Astra, et le test de cybersécurité à score maximal est encore plus remarquable

OpenAI lance GPT-6 Astra, et le test de cybersécurité à score maximal est encore plus remarquable

Informations sur l’IA Admin 3 vues

GPT-6 Astra a officiellement fait ses débuts. OpenAI le positionne actuellement comme le modèle le plus puissant, axé sur les opérations informatiques, le travail professionnel, la science, la programmation et la cybersécurité. FrontierMath Tier 4 v2 atteint 97,6 %, ARC-AGI-3 atteint un pic de 99,9 %, et ExploitBench atteint même 100 %. Ce qui mérite vraiment d’être souligné, c’est que les capacités du modèle passent rapidement de « résoudre des problèmes » à « accomplir des tâches ».

De répondre aux questions à accomplir des tâches complètes

Astra prend en compte plus d’un million de contextes de jetons et améliore la recherche web, l’utilisation de l’ordinateur, l’exécution du code et la collaboration multi-outils. La direction d’OpenAI est claire : le modèle ne se contente pas de générer des réponses, mais accomplit en continu des tâches en plusieurs étapes à travers navigateurs, terminaux et logiciels professionnels.

C’est particulièrement crucial pour les agents IA. Les flux de travail complexes étaient auparavant interrompus par la perte de contexte et des appels d’outils défaillants ; Astra vise à transformer les modèles en véritables « exécuteurs » », réduisant encore le transfert manuel dans le développement logiciel, la recherche et l’automatisation d’entreprise.

99,9 % ne correspond pas à une AGI

Le plus remarquable est ARC-AGI-3. Les tests indépendants du prix ARC montrent qu’Astra a atteint un maximum de 99,9 % dans l’environnement OpenAI Provider Adapter mais 62,7 % dans le harnais Standard unifié. Le cadre d’exécution et la gestion du contexte ont un impact considérable sur le score final.

Malgré tout, cela reste un bond en avant clair. La capacité d’Astra à explorer des règles, construire des modèles internes et planifier des actions dans des environnements inconnus montre que les modèles de pointe améliorent l’apprentissage continu et l’exécution des tâches, mais le prix ARC affirme également clairement qu’un score élevé seul ne peut pas prouver qu’une AGI a été atteinte.

La cybersécurité a atteint pour la première fois le niveau critique

Astra a obtenu un score de 100 % sur ExploitBench, et OpenAI a également évalué pour la première fois la capacité de cybersécurité de son modèle comme Critique dans le cadre de préparation. Le modèle est déjà capable de détecter des vulnérabilités inconnues, de développer des chaînes d’exploitation et d’exécuter des tâches de sécurité complexes.

Cependant, OpenAI a reconnu que des vulnérabilités historiques pouvaient avoir contaminé les données ExploitBench, il a donc utilisé de nouvelles vulnérabilités divulguées entre juin et août 2026 pour des tests internes. Lors des tests, Astra a également découvert et exploité deux vulnérabilités zero-day jusque-là inconnues, les problèmes connexes étant actuellement divulgués de manière responsable.

Ce que GPT-6 Astra change vraiment, ce n’est pas un seul classement, mais les limites des capacités de l’IA : lorsque les modèles peuvent fonctionner en continu des logiciels, mener des recherches et gérer des tâches d’ingénierie complexes, la prochaine phase de compétition entrepreneuriale en IA passera de « l’intégration de grands modèles » à « qui peut réellement prendre le contrôle de l’ensemble du flux de travail ».

Outils Recommandés

Plus