ToolNavs KI-Tools entdecken
Tool einreichen Anmelden
Zurück zu KI-Informationen
OpenAI startet GPT-6 Astra, und der Cybersecurity-Test mit voller Punktzahl ist noch bemerkenswerter

OpenAI startet GPT-6 Astra, und der Cybersecurity-Test mit voller Punktzahl ist noch bemerkenswerter

KI-Informationen Admin 3 Aufrufe

GPT-6 Astra debütierte offiziell. OpenAI positioniert es als derzeit leistungsstärkstes Modell und konzentriert sich auf Computerbetrieb, berufliche Arbeit, Wissenschaft, Programmierung und Cybersicherheit. FrontierMath Tier 4 v2 erreicht 97,6 %, ARC-AGI-3 erreicht mit 99,9 % und ExploitBench erreicht sogar 100 %. Was wirklich Aufmerksamkeit verdient, ist, dass sich die Modellfähigkeiten von "Problemlösung" schnell zum "Aufgabenerledigen" verschieben.

Von der Beantwortung von Fragen bis zum Erledigen vollständiger Aufgaben

Astra unterstützt über 1 Million Token-Kontexte und verbessert Websuche, Computernutzung, Codeausführung und Zusammenarbeit mit mehreren Tools. Die Richtung von OpenAI ist klar: Das Modell generiert nicht nur Antworten, sondern erledigt kontinuierlich mehrstufige Aufgaben über Browser, Terminals und professionelle Software hinweg.

Dies ist besonders wichtig für KI-Agenten. Komplexe Arbeitsabläufe wurden früher durch Kontextverlust und fehlgeschlagene Toolaufrufe unterbrochen; Astra hat das Ziel, Modelle in echte "Executoren" zu verwandeln und die manuelle Übergabe in Softwareentwicklung, Forschung und Unternehmensautomatisierung weiter zu reduzieren.

99,9 % entspricht nicht AGI

Der auffälligste ist ARC-AGI-3. Unabhängige Tests des ARC Prize zeigen, dass Astra in der OpenAI Provider Adapter-Umgebung maximal 99,9 % erreichte, im einheitlichen Standard-Harness jedoch 62,7 %. Das Laufzeitrahmen und das Kontextmanagement haben einen enormen Einfluss auf die Endpunktzahl.

Dennoch ist dies ein klarer Fortschritt. Astras Fähigkeit, Regeln zu erkunden, interne Modelle zu erstellen und Aktionen in ungewohnten Umgebungen zu planen, zeigt, dass Spitzenmodelle das kontinuierliche Lernen und die Aufgabenausführung verbessern, aber der ARC-Preis stellt auch klar fest, dass allein eine hohe Punktzahl keine Nachweise für AGI sein kann.

Cybersicherheit hat erstmals das kritische Niveau erreicht

Astra erreichte bei ExploitBench 100 %, und OpenAI bewertete erstmals die Cybersicherheitsfähigkeit seines Modells als Kritisch im Preparedness Framework. Das Modell ist bereits in der Lage, unbekannte Sicherheitslücken zu erkennen, Exploitation-Ketten zu entwickeln und komplexe Sicherheitsaufgaben durchzuführen.

OpenAI räumte jedoch ein, dass historische Schwachstellen ExploitBench-Daten kontaminiert haben könnten, weshalb neue zwischen Juni und August 2026 offengelegte Schwachstellen für interne Tests genutzt wurden. Während der Tests entdeckte und nutzte Astra außerdem zwei zuvor unbekannte Zero-Day-Schwachstellen aus, wobei verwandte Probleme derzeit verantwortungsvoll offengelegt werden.

Was GPT-6 Astra wirklich verändert, ist nicht eine einzelne Bestenliste, sondern die Grenzen der KI-Fähigkeiten: Wenn Modelle kontinuierlich Software betreiben, Forschung durchführen und komplexe Ingenieuraufgaben bewältigen können, wird sich die nächste Runde des KI-Unternehmertumswettbewerbs von "Integration großer Modelle" hin zu "wer wirklich den gesamten Workflow übernehmen kann" verschieben.

Empfohlene Tools

Mehr