ToolNavs 便利なAIツールを発見
ツール投稿 ログイン
戻るAI情報
OpenAIはGPT-6 Astraを発表し、満点サイバーセキュリティテストはさらに注目に値します

OpenAIはGPT-6 Astraを発表し、満点サイバーセキュリティテストはさらに注目に値します

AI情報 Admin 3 回閲覧

GPT-6 Astraが正式に登場しました。OpenAIは、コンピュータ運用、専門業務、科学、プログラミング、サイバーセキュリティに焦点を当て、現在最も強力なモデルとして位置づけています。FrontierMath Tier 4 v2は97.6%、ARC-AGI-3は99.9%のピーク、ExploitBenchは100%のスコアを記録しています。本当に注目すべきは、モデルの能力が「問題解決」から「タスク完了」へとシフトしていることです。

質問への回答からタスクの完了まで

Astraは100万以上のトークンコンテキストをサポートし、ウェブ検索、コンピュータ利用、コード実行、マルチツール連携を強化します。OpenAIの方向性は明確です。モデルは単に回答を生成するだけでなく、ブラウザ、端末、プロフェッショナルソフトウェアを横断して多段階のタスクを継続的に完成させます。

これは特にAIエージェントにとって重要です。複雑なワークフローはかつてコンテキストの喪失やツール呼び出しの失敗によって中断されていましたが、Astraはモデルを真の「実行者」に変え、ソフトウェア開発、研究、エンタープライズ自動化における手動の引き継ぎをさらに削減することを目指しています。

99.9%はAGIとは等しくありません

最も目を引くのはARC-AGI-3です。ARCプライズの独立テストによると、AstraはOpenAIプロバイダーアダプター環境で最大99.9%に達しましたが、統一標準ハーネスでは62.7%に達しました。ランタイムフレームワークとコンテキスト管理は最終スコアに大きな影響を与えます。

それでも、これは明確な飛躍です。Astraがルールを探求し、内部モデルを構築し、慣れない環境で行動を計画する能力は、最先端のモデルが継続的な学習とタスク実行を強化していることを示していますが、ARC賞は高得点だけではAGI達成を証明できないことを明確に示しています。

サイバーセキュリティは初めてクリティカルレベルに達しました

AstraはExploitBenchで100%を獲得し、OpenAIは初めて自社モデルのサイバーセキュリティ能力を準備フレームワークで「重要」と評価しました。このモデルはすでに未知の脆弱性の発見、エクスプロイテーションチェーンの開発、複雑なセキュリティタスクの実行が可能です。

しかし、OpenAIは過去の脆弱性がExploitBenchのデータを汚染した可能性があることを認め、2026年6月から8月にかけて公開された新たな脆弱性を内部テストに使用しました。テスト中、Astraはこれまで知られていなかった2つのゼロデイ脆弱性を発見し悪用し、関連問題は現在責任を持って開示されています。

GPT-6 Astraが本当に変えるのは単一のリーダーボードではなく、AI能力の境界です。モデルが継続的にソフトウェアを操作し、研究を行い、複雑なエンジニアリング作業をこなせるようになると、次のAI起業競争は「大規模モデルの統合」から「誰が真にワークフロー全体を支配できるか」へと移行するでしょう。

おすすめツール

もっと見る