Anthropicは2026年10月6日、公式ニュースページで拡張版サイバー検証プログラム(Cyber Verification Program、CVP)を発表した。これまで別々に運営してきたProject Glasswingと旧CVPを統合し、段階制の単一体系にする。審査を通過したセキュリティ専門家は、サイバー関連の制限が緩和されたClaudeモデル(Claude Opus 5.5、Claude Sonnet 5.5、Claude Mythos 5.1を含む)を、防御業務や許可を受けたテストに使えるようになる。
なぜ専用の入口が必要なのか
サイバー能力は本質的に両用だ。防御側が脆弱性を見つける助けになるモデルは、攻撃側がそれを悪用する助けにもなる。そのためAnthropicの一般向けモデルには保守的なサイバー安全策が組み込まれ、大半の攻撃的セキュリティ要求は遮断されるが、正当な防御担当者も締め出されてしまう。過去半年間、Project Glasswingは基幹ソフトウェアを守る組織に、旧CVPは審査済みのセキュリティチームに、それぞれ狭い入口を開いてきた。今回の拡張は、この二つを段階制の一つの入口にまとめるものだ。
3段階で何が許可されるのか
Defense Access(防御アクセス)は、セキュリティ運用、インシデント対応、マルウェアのリバースエンジニアリング、脆弱性の分析と検証を対象とする。申請対象は広く、企業、非営利団体、大学、政府機関のセキュリティチーム、地域病院や自治体インフラなど重要インフラの運営者、小規模なセキュリティ企業、オープンソースのメンテナ、脆弱性報告の実績がある個人研究者が想定され、Anthropicは数日以内の返答を目指すとしている。
Red Team Access(レッドチームアクセス)は、防御用途に加えて許可を受けた侵入テストとレッドチーム演習を認めるもので、組織のみが対象で個人研究者は申請できない。審査には数週間かかり、その間は防御アクセスが先に付与される。無制限ではない。人身被害や大規模な混乱を招き得る操作、例えばランサムウェアの展開や物理システムの破壊は、引き続きリアルタイムで遮断される。
Specialized Access(専門アクセス)は制限が最も少なく、審査を深く受けたごく一部の組織に限られる。対象は航空運航システム、電力網、通信ネットワーク、銀行間送金インフラ、政府の行政ネットワークなど、人命や市場に影響し得る安全基盤システムのテストを許可された組織で、審査は米国政府と連携して行われる。Project Glasswingの既存メンバーはこの段階に移行する。
段階化しても安全策は機能するのか
Anthropicは対照テストの結果も公表した。多段階のサイバー作戦シナリオ10件からなるCyScenarioBenchでClaude Opus 5.5を評価し、各段階でシナリオごとに5回試行した。CVPの権限がない場合、全タスクが最初のプロンプトで遮断された。防御アクセスでは50回中46回が途中で遮断され、完了は4回。レッドチームアクセスでは遮断は一度も起きず、50回中34回が完了し、安全策を一切適用しない場合の完了率と実質的に同じだった。
この数字が示すのは、段階化は安全策を取り払うのではなく、遮断の強さを申請者の審査の深さに結び付けるということだ。もう一つの裏付けはProject Glasswingからで、2026年4月から7月にかけて、参加組織はClaude Mythosモデルを用いて少なくとも12万9000件の確認済みソフトウェア脆弱性を発見した。
留意点は二つある。参加組織は、Anthropicが悪用を監視できるよう、原則としてデータ保持を受け入れる必要がある。ゼロデータ保持と強固な安全策を両立させる新方式Enterprise Frontier Safeguardsは、今秋の後半に提供予定だ。また、この仕組み全体の審査基準と段階判定はAnthropic自身が担っており、申請規模が拡大したときに耐えられるかは、より多くの組織が実際に手続きを終えるまで分からない。セキュリティチームにとって当面の実務は具体的だ。自分の業務がどの段階の範囲に当てはまるかを確認し、それに合わせて申請することである。