解雇されたOpenAIの安全研究者3名が2026年10月7日、同社の取締役会と安全委員会に書簡を送り、その抜粋が10月8日にウォール・ストリート・ジャーナルなどによって報じられた。3名はJasmine Wang、Tomek Korbak、Mikita Balesniで、いずれも安全とアライメントのチームに所属していた。OpenAIは10月1日、機密情報の取り扱いに関するポリシー違反を理由に3名と袂を分かったが、実名も関係した外部組織名も公表していない。今回の書簡は、自身の行為への弁明と、会社への具体的な技術的要求を同時に行うものだ。
まずは双方の言い分を並べる
書簡と公開投稿の中で3名は、外部との接触はすべて職務の範囲内だったと述べている。Korbakによれば、OpenAIがHugging Face事件を調査していた際、評価機関METRとの技術的な窓口を務めており、当時同社は前例のない調査の手順を模索している最中だった。Balesniは、自身が調整した企業横断の監視可能性に関する協働は事前に報告ラインへ共有し、資料共有前に機密部分を除去していたという。Wangは10月8日の投稿で、幹部の機密メールを誤って開いたのは、採用業務のために付与され、その後取り消しを申請したのにIT側で処理されなかった受信箱の権限が残っていたためだとし、数分以内に本人へ報告して再度取り消しを求めたと述べている。3名は、監視しにくいアーキテクチャに関する報道の情報源であることも否定している。これらはいずれも当事者側の主張であり、書簡全文は公開されておらず、詳細を独立に検証することはできない。
書簡の本当の要求は、思考の連鎖を監視可能に保つこと
技術面の要求は明確だ。監視できないモデルを安全に開発・展開する方法を業界はいまだ知らず、フロンティア企業は思考の連鎖の監視可能性をさらに弱める開発を進めるべきではない、というものだ。あわせて、第三者の監査者と協力し、開かれた透明な安全エコシステムを支えることも求め、今回の解雇が残った従業員を萎縮させていると書いている。OpenAIの広報担当者は、解雇は安全上の懸念提起や発言とは無関係だと述べ、10月8日に研究責任者が送った社内メモの一部を共有した。そのメモは書簡の提言に強く同意する内容だったという。なお、GPT-6 Astraのシステムカードはすでに、その思考の連鎖が前世代より監視しにくいことを認めており、まさに3名が懸念する方向だ。
ルールが曖昧なままでは、守秘と協働は必ず衝突する
他の研究機関が注目すべきは、どちらが正しいかではなく、境界線の引き方だ。安全研究は本質的に外部の評価者との情報交換を必要とし、一方の守秘義務は何も外に出すなと言う。その線引きを事後の調査だけで決めるなら、正当な協働をする研究者は皆、次の調査の材料にならないかをまず自問することになる。3名が求めるのは、外部協働のルールを明文化することだ。会社が書簡の技術的提言に本当に同意するなら、実務的な応答は、何ができて何ができないか、誰に申請するかを文書にし、第三者監査の枠組みを公表することだろう。さもなければ、先に後退するのは思考の連鎖の監視ではなく、内部で意見を言う意欲のほうかもしれない。