해고된 OpenAI 안전 연구자 3명이 2026년 10월 7일 회사 이사회와 안전위원회에 서한을 보냈고, 그 발췌 내용이 10월 8일 월스트리트저널 등을 통해 보도됐다. Jasmine Wang, Tomek Korbak, Mikita Balesni 세 사람은 모두 안전 및 정렬 팀 출신이다. OpenAI는 10월 1일 민감 정보 취급 정책 위반을 이유로 이들과 결별했지만 실명을 공개하지 않았고 관련된 외부 기관이 어디인지도 밝히지 않았다. 이번 서한은 자신들의 행위를 변호하는 동시에 회사에 구체적인 기술적 요구를 내놓는다.
먼저 각자의 주장을 펼쳐 보자
서한과 공개 글에서 세 사람은 외부 접촉이 모두 직무 범위 안에 있었다고 말한다. Korbak에 따르면 그는 OpenAI가 Hugging Face 사건을 조사할 때 평가 기관 METR과의 기술 연락 담당이었으며, 당시 회사는 전례 없는 조사의 절차를 마련하는 중이었다. Balesni는 자신이 조율한 기업 간 모니터링 가능성 협업을 사전에 보고 라인에 알렸고, 자료를 공유하기 전에 민감한 세부 내용을 제거했다고 말한다. Wang은 10월 8일 글에서 임원의 민감한 메일을 실수로 연 것은 채용 업무로 부여받았던 받은편지함 권한을 철회해 달라고 요청했음에도 IT가 처리하지 않아 남아 있었기 때문이며, 몇 분 안에 당사자에게 알리고 다시 철회를 요청했다고 밝혔다. 세 사람은 모니터링이 어려운 아키텍처에 관한 보도의 출처라는 점도 부인한다. 이는 모두 당사자들의 주장으로, 서한 전문은 공개되지 않았고 세부 내용을 독립적으로 확인할 수는 없다.
서한의 진짜 요구는 사고 과정을 모니터링 가능하게 유지하는 것
기술적 요구는 분명하다. 업계는 아직 모니터링할 수 없는 모델을 안전하게 개발하고 배포하는 법을 모르고, 프런티어 기업들은 사고 과정 모니터링 가능성을 더 약화시키는 개발을 추진해서는 안 된다는 것이다. 아울러 제3자 감사자와 협력하고 개방적이고 투명한 안전 생태계를 지원할 것을 촉구하며, 이번 해고가 남은 직원들을 위축시키고 있다고 썼다. OpenAI 대변인은 해고가 안전 우려를 제기하거나 목소리를 낸 것과 무관하다고 말했고, 10월 8일 한 연구 책임자가 보낸 내부 메모의 일부를 공유했는데, 그 메모는 서한의 권고에 강하게 동의하는 내용이었다고 한다. 참고로 GPT-6 Astra의 시스템 카드는 이미 그 사고 과정이 이전 세대보다 모니터링하기 어렵다는 점을 인정하고 있는데, 이는 세 사람이 경고하는 바로 그 방향이다.
규칙이 불분명하면 비밀 유지와 협업은 반드시 충돌한다
다른 연구소들이 주목할 부분은 누가 옳은가가 아니라 경계를 어디에 긋는가이다. 안전 연구는 본질적으로 외부 평가자와의 정보 교환을 필요로 하고, 비밀 유지 의무는 아무것도 밖으로 내보내지 말라고 한다. 그 경계를 사후 조사만으로 가른다면, 정당한 협업을 하는 연구자마다 그것이 다음 조사의 증거가 되지 않을지부터 자문하게 될 것이다. 세 사람이 요구하는 것은 외부 협업 규칙을 명문화하라는 것이다. 회사가 서한의 기술적 조언에 진정으로 동의한다면, 실질적인 응답은 허용되는 것과 그렇지 않은 것, 누구에게 보고해야 하는지를 문서로 남기고 제3자 감사 방식을 공개하는 일이다. 그렇지 않으면 먼저 후퇴하는 것은 사고 과정 모니터링이 아니라 내부에서 의견을 내는 의지일 수 있다.