ToolNavs Outils IA à découvrir
Proposer Connexion
Retour à Informations sur l’IA
Des chercheurs licenciés d'OpenAI écrivent au conseil : la surveillance de la chaîne de pensée ne doit pas reculer

Des chercheurs licenciés d'OpenAI écrivent au conseil : la surveillance de la chaîne de pensée ne doit pas reculer

Informations sur l’IA • Admin • • 11 vues

Trois chercheurs en sécurité licenciés par OpenAI ont adressé le 7 octobre 2026 une lettre au conseil d'administration et aux comités de sécurité de l'entreprise, dont des extraits ont été rapportés le 8 octobre par le Wall Street Journal et d'autres médias. Jasmine Wang, Tomek Korbak et Mikita Balesni travaillaient tous dans les équipes de sécurité et d'alignement. OpenAI s'est séparé d'eux le 1er octobre pour violation de ses règles sur le traitement des informations sensibles, sans les nommer publiquement ni identifier l'organisation externe concernée. Leur lettre fait deux choses à la fois : défendre leur conduite et formuler une demande technique précise.

Ce que dit chaque partie

Dans la lettre et dans des messages publics, les trois chercheurs affirment que leurs contacts extérieurs relevaient de leurs fonctions. Korbak indique avoir été l'interlocuteur technique de l'organisme d'évaluation METR pendant l'enquête d'OpenAI sur l'incident Hugging Face, alors que l'entreprise définissait encore les procédures d'une investigation sans précédent. Balesni dit que le travail interentreprises sur la monitorabilité qu'il coordonnait avait été signalé à sa hiérarchie et que les détails sensibles avaient été retirés avant tout partage. Wang, dans un fil publié le 8 octobre, explique avoir ouvert par erreur un e-mail sensible d'un dirigeant à cause d'un accès à une boîte de réception accordé pour du recrutement, dont elle avait demandé la révocation sans que le service informatique la traite ; elle dit avoir alerté le dirigeant en quelques minutes et renouvelé sa demande. Les trois nient aussi être la source d'une fuite sur des architectures moins monitorables. Ce sont leurs propres récits ; la lettre complète n'a pas été publiée et les détails ne peuvent pas être vérifiés de manière indépendante.

La vraie demande : garder la chaîne de pensée monitorable

La demande technique de la lettre est claire : l'industrie ne sait pas encore développer et déployer en sécurité des modèles qu'elle ne peut pas surveiller, et les entreprises de pointe ne devraient pas poursuivre des développements qui affaiblissent encore la monitorabilité de la chaîne de pensée. La lettre demande aussi à OpenAI de travailler avec des auditeurs tiers et de soutenir un écosystème de sécurité ouvert et transparent, et affirme que ces licenciements glacent ceux qui restent. Un porte-parole d'OpenAI a déclaré que les départs n'étaient pas liés au fait de soulever des inquiétudes de sécurité ou de s'exprimer, et a partagé un extrait d'une note interne envoyée le 8 octobre par un responsable de recherche, qui approuvait fortement les recommandations de la lettre. Fait notable : la fiche système de GPT-6 Astra reconnaît déjà que sa chaîne de pensée est plus difficile à surveiller que celle de son prédécesseur — exactement la direction que dénoncent les trois chercheurs.

Quand les règles ne sont pas écrites, secret et collaboration se heurtent

Ce que les autres laboratoires devraient retenir ne concerne pas qui a raison, mais où passe la frontière. La recherche en sécurité exige par nature d'échanger des informations avec des évaluateurs externes, tandis que les obligations de confidentialité interdisent toute sortie d'information. Si la ligne n'est tracée qu'après coup, par des enquêtes, chaque chercheur engagé dans une collaboration légitime se demandera d'abord si elle pourra servir de pièce à charge lors de la prochaine. Les trois demandent que les règles sur le travail externe soient écrites. Si l'entreprise approuve réellement les conseils techniques de la lettre, la réponse concrète consiste à publier ce qui est permis, ce qui ne l'est pas et qui l'autorise — et à préciser ses dispositifs d'audit tiers. À défaut, ce qui risque de reculer en premier n'est pas la surveillance de la chaîne de pensée, mais la volonté des employés de signaler des problèmes.

Outils Recommandés

Plus