Trois anciens chercheurs en sécurité d’OpenAI ont demandé aux organes de supervision de l’entreprise de préserver les travaux indépendants en sécurité et de préciser comment les employés peuvent partager des informations avec des évaluateurs externes. Dans une lettre ouverte publiée le 8 octobre, Tomek Korbak, Jasmine Wang et Mikita Balesni contestent les accusations de manquement apparues après leur licenciement. OpenAI a déclaré à TechCrunch qu’une enquête avait révélé des manquements répétés dans le traitement d’informations de recherche, au-delà du partage avec un groupe d’évaluation externe. La lettre et l’article de TechCrunch ne fournissent ni le dossier d’enquête sous-jacent ni les règles précises en cause.
Cette lettre défend la position des trois personnes concernées. Elles disent avoir pensé que leur travail avec des groupes externes relevait de leurs fonctions et des pratiques d’OpenAI. Elles nient être à l’origine d’une fuite auprès de The Information au sujet d’architectures de modèles prétendument plus difficiles à surveiller. Ces déclarations décrivent leur version des faits, et non des conclusions établies par une enquête indépendante.
Le grand changement
- Ce qui a changé :Les chercheurs demandent au Comité de sécurité et de sûreté, au Groupe consultatif sur la sécurité et au Conseil consultatif de mission d’OpenAI d’examiner comment les employés peuvent collaborer avec des évaluateurs indépendants en sécurité tout en respectant la confidentialité.
- Pourquoi c’est important :La lettre demande de maintenir l’accès des auditeurs, de protéger la capacité de surveiller les modèles et d’établir des règles explicites pour la collaboration externe. Ces demandes portent à la fois sur les informations accessibles aux évaluateurs et sur les limites que les employés doivent respecter lorsqu’ils les partagent.
- À suivre :Selon la réponse attribuée à OpenAI, les licenciements ont fait suite à des violations des règles et n’étaient pas liés à la formulation de préoccupations en matière de sécurité. La réponse rapportée par TechCrunch ne précise ni les règles concernées ni les éléments ayant motivé les décisions.
Ce que les chercheurs disent qu’il s’est passé
Korbak dit avoir été le contact de l’évaluateur externe METR lors d’une enquête sur un incident impliquant un agent d’OpenAI et Hugging Face. La lettre indique que l’enquête n’avait pas de précédent établi et que ses procédures internes étaient encore en cours d’élaboration. Elle affirme qu’il a essayé de respecter les règles alors en vigueur dans ses échanges avec des interlocuteurs externes.
Balesni dit avoir travaillé sur des engagements entre entreprises concernant la possibilité de surveiller le raisonnement des modèles. Selon la lettre, il en a discuté avec des membres du conseil d’administration et des dirigeants, a vérifié auprès de sa hiérarchie et a retiré les détails sensibles avant de partager des documents. Wang dit qu’elle avait reçu l’accès à la messagerie d’un dirigeant pour le recrutement ; après avoir ouvert par erreur un courriel sensible, elle affirme l’avoir signalé immédiatement et avoir de nouveau demandé au service informatique de supprimer cet accès. Aucun de ces récits n’établit les conclusions de l’enquête d’OpenAI.
Les demandes et la réponse de l’entreprise
La lettre formule trois recommandations. Premièrement, OpenAI devrait tenir un engagement public que les chercheurs attribuent à Sam Altman : donner un accès continu aux évaluateurs indépendants. Ils craignent que les licenciements ne réduisent la collaboration avec METR ou d’autres auditeurs. Deuxièmement, ils demandent à OpenAI et aux autres développeurs de modèles avancés d’éviter les changements qui réduiraient encore la capacité de surveillance, alors que les travaux de sécurité en dépendent. La lettre évoque précisément la surveillance du raisonnement en chaîne de pensée ; elle n’établit pas de baisse mesurée pour un modèle nommé. Troisièmement, ils demandent à OpenAI de réaffirmer son soutien aux débats ouverts sur la sécurité et de publier des procédures claires pour travailler avec des organisations externes.
OpenAI n’a pas publié de réponse officielle à la lettre, selon l’article de TechCrunch du 8 octobre. Le média indique qu’une note interne qui lui a été communiquée niait que les licenciements soient une représaille aux prises de parole et approuvait les recommandations des chercheurs. Par ailleurs, un porte-parole a déclaré à TechCrunch qu’une enquête avait révélé des manquements répétés dans le traitement d’informations de recherche, au-delà du partage externe. TechCrunch précise qu’OpenAI n’a pas répondu à ses questions sur les règles précises, les circonstances des licenciements ou les protections accordées aux employés travaillant avec des évaluateurs externes.
Les informations publiques montrent un accord de principe sur la valeur du travail externe en sécurité, mais aussi un désaccord sur la façon dont ces trois employés l’ont mené. La lettre ne permet pas de vérifier les autorisations ou les intentions de ses auteurs, et les déclarations rapportées de l’entreprise ne permettent pas aux lecteurs d’évaluer les violations alléguées. Les organes de supervision d’OpenAI doivent encore définir les règles applicables à cette collaboration et l’accès accordé aux auditeurs indépendants.
Sources et lectures complémentaires
- Korbak, Wang et Balesni, « OpenAI ne peut pas rendre l’IA sûre à elle seule », lettre ouverte publiée le 8 octobre 2026. Source primaire pour le récit des auteurs et leurs trois recommandations. Leurs descriptions d’événements internes, d’autorisations et de travaux sur les modèles sont des affirmations de parties intéressées.
- Rebecca Bellan, TechCrunch, 8 octobre 2026. L’article présente les réponses du porte-parole d’OpenAI et de la note interne, ainsi que les questions restées sans réponse. Il confirme les propos de chaque partie, et non les faits contestés sous-jacents.



