Les responsables de la recherche d’OpenAI ont répondu publiquement le 9 octobre à une lettre de trois anciens chercheurs en sécurité dans un OpenAI Newsroom post on X. L’Associated Press et Reuters rapportent que l’entreprise a déclaré qu’une enquête interne avait constaté des violations des règles de traitement des informations sensibles et une « rupture importante de confiance » au-delà de la lettre. OpenAI a nié que les licenciements soient liés à l’expression de préoccupations de sécurité. La publication dit aussi que des contrats avec des évaluateurs de sécurité tiers sont en cours de finalisation et que des détails suivront dans les prochaines semaines. L’entreprise n’a précisé ni les actes concernés ni la règle en cause.

Le grand changement

  • Ce qui a changé : La réponse publique d’OpenAI associe désormais son explication des licenciements au projet de finaliser des contrats avec des évaluateurs de sécurité tiers et réaffirme que la capacité à surveiller les modèles est un engagement de toute l’industrie.
  • Pourquoi c’est important :Le différend porte à la fois sur le traitement des chercheurs et sur leur travail avec des groupes externes de sécurité. L’engagement d’OpenAI donne une prochaine étape concrète à cette seconde question, mais les conditions, l’accès et le périmètre du travail des évaluateurs restent inconnus.
  • À surveiller :OpenAI a dit que les détails suivraient dans les prochaines semaines. Ils permettront de voir si les évaluateurs indépendants obtiennent l’accès durable demandé par les chercheurs et comment le personnel peut partager des informations avec eux tout en protégeant les documents confidentiels.

Cet article poursuit, avec une date, le reportage de BIG CHANGE sur la lettre des chercheurs. Dans leur lettre originale aux organes de surveillance d’OpenAI, ils ont décrit trois situations différentes. Tomek Korbak a dit qu’on lui avait indiqué verbalement que son licenciement concernait sa façon de communiquer avec METR, l’association à but non lucratif impliquée dans l’évaluation de l’incident d’OpenAI avec Hugging Face. Mikita Balesni a dit que son travail sur la capacité de surveillance avec des groupes externes était coordonné avec sa hiérarchie et qu’il avait retiré les détails sensibles avant de partager des documents. Jasmine Wang a dit qu’un accès à l’e-mail d’un dirigeant lui avait été délégué pour le recrutement, qu’elle avait demandé à l’équipe informatique de le supprimer et qu’elle avait signalé un clic accidentel sur un message sensible. Ce sont les récits des chercheurs, pas des conclusions établies de façon indépendante.

La publication d’OpenAI répond à deux demandes centrales de la lettre. Le texte intégral reproduit par The Indian Express indique que l’entreprise finalisait des contrats avec des évaluateurs de sécurité tiers et restait déterminée à intégrer des examinateurs externes. Elle dit aussi qu’OpenAI convient que préserver la capacité à surveiller les modèles de pointe exige un engagement de toute l’industrie et qu’elle continuera d’investir dans ce travail. Ce sont des déclarations de l’entreprise sur ses projets et priorités ; la publication ne nomme pas les évaluateurs, ne précise pas leur accès et ne publie pas les contrats.

Au sujet des licenciements, OpenAI a dit qu’une enquête avait trouvé des violations des règles de traitement de l’information et que ses décisions n’étaient pas liées à des critiques sur la sécurité. Mais la publication publique n’identifie ni l’information, ni la règle précise, ni les éléments étayant sa conclusion. L’Associated Press a rapporté qu’OpenAI ne donnerait pas davantage de précisions sur les raisons du licenciement des chercheurs. Reuters a indiqué que l’entreprise n’avait pas révélé les violations alléguées. Aucun des deux médias ne publie le dossier d’enquête ni n’établit indépendamment quel récit est exact.

Le différend professionnel ne tranche pas non plus le débat technique distinct sur la capacité de surveillance. Les chercheurs disent que celle des modèles de pointe se dégrade ; OpenAI dit convenir de son importance et poursuivre ses investissements. La réponse du 9 octobre ne présente aucune nouvelle mesure ni aucun résultat d’évaluation.

Sources et lectures complémentaires