Os responsáveis de investigação da OpenAI responderam publicamente a 9 de outubro a uma carta de três antigos investigadores de segurança num OpenAI Newsroom post on X. A Associated Press e a Reuters noticiaram que a empresa afirmou que uma investigação interna encontrou violações das políticas de tratamento de informação sensível e descreveu uma «quebra significativa de confiança» para além da carta. A OpenAI negou que os despedimentos estivessem relacionados com a apresentação de preocupações de segurança. A publicação também disse que estão a ser finalizados contratos com avaliadores de segurança externos e que haverá detalhes nas próximas semanas. A empresa não identificou a conduta ou a política em causa.

A grande mudança

  • O que mudou: A resposta pública da OpenAI associa agora a sua explicação dos despedimentos ao plano de finalizar contratos com avaliadores de segurança externos e reafirma publicamente que a monitorização de modelos é um compromisso de toda a indústria.
  • Porque é importante:A disputa dos investigadores diz respeito tanto ao tratamento que receberam como ao trabalho com grupos externos de segurança. O compromisso da OpenAI dá um próximo passo concreto para esta segunda questão, embora os termos, o acesso e o âmbito do trabalho dos avaliadores continuem desconhecidos.
  • O que acompanhar:A OpenAI disse que os detalhes seriam divulgados nas próximas semanas. Esses detalhes poderão mostrar se os avaliadores independentes terão o acesso continuado pedido pelos investigadores e como os funcionários poderão partilhar informação, protegendo ao mesmo tempo material confidencial.

Esta é uma continuação datada do relato da BIG CHANGE sobre a carta dos investigadores. Na sua carta original aos órgãos de supervisão da OpenAI, descreveram três situações diferentes. Tomek Korbak disse que lhe comunicaram verbalmente que o despedimento estava relacionado com a forma como comunicou com a METR, organização sem fins lucrativos envolvida na avaliação do incidente da OpenAI com a Hugging Face. Mikita Balesni disse que o seu trabalho sobre monitorização com grupos externos foi coordenado com a sua linha hierárquica e que retirou detalhes sensíveis antes de partilhar materiais. Jasmine Wang disse que lhe foi delegado acesso ao e-mail de um executivo para recrutamento, que pediu à equipa de TI que o removesse e que comunicou um clique acidental numa mensagem sensível. Estes são relatos dos investigadores, não conclusões estabelecidas de forma independente.

A publicação da OpenAI responde a dois pedidos centrais da carta. O texto integral reproduzido pelo The Indian Express afirma que a empresa estava a finalizar contratos com avaliadores de segurança externos e mantinha o compromisso de integrar revisores externos. Diz também que a OpenAI concorda que preservar a monitorização de modelos de fronteira exige um compromisso de toda a indústria e que continuará a investir nesse trabalho. São declarações da empresa sobre planos e prioridades; a publicação não identifica os avaliadores, o acesso de que disporão nem os termos dos contratos.

Sobre os despedimentos, a OpenAI disse que uma investigação encontrou violações das políticas de tratamento de informação e que as decisões não se deveram a críticas de segurança. Mas a publicação pública não identifica a informação, a regra específica ou as provas que sustentam a conclusão. A Associated Press noticiou que a OpenAI não forneceria mais pormenores sobre os motivos do despedimento dos investigadores. A Reuters noticiou que a empresa não revelou as alegadas violações. Nenhuma das fontes publica o processo da investigação nem estabelece de forma independente qual relato está correto.

A disputa laboral também não resolve o debate técnico separado sobre monitorização. Os investigadores dizem que a capacidade de monitorizar modelos de fronteira está a degradar-se; a OpenAI diz concordar que a monitorização é importante e que continuará a investir. A resposta de 9 de outubro não apresenta novas medições nem resultados de avaliação.

Fontes e leituras adicionais