Três antigos investigadores de segurança da OpenAI pediram aos órgãos de supervisão da empresa que preservem o trabalho independente em segurança e clarifiquem como podem os funcionários partilhar informação com avaliadores externos. Numa carta aberta publicada a 8 de outubro, Tomek Korbak, Jasmine Wang e Mikita Balesni contestam a versão de má conduta que surgiu após o despedimento. A OpenAI disse à TechCrunch que uma investigação encontrou um padrão de tratamento inadequado de informação de investigação que foi além da partilha com um grupo externo de avaliação. A carta e a notícia da TechCrunch não apresentam o registo subjacente da investigação nem identificam as políticas específicas em causa.

A carta é uma tomada de posição das três pessoas afetadas. Dizem que acreditavam que o seu trabalho com grupos externos se enquadrava nas suas funções e nas práticas da OpenAI. Negam ter sido a fonte de uma fuga de informação para a The Information sobre arquiteturas de modelos alegadamente menos monitorizáveis. Estas declarações descrevem a versão dos acontecimentos dos autores, não conclusões estabelecidas por um inquérito independente.

A grande mudança

  • O que mudou:Os investigadores pedem ao Comité de Segurança e Proteção, ao Grupo Consultivo de Segurança e ao Conselho Consultivo da Missão da OpenAI que abordem como podem os funcionários trabalhar com avaliadores independentes de segurança respeitando a confidencialidade.
  • Porque é importante:A carta pede que se mantenha o acesso dos auditores, se proteja a monitorabilidade dos modelos e se estabeleçam regras explícitas para a colaboração externa. Estes pedidos dizem respeito tanto à informação que os avaliadores externos podem receber como aos limites que os funcionários devem respeitar ao partilhá-la.
  • O que acompanhar:A resposta atribuída à OpenAI afirma que os despedimentos resultaram de violações das políticas e não tiveram relação com a apresentação de preocupações de segurança. A resposta, segundo a TechCrunch, não identifica as políticas específicas nem as provas que fundamentaram as decisões.

O que os investigadores dizem ter acontecido

Korbak diz que foi o ponto de contacto do avaliador externo METR durante uma investigação a um incidente com um agente da OpenAI que envolveu a Hugging Face. A carta afirma que a investigação não tinha precedentes estabelecidos e que os procedimentos internos ainda estavam a ser desenvolvidos. Diz que tentou seguir as políticas então em vigor enquanto comunicava com interlocutores externos.

Balesni diz que trabalhou em compromissos entre empresas relativos à capacidade de monitorizar o raciocínio dos modelos. Segundo a carta, discutiu o trabalho com membros do conselho e executivos, confirmou-o junto da sua linha hierárquica e removeu detalhes sensíveis antes de partilhar material. Wang diz que lhe tinha sido concedido acesso ao correio eletrónico de um executivo para recrutamento; depois de abrir por engano uma mensagem sensível, afirma que a comunicou prontamente e voltou a pedir à equipa de TI que retirasse o acesso. Nenhum destes relatos estabelece o que concluiu a investigação da OpenAI.

Os pedidos e a resposta da empresa

A carta apresenta três recomendações. Primeiro, a OpenAI deve cumprir um compromisso público, que os investigadores atribuem a Sam Altman, de manter o acesso de avaliadores independentes. Receiam que os despedimentos possam reduzir o trabalho com a METR ou outros auditores. Segundo, pedem à OpenAI e a outros criadores de modelos avançados que evitem alterações que reduzam ainda mais a monitorabilidade enquanto o trabalho de segurança depender dela. A carta refere especificamente a monitorização do raciocínio em cadeia de pensamento; não demonstra uma diminuição medida num modelo identificado. Terceiro, pedem à OpenAI que reafirme o debate aberto sobre segurança e publique procedimentos claros para trabalhar com organizações externas.

A OpenAI não respondeu formalmente à carta, segundo a notícia da TechCrunch de 8 de outubro. A publicação afirma que um memorando interno que lhe foi partilhado negou que os despedimentos fossem uma retaliação por se terem manifestado e concordou com as recomendações dos investigadores. Separadamente, um porta-voz disse à TechCrunch que uma investigação encontrou um padrão de má conduta no tratamento de informação de investigação que foi além da partilha externa. A TechCrunch diz que a OpenAI não respondeu às perguntas sobre as políticas específicas, as circunstâncias dos despedimentos ou as proteções para funcionários que trabalham com avaliadores externos.

O registo público mostra um acordo de princípio quanto ao valor do trabalho externo em segurança, a par de uma disputa sobre a forma como estes três funcionários o conduziram. A carta não pode confirmar as autorizações ou intenções dos autores, e as declarações atribuídas à empresa não permitem aos leitores avaliar as alegadas violações. Os órgãos de supervisão da OpenAI ainda têm de definir que regras regem esta colaboração e que acesso terão os auditores independentes.

Fontes e leituras adicionais

  • Korbak, Wang e Balesni, «A OpenAI não consegue tornar a IA segura por si só», carta aberta publicada a 8 de outubro de 2026. Fonte primária para a versão dos autores e as suas três recomendações. As descrições de acontecimentos internos, autorizações e trabalho com modelos são alegações de partes interessadas.
  • Rebecca Bellan, TechCrunch, 8 de outubro de 2026. Relata as respostas do porta-voz da OpenAI e do memorando interno, bem como as perguntas a que a empresa não respondeu. Corrobora o que cada parte disse, não a conduta contestada subjacente.