Três ex-pesquisadores de segurança da OpenAI pediram aos órgãos de supervisão da empresa que preservem o trabalho independente em segurança e esclareçam como os funcionários podem compartilhar informações com avaliadores externos. Em uma carta aberta publicada em 8 de outubro, Tomek Korbak, Jasmine Wang e Mikita Balesni contestam a versão de conduta imprópria que surgiu após suas demissões. A OpenAI disse à TechCrunch que uma investigação encontrou um padrão de tratamento inadequado de informações de pesquisa que foi além do compartilhamento com um grupo externo de avaliação. A carta e a reportagem da TechCrunch não apresentam o registro da investigação nem identificam as políticas específicas em questão.

A carta apresenta a defesa das três pessoas afetadas. Elas dizem que acreditavam que o trabalho com grupos externos fazia parte de suas funções e das práticas da OpenAI. Negam ter sido a fonte de um vazamento para o The Information sobre arquiteturas de modelos supostamente menos monitoráveis. Essas declarações descrevem a versão delas dos fatos, não conclusões estabelecidas por uma investigação independente.

A grande mudança

  • O que mudou:Os pesquisadores pedem ao Comitê de Segurança e Proteção, ao Grupo Consultivo de Segurança e ao Conselho Consultivo de Missão da OpenAI que discutam como os funcionários podem trabalhar com avaliadores independentes de segurança respeitando a confidencialidade.
  • Por que isso importa:A carta pede acesso contínuo para auditores, proteção da monitorabilidade dos modelos e regras explícitas para a colaboração externa. As solicitações tratam tanto das informações que os avaliadores externos podem receber quanto dos limites que os funcionários devem seguir ao compartilhá-las.
  • O que acompanhar:A resposta atribuída à OpenAI afirma que as demissões ocorreram após violações de políticas e não tiveram relação com a apresentação de preocupações de segurança. A resposta, conforme relatada pela TechCrunch, não identifica as políticas específicas nem as evidências por trás das decisões.

O que os pesquisadores dizem que aconteceu

Korbak diz que foi o contato do avaliador externo METR durante uma investigação de um incidente com um agente da OpenAI que envolveu a Hugging Face. A carta afirma que a investigação não tinha precedentes estabelecidos e que seus procedimentos internos ainda estavam sendo desenvolvidos. Segundo o texto, ele tentou seguir as políticas vigentes ao se comunicar com pessoas externas.

Balesni diz que trabalhou em compromissos entre empresas sobre a possibilidade de monitorar o raciocínio dos modelos. Segundo a carta, ele discutiu o trabalho com integrantes do conselho e executivos, confirmou o tema com sua linha de reporte e removeu detalhes confidenciais antes de compartilhar materiais. Wang diz que recebeu acesso ao e-mail de um executivo para recrutamento; após abrir por engano uma mensagem confidencial, afirma que a comunicou imediatamente e voltou a pedir à equipe de TI que removesse o acesso. Nenhum desses relatos estabelece o que a investigação da OpenAI concluiu.

As solicitações e a resposta da empresa

A carta faz três recomendações. Primeiro, a OpenAI deveria cumprir um compromisso público que os pesquisadores atribuem a Sam Altman: manter o acesso de avaliadores independentes. Eles temem que as demissões reduzam o trabalho com a METR ou outros auditores. Segundo, pedem à OpenAI e a outros desenvolvedores de modelos avançados que evitem mudanças que reduzam ainda mais a monitorabilidade enquanto o trabalho de segurança depender dela. A carta menciona especificamente o monitoramento do raciocínio em cadeia de pensamento; não comprova uma queda mensurada em um modelo específico. Terceiro, pedem que a OpenAI reafirme o apoio à discussão aberta sobre segurança e publique procedimentos claros para trabalhar com organizações externas.

A OpenAI não apresentou uma resposta formal à carta, segundo a reportagem da TechCrunch de 8 de outubro. A publicação diz que um memorando interno compartilhado com ela negou que as demissões fossem retaliação por manifestações públicas e concordou com as recomendações dos pesquisadores. Separadamente, um porta-voz disse à TechCrunch que uma investigação encontrou um padrão de conduta imprópria no tratamento de informações de pesquisa que foi além do compartilhamento externo. A TechCrunch afirma que a OpenAI não respondeu às perguntas sobre políticas específicas, as circunstâncias das demissões ou as proteções para funcionários que trabalham com avaliadores externos.

O registro público mostra concordância em princípio sobre o valor do trabalho externo de segurança, junto a uma disputa sobre como esses três funcionários o conduziram. A carta não comprova as permissões ou intenções dos autores, e as declarações atribuídas à empresa não permitem que os leitores avaliem as supostas violações. Os órgãos de supervisão da OpenAI ainda precisam definir quais regras regem essa colaboração e que acesso os auditores independentes terão.

Fontes e leituras adicionais

  • Korbak, Wang e Balesni, “A OpenAI não consegue tornar a IA segura sozinha”, carta aberta publicada em 8 de outubro de 2026. Fonte primária para o relato dos autores e suas três recomendações. As descrições de eventos internos, permissões e trabalho com modelos são alegações de partes interessadas.
  • Rebecca Bellan, TechCrunch, 8 de outubro de 2026. Relata as respostas do porta-voz da OpenAI e do memorando interno, além das perguntas que a empresa não respondeu. Confirma o que cada lado disse, não a conduta contestada em si.