AI-translated from English; not yet reviewed by a fluent editor.

# Antigos investigadores de segurança da OpenAI pedem aos órgãos de supervisão que protejam a colaboração externa

> Três investigadores da OpenAI despedidos apelam aos órgãos de supervisão para protegerem o trabalho externo em segurança e clarificarem as regras para os funcionários. A OpenAI contesta a versão dos despedimentos apresentada por eles.

By BIG CHANGE Editorial

Published: 2026-10-09T04:59:01.631Z
Updated: 2026-10-09T04:59:01.631Z
Canonical: https://bigchange.ai/blog/openai-researchers-letter-outside-safety-evaluators

![A blank ivory letter sheet lies open over three aligned pages on a warm ivory background.](https://bigchange.ai/api/media/file/openai-monitorability-letter-hero-v2.png)
Conceptual illustration of the researchers’ public open letter calling for clear rules for outside safety work. It does not reproduce the letter or depict internal events or a model assessment. AI-generated illustration by BIG CHANGE.

Três antigos investigadores de segurança da OpenAI pediram aos órgãos de supervisão da empresa que preservem o trabalho independente em segurança e clarifiquem como podem os funcionários partilhar informação com avaliadores externos. Numa [carta aberta publicada a 8 de outubro](https://mikitabalesni.com/letter/letter.pdf), Tomek Korbak, Jasmine Wang e Mikita Balesni contestam a versão de má conduta que surgiu após o despedimento. A OpenAI disse à TechCrunch que uma investigação encontrou um padrão de tratamento inadequado de informação de investigação que foi além da partilha com um grupo externo de avaliação. A carta e a notícia da TechCrunch não apresentam o registo subjacente da investigação nem identificam as políticas específicas em causa.

A carta é uma tomada de posição das três pessoas afetadas. Dizem que acreditavam que o seu trabalho com grupos externos se enquadrava nas suas funções e nas práticas da OpenAI. Negam ter sido a fonte de uma fuga de informação para a The Information sobre arquiteturas de modelos alegadamente menos monitorizáveis. Estas declarações descrevem a versão dos acontecimentos dos autores, não conclusões estabelecidas por um inquérito independente.

## A grande mudança

- **O que mudou:**Os investigadores pedem ao Comité de Segurança e Proteção, ao Grupo Consultivo de Segurança e ao Conselho Consultivo da Missão da OpenAI que abordem como podem os funcionários trabalhar com avaliadores independentes de segurança respeitando a confidencialidade.
- **Porque é importante:**A carta pede que se mantenha o acesso dos auditores, se proteja a monitorabilidade dos modelos e se estabeleçam regras explícitas para a colaboração externa. Estes pedidos dizem respeito tanto à informação que os avaliadores externos podem receber como aos limites que os funcionários devem respeitar ao partilhá-la.
- **O que acompanhar:**A resposta atribuída à OpenAI afirma que os despedimentos resultaram de violações das políticas e não tiveram relação com a apresentação de preocupações de segurança. A resposta, segundo a TechCrunch, não identifica as políticas específicas nem as provas que fundamentaram as decisões.

## O que os investigadores dizem ter acontecido

Korbak diz que foi o ponto de contacto do avaliador externo METR durante uma investigação a um incidente com um agente da OpenAI que envolveu a Hugging Face. A carta afirma que a investigação não tinha precedentes estabelecidos e que os procedimentos internos ainda estavam a ser desenvolvidos. Diz que tentou seguir as políticas então em vigor enquanto comunicava com interlocutores externos.

Balesni diz que trabalhou em compromissos entre empresas relativos à capacidade de monitorizar o raciocínio dos modelos. Segundo a carta, discutiu o trabalho com membros do conselho e executivos, confirmou-o junto da sua linha hierárquica e removeu detalhes sensíveis antes de partilhar material. Wang diz que lhe tinha sido concedido acesso ao correio eletrónico de um executivo para recrutamento; depois de abrir por engano uma mensagem sensível, afirma que a comunicou prontamente e voltou a pedir à equipa de TI que retirasse o acesso. Nenhum destes relatos estabelece o que concluiu a investigação da OpenAI.

## Os pedidos e a resposta da empresa

A carta apresenta três recomendações. Primeiro, a OpenAI deve cumprir um compromisso público, que os investigadores atribuem a Sam Altman, de manter o acesso de avaliadores independentes. Receiam que os despedimentos possam reduzir o trabalho com a METR ou outros auditores. Segundo, pedem à OpenAI e a outros criadores de modelos avançados que evitem alterações que reduzam ainda mais a monitorabilidade enquanto o trabalho de segurança depender dela. A carta refere especificamente a monitorização do raciocínio em cadeia de pensamento; não demonstra uma diminuição medida num modelo identificado. Terceiro, pedem à OpenAI que reafirme o debate aberto sobre segurança e publique procedimentos claros para trabalhar com organizações externas.

A OpenAI não respondeu formalmente à carta, segundo [a notícia da TechCrunch de 8 de outubro](https://techcrunch.com/2026/10/08/fired-openai-safety-researchers-dispute-misconduct-claims-warn-of-chilling-effect/). A publicação afirma que um memorando interno que lhe foi partilhado negou que os despedimentos fossem uma retaliação por se terem manifestado e concordou com as recomendações dos investigadores. Separadamente, um porta-voz disse à TechCrunch que uma investigação encontrou um padrão de má conduta no tratamento de informação de investigação que foi além da partilha externa. A TechCrunch diz que a OpenAI não respondeu às perguntas sobre as políticas específicas, as circunstâncias dos despedimentos ou as proteções para funcionários que trabalham com avaliadores externos.

O registo público mostra um acordo de princípio quanto ao valor do trabalho externo em segurança, a par de uma disputa sobre a forma como estes três funcionários o conduziram. A carta não pode confirmar as autorizações ou intenções dos autores, e as declarações atribuídas à empresa não permitem aos leitores avaliar as alegadas violações. Os órgãos de supervisão da OpenAI ainda têm de definir que regras regem esta colaboração e que acesso terão os auditores independentes.

## Fontes e leituras adicionais

- [Korbak, Wang e Balesni, «A OpenAI não consegue tornar a IA segura por si só»](https://mikitabalesni.com/letter/letter.pdf), carta aberta publicada a 8 de outubro de 2026. Fonte primária para a versão dos autores e as suas três recomendações. As descrições de acontecimentos internos, autorizações e trabalho com modelos são alegações de partes interessadas.
- [Rebecca Bellan, TechCrunch](https://techcrunch.com/2026/10/08/fired-openai-safety-researchers-dispute-misconduct-claims-warn-of-chilling-effect/), 8 de outubro de 2026. Relata as respostas do porta-voz da OpenAI e do memorando interno, bem como as perguntas a que a empresa não respondeu. Corrobora o que cada parte disse, não a conduta contestada subjacente.

## Sources

- [Korbak, Wang e Balesni, «A OpenAI não consegue tornar a IA segura sozinha»](https://mikitabalesni.com/letter/letter.pdf) — Carta primária; as alegações contestadas dos signatários sobre acontecimentos internos são-lhes atribuídas.
- [Antigos investigadores de segurança da OpenAI contestam acusações de má conduta e alertam para um efeito inibidor](https://techcrunch.com/2026/10/08/fired-openai-safety-researchers-dispute-misconduct-claims-warn-of-chilling-effect/) — Artigo de Rebecca Bellan sobre a carta e as respostas do porta-voz e do memorando da OpenAI.
