O MUNDO NÃO ESTÁ PARADO.RSS
BIG CHANGE.

Edição em Markdown

AI-translated from English; not yet reviewed by a fluent editor.

# Ex-pesquisadores de segurança da OpenAI pedem que órgãos de supervisão protejam a colaboração externa

> Três pesquisadores demitidos da OpenAI pedem aos órgãos de supervisão que protejam o trabalho externo de segurança e esclareçam as regras para funcionários. A OpenAI contesta a versão deles sobre as demissões.

By BIG CHANGE Editorial

Published: 2026-10-09T04:59:01.631Z
Updated: 2026-10-09T04:59:01.631Z
Canonical: https://bigchange.ai/blog/openai-researchers-letter-outside-safety-evaluators

![A blank ivory letter sheet lies open over three aligned pages on a warm ivory background.](https://bigchange.ai/api/media/file/openai-monitorability-letter-hero-v2.png)
Conceptual illustration of the researchers’ public open letter calling for clear rules for outside safety work. It does not reproduce the letter or depict internal events or a model assessment. AI-generated illustration by BIG CHANGE.

Três ex-pesquisadores de segurança da OpenAI pediram aos órgãos de supervisão da empresa que preservem o trabalho independente em segurança e esclareçam como os funcionários podem compartilhar informações com avaliadores externos. Em uma [carta aberta publicada em 8 de outubro](https://mikitabalesni.com/letter/letter.pdf), Tomek Korbak, Jasmine Wang e Mikita Balesni contestam a versão de conduta imprópria que surgiu após suas demissões. A OpenAI disse à TechCrunch que uma investigação encontrou um padrão de tratamento inadequado de informações de pesquisa que foi além do compartilhamento com um grupo externo de avaliação. A carta e a reportagem da TechCrunch não apresentam o registro da investigação nem identificam as políticas específicas em questão.

A carta apresenta a defesa das três pessoas afetadas. Elas dizem que acreditavam que o trabalho com grupos externos fazia parte de suas funções e das práticas da OpenAI. Negam ter sido a fonte de um vazamento para o The Information sobre arquiteturas de modelos supostamente menos monitoráveis. Essas declarações descrevem a versão delas dos fatos, não conclusões estabelecidas por uma investigação independente.

## A grande mudança

- **O que mudou:**Os pesquisadores pedem ao Comitê de Segurança e Proteção, ao Grupo Consultivo de Segurança e ao Conselho Consultivo de Missão da OpenAI que discutam como os funcionários podem trabalhar com avaliadores independentes de segurança respeitando a confidencialidade.
- **Por que isso importa:**A carta pede acesso contínuo para auditores, proteção da monitorabilidade dos modelos e regras explícitas para a colaboração externa. As solicitações tratam tanto das informações que os avaliadores externos podem receber quanto dos limites que os funcionários devem seguir ao compartilhá-las.
- **O que acompanhar:**A resposta atribuída à OpenAI afirma que as demissões ocorreram após violações de políticas e não tiveram relação com a apresentação de preocupações de segurança. A resposta, conforme relatada pela TechCrunch, não identifica as políticas específicas nem as evidências por trás das decisões.

## O que os pesquisadores dizem que aconteceu

Korbak diz que foi o contato do avaliador externo METR durante uma investigação de um incidente com um agente da OpenAI que envolveu a Hugging Face. A carta afirma que a investigação não tinha precedentes estabelecidos e que seus procedimentos internos ainda estavam sendo desenvolvidos. Segundo o texto, ele tentou seguir as políticas vigentes ao se comunicar com pessoas externas.

Balesni diz que trabalhou em compromissos entre empresas sobre a possibilidade de monitorar o raciocínio dos modelos. Segundo a carta, ele discutiu o trabalho com integrantes do conselho e executivos, confirmou o tema com sua linha de reporte e removeu detalhes confidenciais antes de compartilhar materiais. Wang diz que recebeu acesso ao e-mail de um executivo para recrutamento; após abrir por engano uma mensagem confidencial, afirma que a comunicou imediatamente e voltou a pedir à equipe de TI que removesse o acesso. Nenhum desses relatos estabelece o que a investigação da OpenAI concluiu.

## As solicitações e a resposta da empresa

A carta faz três recomendações. Primeiro, a OpenAI deveria cumprir um compromisso público que os pesquisadores atribuem a Sam Altman: manter o acesso de avaliadores independentes. Eles temem que as demissões reduzam o trabalho com a METR ou outros auditores. Segundo, pedem à OpenAI e a outros desenvolvedores de modelos avançados que evitem mudanças que reduzam ainda mais a monitorabilidade enquanto o trabalho de segurança depender dela. A carta menciona especificamente o monitoramento do raciocínio em cadeia de pensamento; não comprova uma queda mensurada em um modelo específico. Terceiro, pedem que a OpenAI reafirme o apoio à discussão aberta sobre segurança e publique procedimentos claros para trabalhar com organizações externas.

A OpenAI não apresentou uma resposta formal à carta, segundo [a reportagem da TechCrunch de 8 de outubro](https://techcrunch.com/2026/10/08/fired-openai-safety-researchers-dispute-misconduct-claims-warn-of-chilling-effect/). A publicação diz que um memorando interno compartilhado com ela negou que as demissões fossem retaliação por manifestações públicas e concordou com as recomendações dos pesquisadores. Separadamente, um porta-voz disse à TechCrunch que uma investigação encontrou um padrão de conduta imprópria no tratamento de informações de pesquisa que foi além do compartilhamento externo. A TechCrunch afirma que a OpenAI não respondeu às perguntas sobre políticas específicas, as circunstâncias das demissões ou as proteções para funcionários que trabalham com avaliadores externos.

O registro público mostra concordância em princípio sobre o valor do trabalho externo de segurança, junto a uma disputa sobre como esses três funcionários o conduziram. A carta não comprova as permissões ou intenções dos autores, e as declarações atribuídas à empresa não permitem que os leitores avaliem as supostas violações. Os órgãos de supervisão da OpenAI ainda precisam definir quais regras regem essa colaboração e que acesso os auditores independentes terão.

## Fontes e leituras adicionais

- [Korbak, Wang e Balesni, “A OpenAI não consegue tornar a IA segura sozinha”](https://mikitabalesni.com/letter/letter.pdf), carta aberta publicada em 8 de outubro de 2026. Fonte primária para o relato dos autores e suas três recomendações. As descrições de eventos internos, permissões e trabalho com modelos são alegações de partes interessadas.
- [Rebecca Bellan, TechCrunch](https://techcrunch.com/2026/10/08/fired-openai-safety-researchers-dispute-misconduct-claims-warn-of-chilling-effect/), 8 de outubro de 2026. Relata as respostas do porta-voz da OpenAI e do memorando interno, além das perguntas que a empresa não respondeu. Confirma o que cada lado disse, não a conduta contestada em si.

## Sources

- [Korbak, Wang e Balesni, “A OpenAI não consegue tornar a IA segura sozinha”](https://mikitabalesni.com/letter/letter.pdf) — Carta primária; as alegações contestadas dos signatários sobre eventos internos são atribuídas a eles.
- [Ex-pesquisadores de segurança da OpenAI contestam acusações e alertam para um efeito inibidor](https://techcrunch.com/2026/10/08/fired-openai-safety-researchers-dispute-misconduct-claims-warn-of-chilling-effect/) — Reportagem de Rebecca Bellan sobre a carta e as respostas do porta-voz e do memorando interno da OpenAI.