Tres antiguos investigadores de seguridad de OpenAI han pedido a los órganos de supervisión de la empresa que preserven el trabajo independiente en seguridad y aclaren cómo puede compartir información el personal con evaluadores externos. En una carta abierta publicada el 8 de octubre, Tomek Korbak, Jasmine Wang y Mikita Balesni cuestionan la versión de conducta indebida que surgió tras su despido. OpenAI dijo a TechCrunch que una investigación detectó un patrón de manejo indebido de información de investigación que iba más allá de compartirla con un grupo externo de evaluación. La carta y el artículo de TechCrunch no aportan el expediente de la investigación ni identifican las políticas concretas en cuestión.

La carta es una defensa de las tres personas afectadas. Afirman que creían que su trabajo con grupos externos formaba parte de sus funciones y de las prácticas habituales de OpenAI. Niegan haber filtrado a The Information datos sobre arquitecturas de modelos supuestamente menos monitorizables. Esas declaraciones describen su versión de los hechos, no conclusiones acreditadas por una investigación independiente.

El gran cambio

  • Qué cambió:Los investigadores han pedido al Comité de Seguridad y Protección, al Grupo Asesor de Seguridad y al Consejo Asesor de Misión de OpenAI que aclaren cómo puede colaborar el personal con evaluadores de seguridad independientes sin vulnerar la confidencialidad.
  • Por qué importa:La carta pide mantener el acceso de los auditores, proteger la monitorabilidad de los modelos y establecer reglas explícitas para la colaboración externa. Las peticiones abarcan tanto la información que pueden recibir los evaluadores como los límites que debe respetar el personal al compartirla.
  • Qué conviene seguir:La respuesta atribuida a OpenAI sostiene que los despidos se debieron a infracciones de las políticas y no estuvieron relacionados con plantear preocupaciones de seguridad. La respuesta, según TechCrunch, no identifica las políticas concretas ni las pruebas que sustentaron las decisiones.

Qué dicen los investigadores que ocurrió

Korbak afirma que fue el contacto con el evaluador externo METR durante una investigación sobre un incidente de un agente de OpenAI relacionado con Hugging Face. La carta dice que la investigación carecía de precedentes establecidos y que sus procedimientos internos aún se estaban desarrollando. También señala que intentó seguir las políticas vigentes al comunicarse con colaboradores externos.

Balesni afirma que trabajó en compromisos entre empresas sobre la posibilidad de monitorizar el razonamiento de los modelos. Según la carta, habló del trabajo con miembros del consejo y directivos, consultó a su línea de reporte y eliminó detalles sensibles antes de compartir material. Wang afirma que le habían delegado el acceso al correo de un directivo para tareas de contratación; tras abrir por accidente un correo sensible, dice que lo comunicó de inmediato y volvió a pedir al equipo de TI que retirara el acceso. Ninguno de esos relatos demuestra qué concluyó la investigación de OpenAI.

Las peticiones y la respuesta de la empresa

La carta formula tres recomendaciones. Primero, OpenAI debería cumplir un compromiso público que los investigadores atribuyen a Sam Altman: mantener el acceso de evaluadores independientes. Les preocupa que los despidos reduzcan la colaboración con METR u otros auditores. Segundo, piden a OpenAI y a otros desarrolladores de modelos de frontera que eviten cambios que reduzcan aún más la monitorabilidad mientras el trabajo de seguridad dependa de ella. La carta menciona específicamente la supervisión del razonamiento en cadena de pensamiento, pero no demuestra un descenso medido en ningún modelo concreto. Tercero, piden a OpenAI que reafirme el debate abierto sobre seguridad y publique procedimientos claros para colaborar con organizaciones externas.

OpenAI no ha emitido una respuesta formal a la carta, según el artículo de TechCrunch del 8 de octubre. La publicación afirma que un memorando interno que recibió negó que los despidos fueran una represalia por expresarse y respaldó las recomendaciones de los investigadores. Por separado, un portavoz dijo a TechCrunch que una investigación detectó un patrón de conducta indebida en el manejo de información de investigación que iba más allá de compartirla con terceros. TechCrunch señala que OpenAI no respondió a sus preguntas sobre las políticas específicas, las circunstancias de los despidos ni las protecciones para el personal que colabora con evaluadores externos.

La información pública muestra un acuerdo de principio sobre el valor del trabajo externo en seguridad, junto con una disputa sobre cómo lo llevaron a cabo estos tres empleados. La carta no permite verificar los permisos ni las intenciones de sus autores, y las declaraciones atribuidas a la empresa no permiten evaluar las presuntas infracciones. Los órganos de supervisión de OpenAI aún deben aclarar qué reglas rigen esa colaboración y qué acceso tendrán los auditores independientes.

Fuentes y lecturas adicionales

  • Korbak, Wang y Balesni, «OpenAI no puede hacer que la IA sea segura por sí sola», carta abierta publicada el 8 de octubre de 2026. Fuente primaria para la versión de los autores y sus tres recomendaciones. Sus descripciones de los hechos internos, los permisos y el trabajo con modelos son afirmaciones de partes interesadas.
  • Rebecca Bellan, TechCrunch, 8 de octubre de 2026. Informa sobre las respuestas del portavoz de OpenAI y del memorando interno, así como sobre las preguntas que la empresa no contestó. Confirma lo que dijo cada parte, no la conducta controvertida subyacente.