Los responsables de investigación de OpenAI respondieron públicamente el 9 de octubre a una carta de tres antiguos investigadores de seguridad en una OpenAI Newsroom post on X. La Associated Press y Reuters informaron que la empresa dijo que una investigación interna encontró infracciones de las políticas sobre el manejo de información confidencial y describió una «grave ruptura de confianza» más allá de la carta. OpenAI negó que los despidos se debieran a que los investigadores plantearan inquietudes de seguridad. La publicación también dijo que se estaban ultimando contratos con evaluadores externos de seguridad y que habría detalles en las próximas semanas. La empresa no identificó la conducta ni la política concretas.

El gran cambio

  • Qué cambió: La respuesta pública de OpenAI ahora combina su explicación de los despidos con el plan de finalizar contratos con evaluadores externos de seguridad y una reafirmación pública de que la monitorización de modelos es un compromiso de toda la industria.
  • Por qué importa:La disputa de los investigadores abarca tanto su trato como su trabajo con grupos externos de seguridad. El compromiso de OpenAI da un próximo paso concreto para esa segunda cuestión, aunque siguen sin conocerse las condiciones, el acceso y el alcance del trabajo de los evaluadores.
  • Qué observar:OpenAI dijo que daría detalles en las próximas semanas. Esos datos permitirán ver si los evaluadores independientes obtienen el acceso sostenido que pidieron los investigadores y cómo puede el personal compartir información con ellos mientras protege material confidencial.

Esta es una continuación fechada del informe de BIG CHANGE sobre la carta de los investigadores. En su carta original a los órganos de supervisión de OpenAI, describieron tres situaciones distintas. Tomek Korbak dijo que le comunicaron verbalmente que su despido se relacionaba con cómo se comunicó con METR, la organización sin fines de lucro que participó en la evaluación del incidente de OpenAI con Hugging Face. Mikita Balesni dijo que su trabajo sobre monitorización con grupos externos se coordinó con su línea de reporte y que eliminó detalles confidenciales antes de compartir materiales. Jasmine Wang dijo que se le había delegado acceso al correo de un directivo para tareas de contratación, que pidió a TI que lo retirara y que notificó un clic accidental en un mensaje confidencial. Son los relatos de los investigadores, no conclusiones establecidas de forma independiente.

La publicación de OpenAI responde a dos solicitudes centrales de la carta. El texto íntegro reproducido por The Indian Express dice que la empresa estaba ultimando contratos con evaluadores externos de seguridad y mantenía su compromiso de integrar revisores externos. También dice que OpenAI está de acuerdo en que preservar la capacidad de monitorizar modelos de frontera requiere un compromiso de toda la industria y que seguirá invirtiendo en ello. Son declaraciones de la empresa sobre planes y prioridades; la publicación no identifica a los evaluadores, su acceso ni las condiciones contractuales.

Sobre los despidos, OpenAI dijo que una investigación encontró infracciones de las políticas sobre el manejo de información y que las decisiones no se debieron a críticas de seguridad. Pero la publicación no identifica la información, la norma concreta ni las pruebas de su conclusión. La Associated Press informó que OpenAI no daría más detalles sobre por qué despidió a los investigadores. Reuters informó que la empresa no reveló las presuntas infracciones. Ninguno publicó el expediente de la investigación ni estableció independientemente qué relato es correcto.

La disputa laboral tampoco resuelve el debate técnico separado sobre la monitorización. Los investigadores dicen que se está deteriorando la capacidad de monitorizar modelos de frontera; OpenAI dice que coincide en que importa y que seguirá invirtiendo. La respuesta del 9 de octubre no presenta nuevas mediciones ni resultados de evaluación.

Fuentes y lecturas adicionales