Руководители исследовательского направления OpenAI публично ответили 9 октября на письмо трех бывших исследователей по безопасности в OpenAI Newsroom post on X. Associated Press и Reuters сообщили, что компания заявила: внутреннее расследование обнаружило нарушения правил обращения с конфиденциальной информацией и выявило «серьезный разрыв доверия», выходящий за рамки письма. OpenAI отрицает, что увольнения были связаны с высказыванием опасений по поводу безопасности. В публикации также сказано, что компания завершает договоры с внешними экспертами по безопасности и сообщит подробности в ближайшие недели. Конкретные действия или нарушенное правило не названы.

Главное изменение

  • Что изменилось: В публичном ответе OpenAI теперь соединяет объяснение увольнений с планом завершить договоры с внешними экспертами по безопасности и вновь подтверждает, что мониторинг моделей — обязательство всей отрасли.
  • Почему это важно:Спор касается и отношения к исследователям, и их работы с внешними группами по безопасности. Обещание OpenAI задает конкретный следующий шаг по второму вопросу, но условия, доступ и объем работы экспертов остаются неизвестными.
  • За чем следить:OpenAI пообещала сообщить подробности в ближайшие недели. Они покажут, получат ли независимые эксперты постоянный доступ, которого просили исследователи, и как сотрудники смогут делиться информацией, защищая конфиденциальные материалы.

Это продолжение с датой публикации материала BIG CHANGE о письме исследователей. В своем первоначальном письме надзорным органам OpenAIони описали три разные ситуации. Tomek Korbak рассказал, что устно ему сообщили о связи увольнения с тем, как он общался с METR — некоммерческой организацией, участвовавшей в оценке инцидента OpenAI с Hugging Face. Mikita Balesni сказал, что его работа над мониторингом с внешними группами координировалась по линии подчинения и что перед передачей материалов он удалил конфиденциальные подробности. Jasmine Wang рассказала, что ей делегировали доступ к почте руководителя для подбора сотрудников, что она попросила IT удалить доступ и сообщила о случайном нажатии на конфиденциальное сообщение. Это рассказы самих исследователей, а не независимо установленные выводы.

Публикация OpenAI отвечает на два главных требования письма. Полный текст, опубликованный The Indian Express сообщает, что компания завершает договоры с внешними экспертами по безопасности и по-прежнему намерена привлекать внешних рецензентов. В ней также говорится, что OpenAI согласна: сохранение возможности мониторинга передовых моделей требует обязательства всей отрасли, и компания продолжает вкладываться в эту работу. Это заявления компании о планах и приоритетах; эксперты, их доступ и условия договоров не названы.

Об увольнениях OpenAI заявила, что расследование выявило нарушения правил обращения с информацией, а решения не были связаны с критикой безопасности. Однако публичная публикация не указывает, о какой информации и конкретном правиле идет речь, и не приводит доказательств вывода. Associated Press сообщило, что OpenAI не станет подробнее объяснять причины увольнения исследователей. Reuters сообщило, что компания не раскрыла предполагаемые нарушения. Ни одно из изданий не опубликовало материалы расследования и не установило независимо, чья версия верна.

Трудовой спор не разрешает отдельную техническую дискуссию о мониторинге. Исследователи утверждают, что способность отслеживать передовые модели ухудшается; OpenAI говорит, что согласна с важностью мониторинга и продолжит инвестиции. В ответе от 9 октября новых измерений или результатов оценки нет.

Источники и дополнительное чтение