OpenAI 研究主管於 10 月 9 日公開回應三名前安全研究人員的一封信,並發表在 OpenAI Newsroom post on X。Associated Press與Reuters報導,公司表示內部調查發現研究人員違反敏感資訊處理政策,並稱信件之外還有「嚴重的信任破裂」。OpenAI 否認解僱與提出安全疑慮有關。貼文也表示,第三方安全評估人員的合約正在敲定,未來幾週會公布詳情。公司未指出涉及的具體行為或政策。

重大變化

  • 變化內容: OpenAI 的公開回應現在把解僱說明與敲定第三方安全評估合約的計畫放在一起,也再次公開確認,模型可監控性是全產業的共同承諾。
  • 重要性:研究人員的爭議既涉及他們受到的待遇,也涉及他們與外部安全團體的合作。OpenAI 的承諾為第二個問題提供具體的下一步,但評估工作的條款、權限與範圍仍未知。
  • 後續觀察:OpenAI 表示將於未來幾週公布詳情。這些內容可顯示獨立評估人員是否取得研究人員要求的持續存取權,以及員工如何在保護機密資料的同時與他們分享資訊。

這是對 BIG CHANGE 報導研究人員聯名信的有日期後續報導。他們在 致 OpenAI 監督機構的原始公開信中描述了三種不同情況。Tomek Korbak 表示,有人曾口頭告知他,解僱與他和 METR 的溝通方式有關;這個非營利組織曾參與評估 OpenAI 的 Hugging Face 事件。Mikita Balesni 表示,他與外部團體合作的可監控性工作經由主管匯報線協調,且他在分享資料前刪除敏感細節。Jasmine Wang 表示,為招募工作而獲授權存取一名主管的電子郵件後,她要求 IT 移除權限,並通報自己意外點擊敏感訊息。這些是研究人員的說法,並非獨立確認的調查結論。

OpenAI 的貼文回應了信中的兩項核心訴求。《印度快報》刊出的全文表示公司正在敲定第三方安全評估合約,並持續承諾納入外部審查者。文中也表示,OpenAI 認同維持前沿模型可監控性需要全產業共同承諾,並會持續投入這項工作。這些是公司對計畫與優先事項的說明;貼文未公布評估人員身分、其存取權限或合約條款。

關於解僱,OpenAI 表示調查發現資訊處理政策遭違反,且其決定並非出於安全批評。但公開貼文沒有指出相關資訊、具體規則或支持結論的證據。Associated Press報導,OpenAI 不會進一步說明解僱研究人員的原因。Reuters報導,公司沒有揭露所稱違規。兩家媒體都未公布調查檔案,也未獨立確認哪一方的說法正確。

勞動爭議也沒有解決可監控性的獨立技術爭論。研究人員表示,監控前沿模型的能力正在下降;OpenAI 表示認同可監控性很重要,並會繼續投資。10 月 9 日的回應沒有提出新的測量或評估結果。

來源與延伸閱讀