OpenAI研究负责人于10月9日公开回应三名前安全研究人员的一封信,信件发表于一则OpenAI新闻办公室在X上的帖子。美联社和路透社报道称,公司表示内部调查发现研究人员违反了敏感信息处理政策,并称信件之外还存在“严重的信任破裂”。OpenAI否认解雇与提出安全担忧有关。帖子还称,第三方安全评估方的合同正在敲定,未来几周将公布详情。公司没有指出具体行为或涉及的政策。

重大变化

  • 变化内容: OpenAI公开回应解雇事件,同时表示计划敲定第三方安全评估合同,并再次公开确认,可监控前沿模型是全行业的共同承诺。
  • 重要性:研究人员的争议既涉及他们受到的待遇,也涉及他们与外部安全团体的工作。OpenAI的承诺为第二个问题提出了具体后续步骤,但评估工作的条款、访问权限和范围仍未知。
  • 后续关注:OpenAI表示将在未来几周提供详情。这些信息将显示独立评估方能否获得研究人员所要求的持续访问权限,以及员工如何在保护机密材料的同时与他们分享信息。

这是对BIG CHANGE此前报道研究人员联名信的后续报道。在他们致OpenAI监督机构的原始公开信中,三人描述了不同情况。Tomek Korbak称,他被口头告知解雇与其和非营利组织 METR 的沟通方式有关;METR曾参与评估OpenAI的 Hugging Face 事件。Mikita Balesni称,他与外部团体开展的可监控性工作经过直属汇报线协调,并在分享材料前删除了敏感细节。Jasmine Wang称,一名高管的邮箱访问权限曾为招聘工作授权给她;她要求IT移除该权限,并报告自己意外点击了一条敏感消息。这些是研究人员的说法,并非独立确认的调查结论。

OpenAI的帖子回应了这封信的两个核心诉求。《印度快报》刊出的全文称,公司正在敲定与第三方安全评估方的合同,并仍承诺让外部审查人员参与其中。帖子还称,OpenAI认同,维护前沿模型可监控性需要全行业共同承诺,并会继续投入相关工作。这些是公司对计划和优先事项的陈述;帖子没有公布评估方身份、访问权限或合同条款。

关于解雇事件,OpenAI称调查发现了信息处理政策违规,并表示决定与安全批评无关。但公开帖子没有说明相关信息、具体规则或支持结论的证据。美联社报道OpenAI不会进一步说明解雇研究人员的原因。路透社报道公司没有披露所称违规的具体内容。两家媒体均未公布调查档案,也未独立确认哪一方的说法正确。

这场劳动争议也没有解决关于可监控性的独立技术争论。研究人员称监控前沿模型的能力正在下降;OpenAI则表示认同可监控性很重要,并会继续投入。10月9日的回应没有报告新的测量或评估结果。

来源与延伸阅读