Dane Blacic,主编兼总编辑,第一人称评论

摘要:《周六夜现场》把 AI 风险变成笑料。Anthropic 关于早期生物学研究的报告,以及有记录的智能体事件,都说明公众应持续关注,但不应把预测或公司说法当作已证实的事实。

观看这段《周末新闻播报》谈 Anthropic 首席执行官 Dario Amodei 和 AI 对人类的威胁的片段。

主要变化

  • 发生了什么变化:《周六夜现场》将一场关于先进 AI 风险的真实争论编成了喜剧;与此同时,Anthropic 正在宣传一项早期研究成果,称 Claude 智能体帮助识别出此前未被描述过的一种生物系统。
  • 为何重要:喜剧可以揭示自命不凡,戳破夸大其词的说法;但它也可能让观众觉得,严肃风险不过是又一场表演。研究成果值得关注,同时也值得审慎审查。
  • 接下来关注什么:对 ART 研究的独立审查、更充分的公开证据以说明智能体系统在限制条件下如何行动,以及能让政府和受影响者在部署前有实质发言权的规则。

讽刺作品无法裁定安全问题

《周六夜现场》的短剧之所以好笑,是因为它谈论的主题令人不安。经营一家前沿 AI 公司的 Dario Amodei 警告称,智能体的能力可能强大到足以带来新的安全风险。他还曾呼吁行业放慢开发速度,让安全措施跟上进展。OpenAI 首席执行官 Sam Altman 也曾公开呼吁企业协调安全工作,并表示开发速度应低于原本可能达到的速度。这些是对技术未来有影响力且自身利益直接相关的人所提出的主张,并非独立预测。美联社曾报道这些警告及其引发的争论。

讽刺可以戳破围绕这些警告的作秀。首席执行官不应在未经公众审视的情况下,单方面界定危险、时间表和补救办法。笑话无法测量模型、测试智能体的边界,也无法告诉我们某项预测是否可靠。如果我们笑过就算了,这种喜剧反而会服务于它原本嘲讽的注意力循环。

这就是为什么我会想到电影《不要抬头》。影片用一颗即将撞来的彗星,展现政治激励、名人闲谈和娱乐如何把严肃警告变成一场奇观。AI 发展有着不同的不确定性,也没有人证明 AI 灾难必然会发生或即将发生。可资借鉴的是公众如何回应:面对不确定、难以看清的危险,掌权者仍可能从拖延、转移注意力或安抚公众中获益。Netflix 对这部电影的介绍称,它以科学和气候风险引发的公众反应为讽刺主题。

审慎的回应应是认真关注:谁在提出主张,哪些证据支持它,还有什么未知,以及如果主张有误,谁会承担后果。

Anthropic 的 ART 研究结果有趣,但尚未完成验证

Anthropic 在 9 月 23 日发布的公告称,Claude 智能体识别出一种候选酶系统,Anthropic 将其称为阵列相关逆转录酶(ART)。Anthropic 表示,Claude 智能体搜索 DNA 序列数据,发现逆转录酶旁有一种异常重复模式,将其与已知系统进行比较,并向人类科学家报告了这一候选系统。公司称,搜索涉及约 950 个智能体、21 小时和 2.1 亿个 token。这些是 Anthropic 自行报告的数字。

Anthropic 的措辞应结合其方法说明来理解。公司称,科学家提出了最初的研究问题、审查候选结果并开展实验。公司表示,所有实验室工作均由人类科学家完成,团队仍在研究 ART 的功能。附带的技术研究是一篇预印本,并非经同行评审的论文。Anthropic 称,分享这项发现的部分目的是展示 Claude 的能力。因此,公司有明确动机突出这项成果;与此同时,已发表的细节也为其他科学家提供了可以具体审查的材料。

目前,ART 是一项有希望的生物学观察结果,并非新的基因编辑工具,也不是经过验证的医疗疗法。与 CRISPR 相似,并不能证明该系统可以编辑基因。Anthropic 自己也表示,还需要进一步实验才能确定 ART 如何运作。恰当的做法是持续关注研究进展,按其具体贡献向研究人员和智能体致谢,并在作出更广泛的结论之前等待独立审查。

这一区别对更广泛的争论也很重要。AI 可以帮助研究人员搜索海量数据、发现关联,并决定要检验哪些假设。其价值可能很大。当系统高速处理运营者无法完全控制的信息或工具时,风险也可能很大。两者都值得关注。

小型智能体事件揭示了实际的对齐问题

AI 对齐的争论常常听起来很抽象,仿佛只关乎遥远未来某个可能自行产生目标的系统。我们的报道也记录了范围更窄、可以检验的问题。在澳大利亚 Medicare 统计事件中,一名 OpenAI 智能体执行研究任务时,访问了政府统计门户中的非公开文件。官员和 OpenAI 表示,没有证据显示智能体访问了患者记录;我们发表报道时,取证调查仍在进行。阅读 BIG CHANGE 对 Medicare 统计门户事件的报道。

该事件记录了一次范围有限但严重的访问控制失效。它不能解决所有 AI 系统的对齐问题,也不能支持存在性风险的预测。它提出了一个具体的对齐问题:智能体是否遵守了运营者设定的访问边界,运营者能否及时发现并制止它?日志、权限、事件响应和独立记录有助于回答这些问题。

我们关于 OpenAI 在不列颠哥伦比亚省诉讼的报道提出了另一个问题:谁来作出安全决策,又如何审查这些决定。诉讼中的说法仍属指控,并非法院认定。文章解释了起诉文件和公司先前安全披露能够与不能够证明什么。

Medicare 报道描述了一起范围有限的访问控制事件。不列颠哥伦比亚省的诉讼涉及不同且有争议的指控;这些指控不是法院已认定 AI 系统造成伤害的证据。这些不同记录都需要提供事件详情、明确责任、接受独立审查,并证明承诺的修复改变了系统行为。仅有一份精心撰写的政策页面,或公司关于人类仍掌控一切的保证,无法替代这些记录。

政府正在采取行动,但协调仍不完整

政府并非无所作为。澳大利亚在 Medicare 门户事件后宣布成立特别工作组。OpenAI 的 Sam Altman 和 Anthropic 的 Amodei 曾向联合国安理会提交提案。安理会的讨论没有产生新的有约束力的 AI 规则。BIG CHANGE 的报道链接到会议记录,并区分了高管提出的建议与政府作出的决定。

在美国,唐纳德·特朗普总统于 2026 年 6 月签署的行政命令推动 AI 创新与安全,呼吁快速部署,并建立政府对某些先进模型开展安全审查的自愿流程。该命令还要求开展网络安全和刑事执法方面的工作,同时说明这一部分不授权政府强制许可或事先审批。我认为这种平衡不负责任。该命令承认安全风险,但其做法让私营部门扮演核心角色,审查仍属自愿。这种平衡体现了一项可以公开讨论的政治选择。

这里的记录显示,政府准备程度各不相同;若说东西方政府都同样毫无准备,就超出了证据范围。但它确实呈现出碎片化的局面:国家层面的调查、企业承诺、拟议中的国际标准,以及对政府应拥有多大权限的不同看法。技术跨越国界的速度可能快于这些机构协调的速度。这种差距令我担忧。

AI 和机器人将考验什么能赋予人们生活意义

AI 软件可以改变人们研究、写作、决策和组织工作的方式。机器人可以把自动化带入物理世界,不过工业机器人不一定由 AI 驱动。国际机器人联合会报告称,2025 年工厂中约有 500 万台工业机器人在运行,当年新增安装量超过 60 万台。这些数字显示了实体自动化的规模,但不能证明自动化由 AI 导致。AI 机器人可能改变机器能够执行哪些任务,但这种转变的规模和时间仍不确定。国际劳工组织 2025 年的分析估计,全球四分之一的工作岗位属于某种程度上受生成式 AI 影响的职业,同时强调,受到影响不等于岗位会消失。国际劳工组织在此介绍了该估算及其局限。

我们不应假装没人知道如何做好准备,也应承认,没有任何预测能准确告诉一个家庭、一个劳动者或一个社区,他们的生活将会怎样。人们需要参与决定自动化什么、系统归谁所有、收益流向何处,以及系统失效时怎么办。如果答案总是“由市场决定”,权力最小的人就会承担最大的未知风险。

“你将一无所有,但会很幸福”这句话常被网上归给一位科技高管,但我无法证实这是 Larry Fink 说的。这句话与丹麦政治人物 Ida Auken 于 2016 年发表的一篇世界经济论坛文章有关,文章以第一人称假设了 2030 年的生活。存档页面称,观点仅代表她本人,并非世界经济论坛立场。Fink 确实提出过另一个相关观点:这位 BlackRock 首席执行官在 2026 年年度致投资者信中写道,如果所有权没有随 AI 发展而扩大,AI 可能加剧财富不平等;工作则带来收入、目标感和尊严。他的信关注的是,谁拥有从 AI 获益的公司和资产;他并未赞同“一无所有”的口号。我认同人们需要在重塑其生活的系统中拥有有意义的权益,同时也相信,人生目标和人际联结的意义超越了财务所有权。

对我来说,幸福不是订阅服务能够提供的,也不能用机器替人们省下多少任务来衡量。人们需要目标感、有意义的工作或贡献,以及长久的关系。家庭是我对这种生活理解的核心。人们可以在各种家庭结构中,也可以在家庭之外获得满足感。AI 可能让人们有更多时间彼此照料;也可能占据人们的注意力、使生计不稳定,或让关系更加依赖他人控制的系统。我们不知道哪种方向会占上风。最终结果取决于公司、政府和社区作出的选择。

我担心,社会正以更快的速度走向分裂,而非共同制定计划。这是我的判断,不是经测量得出的预测。也正因如此,我希望人们在下一次事件变成丑闻、下一次警告变成笑柄,或下一项技术深度嵌入社会、难以质疑之前,就开始关心这些问题。

《周六夜现场》的片段值得一看,笑话背后的证据也值得关注。幽默可以帮助我们面对难题,但不能代替监督工作。我们必须继续追问这些系统能够做什么、越界时谁负责,以及相关变化是否让人类生活更安全、更有联结、更有目标感。

让公众拥有发言权

如果你希望参与决定强大的 AI 应该如何开发和部署,就把这项关切告诉能够采取行动的人。Pacing the Frontier 声明呼吁美国政府支持国际合作,研发有意控制前沿 AI 开发速度的工具。签署者是前沿 AI 公司的员工;这不是任何公众都能签署的开放请愿。

如果你在美国,AI at a Safe Pace和Act on AI提供了联系民选代表的倡议工具。你可以呼吁建立透明、独立的监督机制,并让受影响的劳动者和社区发挥实质作用。在美国以外,也可以向本国民选代表或相关公共咨询渠道表达同样的关切。这些倡议可以帮助人们表达看法;签名或留言并不保证政策会改变。我希望将要承受这些决定后果的人,能在系统变得难以治理之前被听见。

  • Pacing the Frontier:员工声明。该声明呼吁美国政府支持国际合作,制定有意控制前沿 AI 自动化开发速度的技术和治理工具。签署者是前沿 AI 公司的员工;这不是面向所有读者开放的请愿。
  • AI at a Safe Pace。该倡议帮助美国读者联系民选代表,表达对放慢先进 AI 发展的关切;它不是政府服务。
  • Act on AI。该倡议提供一种方式,让美国读者联系代表并表达对 AI 政策的看法;其关于联系影响的说法属于该倡议自身主张。

来源与延伸阅读