AI 安全辩论中出人意料的趋同

人工智能领域三位最杰出的人物——OpenAI 首席执行官 Sam Altman、Elon Musk 以及前 DeepMind 首席执行官 Demis Hassabis——都至少部分支持了 Anthropic 首席执行官 Dario Amodei 提出的一项主张,即在 AI 实验室内部实行独立监督。据 The Decoder 报道,这一立场趋同在一个领导者们经常就风险、时间线和监管公开分歧的领域里,标志着一个值得注意的时刻。它并不代表在放缓 AI 发展上达成了完全共识,但确实表明外部或独立评估的理念已更接近主流。

Musk 的立场最不令人意外。多年来他一直警告 AI 风险,常常将先进系统描述为一种生存性担忧。相比之下,Altman 和 Hassabis 领导的机构,其商业成功依赖于前沿模型的快速部署。他们愿意支持独立监督——即便是部分支持——也表明辩论已从是否需要监督,转向监督应如何设计以及由谁来执行。

Amodei 提出了什么

Amodei 的提议核心在于这样一条原则:AI 实验室不应成为自身安全性的唯一裁判。在这一框架下,独立评估将让外部专家接触模型和训练流程,以便在部署前评估能力与风险。据报道,Altman 和 Amodei 在这一核心点上意见一致:AI 实验室应接受独立评估。这一趋同意义重大,因为两人都经营着在前沿竞争的公司,而且此前都曾面临批评,称自我监管无异于自己给自己批改作业。

独立评估作为共同原则

Altman、Musk 和 Hassabis 的支持并不是对暂停令或全球速度上限的全面认同。更准确的理解是,他们支持一种治理机制:对前沿系统进行独立审查。这一区别很重要。一家实验室可以接受外部评估,同时仍主张快速发展,只要评估显示系统足够安全、可以继续推进。反过来,批评者也可以支持独立监督,同时反对强制放缓。

为何共识只是部分的

这种支持的部分性质,为围绕执行的激烈分歧留下了空间。谁来任命评估者?他们能获得什么访问权限?如果实验室对评估结果提出异议会怎样?这些问题都没有被共同原则解决。The Decoder 指出,这些领导者一致认为需要在 AI 实验室内部实行独立监督,但实际细节仍悬而未决——而这些细节将决定监督是有意义的,还是仅仅象征性的。

OpenAI 的 IPO 时机与安全解释

Altman 还告诉《财富》杂志,OpenAI 今年不会上市,理由是安全方面的担忧。他已在 6 月内部传达了这一决定。候选简报将此举描述为出于安全考量将 IPO 推迟到 2027 年,同时也指出了另一种解读:OpenAI 的财务状况目前可能不支持 IPO,尤其是与 Anthropic 相比。两种解释可能同时成立。一家公司既可能面临不利的市场环境,也可能选择强调安全作为等待的理由。

对推迟的两种解读

安全解释符合 Altman 近期的公开姿态。如果前沿 AI 带有严重风险,那么承担上市的信息披露义务和季度压力,可能会使一项审慎的安全战略复杂化。财务解释则符合竞争格局。Anthropic 被引为比较对象,而 IPO 归根结底既是一个市场决定,也是一个理念决定。投资者和监管机构可能会要求明确究竟是哪个因素在驱动这一时间表。

Altman and Amodei agree: AI labs should be evaluated independently. | Image: via X
Altman and Amodei agree: AI labs should be evaluated independently. | Image: via X

无论如何,这一推迟使 OpenAI 在主要 AI 公司中独树一帜:一家领先实验室的领导层公开将其资本市场决策与安全担忧挂钩。这种挂钩赋予了监督辩论一个具体的企业维度。它不再只是抽象原则的问题;它关乎一家前沿实验室如何构建其治理、披露以及对独立审查的义务。

反驳意见:稳定性才是真正的速度上限

并非所有人都接受 Amodei 所提议速度上限背后的前提。Google 研究员 Peyman Milanfar 提出反驳,认为递归自我改进(RSI)是一种天真的假设,因为其中涉及的反馈回路本质上是不稳定的。在他看来,一个系统越是试图优化自身,就越会陷入盲点。他认为,可靠的证据来自现实世界,而不是基准测试。

为何 Milanfar 认为速度上限没有必要

Milanfar 的论证将他引向一个不同结论:不需要强制速度上限,因为自我改进天然是有边界的。他主张,能够可靠地自我改进的系统,将受到从纯粹效率角度看显得浪费的容差的治理、抑制、放缓和约束。用他的表述来说,稳定性本身就是有效的速度上限。如果这是正确的,那么失控的递归改进与其说是一种迫在眉睫的必然,不如说是一种忽视反馈回路脆弱性的理论情景。

这是对推动监督呼吁的风险模型的直接挑战。Amodei 的提议假设,除非施加外部约束,否则实验室可能会加速到超过安全速度。Milanfar 的回应则假设,底层动态本身已经施加了约束,而基准驱动的叙事夸大了系统能够多顺利地自我提升能力。分歧不在于安全是否重要;而在于这项技术究竟需要何种干预——如果需要的话。

辩论接下来走向何方

两个阵营之间的分歧将塑造 AI 治理的演变方式。如果独立监督成为一项标准预期,实验室可能会在外部评估者的可信度上展开竞争。如果不稳定性论证获得更多支持,那么放缓的呼吁可能会被重新表述为对已经受自身边界约束的系统施加不必要的刹车。

  • Altman、Musk 和 Hassabis 都部分支持了 Amodei 关于在 AI 实验室内部实行独立监督的呼吁。
  • 据报道,Altman 和 Amodei 一致认为 AI 实验室应接受独立评估。
  • Altman 告诉《财富》杂志,OpenAI 今年不会上市,理由是安全担忧,这一决定已于 6 月在内部传达。
  • 候选简报还指出了一种财务解读:OpenAI 的数据目前可能不支持 IPO,尤其是相对于 Anthropic 而言。
  • Google 研究员 Peyman Milanfar 认为 RSI 是一种天真的假设,因为自我优化的反馈回路不稳定,且盲点会随着优化而加深。
  • Milanfar 主张可靠证据来自现实世界而非基准测试,并认为稳定性发挥着有效速度上限的作用。

目前,最具影响的进展或许是,曾经对监督提议不屑一顾的领导者与曾倡导这些提议的领导者之间的差距正在缩小。独立评估不再是一项边缘诉求。从 OpenAI 到 Anthropic,从 Musk 长期以来的警告到 Hassabis 的研究背景,前沿领域的各路人物至少都能部分支持这一立场。剩下的问题关乎制度设计、执行,以及推迟 IPO 的安全理由究竟反映的是一项持久战略,还是一种便利的叙事。无论速度上限辩论中哪一方占上风,这些问题都将伴随该行业进入下一阶段。

本文基于 The Decoder 的报道。阅读原文

Originally published on the-decoder.com