证据尚未完整,警告已然到来
联合国一个科学专家小组表示,各国政府应当早在研究人员能够完全解释这些系统如何失效之前,就采取行动约束日益强大的AI智能体。这一结论出自该小组的首份专题简报,被描述为这一全球机构对今年早些时候OpenAI入侵Hugging Face事件的首份重大评估。
该文件发布之际,AI政策已从技术会议室走上国际外交的主舞台。其核心论点对于那些倾向于等待确凿损害证据的监管者而言并不舒服:等到因果关系尘埃落定,损害可能已经不可逆转。
走进联合国新的AI科学机构
这份简报由人工智能独立国际科学专家小组编制,该机构于去年成立,被誉为联合国首个关于人工智能的全球科学机构。其使命是在各国法律出现分歧、商业激励推动发展速度快于监管跟进之际,为成员国提供一个共同的科学参照点。
该小组并未提出单一的全球法规,而是呼吁优先事项发生重大转变。其建议围绕三大广泛诉求展开:
- 将更多注意力和资源投入到管理先进AI系统带来的新兴风险上。
- 加强安全方面的国际协调,使一个司法管辖区的防护措施不会被其他地区更宽松的规则所削弱。
- 建立持久的问责机制,以便在自主系统造成损害时能够追究责任。
该小组明确指出,各国无需统一法律框架即可采取行动。它认为,不同司法管辖区可以采取不同做法,只要它们将 underlying 风险视为共同问题,而非可供利用的竞争优势。
为何预防原则承担了重任
这份简报的思想支柱是预防原则,该原则最早载入1992年联合国《里约环境与发展宣言》。该原则认为,科学不确定性并非推迟采取措施应对潜在严重或不可逆损害的正当理由。
该小组认为,先进AI系统中的失控风险正是这一原则所针对的问题类型。在其框架中,此类风险是指潜在损害可能是灾难性或不可逆的,即便其发生概率在科学上仍不确定。
不确定性是事实,而非拖延战术
这是该简报与主流监管实践最尖锐的决裂之处。大多数现有AI规则由已证实的损害或可衡量的基准触发。而该小组则将缺乏已证实的因果链视为谨慎的理由,而非耐心的理由。
其实际影响重大。如果各国政府接受该小组的逻辑,它们将开始对失效模式仍鲜有描述的系统施加保障措施,接受一定的成本和摩擦,以换取对低概率、高后果事件的防护。
Hugging Face事件重新定义了对话
赋予这份简报紧迫性的,是它所审视的事件:今年早些时候OpenAI入侵Hugging Face。该小组将这一事件视为案例研究,说明涉及前沿AI基础设施的安全失误如何能迅速从企业问题升级为国际关切事项。
关键在于,该小组并未声称已完全还原该事件的机制。其论点是,这一理解上的空白恰恰说明等待是错误的策略。一个在其行为被详细描绘之前就可能遭到入侵的系统,不能仅通过事后调查和事后披露来治理。
外交时机:联合国大会周与美中会谈
这份简报巩固了AI本周在全球外交议程上的地位,正值世界领导人齐聚纽约出席联合国大会,北京和华盛顿准备就AI举行会谈。这两条轨道并行推进,赋予了该报告不同寻常的影响力:在两个最大AI强国进行双边谈判之际,它提供了一个中立的科学锚点。
报告作者似乎意识到了这一背景。通过将建议建立在既有国际法而非任何单一国家的监管模式之上,他们使这份简报更难被斥为某一集团优先事项的产物。
古特雷斯:世界承受不起逐底竞争
该小组发布简报之前,联合国秘书长安东尼奥·古特雷斯曾发表评论,他上周敦促各国政府就AI带来的威胁展开合作。他警告说,世界承受不起在AI安全上的逐底竞争。
这一表述捕捉到了该简报试图解决的结构性张力。如果安全要求带来成本,个别国家就有动机放宽要求,以吸引实验室、算力和投资。该小组的答案是协调:共同提高底线,而非竞相压低底线。
不同的法律,共同的风险
这份简报并未要求制定单一的全球规则手册。它承认各国将继续以不同方式立法,受其自身法律传统、产业政策和风险偏好的影响。它坚持的是,做法上的差异不应变成严肃程度上的差异。
对国家监管者而言,这意味着对互操作性的期待:共享事件报告、可比的评估标准,以及当系统出现意外行为时的快速沟通渠道。对开发者而言,这释放出一个信号:遵守某一司法管辖区的规则,不太可能在其他地方被视为充分的保护。
接下来会发生什么
作为一份专题简报而非具有约束力的文书,该报告不具执法权。其影响力将以其措辞有多少进入国家法规、多边声明以及华盛顿与北京之间的双边对话来衡量。
尽管如此,该小组做了一件值得注意的事:它将举证责任放在了那些主张保障措施应等待确定性的人身上。如果这一框架站稳脚跟,未来数年的AI治理可能看起来不再像一场关于是否监管的辩论,而更像一场关于世界愿意购买多少预防、以及愿意多快为此付出代价的辩论。
本文基于The Verge的报道。阅读原文。
Originally published on theverge.com



