两位研究者为华盛顿与北京提供了一份模板
来自美国和中国的专家希望防止人工智能系统自主决定部署核武器,他们现已提出具体提案,希望两国政府采纳。布鲁金斯学会的Melanie Sisson与复旦大学的Jiang Tianjiao在特朗普总统与习近平主席计划于9月24日举行会晤之前发表了这些建议——这一时机似乎旨在趁高层对话仍在日程之中,将具体措辞呈现在决策者面前。
两位研究者并未呼吁全面暂停AI的军事应用,而是聚焦于少数几条明确界定的红线。这种框架反映了一种隐含判断:美中利益最明显重叠的领域,也正是误判后果最难控制的领域。
提案将划定的红线
这些建议列出了若干禁止事项,每一条都针对特定的失效模式,而非针对技术本身。
不得拥有独立发射权
第一条也是最关键的一条规则涉及发射权。根据提案,任何AI系统都不得自行发射核武器。该条款将封堵任何路径,使算法无论多么强大,都无法在没有人类决策支撑的情况下下令发动打击。
核指挥系统不得触碰
第二条红线禁止将AI用于攻击核指挥系统。由于这些系统处于一国探测、决策和报复能力的核心,针对它们的自动化操作极有可能被解读为首次打击的准备。将其排除在AI赋能的目标选择之外,旨在消除这一特定触发因素。
人类保留对网络行动的完全控制
第三项条款涉及网络空间。人类将被要求保留对针对战略基础设施的AI驱动网络攻击的完全控制。网络行动是一个机器速度行动已具现实可能性的领域,也是一个探测与瘫痪对手之间的界限可能因自动化工具的速度而变得模糊的领域。
就“人类控制”的实际含义达成一致
支撑这些具体禁令的是一个定义问题。提案呼吁两国就“人类控制”的共同定义达成一致。没有这一共同词汇,各方都可能声称合规,却按照对方不承认的标准行事——这正是军控协议历来难以弥合的模糊之处。
立足于已达成的共识
这些建议建立在拜登与习近平于2024年11月达成的谅解之上。此前的承诺确立了最高层的政治认可,但并未解决哪些行为被禁止、由谁核查合规、以及如何解决争端等操作性问题。新提案试图将一份意向声明转化为更接近可操作规则手册的东西。
将该努力框定为现有谅解的延伸,是一种刻意的外交选择。它使两国政府能够将这些措施呈现为延续而非让步,当双方国内受众倾向于将任何双边安全安排解读为立场削弱时,这一点尤为重要。
围绕AI事件建立的热线
Jiang还提议建立一条专门针对AI事件的热线。其推理直截了当,值得细究。假设一个防御性AI系统自动对它所识别到的可疑活动作出回应。另一方在缺乏背景的情况下观察到这一回应,可能将其解读为攻击的开端,而非对误读信号的反应。两国政府之间的直通线路可以让一方在局势升级到澄清仍有用的程度之前,说明某起事件是意外。
实际上,这条热线旨在用人类对话打破自动化循环——恢复自动化系统本应压缩的、更缓慢审慎的决策过程。
为何部分分析人士质疑热线构想
并非所有人都相信这样一条渠道在最需要时能够发挥作用。约翰斯·霍普金斯大学的Carla Freeman质疑这类热线是否真能奏效。她指出2023年的间谍气球危机,当时美国打电话时中国没有接听。
这一例子直击核查问题的核心。热线的价值取决于双方在真正危机期间接听的意愿,而危机时刻恰恰是政府最不愿意信任一条不熟悉渠道的时候。这一反对意见并非认为沟通不必要,而是认为制度机制需要在紧急情况使其成为关键支撑之前,早就得到演练和常态化。
五年的警告,仍无约束性规则
这并非首次敲响警钟。美国人工智能国家安全委员会早在2021年就呼吁保留人类对核武器的控制。五年多过去了,具有约束力的机制仍不存在。
这一差距——广泛共享的诊断与任何可执行工具缺失之间——正是新提案必须克服的核心障碍。专家共识在大体上已经达成:很少有严肃声音主张应由机器决定是否使用核武器。真正难以实现的是让这一共识具有约束力、可核查、并能跨越政府更迭而持久的机制。
9月24日之前的狭窄窗口
这些提案出台之际,两国政府正筹备会晤,这使这些想法有机会从智库论文的页面进入塑造峰会议程的筹备对话。它们能否做到,以及是否有任何红线能在谈判过程中存活下来,将取决于远在研究者控制之外的因素。
这些提案确实做到的是将论点具体化。它们没有泛泛警告军事AI的风险,而是指出了具体的禁止事项、一项定义任务和一条危机沟通渠道——一组有可能被讨论、部分采纳或直接拒绝的事项。在一个以分钟和英里衡量利害的政策领域,这种具体性本身就是一种贡献:它将抽象的担忧转化为决策者实际可以做出的一系列决定。
本文基于The Decoder的报道。阅读原文。
Originally published on the-decoder.com



