美国和俄罗斯通过取消人工目标审查削弱 AI 武器协议
据报道,美国和俄罗斯在 9 月的谈判中削弱了一项联合国 AI 武器协议,尽管各方对自动化战争的担忧日益加深,两国仍删除了多项保障措施。
根据三名知情人士向修订内容报道披露的信息,被删除的条款要求在发动打击前由人类审查 AI 生成的军事目标。谈判代表还取消了对军事 AI 必须以可预测且可靠的方式运行的要求。呼吁考虑伦理因素的条款也被删除。
美国国务院、俄罗斯外交部和联合国均未回应该媒体的置评请求。这一沉默意味着,保密谈判之外的重要细节仍未得到证实。
不过,据报道的改动揭示了明显分歧。许多政府和人道主义团体希望实施可强制执行的限制,以保留人类控制权。美国和俄罗斯则倾向于在军事 AI 的设计和部署方式上保留更大的国家自主裁量空间。
这项美俄 AI 武器协议并非条约,其现有措辞也不构成具有约束力的法律。然而,它代表着多年来联合国谈判在制定共同规则方面所达到的最远进展。
因此,冲突远不止于一份存在争议的草案。它是对具有约束力的人类控制要求与由寻求行动灵活性的军事强国塑造的自愿原则之间的较量。
美俄 AI 武器协议发生了什么变化
草案失去了针对“算法建议何时转变为攻击决定”这一关键节点的保障措施。
据《华盛顿邮报》报道,谈判于 9 月初在日内瓦举行。会议涉及致命性自主武器系统,即能够以不同程度的人类参与选择或攻击目标的武器。
三名熟悉谈判的人士表示,美国和俄罗斯代表团在一次闭门会议中推动了修改。报道称,联合国的摄像机被关闭,民间社会观察员也被请出会场。
报道说,两个代表团各带来了约 10 名律师,几乎是其他参与方外交人员数量的两倍。他们提出的修改来得很快,以至于较小代表团难以跟上不断变化的文本。
最具影响力的删除内容涉及目标审查。早先的一项条款要求,在打击继续进行前,由人类审查 AI 生成的军事目标。
这项要求既适用于 AI 决策支持系统,也适用于更具自主性的武器。决策支持系统可以分析监视信息、对疑似目标排序、评估风险,或提出攻击建议,但并不实际发射武器。
删除审查条款并不意味着自动授权机器在无人监督下杀戮。无论使用何种技术,现有国际人道法仍对各国和军事人员具有约束力。
然而,这项删除取消了一项拟议的程序性保障。草案不再明确要求,使用武力前必须由人员独立审查 AI 生成的目标。
据报道,代表团还删除了要求系统以可预测、可靠方式运行的措辞。这些表述至关重要,因为当战场条件偏离训练和测试环境时,机器学习系统的行为可能发生变化。
他们还删除了一项要求军方在使用 AI 赋能武器时考虑伦理问题的条款。伦理语言或许难以执行,但删除它收窄了草案所表达的预期。
这些变化合在一起意义重大。人工审查、可靠性和伦理评估涉及同一链条的不同阶段,从系统设计到目标选择和攻击授权。
该草案仍属于基于共识的程序。数十个参与国必须达成一致,更严格的规则才能推进,这赋予了主要反对方相当大的阻挠能力。
预计各国政府将于 11 月重返日内瓦。他们将讨论该程序是否应获得正式授权,以及谈判能否朝着具有法律约束力的规则推进。
这次会议将检验被删除的条款是否会继续缺席、以修改后的形式回归,或成为单独协议的议题。它也将显示较小国家能够维持多大程度的抵制。
缺失的人类审查规则最为关键
如果审查者没有足够的信息、权力和时间来否决机器的建议,人类批准这一步骤的价值就微乎其微。
被删除的要求并不只是让某个人处于指挥链中的某个位置。它关注的是,在武器释放之前,人类是否必须审查由 AI 系统生成的具体目标。
这一差异是军事 AI 治理的核心。人类控制可以指从设计广泛任务参数,到在攻击前立即审查每一个建议目标的任何安排。
这些安排带来的保障截然不同。批准一般作战区域的指挥官,并不一定会评估算法识别出的每个人、车辆或建筑物。
目标选择还涉及模式识别系统无法单凭统计数据解决的法律和情境判断。操作人员必须区分军事目标与平民,并评估预期的附带伤害。
AI 可以高速整合传感器数据、通信内容、图像、位置历史及其他数据。随后,它可以根据从以往案例中学习到的相关性,对物体或人员进行评分。
这种速度带来军事优势,也可能造成自动化偏见,即人们在未进行有意义的独立判断时接受计算机化建议。
面对数分钟内涌现的数百个拟议目标,审查者可能机械地批准输出结果。人类在形式上仍参与其中,但实际流程已将决策转向机器。
人权观察组织 2026 年 6 月发布的军事 AI 简报指出了这一风险。简报警告称,速度和规模可能使必要的预防措施变得困难甚至不可能。
该组织认为,概率性输出不能取代国际人道法所要求的定性判断。它还建议暂停将 AI 作为目标选择决策的依据。
这一立场比据报道的联合国草案走得更远。但它说明了为何被删除的审查措辞比泛泛承诺负责任使用具有更大分量。
一项有用的保障措施应明确审查者将获得哪些信息,包括系统的证据、不确定性、数据局限性和推荐目标的理由。它还应保留审议所需的时间。
审查者需要有权延后或取消打击,而不必承受与机器速度同步的压力。他们还需要接受军事法律和系统失效模式方面的培训。
最终决定还需要留下记录。如果没有显示建议内容、支撑数据、人类回应和指挥授权的日志,在平民伤害发生后就很难追究责任。
“人类参与回路”这一表述并不能保证上述支持性细节。一个名义上的批准按钮,可能是在掩饰自动化流程,而不是对其加以约束。
因此,被删除的条款是必要的,但并不充分。恢复它将确立最低预期,而详细标准将决定审查是否具有实际意义。
军事速度正在与人类判断发生碰撞
推动弱化规则的行动激励在于速度,而法律和人道主义方面的担忧在于,速度是否会取代判断。
军事组织正越来越多地将 AI 用于情报分析、后勤、监视、网络行动和战场规划。这些应用并非都具有相同风险。
自动化维护计划与将人员列为潜在目标存在根本差异。前者可以提高效率,后者则可能影响不可逆转的生死决定。
美国官员已公开强调更快的目标选择。一名五角大楼官员告诉美联社,AI 可以帮助部队更快识别目标,并加速后续打击。
其他军事领导人则强调谨慎。领导美国特种作战司令部的弗兰克·布拉德利海军上将表示,人类必须相信 AI 只会将暴力引向预期目标。
指挥部门官员还将 AI 描述为减少日常行政工作的工具。一位负责采购的领导人表示,目标是增强操作人员的判断力,而非取代它。
这些立场揭示的是内部张力,而非在采用与拒绝之间作出的简单选择。军事领导人希望获得计算速度,同时保留信心、控制权和法律责任。
在高强度行动中,这种张力会更加尖锐。《华盛顿邮报》报道称,美军在一场战争开始后的前 24 小时内,使用 Anthropic 聊天机器人协助识别了近 1,000 个目标。
该报道并不能证明该聊天机器人独立选择了目标或授权了打击。但它说明,审查程序必须同时考虑规模和正式授权。
当行动时间表只允许每项决定花费数秒时,一个人无法对大量建议进行有意义的评估。即使批准仍由人类作出,更快的输出也会削弱审议。
6 月联合国在日内瓦举行的交流会议汇集了 100 多个国家、国际组织和民间社会团体。
奥地利、巴西、智利、墨西哥、塞拉利昂、哥斯达黎加和古巴等政府在讨论中强调了人类判断和问责。
俄罗斯反对新的限制,并将一些提案描述为由西方主导的倡议。俄方认为,军事 AI 应继续置于现有的常规武器政府专家程序之内。
据会议记录,美国和以色列出席了会议,但未提交正式的会议发言。他们的出席并未明确其所倾向的最低保障措施。
支持国家灵活性的实际理由很直接。指挥官不希望宽泛的国际措辞禁止防御性自动化,或拖慢合法行动。
反对方的论点同样具体。如果每个国家都自行定义何为“适当”的人类判断,这一表述就难以对最低限度或仪式化审查提供多少防护。
这也是为什么可预测性和可靠性同样受到争议。这些要求可能会限制尚未在真实战场条件下得到验证的系统部署。
战场上存在受损传感器、欺骗信号、不完整情报、陌生环境,以及试图操纵算法的对手。在受控测试中衡量的表现,未必能经受住这些条件。
删除明确的可靠性措辞,使政府对可接受性能拥有更大裁量权。它也使得在系统影响致命决策之前建立共同门槛变得更加困难。
自愿规范正在与具有约束力的限制竞争
这场核心外交博弈在于:强大军事力量究竟应承诺克制,还是接受其他国家可据以约束它们的规则。
美国此前曾推动负责任军事 AI 的自愿原则。其 2023 年政治宣言呼吁明确界定使用场景、建立负责任的指挥链、进行测试,并确保适当的人类判断。
已有超过 50 个国家认可这一框架。它建立了共同语言,但并未形成条约、执行机制或独立检查程序。
自愿宣言仍可影响采购、训练和军事 doctrine。它们能够帮助各国政府在对具有约束力法律形成政治支持之前,就预期达成趋同。
当战略激励发生变化时,其弱点便会显现。国家可以重新解读弹性措辞、修订国内政策,或取消实际保障措施,而不会违反法律义务。
据报道,日内瓦草案的修改正反映了这种分歧。美国和俄罗斯虽是地缘政治竞争对手,但两国都拥有先进军事力量,也重视武器研发自主权。
两国都不支持活动人士倡导的、限制自主武器的具有约束力国际条约。它们的共同利益在于阻止其他国家确立狭窄的规则。
这种一致性并不意味着双方军事 doctrine 完全相同。它意味着,在相关技术和战场应用不断发展之际,两国政府都能从保留国家裁量权中获益。
共识规则会放大它们的影响力。Stop Killer Robots 的 Nicole van Rooijen 表示,华盛顿和莫斯科能够阻止获得绝大多数国家支持的进展。
较小国家或许支持严格保障措施,却缺乏同等规模的法律团队和外交施压力度。当修改快速出现时,封闭式起草会议可能加剧这种不平衡。
条约倡导者将化学武器、生物武器、杀伤人员地雷和集束弹药视为先例。这些制度在成员资格和执行机制方面各不相同,但都帮助污名化了某些行为。
国际红十字委员会裁军顾问 Richard Lennane 曾指出,条约的意义不仅在于惩罚,更在于塑造规范和行为。
联合国和红十字会于 8 月重申了联合呼吁。它们寻求禁止某些自主武器,并限制其他类型。
其提案将禁止那些其影响无法被充分理解、预测或解释的系统,也将禁止被设计或用于直接瞄准人类的系统。
其他自主系统仍可在涉及目标类型、持续时间、地理范围和人类监督的限制下获准使用。这一结构避免将所有自动化功能一概视为同等危险。
美俄 AI 武器协议处于这些方案之间。它可能继续作为自愿政治声明,也可能成为条约谈判的基础,或在共识机制下陷入停滞。
这种不确定的法律地位解释了为何措辞如今如此重要。早期妥协往往会成为后续协议、国家政策、采购合同和军事手册的参考点。
如果人类目标审查从共同基线中消失,倡导者就必须在每一个后续阶段争取恢复它。这一遗漏可能逐渐成为被接受的外交起点。
草案仍留下关键未解问题
该报道指出了一些被删除的保障措施,但没有披露完整草案、各代表团的提案,或争议措辞最终具有何种法律含义。
《华盛顿邮报》的报道基于三名熟悉机密谈判的人士。被点名的政府和联合国均未提供可供刊载的回应。
因此,读者应区分报道细节与已获公开确认的外交记录。删除内容具有可信报道基础,但完整谈判历史尚未公开。
目前仍不清楚美国和俄罗斯是否提出了完全相同的修改,还是选择性地相互支持。两国反对各项条款的理由并未公布。
公众也尚未获得逐项对照文本,以显示每一次修订。这样的比较将揭示保障措施是被直接删除、移往其他位置,还是被更宽泛的措辞取代。
“人类审查”这一表述同样需要定义。一项要求可能适用于每个目标、特定类别的目标,或仅适用于 AI 系统提供决定性信息的情形。
同样,“AI 生成的目标”可能指机器最初识别的目标、经排序的推荐,或由多种人工和自动化输入汇集而成的目标包。
这些区别会影响实际后果。狭窄的定义可能让政府将许多算法辅助决策归类为人类生成,从而规避保障措施。
该报道也未能证明任一国家目前允许武器在未经人类授权的情况下攻击人员。针对某项条款进行谈判,并不能证明存在特定部署政策。
这种不确定性不应淡化担忧。外交层面的抵制仍表明,政府不愿在国际上接受哪些约束。
国内政策又增添了一层未解问题。五角大楼一直在修订 Directive 3000.09,即其关于武器系统自主性的政策。
据报道,一份 6 月的国家安全备忘录要求在 90 天内完成更新。截至 9 月下旬,尚未出现修订后的公开版本。
2023 年版指令要求在使用武力时作出适当的人类判断。它还对某些自主和半自主武器系统规定了审查要求。
待定的国内修订与日内瓦谈判立场之间的关系尚不清楚。若出现类似删除,将表明政策协调转向更大的行动裁量权。
不同的措辞则会显示,华盛顿在国内接受保障措施,同时抵制国际承诺。这种立场或许能保护军事灵活性,却会削弱美国在海外的倡导能力。
由于有关研发、测试和部署的公开透明度仍然有限,俄罗斯的政策更难评估。有关战场使用的说法往往无法得到独立验证。
人道主义组织也面临证据缺口。联合国和红十字会表示,自主武器正在快速发展,但避免就特定战场使用作出定论性主张。
相比完全自主的致命行动,AI 赋能的决策支持更容易被记录。但决策支持工具仍可能影响谁会遭受攻击,特别是在时间高度压缩的情况下。
负责任的结论应比最令人担忧的解读更为克制。据报道,草案失去了重要屏障,但其确切的实际影响取决于定义和实施。
11 月谈判前值得关注的三个信号
11 月谈判、五角大楼修订后的指令,以及对公开草案文本的要求,将决定此事是否演变为持久的政策逆转。
第一个信号是,各国政府是否会在日内瓦会议之前或期间恢复明确的目标审查要求。其措辞应要求在任何打击之前进行知情的人类评估。
恢复该条款将强化这样一种判断:9 月的删除只是暂时性的谈判动作。持续排除则将确认一个更弱的国际基线。
细节比标签更重要。有意义的审查需要足够的时间、相关证据、不确定性信息,以及拒绝 AI 建议的权力。
第二个信号是五角大楼修订后的自主武器指令。它应显示美国是否保留与国际层面被删除内容相似的国内承诺。
应关注涵盖人类判断、测试、可靠性、法律审查、高级别授权,以及对抗性条件下故障的措辞。定义和豁免将尤为重要。
如果该指令保留强有力的国内控制措施,华盛顿将面临为何拒绝类似国际措辞的质疑。若其削弱这些控制,政策转向将更为广泛。
第三个信号是谈判文本的透明度。各国、记者和民间社会组织需要获得争议草案及拟议修正案的公开对照。
透明度将让独立专家检验各方说法,也将显示较小代表团是否获得足够的时间和资源来评估快速修订。
即使这三个信号全部改善,国际进程仍将脆弱。共识谈判允许少数有影响力的国家拖延授权或收窄拟议规则。
不过,恢复人类审查将确立明确底线。它将表明,机器生成的目标信息不能在没有可追责的人类判断的情况下直接进入打击行动。
对于开发者而言,这场辩论不止涉及武器硬件。军事 AI 系统依赖商业模型、云平台、数据管道、评估工具和软件承包商。
工程师可能被要求记录不确定性、保留审计日志、限制系统自主性,或设计能够防止自动接受建议的界面。政策措辞可以转化为产品要求。
企业采购方也应关注同样的问责问题。高风险 AI 需要留存记录,说明系统提出了什么建议、使用了哪些证据,以及由谁批准结果。
跟踪快速变化政策进程的知识工作者,可以维护一个包含草案措辞、官方声明和带日期修订的个人知识库。这种做法能让悄然发生的变化更容易被发现。
美俄 AI 武器协议只有在其保障措施经受住军事激励的考验后才具有意义。11 月将显示,人类审查仍是可谈判事项,还是将成为最低规则。
眼下的问题很简单:各国政府会否公开文本,并要求在使用武力前由人员审查 AI 生成的目标?



