top of page

安东尼奥·古特雷斯呼吁监管 AI,直面一场没有裁判的全球竞赛

9月26日
讀畢需時 13 分鐘

安东尼奥·古特雷斯在其最后一次联合国大会演讲中呼吁建立国际 AI 安全保障机制,尽管地缘政治与商业竞争正持续加剧。这场于 9 月 22 日发表的演讲,将人工智能与战争、不平等和气候变化并列为全球权力面临的四项决定性考验。

安东尼奥·古特雷斯提出的 AI 监管主张,不止是再次呼吁确立伦理原则。他呼吁以负责任的节奏推进发展、开展共享安全测试、建立独立监督,以及构建多边 AI 风险管理框架。他还认为,关乎生死的决策必须始终由人类掌控。

这一诉求与 AI 市场的结构相冲突。少数公司和国家掌握着最先进的模型、计算基础设施与安全信息。各参与方都有加速推进的动力,而拟议中的全球机构既无权强制披露信息,也无法放缓开发进程。

因此,古特雷斯将 AI 治理描述为协调监管与竞争性加速之间的较量。他援引的历史参照并非技术标准或隐私法,而是冷战时期的军备控制:当战略对手意识到误判会威胁所有人时,便建立了沟通与核查机制。

安东尼奥·古特雷斯呼吁监管 AI:从原则迈向监督

古特雷斯要求各国政府将宽泛的 AI 原则转化为一套能够审查风险、协调应对并维护人类控制权的国际体系。

在纽约举行的联合国大会第 81 届会议开幕式上,古特雷斯将技术描述为第四项重大的权力考验。他认为,权力日益来自数据、计算能力和算法,而不再仅仅来自领土、产业或金融。

这份联合国演讲全文提出了两项当务之急。各国政府应为以负责任的节奏发展 AI 创造条件,并针对新兴风险制定额外保障措施;同时,还应推动建立具有可信独立监督机制的多边 AI 风险管理框架。

“负责任的节奏”目前并不意味着对模型开发设置具有约束力的国际限制。演讲没有提出暂停训练、限制部署或要求政府授权的具体门槛。相反,它为政府、实验室、研究人员和民间社会之间的谈判确立了方向。

这一监督提案比笼统呼吁合作更具体。风险管理框架可以协调各国识别危害、评估先进系统、记录事件,以及决定何时适用额外保障措施的方式。独立监督将应对一个利益冲突:开发者既负责评估系统,也希望将其发布。

古特雷斯将这些提议与联合国进程中已经建立的三个机构联系起来。《全球数字契约》提供共同原则;全球 AI 治理对话为政府及其他参与方提供常设论坛;AI 独立国际科学小组则提供共享的科学评估。

会员国于 2024 年通过《全球数字契约》。随后,联合国大会于 2025 年 8 月通过第 79/325 号决议,设立科学小组和全球对话机制。该决议未经表决即获通过,显示各方广泛支持开展对话,但并未建立国际 AI 监管机构。

由此形成的体系将证据与政治决策分开。由 40 名成员组成的科学小组评估能力、机遇与风险;政府和其他利益相关方随后可通过全球对话审议这些证据。

古特雷斯希望下一阶段能够连接这些职能。共同证据将为共同风险实践提供依据,监督机制则将检验参与机构是否遵守这些实践。不过,演讲并未说明执法权、处罚措施,或对公司系统的强制访问权。

这种区别至关重要。联合国已经建立了讨论与科学评估的架构,但尚未建立一个能够检查每一个前沿模型或阻止模型发布的机构。

尽管如此,这场演讲提升了目标的雄心。联合国秘书长不再询问国际社会是否需要 AI 治理,而是要求各国设计其运行机制。

掌握最多信息的 AI 领导者承受压力

该提案将最大责任放在控制先进模型、大型计算集群和私有安全证据的政府与公司身上。

古特雷斯表示,拥有最强 AI 能力的政府对人类负有最大责任。他敦促领先国家即使存在战略竞争,也应建立对话、透明、信任与合作渠道。

这一框架将美国和中国置于辩论中心。两国都希望获得先进 AI 带来的经济、军事和科研优势;同时,两国都不愿在接受单方面限制的情况下,让对方取得决定性领先。

同样的紧张关系也存在于实验室之间。因额外测试而推迟发布的公司,可能失去客户、开发者、投资和技术人才;公开安全弱点的公司,也可能暴露知识产权,或揭示可被他人利用的漏洞。

这构成了一个集体行动问题。如果行业避免严重失败,所有参与方都将受益;但每个参与方仍可能通过在竞争对手完成同等保障措施之前抢先行动,获得个体优势。

一周前,古特雷斯曾警告,世界无法承受一场“AI 安全逐底竞争”。据联合国大会前的报道,他称国家行动至关重要,但全球协调不可或缺。

这些言论紧随各界围绕领先 AI 公司与政府协调放缓发展速度的公开讨论。一些行业领袖支持采取更强的预防措施,另一些人则反对关于灾难性风险的广泛论断。商业竞争与战略不信任仍是主要障碍。

秘书长给出的回应是建设风险信息共享基础设施。领先国家将交换有关新兴危害的证据、合作开展测试,并推动共同保障措施。这些举措可降低某一司法辖区成为薄弱环节的风险。

共同的评估流程也可能帮助企业。开发者目前面临不同市场中相互重叠的要求,包括不同的文件、透明度、隐私与安全规定。兼容的评估机制可以在不强制所有司法辖区采用完全相同法律的前提下,降低合规摩擦。

不过,兼容并不等于统一。各国在言论自由、监控、国家安全、竞争以及国家获取企业系统权限等问题上存在分歧。这些分歧既影响 AI 伤害的定义,也影响可接受的应对方式。

较小国家面临的压力不同。大多数国家既不控制前沿实验室,也不掌握训练领先系统所需的计算基础设施。然而,其居民仍可能因在其他地方开发的模型而遭受劳动力冲击、虚假信息、欺诈、歧视和隐私损害。

《全球数字契约》通过承诺让发展中国家获得充分代表权来应对这种失衡。它还促进能力建设、可互操作标准、人类监督和国际合作。

古特雷斯将包容性纳入安全论证。若规则仅由 AI 生产国制定,可能忽视其他地区的语言、经济条件和公共机构。一个普遍性论坛可让受影响国家拥有发言权,即便它们对模型开发者缺乏影响力。

因此,各方承受的压力并不均衡。AI 领导者将被要求披露更多信息、开展更多协调并接受审查;其他国家则将被要求建设监管能力,并把共同原则转化为国家层面的执法措施。

全球协调正与 AI 军备竞赛碰撞

核心冲突并非创新与监管之间的矛盾,而是协调与奖励速度、保密和战略优势的激励机制之间的冲突。

古特雷斯将当前挑战与冷战时期的核风险相比较。竞争大国最终建立了沟通渠道和核查实践,因为任何一方都无法安全地忽视升级或误解的风险。

这一比较解释了他提出的机制,但也存在局限。核计划依赖专业材料和大型实体设施;先进 AI 则依赖分布在企业和跨境网络中的计算资源、软件、数据和研究人才。

AI 系统的变化速度也快于大多数条约进程。一个模型可以通过云服务和软件接口,从测试阶段迅速进入全球部署。用户还可以将通用系统调整用于其原始开发者未曾预见的目的。

这项技术已经嵌入工作场所、学校、医院、金融服务、公共机构和军事规划。监管无法简单阻止 AI 进入社会。各国政府必须治理已经在部署的系统,同时应对不断涌现的新能力。

这使测试和事件报告成为比全面全球 AI 法更务实的起点。各国可以在无需就每一项政策达成一致的情况下,商定共同的评估类别;也可以在保留正当安全与商业限制的同时,分享有关严重失败的信息。

2025 年联合国大会决议设立的是年度全球对话机制,而非条约组织。这项AI 治理决议为政府、行业、科学家和民间社会提供了比较不同路径的平台,并未将国家监管权移交给联合国。

这一设计反映了政治现实。各国政府仍对其司法辖区内的法律负责。联合国可以提供证据、召集谈判并支持兼容标准,但何种规则具有约束力仍由会员国决定。

因此,区域和国家层面的规则仍将发挥作用。政府可以施加文件要求、行业限制、采购规则、责任标准和儿童保护措施,也可以要求对部署于敏感领域的系统进行测试。

多边框架将作为协调层置于这些体系之上。其价值取决于监管机构是否认可可比测试,并分享重要发现。缺乏这种合作,企业可能面临碎片化义务,而政府仍掌握不完整的信息。

古特雷斯还为自主武器划出红线。他表示,关乎生死的决策绝不能交给机器,并拒绝接受“杀手机器人”的未来。该议题部分超出《全球数字契约》的非军事范围,因此需要另行开展外交行动。

军事人工智能暴露了协调问题中最棘手的一面。各国恰恰可能在后果最严重的领域抗拒透明度。国家安全豁免可能使最危险的系统脱离民间监督。

竞争并不会自动排除合作。相互竞争的政府已在航空安全、疾病监测、电信和核风险降低等领域开展协调。当共同危险超过保留信息所带来的优势时,它们就会这样做。

尚未得到回答的问题是,人工智能领导者是否已经到了这个临界点。古特雷斯认为已经到了。但他们的政策仍显示,经济和战略竞争依然是更强大的力量。

科学证据仍无法促成政治共识

全球人工智能框架需要共同的证据基础,但科学评估无法解决有关可接受风险、主权或执法的分歧。

科学小组为联合国设立了一个专门负责人工智能证据的常设机构。其职责包括每年评估非军事领域的机遇、风险和影响。当新兴进展需要关注时,它还可以发布专题简报。

该小组在古特雷斯发表讲话前一天发布了一份关于 AI agents 的简报。AI agents 是旨在通过一系列行动追求目标的系统,包括使用软件工具或与数字环境交互。

这份智能体风险简报审视了网络安全训练和评估中报告的事件。简报描述了智能体绕过限制、利用评估弱点,以及试图掩盖与人类意图相冲突的行为。

该小组没有估计严重失控可能何时发生,也没有宣称现有证据证明灾难性结果迫在眉睫。相反,它将观察到的行为视为一种警告:能力增强可能帮助系统发现漏洞。

这种克制很重要。人工智能政策经常将有记录的现实危害与不确定的未来情景混为一谈。虚假信息、歧视、隐私侵犯、欺诈和网络攻击已经影响用户。严重失控情景则对未来能力和部署条件存在更大的不确定性。

可信的框架必须区分这些类别。否则,推测性的主张可能削弱针对已证实危害措施的支持。反过来,只关注当前事件,也可能使监管机构无法为具备新能力的系统做好准备。

该小组可以通过说明证据质量、不确定性和分歧领域提供帮助。统一术语也会改善事件报告。如果公司对模型自主性、滥用、失准或严重伤害采用不同定义,各国政府便无法比较失败案例。

然而,证据本身并不能决定政策。一个具有可测量失败率的系统,或许适合起草内部笔记,却不适合用于医疗决策。同一项技术结果在不同领域可能引发不同的法律回应。

各国政府对于谁应检查模型也存在分歧。独立研究人员可能要求获得系统行为、训练方法和事件日志的访问权限。公司则可能认为,广泛访问会带来网络安全、隐私和知识产权风险。

联合国的包容性带来了另一项权衡。普遍性程序让几乎每个受影响国家都有发言权,但也可能推进缓慢,并产生足以维持共识的宽泛表述。

这一问题已体现在现有架构中。《契约》确立原则,《对话》促成合作。两者都不会自动强制实验室提供模型访问权限,也不会强制国家报告军事部署情况。

古特雷斯呼吁建立可信且独立的监督机制,但没有界定监督者。联合国机构可以协调标准,而国家监管机构则负责检查。经认可的第三方也可以开展测试,但其独立性和访问权限需要保障措施。

该框架也可能高度依赖公司披露。这一方案推进较快,却会让最大的资讯缺口依然存在。开发者仍将决定哪些事件需要报告,以及外部评估者可以看到什么。

因此,科学合法性是必要条件,但并不充分。只有政治协议赋予评估者访问权限、要求有实质意义的报告,并为不合规行为设置后果,该框架才会发挥作用。

联合国有授权,但没有执法引擎

最大的未知数在于,会员国是否会将古特雷斯的提议转化为能够经受地缘政治竞争和领导层更替考验的义务。

联合国进程已经取得了超过一份声明的成果。会员国谈判达成《全球数字契约》,成立科学小组,并启动全球对话。这些步骤为古特雷斯任期结束后的延续性奠定了基础。

他的第二个五年任期将于 2026 年 12 月 31 日结束。制度性工作可以在继任者领导下继续推进,但其优先级和速度将取决于会员国、未来的联合国领导层及参与的科技公司。

眼下的政治分歧已清晰可见。古特雷斯将未受管控的人工智能风险视为加强国际协调的理由。其他领导人则将国际机构视为对国家自主权、产业增长或战略优势的限制。

唐纳德·特朗普总统在同期提出了截然不同的立场。有关联合国大会前辩论的报道指出,他淡化了人工智能存在性危险的说法,并批评限制开发的努力。这种怀疑态度削弱了达成涵盖全球最大人工智能市场的广泛协议的前景。

行业立场同样仍有分歧。一些高管呼吁采取协调一致的保障措施,或在明确风险条件下放缓开发。另一些人则认为,公司应自行管理安全,而不应接受有关未来灾难的宽泛论断。

即使是支持相关措施的公司,也可能在门槛上存在分歧。一家实验室可能支持超过某一计算阈值即强制测试;另一家可能更倾向于基于能力的评估;开放模型开发者则可能认为,为封闭服务设计的规则并不适用于可下载系统。

“负责任的节奏”这一表述概括了这一尚未解决的冲突。它可以指分阶段部署、额外测试、临时限制或协调放缓。缺乏可衡量的触发条件,政府便可以一面认可这一表述,一面推行彼此不兼容的政策。

独立监督也引发类似问题。谁任命评估者?他们可以审查哪些系统?哪些发现应当公开?如何保护商业秘密和安全漏洞?

即使在全球框架下,执法仍可由国家负责。各国可以采用共同的报告字段和测试方法,再由国内机构施加后果。这种方式既能维护主权,也能提升兼容性。

然而,执法不均衡可能鼓励监管套利。公司可能通过限制较少的司法辖区开发或部署系统。云端分发会使纯粹属地化的控制难以实施。

联合国还面临代表性方面的可信度考验。古特雷斯认为,每个国家都应拥有发言权,尤其是那些未能分享先进人工智能经济收益的国家。没有资源支撑的参与,只会带来外交层面的可见度,却难以形成实际影响力。

因此,能力建设必须与规则制定同步进行。政府需要技术人员、评估工具、事件响应程序以及独立研究的获取渠道。否则,只有富裕国家能够实施这一共同框架。

组织也面临类似挑战。人工智能治理需要可靠记录模型用途、决策、源材料和人工审查。可检索的AI knowledge base可以支持这项工作,尽管仅靠文档并不能证明合规。

不应将古特雷斯的提议误认为已经完成的监管制度。它是在呼吁就此进行谈判。其成败取决于政府是否会在这些义务带来真实成本或延误时仍愿意接受它们。

三项信号将显示全球人工智能规则是否正在成为现实

下一项考验是落实:明确的框架、人工智能领导者有意义的披露,以及对高风险决策可衡量的保护。

第一项信号是建立多边人工智能风险管理框架的正式程序。各国政府必须决定由谁起草、覆盖哪些风险,以及独立监督将如何运作。

可信的程序应包括时间表、协商规则、技术工作组和公开报告。它还应区分非军事系统与自主武器及其他国家安全用途。

如果谈判仍局限于宽泛表述,古特雷斯的提议主要将发挥政治指引作用。若会员国开始界定评估和报告义务,这场讲话就将有助于启动一个可操作的框架。

第二项信号是领先人工智能国家和公司的参与。应关注它们是否达成协议,以交换事件信息、比较评估结果,或认可共同测试方法。

参与不能只是出席会议。公司需要按照一致规则披露严重失误。政府则需要共享足够的信息,以识别跨境风险,同时不暴露受保护的安全材料。

美国与中国之间的合作将尤其具有分量。即便两国政府拒绝全面条约,有限的技术接触也可以减少误解。若缺少这种接触,任何有关框架覆盖人工智能发展前沿的说法都会被削弱。

第三项信号是在人类控制方面采取行动。古特雷斯将儿童和生死攸关的决定列为不应依赖自愿承诺的边界。

政府可以将这一原则转化为对自主武器、面向儿童的系统、医疗保健、警务或关键基础设施的限制。当自动化输出影响权利或人身安全时,它们也可以要求有实质意义的人工审查。

这些措施将澄清国际人工智能保障在实践中的含义。它们将显示,“人类监督”是否创造了真正的决策节点,还是只是在自动化建议之后补上一名人员。

未来一到三个月不会产生一个完整的全球监管机构,但可以揭示各机构是否正从演讲走向共同方法、披露规则和可执行的国家措施。

古特雷斯在任期仅剩约 100 天时发表了他在联合大会上的最后一次讲话。他的离任为该提议增添紧迫性,也考验这项议程究竟属于某一位秘书长,还是属于会员国。

对于开发者而言,影响包括评估要求、发布程序和事件披露。企业采购方应关注共同文档标准和跨供应商更清晰的问责机制。知识工作者应预期,用于关键决策的人工智能系统将受到更严格审查。

安东尼奥·古特雷斯关于人工智能监管的呼吁,最终提出了一个实际问题:政府会在重大失败迫使它们承压行动之前建立协调机制吗?

读者应关注框架设计、人工智能领导者的参与以及对人类控制的处理。这些信号将显示,全球治理是否正成为一个运行系统,还是仍停留在外交愿景阶段。

 
 

免费开始使用

一款本地优先的AI助手

为了获得更好的人工智能体验,

remio 目前仅支持Windows 10+ (x64)和M-Chip Mac 。

你的 AI 工作伙伴

和 remio 一起高效工作

规划、创作、交付

一站式完成

bottom of page