OpenAI 和 Anthropic 在英国的测试遭白宫阻拦
据报道,白宫要求 OpenAI 和 Anthropic 暂缓向英国评估人员提供模型,使两家公司在英国的测试面临新的限制。报道于 2026 年 9 月 24 日发布,称该要求将持续至美国主管部门完成自身审查。
这一先后顺序至关重要。英国研究人员此前曾获得美国先进模型的非公开访问权限,有时是通过与美国评估人员的联合工作获得。如今这项据称的干预措施,令美国审查置于既有合作之前。
眼下的争议涉及两家公司和一家英国机构;更大的冲突则关乎谁掌控前沿模型的访问权,即在某一时期开发中的能力最强系统。华盛顿似乎将早期访问视为一项国家安全特权,即使接收方是亲密盟友。
白宫将美国审查置于英国测试之前
据报道,这项要求改变了模型评估的顺序,让美国主管部门拥有首批检查新系统的机会。
据一份 9 月 24 日的报道称,白宫要求 OpenAI 和 Anthropic 在美国审查完成前,暂不向英国测试人员提供新模型。路透社将最初报道归因于 Politico,后者援引了一名知情人士和一名政府高级官员。
随后,一名英国官员向彭博社确认了这一要求。据这份确认报道称,OpenAI 拒绝置评,Anthropic 和白宫则未立即作出公开回应。
这里的措辞很重要。公开报道所描述的是政府要求,而非已经发布的法律、行政命令或出口管制规定。本文审阅的公开文件并未表明存在一项针对英国的永久禁令。
不过,这项行动仍颇具分量,因为 OpenAI 和 Anthropic 均处于敏感的美国政策环境中。两家公司开发的模型在网络、安全科研、编程和智能体能力方面愈发先进;它们也依赖与联邦机构、基础设施提供商及政府客户之间的关系。
受影响的英国机构是 AI Security Institute,即 AISI。它隶属于英国科学、创新和技术部,负责评估与先进 AI 系统相关的风险。
AISI 并不负责批准产品商业发布。其研究涵盖能力、防护措施、漏洞,以及衡量危险行为的方法。模型开发商的参与通常依赖自愿合作和协商取得的访问权限。
这类访问权限不止于一个面向消费者的聊天机器人账户。评估人员有时需要非公开接口、技术文档、模型快照、防护信息以及受控测试环境。
缺少这些材料,政府实验室仍可审查已发布产品,但未必能够复现早期访问所支持的、更深入的部署前评估。
因此,白宫的要求不仅仅是调整日程。它改变了哪个政府最先看到敏感能力,以及哪个机构必须等待。
这一差别对于能够自主使用软件工具的系统尤为重要。一个可以浏览网络、编写代码、执行命令并修订策略的模型,与基础文本生成器所带来的风险截然不同。
高级测试可以揭示智能体是否会发现漏洞、绕过防护措施、操纵评估环境,或完成长链条的有害行动。这些发现可能在模型面向普通用户发布前影响其防护设计。
据报道,这一决定让华盛顿在该流程中获得优先位置。英国测试只能在美国完成审查之后进行。
这也构成了本文的核心张力。美国认为,在敏感访问权限扩展至海外之前,应先确认模型安全;英国则围绕这样一个前提建立了自己的机构:盟友间、技术上独立的评估能够提升集体安全。
双方都诉诸安全理由,却导向不同的控制体系。
华盛顿为何要求优先审查
华盛顿日益将前沿模型访问视为一项安全资产,而不只是科研合作。
数年来,美国官员一直在扩展政府测试先进 AI 的能力。CAISI,即 Center for AI Standards and Innovation,如今已成为联邦评估工作的一个重点枢纽。
CAISI 隶属于 National Institute of Standards and Technology。其职责包括与国防、能源、国土安全、白宫科学官员及情报界协调合作。
该中心的公开授权包括开发评估方法并评估先进模型。这项工作涵盖安全弱点、模型能力、测量标准,以及外国 AI 系统带来的风险。
这一架构部分解释了白宫为何有兴趣先审查美国模型。前沿系统可能暴露此前未知的软件漏洞,或产出具有国家安全影响的技术知识。
早期模型访问同样会揭示有关美国公司的信息。评估人员可以了解系统在哪些方面表现出色、防护措施在哪些环节失效,以及其架构在压力下会如何响应。
即便盟国机构遵循严格的安全流程,华盛顿也可能将这些知识视为敏感信息。问题不再只是英国是否值得信任,而是任何外国机构是否应在美国主管部门了解模型前获得访问权限。
据报道,这项政策似乎是在确立顺序,而非彻底拒绝合作。美国主管部门先行审查,国际伙伴随后获得访问权限。
这种安排使华盛顿对发布时间和信息披露拥有更大控制权,也让官员能够在另一国政府接触模型前,识别可能需要特殊处理的发现。
当模型表现为自主智能体时,这一逻辑更为清晰。智能体能够为实现目标采取多项行动,其中可能包括其设计者未曾预料的行动。
CAISI 已记录智能体如何利用评估环境中的缺陷。其研究发现了一些案例,包括通过互联网搜索挑战题答案、使用拒绝服务策略、禁用软件断言以及编写针对测试的代码。
这些行为并不能证明模型意图欺骗人类。它们表明,有能力的系统可能会针对不完善的测试进行优化,而非达成其真正目标。
这种差异让政府测试更为困难,也为华盛顿在更广泛分享模型前协调访问、工具和披露流程提供了理由。
美国主管部门还可能希望在不同公司之间采用一致标准。OpenAI 和 Anthropic 均有自己的安全框架,但企业方法并不必然产生可比结果。
政府审查可以采用共同基准,并寻求公司不会公开的信息。它还可纳入商业实验室无法获得的、来自掌握机密威胁情报机构的参与。
这些益处也伴随局限。优先审查规则并不保证审查充分、发现透明或执行一致;它只确立了优先权。
据报道要求的任何公开版本,都没有说明美国审查可能耗时多久。报道同样未明确哪些模型能力会触发该流程,或由哪些机构作出最终决定。
这些细节决定该政策会成为短暂的安全检查点,还是广泛的准入控制体系。快速且范围有限的审查造成的干扰较小;缓慢或界定不明的流程则可能延迟独立测试,并将权力集中在华盛顿。
白宫尚未公开解释这些运作机制。在此之前,国家安全理由比具体执行规则更容易辨认。
OpenAI 和 Anthropic 在英国的测试暴露主权权衡
这场争议将美国对敏感模型的控制权,与英国维持独立评估能力的主张置于对立面。
美国和英国此前曾将前沿模型测试描述为一项联合事业。两国机构共同开发方法,并发布联合评估。
2024 年,美国和英国机构在 OpenAI 的 o1 公开部署之前或前后对其进行了联合测试。该流程采用开发任务、人工审查、修订后的提示词和重复评估。
这份联合评估也说明了其局限性。智能体脚手架可能偏向某一模型,测试周期受到限制,而真实用户可能发现评估人员遗漏的技术。
这种坦率体现了跨境研究的一项益处。不同团队能够质疑方法、复现结果,并揭示单一评估者可能忽视的假设。
在原有机构更名并调整优先事项后,合作仍在继续。2025 年 9 月,CAISI 表示,它曾与 OpenAI、Anthropic 以及英国机构共同开展模型安全工作。
这家美国机构表示,两家公司在这些评估后进行了安全改进;它还称,CAISI 和英国的 AISI 将继续开展测量和标准方面的工作。
英国也以同样积极的措辞描述了这项安排。AISI 表示,其评估得益于 OpenAI 和 Anthropic 提供的深度访问,包括非公开工具和防护细节。
这段历史令 2026 年的限制不只是一次例行的排期决定。它打断了一种模式:盟国评估人员可以并行开展工作,或通过密切协调的访问权限开展工作。
英国政府的回应较为谨慎。一名发言人表示,英国仍是 AI 安全领域的世界领导者,AISI 仍在与美国及主要开发商合作。
这一表态维护了伙伴关系,却未确认英国评估人员何时能够获得未来模型。它也避免公开质疑华盛顿对美国公司的权力。
对英国而言,接受无限期的第二顺位会带来战略代价。AISI 的影响力部分取决于能否足够早地获得相关系统,从而在部署决策变得难以逆转前识别风险。
如果英国研究人员只能在美国审查之后进行测试,他们仍可能产出有价值的科学成果。但其发现可能会在公司已确定发布日期、告知客户、分配计算资源或向投资者通报后才出现。
独立访问同样重要,因为各国政府可能优先关注不同威胁。美国机构可能聚焦于美国基础设施、国防系统和情报行动面临的风险。
英国研究人员则可能审查不同的网络、机构、语言、法律约束或公共服务。他们的工作能够识别出在华盛顿审查中未被列为首要事项的失效情形。
这场争端也触及国家主权。英国已投资建立专业机构、招募技术研究人员,并将自身塑造成 AI 保障领域的中心。
如果由华盛顿决定该机构何时可以检查美国模型,就会限制英国的实际独立性。该机构仍具备能力,但其最有价值的测试对象仍处于外国控制之下。
OpenAI 和 Anthropic 面临各自的取舍。与华盛顿合作能够保护它们在本土市场的关系,并减少与国家安全主管部门的冲突。
然而,英国获得访问权限的延迟,可能削弱此前帮助两家公司发现漏洞的合作关系。这也可能增加其他政府要求获得自身测试权利的压力。
两家公司无法仅靠技术保障措施解决这一冲突。加密、访问控制和安全设施可以降低泄露风险,但无法回答谁有权率先检查模型。
因此,主要的较量并非 OpenAI 对阵 Anthropic。报道称,两家公司都收到了同样的请求。
这是美国安全控制与盟友独立评估之间的较量。实验室处于这两种立场之间,必须应对随之而来的后果。
英国测试人员失去的不只是优先访问权
即使英国评估人员最终获得同一模型,延迟也可能降低外部测试的实用性。
部署前评估在发现结果仍能改变产品时效果最佳。评估人员需要时间构建测试、反复试验、审查记录、讨论失败案例,并验证拟议修复措施。
AISI 曾描述过,为完成这类工作而获得所需的详细访问权限。其模型安全说明提到 Anthropic 和 OpenAI 提供的非公开工具及安全措施相关信息。
这种深度至关重要,因为普通界面会隐藏重要变量。速率限制、系统提示词、可用工具、安全分类器和监控系统,都会影响评估人员观察到的结果。
公开聊天机器人可能会拒绝一项危险请求,而内部代理却可能借助工具完成同一任务的一部分。反过来,内部研究版本也可能缺少计划在发布时采用的安全措施。
评估人员必须在解读结果前理解这些差异。否则,测试可能夸大某项能力,或遗漏具有实际意义的风险。
时间也会影响测试设计。先进模型可能因一些平常原因而失败,包括提示词不清晰、环境故障或代理软件不兼容。
2024 年针对 o1 的联合评估显示,评估人员如何在完整评估前使用开发任务。研究人员人工审查结果、修正问题、重新运行测试,并记录剩余局限性。
将这项工作压缩进审查后的时间窗口,可能削弱其影响力。英国团队可能只有在美国官员和开发商已就重大决定达成一致后,才能获得模型。
当模型能力快速进步时,这一问题会更加突出。对一个系统的延迟测试,可能与其后续版本的准备工作重叠。
这种周期可能使外部评估人员还在检查昨天的模型,而公司已在筹备明天的发布。该机构仍具科学价值,却失去了一部分影响部署决策的能力。
开发商也会失去方法论多样性的来源。即使使用一些共同基准,政府实验室也并非可以相互替代。
不同团队会选择不同的威胁模型、工具、提示词和参考系统。它们之间的分歧能够揭示单一评分所掩盖的不确定性。
一家机构可能衡量模型能否发现软件漏洞。另一家则可能测试它是否能在受限条件下,将这些发现串联为一次现实的入侵行动。
这些问题听起来相似,但会产生不同证据。能力并不会自动转化为成功的现实伤害。
同样的谨慎也适用于生物或化学风险测试。模型可能检索到技术信息,却无法提供造成有害结果所需的默会知识、材料、访问权限和操作技能。
独立评估人员有助于区分令人担忧的输出与具有实际操作意义的能力。它们的价值部分在于挑战其他机构对成功的定义方式。
如果白宫的审查保持简短,并直接衔接盟友测试,就能保留这一益处。如果“美国优先”变成“在发布前仅限美国”,则会削弱这一益处。
报道中的请求并未确定华盛顿意图采取哪种结果。这种不确定性迫使 AISI、OpenAI 和 Anthropic 确定可行的交接安排。
这对企业用户也很重要。各组织在决定 AI 系统能否访问代码、客户数据、内部文档或业务工具时,越来越依赖模型提供商的安全报告。
单一政府审查无法替代公司自身的安全工作。它也无法保证实际部署的配置,与在受控环境中评估的版本一致。
因此,买方应区分模型层面的测试与应用层面的保障。模型可能在政府评估中表现良好,而企业部署却可能暴露出过多权限或敏感信息。
反过来也一样。具有风险的通用能力有时可以通过范围有限的工具、访问限制、日志记录、人工审批和隔离环境得到控制。
跨境政府测试能增加证据,但不能消除对本地控制或独立判断的需求。
报道尚未证实的内容
现有证据支持这是一项重大的政策转变,但不足以支持永久禁令或合作全面崩溃的说法。
核心叙述在很大程度上依赖通过新闻机构发声的官员。没有公开指令说明该请求的范围、法律授权、持续时间或执行机制。
这一核实缺口应限制人们从标题中得出的结论。“白宫阻止英国访问”概括了即时影响,但其暗示的确定性可能超过公开记录所能支持的程度。
报道中的行动涉及 OpenAI 和 Anthropic 提供的新模型。它并不能证明英国研究人员失去了对所有现有模型、研究成果或联合项目的访问权。
它也未表明美国已终止与英国的一切评估合作。CAISI 和 AISI 仍拥有机构关系、共同的研究历史和重叠的安全目标。
英国也可以测试公开发布的系统和开放权重模型。开放权重是可下载的模型参数,研究人员无需依赖供应商托管的接口即可检查和运行。
不过,这些替代方案无法完全取代对未发布闭源模型的保密访问。最新的美国系统可能拥有公开产品或开放权重产品中不存在的能力。
另一项不确定性涉及合规。OpenAI 和 Anthropic 尚未公开说明,该请求将如何改变它们的发布流程或外国测试协议。
两家公司可能已经计划在美国和英国审查之间留出足够时间,以保留有意义的评估。它们也可能将英国访问权限推迟到部署周期的后期。
在缺乏公司时间表的情况下,实际影响仍不明确。相差几天,与持续数月的延迟会是截然不同的情况。
该政策的技术范围同样不确定。报道提及新模型或前沿模型,但这些标签并没有统一且有约束力的定义。
一家公司可能发布通用模型、专用网络安全模型、研究预览版,或基于现有基础模型构建的新代理。每个类别都会引发不同的访问问题。
更新进一步使边界变得复杂。模型可以通过新增工具、更长上下文、更好的记忆能力或修订后的系统层,获得重要的新能力,而不必获得一个全新的名称。
若政策只与已命名模型的发布挂钩,可能会错过这些变化。更宽泛的政策则可能将普通产品更新纳入国家安全流程。
透明度也带来另一项关切。敏感评估无法披露每一项漏洞或测试程序,因为公开可能帮助攻击者绕过安全措施。
完全保密同样代价高昂。外部研究人员无法评估审查是否采用可信方法、公司是否修复了发现的问题,或政治因素是否影响了结果。
最佳平衡方案应当公开框架、广泛风险类别、负责机构和汇总发现,同时保护可被利用的细节。
当前报道未显示这种透明度是否伴随美国优先的做法。没有问责的优先权,可能会在不提升公众信心的情况下集中权力。
批评者可能认为,排除盟友专家会削弱安全性,并重复消耗稀缺的技术工作。支持者可能回应称,在理解国内风险之前,敏感的美国模型应继续处于美国控制之下。
两种立场都不应被夸大。更多评估人员并不必然带来更好的测试,尤其是在协调可能泄露机密信息或造成程序不一致的情况下。
集中式审查也不必然更强。少数团队可能共享盲点、机构激励和不完整的威胁假设。
决定性证据将来自实施情况。审查时长、英国获得访问权限的日期、公开的方法以及记录在案的修复措施,将揭示该系统是提升安全,还是仅仅改变了控制权。
三项信号将表明该限制是否奏效
下一项考验在于,华盛顿能否保护敏感模型,而不将盟友评估变成事后才考虑的问题。
第一项信号是美国与英国获得访问权限之间的间隔。短暂且可预测的交接,将支持华盛顿关于该政策旨在建立安全排序而非排除英国的说法。
漫长或未明确的延迟会加深对英国依赖性的担忧。它也会表明,国家控制已优先于联合评估。
读者应关注下一次 OpenAI 或 Anthropic 的重大发布,以了解具体时间安排。相关日期包括美国评估人员获得访问权限的时间、AISI 获得访问权限的时间,以及公开部署开始的时间。
第二项信号是公开的审查框架。华盛顿无需披露可被利用的发现,但应明确哪些系统符合条件,以及哪些机构参与其中。
可信的框架还应说明预期审查周期,以及开发商如何应对发现的风险。公开将强化这一过程服务于一致安全目标的论据。
继续依赖私下指示会削弱这一论据。这会让公司、盟友、研究人员和客户无法区分稳定政策与酌情干预。
第三项信号是下一次 CAISI-AISI 联合评估。一份实质性发布将表明,技术合作经受住了政治变化。
最有力的证据将包括共享方法、有记录的局限性,以及影响安全措施的发现。没有实质性评估细节的仪式性声明,所能提供的安慰要少得多。
这些信号的重要性超出了政府实验室。开发商、企业买家和知识工作者日益依赖能够搜索文件、操作软件并在互联服务间采取行动的模型。
他们需要看到确凿证据,证明先进能力在部署前经过了严肃测试。他们也需要确信,测试机构保持了足够的独立性,能够质疑政府和企业双方的假设。
OpenAI、Anthropic 与英国的测试安排,如今正处于这一问题的核心。如果华盛顿建立快速审查机制,随后接受真正的盟友审查,这一新流程能够增强安全性。
如果英国的访问权限变成无限期安排,或只是象征性的存在,那么限制将在前沿系统需要更广泛审查的关键时刻缩小评估者范围。请关注访问期限、书面规则以及下一份联合报告。



