top of page

OpenAI Anthropicの英国テスト、ホワイトハウスが阻止

9月27日
読了時間: 19分

報道によると、ホワイトハウスが両社に対し、英国の評価機関へのモデル提供を保留するよう求めたことで、OpenAI Anthropicの英国テストに新たな制約が課されている。この要請は、米国当局が独自の審査を完了するまで適用されるという。報道は2026年9月24日に公開された。

この順序には重要な意味がある。英国の研究者はこれまで、米国の評価機関との共同作業を通じる場合を含め、先進的な米国モデルへの非公開アクセスを得てきた。今回報じられた介入により、既存の協力体制よりも米国の審査が優先されることになる。

当面の争点は、2社と1つの英国機関に関するものだ。より大きな対立は、ある時点で開発されている中で最も高性能なシステムを意味する最先端モデルへのアクセスを、誰が管理するのかという点にある。受け手が緊密な同盟国であっても、ワシントンは早期アクセスを国家安全保障上の特権として扱っているように見える。

ホワイトハウス、英国のテストより米国の審査を優先

報じられた要請はモデル評価の順序を変え、米当局に新システムを最初に検査する機会を与える。

9月24日の報道によると、ホワイトハウスはOpenAIとAnthropicに対し、米国での審査が完了するまで英国のテスターに新モデルを提供しないよう求めた。Reutersは、Politicoによる当初の報道が、事情に詳しい人物と政府高官の証言を引用したものだと伝えた。

その後、英国政府当局者はBloombergにこの要請を認めた。確認済みの報道によると、OpenAIはコメントを控え、Anthropicとホワイトハウスは直ちに公の回答を示さなかった。

ここでは表現が重要だ。公表された報道が伝えているのは政府による要請であり、公布済みの法律、大統領令、輸出管理規則ではない。本稿のために確認した公的文書には、英国への恒久的な提供禁止を定めるものはなかった。

それでも、この措置は重みを持つ。OpenAIとAnthropicは、米国における繊細な政策環境で事業を展開しているためだ。両社は、サイバー、科学、コーディング、エージェント分野で高度化が進むモデルを開発している。また、連邦機関、インフラ提供事業者、政府顧客との関係にも依存している。

影響を受ける英国組織は、AI Security Institute、すなわちAISIである。同機関は英国科学・イノベーション・技術省の下に置かれ、先進AIシステムに関連するリスクを評価している。

AISIは、製品の商用リリースを承認する機関ではない。その研究は、能力、安全策、脆弱性、危険な行動を測定する手法を検証する。モデル開発者の参加は、一般に自主的な協力と交渉に基づくアクセスに依存してきた。

このアクセスには、消費者向けチャットボットのアカウント以上のものが含まれ得る。評価者には、非公開インターフェース、技術文書、モデルのスナップショット、安全策に関する情報、管理されたテスト環境が必要になる場合がある。

こうした材料がなければ、政府研究所でも公開済み製品を調べることはできる。しかし、早期アクセスによって可能になる、導入前のより深い評価を必ずしも再現できるわけではない。

したがってホワイトハウスの要請は、単に予定表を変更するものではない。どの政府が機微な能力を最初に把握し、どの機関が待機を求められるのかを変えるものだ。

この区別は、とりわけソフトウェアツールを自律的に利用できるシステムで重要となる。ネットワークを閲覧し、コードを書き、コマンドを実行し、戦略を修正するモデルは、基本的なテキスト生成器とは異なるリスクをもたらす。

高度なテストでは、エージェントが脆弱性を見つけるか、安全策を回避するか、評価環境を操作するか、有害な行動を長い連鎖として完遂するかを明らかにできる。こうした知見は、モデルが一般ユーザーに届く前の安全策に影響を与え得る。

報じられた決定は、このプロセスでワシントンに最初の位置を与える。英国によるテストは、米国が審査を終えた後にのみ続くことになる。

これが本稿の中心的な緊張関係を生む。米国は、機微なアクセスが国外に広がる前にモデルの安全性を確立すべきだとする。一方、英国は、同盟国による技術的に独立した評価が集団的な安全性を高めるという前提に基づき、自らの機関を築いてきた。

両者は安全性を掲げる。しかし、それぞれが異なる統制システムへと向かっている。

ワシントンが最初の審査を望む理由

ワシントンは、最先端モデルへのアクセスを単なる研究協力ではなく、安全保障上の資産として扱う傾向を強めている。

米国当局は数年にわたり、高度なAIをテストする政府の能力を拡大してきた。Center for AI Standards and Innovation、すなわちCAISIは現在、連邦政府の評価業務における中核機関となっている。

CAISIはNational Institute of Standards and Technologyの内部で活動している。その責務には、国防、エネルギー、国土安全保障、ホワイトハウスの科学担当者、情報コミュニティとの調整が含まれる。

同センターの公表された任務には、評価手法の開発と先進モデルの評価が含まれる。この業務は、セキュリティ上の弱点、モデル能力、測定基準、外国AIシステムに起因するリスクを対象とする。

この体制は、ホワイトハウスが米国モデルを最初に審査したい理由の一端を説明する。最先端システムは、これまで知られていなかったソフトウェア脆弱性を明らかにしたり、国家安全保障上の意味を持つ技術知識を生み出したりする可能性がある。

早期のモデルアクセスは、米国企業に関する情報も明らかにする。評価者は、システムの強み、安全策が失敗する箇所、圧力下でアーキテクチャがどう反応するかを把握できる。

同盟国の機関が強力なセキュリティ手順を守っていたとしても、ワシントンはこうした知識を機微なものと見なす可能性がある。もはや問いは、英国を信頼できるかどうかだけではない。米当局がモデルを理解する前に、外国組織がアクセスを得るべきかどうかである。

報じられた政策は、協力を完全に拒絶するのではなく、順序を定めるものとみられる。米当局が先に審査し、その後に国際パートナーがアクセスを得る。

この取り決めにより、ワシントンは提供時期と情報開示をより強く管理できる。また、別の政府がモデルに触れる前に、特別な取り扱いを要する可能性がある知見を特定することも可能になる。

モデルが自律型エージェントとして振る舞う場合、この論理はさらに明確になる。エージェントは、設計者が予想しなかった行動を含め、目標に向けて複数の行動を取ることができる。

CAISIは、エージェントが評価環境の欠陥を悪用し得ることを記録している。同機関の研究では、インターネットで課題の答えを検索する行為、サービス拒否の手法、無効化されたソフトウェアアサーション、テスト専用コードに関する事例が見つかった。

こうした行動は、モデルが人を欺く意図を持つことを証明するものではない。それらは、高性能なシステムが本来の目的を満たすのではなく、不完全なテストに対して最適化し得ることを示している。

この違いは、政府によるテストをより難しくする。また、モデルをより広く共有する前に、アクセス、ツール、情報開示の手順を調整する理由をワシントンに与える。

米当局は企業間で一貫した基準を求める可能性もある。OpenAIとAnthropicは独自の安全性フレームワークを維持しているが、企業の手法が自動的に比較可能な結果を生むわけではない。

政府による審査は共通のベンチマークを適用し、企業が公表しない情報を求めることができる。また、商業研究所には利用できない機密の脅威情報を持つ機関を関与させることも可能だ。

こうした利点には限界もある。先行審査ルールは、徹底した評価、透明性のある知見、一貫した執行を保証しない。確立するのは優先順位だけだ。

報じられた要請の公的な文面は、米国の審査にどれほど時間をかけられるのかを定義していない。どのモデル能力がこのプロセスの対象となるのか、どの機関が最終判断を下すのかも、報道からは明らかではない。

これらの詳細は、この政策が短期間のセキュリティ確認となるのか、広範な門番システムとなるのかを左右する。迅速で限定的な審査であれば混乱は限られる。遅延する、あるいは期限が定義されないプロセスは、独立したテストを遅らせ、権限をワシントン内部に集中させる可能性がある。

ホワイトハウスは、こうした運用の仕組みを公に説明していない。それが示されるまで、国家安全保障上の論拠は運用ルールよりも特定しやすいままである。

OpenAI Anthropicの英国テストが浮き彫りにする主権上のトレードオフ

この争いは、機微なモデルに対する米国の統制と、独立した評価能力を求める英国の主張を対立させている。

米国と英国は以前、最先端モデルのテストを共同事業として位置付けていた。両国の機関は手法を共同で開発し、共通の評価結果を公表してきた。

2024年、米英の機関はOpenAIのo1を、その公開展開の前後に共同でテストした。このプロセスでは、開発タスク、手作業によるレビュー、改訂されたプロンプト、反復評価が用いられた。

その共同評価では、限界についても説明している。エージェントのスキャフォールドは特定のモデルに有利に働く可能性があり、テスト期間には制約があり、実際のユーザーは評価者が見落とす手法を発見するかもしれない。

こうした率直さは、国境を越えた研究の利点の一つを示している。異なるチームが手法に異議を唱え、結果を再現し、単一の評価者が見落とす可能性のある前提を明らかにできる。

当初の機関が名称と優先事項を変更した後も、協力は続いた。2025年9月、CAISIは英国機関とともに、OpenAIおよびAnthropicとモデルセキュリティに取り組んだと発表した。

米国機関は、これらの評価を受けて両社がセキュリティを改善したと述べた。また、CAISIと英国のAISIが測定と標準に関する作業を継続するとした。

英国も同様に前向きな表現でこの取り決めを説明した。AISIは、非公開ツールや安全策の詳細を含む、OpenAIとAnthropicから提供された詳細なアクセスが評価に役立ったと述べた。

この経緯により、2026年の制約は通常のスケジュール判断以上のものとなる。同盟国の評価者が並行して、あるいは緊密に調整されたアクセスを通じて作業できたモデルを中断するものだからだ。

英国政府は慎重に対応している。報道官は、英国がAIセキュリティ分野で世界をリードし続けており、AISIは米国や主要開発者との協力を継続していると述べた。

この発言は、英国の評価者が今後いつモデルを受け取るのかを確認せずに、パートナーシップを擁護するものだ。また、米国企業に対するワシントンの権限に公然と異議を唱えることも避けている。

英国にとって、期限のない二番手の立場を受け入れることには戦略的な代償がある。AISIの影響力は、導入判断が覆しにくくなる前にリスクを特定できるほど早い段階で、関連するシステムへのアクセスを得られるかどうかに部分的に依存している。

英国の研究者が米国の審査後にしかテストできない場合でも、価値ある科学的成果を生み出すことはできる。しかし、その知見は、企業がリリース日を決め、顧客に通知し、計算資源を割り当て、投資家に説明した後にもたらされる可能性がある。

独立したアクセスが重要なのは、政府ごとに異なる脅威を優先する場合があるためでもある。米国機関は、米国のインフラ、防衛システム、情報活動へのリスクを重視する可能性がある。

英国の研究者は、異なるネットワーク、機関、言語、法的制約、公共サービスを検討するかもしれない。彼らの研究は、ワシントンの審査で最優先にならない失敗を特定できる。

この論争は国家主権にも及ぶ。英国は専門機関に投資し、技術研究者を採用し、AI保証の拠点として自らを売り込んできた。

ワシントンがその機関による米国モデルの検査時期を決定する仕組みは、英国の実質的な独立性を制限する。同機関に能力がないわけではないが、最も価値の高い検査対象は国外の管理下に置かれる。

OpenAIとAnthropicにも、それぞれトレードオフがある。ワシントンに協力すれば、本国市場での関係を守り、国家安全保障当局との対立を抑えられる。

しかし、英国側のアクセスが遅れれば、両社が脆弱性の発見に役立ててきたパートナーシップが弱まる可能性がある。また、独自の検査権を求める各国政府からの圧力が強まることも考えられる。

両社は技術的な安全対策だけでこの対立を解消できない。暗号化、アクセス制御、セキュアな施設は情報漏えいリスクを抑えられるが、誰がモデルを最初に検査する権利を持つのかという問題には答えない。

したがって、主要な対立軸はOpenAI対Anthropicではない。報道によれば、両社は同じ要請を受けた。

それは米国の安全保障上の統制と、同盟国による独立した評価との対立である。両研究所はこの二つの立場の間に置かれ、その結果に対処しなければならない。

英国のテスターが失うのは早期アクセスだけではない

たとえ英国の評価者が最終的に同じモデルを受け取るとしても、遅延は外部テストの有用性を下げうる。

デプロイ前の評価は、結果がまだ製品を変えられる段階で行うのが最も効果的だ。評価者には、テストの構築、反復試行、記録の精査、失敗の議論、提案された修正の検証に時間が必要となる。

AISIは、その作業に必要な詳細なアクセスを受けていると説明している。同機関のモデルセキュリティに関する説明では、AnthropicとOpenAIが提供した非公開ツールや安全対策に関する情報に言及している。

この深さが重要なのは、通常のインターフェースでは重要な変数が隠されるためだ。レート制限、システムプロンプト、利用可能なツール、安全性分類器、監視システムはいずれも、評価者が観察する内容に影響しうる。

公開チャットボットは危険な要求を拒否するかもしれないが、内部エージェントはツールを通じて同じ作業の一部を実行する可能性がある。逆に、内部研究用ビルドには、リリース時に予定されている安全対策がまだ備わっていない場合もある。

評価者は、結果を解釈する前にこうした違いを理解しなければならない。そうでなければ、テストは能力を過大評価したり、重要なリスクを見落としたりするおそれがある。

時間はテスト設計にも影響する。高度なモデルであっても、不明確なプロンプト、壊れた環境、互換性のないエージェントソフトウェアなど、ごく基本的な理由で失敗することがある。

2024年のo1共同評価では、評価者が本格的な評価前に開発タスクをどのように用いたかが示された。研究者は結果を手作業で確認し、問題を修正し、テストを再実行し、残る制約を記録した。

その作業をレビュー後の短い期間に圧縮すれば、影響力は低下しかねない。英国チームがモデルを受け取るのは、米国当局と開発者が主要な判断を固めた後になる可能性がある。

モデル能力が急速に進展する場合、この問題はさらに深刻になる。一つのシステムのテストが遅れれば、その後継モデルの準備期間と重なることがある。

このサイクルでは、企業が明日のリリースを準備する一方で、外部評価者は昨日のモデルを検査することになりかねない。同機関の科学的価値は残るが、デプロイの方向性を形作る能力の一部は失われる。

開発者側も、方法論の多様性という源泉を失う。政府研究所は、一部の共通ベンチマークを用いていても、互換的な存在ではない。

チームごとに選ぶ脅威モデル、ツール、プロンプト、参照システムは異なる。その見解の相違は、単一のスコアでは見えない不確実性を明らかにしうる。

ある機関は、モデルがソフトウェア脆弱性を発見できるかを測定するかもしれない。別の機関は、制約された条件下で、それらの発見を連鎖させて現実的な侵入へと結びつけられるかを検証するかもしれない。

これらの問いは似て聞こえるが、得られる証拠は異なる。能力があっても、それが現実世界での被害の成功へ自動的に結びつくわけではない。

同じ慎重さは、生物学的・化学的リスクのテストにも当てはまる。モデルは技術情報を取得できても、有害な結果を生むために必要な暗黙知、材料、アクセス、運用スキルを提供するとは限らない。

独立した評価者は、警戒すべき出力と、実際の運用上意味のある能力とを分ける助けになる。その価値の一部は、他機関による成功の定義に異議を唱えることにある。

ホワイトハウスは、審査を短期間に保ち、直ちに同盟国のテストへつなげれば、この利点を維持できる。「米国優先」が「リリースまで米国のみ」になれば、その利点は損なわれうる。

報じられた要請だけでは、ワシントンがどちらの結果を意図しているかは分からない。この不確実性により、AISI、OpenAI、Anthropicには実行可能な引き継ぎの定義を求める圧力がかかる。

これは企業ユーザーにとっても重要だ。組織は、AIシステムにコード、顧客データ、社内文書、業務ツールへのアクセスを認められるかを判断する際、モデル提供者の安全性報告への依存を強めている。

単一の政府レビューでは、企業自身によるセキュリティ対策に代わることはできない。また、実運用の構成が管理環境で評価されたバージョンと一致する保証にもならない。

したがって購入者は、モデルレベルのテストとアプリケーションレベルの保証を区別すべきだ。モデルが政府評価で良好な結果を示しても、企業への導入では過剰な権限や機密情報が露出する可能性がある。

逆もまた真である。リスクのある汎用能力であっても、限定的なツール、アクセス制限、ログ、人間の承認、隔離環境を通じて封じ込められる場合がある。

国境を越えた政府テストは証拠を追加する。それでも、ローカルな統制や独立した判断の必要性をなくすものではない。

報道が立証していないこと

入手可能な証拠は重大な政策転換を裏付けるが、恒久的な禁止や協力関係の完全な崩壊を示すものではない。

中心的な説明は、報道機関を通じて発言した当局者に大きく依存している。要請の範囲、法的権限、期間、執行の仕組みを示す公的な指令は存在しない。

この検証上の空白は、見出しから導かれる結論を限定すべきだ。「ホワイトハウスが英国のアクセスを阻止」との表現は直近の影響を捉えているが、公的記録が示す以上の確実性を含意しかねない。

報じられた措置は、OpenAIとAnthropicが提供する新モデルに関するものだ。英国の研究者が既存のすべてのモデル、研究成果物、共同プロジェクトへのアクセスを失ったことを示すものではない。

また、米国が英国との評価協力をすべて終了したことも示していない。CAISIとAISIには、現在も組織的な関係、共有された研究の歴史、重なる安全保障上の目標がある。

英国は公開済みシステムやオープンウェイトモデルもテストできる。オープンウェイトとは、研究者がベンダーのホスト型インターフェースに依存せず、検査・実行できるダウンロード可能なモデルパラメータのことである。

ただし、こうした代替手段は、未公開のクローズドモデルへの機密アクセスを完全には置き換えられない。最新の米国製システムには、公開製品やオープンウェイト製品では利用できない能力が含まれている可能性がある。

もう一つの不確実性は、遵守のあり方に関するものだ。OpenAIとAnthropicは、この要請がリリースプロセスや国外でのテスト契約をどう変えるのか、公には説明していない。

両社がすでに、意味のある評価を維持できるだけの期間を米国と英国のレビューの間に設ける計画を持っている可能性もある。一方で、デプロイサイクルの終盤まで英国側のアクセスを遅らせる可能性もある。

企業側のタイムラインがなければ、運用上の影響は不明確なままだ。数日程度の差と、数か月に及ぶ遅延とでは、意味合いが大きく異なる。

政策の技術的な対象範囲も同様に不明確だ。報道は新規モデルやフロンティアモデルに言及しているが、それらのラベルには単一の拘束力ある定義がない。

企業は汎用モデル、特化型サイバーモデル、研究プレビュー、既存の基盤モデル上に構築された新しいエージェントをリリースする場合がある。それぞれのカテゴリは異なるアクセス上の問題を生む。

アップデートは境界をさらに複雑にする。モデルは、ツールの追加、コンテキストの長期化、メモリの改善、システム層の改訂によって、まったく新しい名称を与えられなくても重要な新能力を獲得しうる。

名前の付いたモデルリリースだけに結び付けられた政策では、こうした変化を見逃す可能性がある。より広範な政策では、通常の製品アップデートまで国家安全保障プロセスに取り込むおそれがある。

透明性も別の懸念を生む。機密性の高い評価では、脆弱性やテスト手順をすべて明らかにすることはできない。公表すれば、攻撃者が安全対策を回避する助けになる可能性があるためだ。

完全な秘密主義にもコストがある。外部研究者は、レビューが信頼できる手法を用いたか、企業が特定された問題を修正したか、政治的な考慮が結果に影響したかを評価できない。

最善のバランスは、悪用可能な詳細を保護しながら、枠組み、広範なリスクカテゴリ、責任を担う機関、集約された結果を公開することだろう。

現在の報道は、そうした透明性が米国優先アプローチに伴っていることを示していない。説明責任を欠く優先順位付けは、国民の信頼を高めずに権力を集中させうる。

批判者は、同盟国の専門家を排除すれば安全性が弱まり、限られた技術的作業を重複させると主張するかもしれない。支持者は、機密性の高い米国モデルは国内リスクが理解されるまで米国の管理下に置くべきだと答えるかもしれない。

どちらの立場も過大に主張すべきではない。より多くの評価者が自動的により良いテストを生むわけではなく、特に調整によって機密情報が漏れたり、手順に一貫性がなくなったりする場合はなおさらだ。

中央集権的なレビューも、自動的により強力になるわけではない。少数のチームは、盲点、組織的なインセンティブ、不完全な脅威想定を共有しうる。

決定的な証拠は実装から得られる。レビュー期間、英国側のアクセス日、公開された手法、記録された修正によって、この制度が安全性を高めるのか、単に統制の主体を変えるだけなのかが明らかになる。

制限が機能するかを示す三つのシグナル

次の試金石は、ワシントンが機密性の高いモデルを保護しながら、同盟国の評価を後回しにせずに済むかどうかだ。

第一のシグナルは、米国と英国のアクセスの間隔である。短く予測可能な引き継ぎなら、この政策が排除ではなく安全な順序付けを定めるものだというワシントンの主張を支えることになる。

長期化した、あるいは期間が定められていない遅延は、英国の依存に対する懸念を強める。また、共同評価よりも国家による統制が優先されたことを示唆するだろう。

読者は、次のOpenAIまたはAnthropicの主要リリースにおける具体的な時期を注視すべきだ。重要な日付は、米国の評価者がアクセスを受ける時点、AISIがアクセスを受ける時点、公開デプロイが始まる時点である。

第二のシグナルは、公的なレビュー枠組みである。ワシントンは悪用可能な発見を開示する必要はないが、どのシステムが対象となり、どの機関が参加するのかは明らかにすべきだ。

信頼できる枠組みは、想定されるレビュー期間と、開発者が発見されたリスクにどう対応するのかも説明すべきである。公開されれば、このプロセスが一貫した安全保障目標に資するものだという根拠が強まる。

非公開の指示に依存し続ければ、その根拠は弱まる。企業、同盟国、研究者、顧客は、安定した政策と裁量的な介入を区別できなくなる。

第三のシグナルは、次のCAISI-AISI共同評価である。実質的な公表があれば、政治的変化を経ても技術協力が存続したことを示せる。

最も強い証拠には、共有された手法、記録された制約、安全対策に影響した発見が含まれるだろう。意味のある評価の詳細を欠く儀礼的な声明では、安心材料としての価値ははるかに低い。

これらのシグナルは、政府研究所を超えて重要である。開発者、企業の購入者、ナレッジワーカーは、ファイルの検索、ソフトウェアの操作、接続されたサービスをまたぐ行動が可能なモデルへの依存を強めている。

高度な能力が導入前に十分に厳格な試験を受けているという証拠が必要だ。また、試験機関が政府と企業の双方の前提に異議を唱えられるだけの独立性を維持しているという確信も求められる。

OpenAI、Anthropic、英国での試験は今、その問いの中心に位置している。ワシントンが迅速な審査を実施し、その後に真に実効性のある同盟国による精査を設けるなら、この新たな手順は安全保障を強化し得る。

英国によるアクセスが無期限化、あるいは象徴的なものにとどまるなら、最先端システムにより広範な検証が求められるまさにその時に、評価者の裾野を狭めることになる。アクセス期限、書面化されたルール、そして次回の共同報告書に注目すべきだ。

 
 

無料で始めましょう

ローカルファーストのパーソナル知識管理付きAIアシスタント

より良いAI体験のために、

remio は現在、 Windows 10+ (x64)とM-Chip Mac のみをサポートしています。

仕事のAIパートナー
remioでもっと仕事が進む

計画・作成・仕上げまで
すべてをひとつに

bottom of page