top of page

백악관, AI 검토 프레임워크 완성했지만 규칙은 비공개

백악관이 고도 AI 모델을 검토하기 위한 프레임워크를 완성했지만, 예정된 30일간의 정부 검토 기간에도 불구하고 규칙은 비공개로 남아 있다. 당국자들이 주요 기술 기업들에 이 자발적 절차를 설명한 뒤, 이 사안은 Google News 전반에서 알려졌다. 이는 국가안보상 비밀주의와 대중에 대한 책임성 사이에 즉각적인 충돌을 만든다.

보도에 따르면 이 프레임워크는 고도 역량과 잠재적 국가안보 위험을 지닌 폐쇄형 모델을 겨냥한다. 학습된 파라미터를 내려받아 수정할 수 있는 오픈웨이트 모델은 제외된 것으로 전해진다. 당국자들은 검토 대상 시스템과 면제 시스템을 구분하는 기준을 공개하지 않았다.

이 구분은 OpenAI, Anthropic, Google, Meta, Microsoft, Nvidia가 프레임워크 관련 비공개 논의에 참석했기 때문에 중요하다. 일부 기업은 폐쇄형 시스템을 개발하는 반면, 다른 기업들은 공개 모델 배포나 이를 뒷받침하는 인프라에 대규모 투자를 하고 있다. 따라서 정부는 경쟁하는 개발 모델들 사이에 중대한 경계를 긋고 있으면서도, 그 경계가 어디에 놓였는지는 대중에게 보여주지 않고 있다.

이 정책은 도널드 트럼프 대통령이 6월 2일 발표한 고도 AI 혁신 및 보안 관련 행정명령을 따른다. 이 명령은 대상 프런티어 모델이 공개되기 전에 정부가 자발적으로 접근할 수 있도록 요구했다. 또한 기관들에 고도 사이버 역량을 측정할 기밀 벤치마크를 만들도록 지시했다.

이 프레임워크는 전통적인 인허가 프로그램이 아니다. 기업들이 모델을 출시하기 전에 연방 정부의 허가를 법적으로 받아야 하는 것은 아니다. 그러나 정부의 요청, 국가안보 관련 관계, 조달 결정, 평판상 압력은 자발적 절차를 실제로 영향력 있게 만들 수 있다.

이 때문에 이 사안은 또 하나의 워싱턴 정책 발표에 그치지 않는다. 백악관은 개발자들이 민감한 모델을 공유해 연방 전문가들이 보안 위험을 찾기를 원한다. 동시에, 역량 있는 AI의 중요한 범주를 제외한다고 전해지는 미공개 기준을 대중이 신뢰해 달라고 요구하고 있다.

백악관 AI 프레임워크가 바꾸는 것

이 프레임워크는 정부가 일부 미출시 AI 모델에 접근할 수 있는 구조화된 경로를 만들지만, 선정 규칙은 대중의 시야 밖에 둔다.

트럼프의 AI 보안 행정명령은 연방 정부에 기밀 벤치마킹 절차를 개발하도록 지시한다. 이 절차는 AI 모델이 고도 사이버 역량을 지녔는지, 그리고 “대상 프런티어 모델”의 기준선을 넘는지를 평가한다.

프런티어 모델은 AI 개발의 최전선에 가까운 곳에서 작동하는 고성능 범용 시스템이다. “대상”이라는 말은 정부가 해당 모델이 행정명령의 보안 중심 검토 절차에 포함된다고 판단한다는 뜻이다.

이 명령은 참여 개발자들에게 대상 모델을 공개 출시 최대 30일 전에 연방 정부가 접근할 수 있도록 요청한다. 그러면 정부는 특히 고도 사이버 작전과 관련된 국가안보 위험을 평가할 수 있다.

미공개 프레임워크는 운영상의 세부 사항을 추가하는 것으로 전해진다. 프레임워크 보도에 따르면, 대상 시스템은 폐쇄형이어야 하고 최첨단 역량을 보유하며 국가안보 우려를 제기해야 한다. 검토 기간에는 직원들의 접근이 제한될 수도 있다.

개발자들은 시스템을 공개 출시일에 가까운 시점에 제출하도록 권장받은 것으로 전해진다. 이 접근법은 정부 시험과 상업적 이용 가능 시점 사이의 지연을 줄인다. 또한 검토자들에게 더 완성된 버전의 모델을 제공한다.

그러나 출시 직전 검토는 실질적인 압박을 만든다. 30일은 연방 팀이 결과를 재현하고, 실제 취약점을 시험 산출물과 구분하며, 완화 조치가 효과가 있는지 평가하기에 제한된 시간이다. 모델마다 도구, 안전장치, 배포 설정이 다르면 어려움은 더 커진다.

모델의 위험은 사람들에게 제공되는 접근 방식에도 좌우된다. API 서비스는 개발자가 사용량을 모니터링하고 안전장치를 중앙에서 변경할 수 있게 한다. 내려받을 수 있는 모델 가중치는 외부 운영자가 시스템을 수정하고 제한을 없애며 비공개로 배포할 수 있게 한다.

이러한 차이는 검토 절차가 단일 벤치마크 점수에 의존할 수 없는 이유를 설명한다. 통제된 실험실 시험은 유리한 조건에서 모델이 무엇을 할 수 있는지 보여줄 수 있다. 그러나 그것이 공격자들이 실제 환경에서 같은 역량에 어떻게 적응할지를 자동으로 예측하지는 않는다.

백악관이 일부 세부 사항을 보호할 정당한 이유는 있다. 정확한 사이버 시험을 공개하면 개발자들이 그 시험에 직접 맞춰 훈련할 수 있다. 또한 정부 기관들이 어떤 공격 방법을 가장 우려하는지 적대적 행위자들에게 알려줄 수도 있다.

그러나 비밀주의가 모든 층위를 덮을 필요는 없다. 정부는 시험 프롬프트와 기밀 위협 정보를 보호하면서도 거버넌스 규칙, 대상 선정 원칙, 검토 일정, 이의제기 절차, 집계 결과를 공개할 수 있다.

이러한 분리는 보안 업무에서 일반적이다. 방어자는 민감한 운영 세부 사항을 거의 공개하지 않지만, 신뢰할 수 있는 감독에는 여전히 가시적인 절차가 필요하다. 그런 절차가 없다면 외부인은 유사한 모델이 유사한 대우를 받는지 판단할 수 없다.

따라서 이 프레임워크는 모델 시험 이상의 변화를 만든다. 이는 연방 당국자들에게 일부 상업용 AI 출시의 최종 단계에서 역할을 부여한다. 절차가 공식적으로 자발적이라는 점에도 이런 영향력은 존재한다.

해결되지 않은 핵심 질문은 모든 벤치마크가 공개되어야 하는지 여부가 아니다. 정부가 개발자, 연구자, 시민이 절차 자체를 평가할 수 있을 만큼 충분히 공개했는지 여부다.

Google News 보도가 비밀주의에 주목하는 이유

가장 뉴스 가치가 큰 특징은 연방 AI 시험의 존재 자체가 아니라, 그 시험을 지배하는 프레임워크를 숨기기로 한 결정이다.

Google News 결과는 이 정책이 두 방향의 신뢰를 요구하기 때문에 이러한 대비를 강조해 왔다. AI 기업들은 독점 모델을 정부에 맡겨야 한다. 대중은 출시 전에 양측이 위험한 역량을 식별할 것이라고 신뢰해야 한다.

백악관은 이 프레임워크가 국가안보와 미국의 AI 리더십을 지원한다고 밝혔다. 이러한 입장은 국내 기업을 약화시키는 느린 승인 체계를 만들지 않으면서 심각한 위험을 해결해야 한다는 더 넓은 정책적 절충을 반영한다.

이 우려는 앞서 정책을 지연시켰다. 5월 트럼프는 제안된 행정명령이 미국의 기술적 우위를 해칠 수 있다고 우려해 예정된 서명 행사를 취소했다. 지연된 행정명령은 행정부 당국자들이 어느 정도의 감독이 적절한지를 여전히 논의하고 있음을 보여줬다.

트럼프는 수정된 행정명령에 6월 2일 서명했다. 이는 인허가 또는 의무적 사전승인 요건을 명시적으로 피했다. 자발적 설계는 산업의 속도와 정부 접근권 사이의 절충안을 제시했다.

기밀 벤치마크가 완전히 공개될 것으로 예상된 적은 없다. 행정명령은 정부가 고도 사이버 역량을 평가하기 위한 기밀 절차를 개발하고 유지해야 한다고 명시한다. 이 문구는 당국자들에게 민감한 시험을 보호할 분명한 근거를 제공한다.

하지만 논란은 그보다 더 나아간다. 보도에 따르면 더 광범위한 프레임워크 역시 비공개로 유지된다. 빠진 정보에는 당국자들이 대상 범위를 정의하는 방식, 기밀 자료를 관리하는 방식, 접근을 제한하는 방식, 시험에서 심각한 문제가 발견됐을 때 대응하는 방식이 포함된다.

이 질문들은 사소한 행정 세부 사항이 아니다. 30일 기간 동안 누가 위험을 부담하는지를 결정한다. 또한 참여가 대형 기업에 소규모 연구소보다 유리한지를 좌우한다.

기존의 정부 관계가 있는 기업은 검토에 변호사, 보안 엔지니어, 정책 담당자를 배정할 수 있다. 소규모 개발자는 대형 출시를 마무리하는 동안 문서를 준비하는 데 어려움을 겪을 수 있다.

참여가 연방 조달이나 정부 파트너십 접근에 영향을 준다면, 이 절차는 경쟁의 관문이 될 수 있다. 서류상으로는 자발적이지만 상업적 결과에 영향을 미치게 된다.

이 프레임워크는 불균등한 정보 공개를 만들 수도 있다. 참여 기업들은 외부인이 볼 수 없는 정부의 기대에 관한 정보를 받는다. 이 지식은 내부 시험, 채용, 출시 계획을 형성할 수 있다.

초대받은 집단 밖의 연구자들은 다른 우려를 안고 있다. 독립 전문가들은 이 프레임워크가 적절한 위협을 다루는지, 신뢰할 만한 평가 방식을 사용하는지 평가할 수 없다. 이들은 당국자와 참여 기업의 요약에 의존해야 한다.

행정명령 이전에 외부 연구자들이 제출한 감독 지침은 독립적인 기술 참여와 대중의 수용을 요구했다. 또한 개발자들과 분쟁이나 소송에 관여한 기관과 관련된 이해충돌을 경고했다.

이 조언은 거버넌스 문제를 부각한다. 같은 연방 정부가 평가자, 고객, 규제기관, 정보 보유자, 소송 당사자로 행동할 수 있다. 명확한 절차는 한 역할이 다른 역할을 조용히 왜곡하는 것을 막는 데 도움이 된다.

Google News 키워드는 독자들을 애그리게이터를 통해 이 이야기로 이끌 수 있지만, 피드보다 원 보도가 더 중요하다. 집계된 헤드라인은 불확실성을 압축하며, 완성되지 않은 정책을 실제보다 더 확정된 것처럼 보이게 할 수 있다.

확인된 사실은 더 제한적이다. 행정명령은 존재한다. 이는 자발적 모델 공유 절차와 기밀 사이버 벤치마크를 만든다. 여러 보도에 따르면 비공개 산업 브리핑도 이뤄졌다.

다른 세부 사항은 공식적으로 공개된 것이 아니라 보도된 내용으로 남아 있다. 여기에는 최종 대상 범위 정의, 오픈 모델의 제외, 검토 중 직원 제한이 포함된다. 백악관은 이러한 조항을 독립적으로 검증할 수 있는 문서를 공개하지 않았다.

따라서 독자들은 비밀주의와 불확실성을 구분해야 한다. 당국자들은 내부 프레임워크를 완성했을 수 있다. 그러나 대중은 보도된 모든 조항이 최종 절차에 남았는지 알 수 있는 원문을 여전히 갖고 있지 않다.

폐쇄형 모델은 검토 대상이지만 오픈 모델은 제외된 것으로 전해져

이 프레임워크의 핵심 절충은 통제 가능한 폐쇄형 모델을 검토하는 반면, 통제가 더 어려운 내려받기 가능한 시스템은 제외한다는 점이다.

폐쇄형 모델은 제공업체의 운영 통제 아래 남아 있다. 사용자는 대개 애플리케이션이나 API를 통해 접근하며, 제공업체는 모델 가중치와 이를 뒷받침하는 인프라를 보유한다.

오픈웨이트 모델은 학습된 파라미터를 내려받을 수 있게 한다. 학습 데이터와 완전한 코드가 계속 제공되지 않을 수 있으므로, 전통적인 소프트웨어 의미에서 항상 오픈소스인 것은 아니다. 그럼에도 외부 운영자는 대체로 이를 수정하고 독립적으로 배포할 수 있다.

보도된 프레임워크는 최첨단 역량을 갖춘 폐쇄형 시스템에 초점을 맞춘다. 이 선택은 검토자들에게 명확한 상대방을 제공한다. 개발자가 접근을 통제하고, 안전한 시험 환경을 제공하며, 출시 전에 모델을 변경할 수 있다.

폐쇄형 모델 제공업체는 출시 후에도 완화 조치를 집행할 수 있다. 이들은 악용 계정을 차단하고, 필터를 업데이트하며, 의심스러운 활동을 모니터링하고, 도구를 철회할 수 있다. 이러한 통제 수단은 정부 권고를 더 쉽게 이행하게 한다.

오픈웨이트 공개는 다른 상황을 만든다. 가중치가 유통되기 시작하면 원래 개발자는 모든 사본을 신뢰성 있게 회수할 수 없다. 독립 운영자는 안전 조치를 제거하거나 특수 작업을 위해 모델을 미세 조정할 수 있다.

그 점에서 사전 출시 검토는 한층 더 중요해진다. 위험한 역량은 공개된 뒤에는 통제하기가 더 어려워진다. 하지만 동시에 집행 가능한 검토 체계를 마련하는 일은 정치적·기술적으로 더 어려워진다.

행정부는 혁신과 미국의 영향력을 위한 도구로서 오픈 모델을 거듭 지지해 왔다. 더 폭넓은 AI 행동 계획은 오픈 시스템이 글로벌 표준이 될 수 있으며, 이를 뒷받침하는 환경이 필요하다고 주장한다.

이들을 제외하면 Meta 같은 기업과 다운로드 가능한 가중치를 공개하는 소규모 개발사에 대한 압박은 줄어든다. 또한 커뮤니티 수정 이후 역량이 달라지는 시스템에 검토 절차를 적용하는 일도 피할 수 있다.

그러나 이 제외 조항은 정책의 위험 논리를 뒤집을 수 있다. 비공개 제공업체는 통제권을 유지한다는 이유로 정부의 감시를 받는다. 반면 오픈 개발자는 이후 배포로 통제력이 제한되는데도, 보도에 따르면 그 절차를 피할 수 있다.

OpenAI와 Anthropic은 모델이 오픈인지 비공개인지와 관계없이 적용되는 역량 기반 접근법을 지지했던 것으로 전해진다. 이 입장은 개발사가 모델을 어떻게 배포하는지가 아니라, 해당 시스템이 무엇을 가능하게 하는지에 초점을 둔다.

역량 기반 기준은 중립적으로 들리지만, 실제 구현은 여전히 어렵다. 검토자는 API, 로컬 배포, 미세 조정 버전, 도구 접근성이 서로 다른 모델 전반에서 비교 가능한 테스트를 마련해야 한다.

오픈 모델은 기본 형태에서는 덜 유능해 보일 수 있지만, 특화 학습 후에는 더 위험해질 수 있다. 비공개 시스템은 실험실에서 높은 점수를 기록하더라도, 실제 배포된 안전장치가 같은 행동을 차단할 수 있다.

정부는 시점 문제에도 직면한다. 비공개 개발사는 안정적인 출시 후보를 공유할 수 있다. 오픈 프로젝트는 더 긴 기간에 걸쳐 구성 요소, 체크포인트, 기술 세부 정보를 공개할 수 있다.

그럼에도 이 범주 전체를 제외하면 눈에 띄는 공백이 남는다. 중국 개발사들은 오픈 가중치 공개를 통해 모델을 빠르게 확산하고 국제적 채택을 유도해 왔다. 미국 당국자들은 이러한 확산을 경쟁상 도전이자 안보 우려로 설명해 왔다.

그 결과, 보도에 따르면 이 정책은 감독하기 가장 쉬운 기업에 집중한다. 이는 유용한 결과를 낼 수 있지만, 가장 광범위하게 통제되지 않은 배포를 보이는 시스템에 반드시 관심을 돌리지는 않는다.

이는 제품 전략에도 영향을 줄 수 있다. 비공개 출시가 추가 검토 비용을 수반한다면, 개발사들은 모델을 공개하는 방식을 재고할 또 하나의 이유를 얻게 된다. 일부는 가장 강력한 제품은 비공개로 유지하면서, 보도된 기준선 아래의 더 작은 오픈 시스템을 출시할 수 있다.

다른 기업들은 정부와의 관계가 참여를 가치 있게 만들지 않는 한 자발적 참여를 피할 수 있다. 이 체계의 영향은 선도 연구소들 사이에서 참여가 기대되는 규범이 되는지에 달려 있다.

참여 의사가 있는 비공개 모델 제공업체에 한정된 검토도 보안을 개선할 수 있다. 수백만 명의 사용자가 접근하기 전에 취약점을 찾아낼 수 있다. 또한 출시 후 발견된 사고에 대응할 소통 채널을 구축할 수도 있다.

우려는 절대적인 것이 아니라 비교에 관한 것이다. 행정부는 명령이 명시한 우려가 위험한 역량에 관한 것인데도, 왜 배포 형식이 자격 요건을 결정해야 하는지 보여주지 않았다.

당국자들이 그 경계를 설명하기 전까지, 이 체계는 가장 통제하기 어려운 문제를 제기하는 모델 범주에 보상하는 것으로 보인다. 이것이 이 이야기를 이끄는 핵심 모순이다.

자발적 절차도 AI 기업에 압력을 가할 수 있다

이 체계에는 공식적인 인허가 권한이 없지만, 연방 정부 접근성, 조달, 국가안보 관련 관계가 실질적인 무게를 부여한다.

OpenAI, Anthropic, Google, Meta, Microsoft, Nvidia 및 소규모 기업들이 백악관 논의에 참여한 것으로 전해진다. 이들의 참여는 이 체계가 업계의 한 구석에만 영향을 미치는 것이 아님을 보여준다.

모델 개발사는 보안 실패를 피하는 데 관심이 있지만, 출시 시점도 중요하게 여긴다. 주력 제품 출시가 지연되면 기업 계약, 개발자 로드맵, 인프라 약속, 경쟁적 입지에 차질이 생길 수 있다.

따라서 30일의 검토 기간은 법적 마감일이 없더라도 긴장을 만든다. 개발사는 후보 모델을 얼마나 일찍 동결할지, 정부 테스터에게 어느 정도의 접근 권한을 부여할지 결정해야 한다.

너무 일찍 공유하면 미완성 작업이 노출되고 오해를 부를 결과가 나올 수 있다. 너무 늦게 공유하면 발견된 약점을 고칠 시간이 거의 남지 않는다. 출시 며칠 전 추가된 완화 조치는 성능을 바꾸거나 새로운 문제를 만들 수도 있다.

기밀성도 또 다른 우려다. 프런티어 모델은 막대한 투자를 의미하며 민감한 기술 정보를 담고 있다. 개발사는 경쟁사, 계약업체 또는 권한 없는 당국자가 자사 시스템에 접근할 수 없다는 보장이 필요하다.

검토 기간 동안 적용되는 것으로 알려진 직원 접근 제한은 이 위험에 대응하기 위한 것으로 보인다. 접근을 제한하면 유출과 내부자 위협을 줄일 수 있다. 다만 정부의 발견 사항을 재현할 수 있는 팀이 소수에 그치면 디버깅은 더 느려질 수 있다.

지식재산권 규정은 사이버보안만큼 중요하다. 모델 검토 과정에서 시스템 지침, 학습 방법, 평가 데이터, 미공개 역량이 드러날 수 있다. 기업들은 기관이 해당 정보를 어떻게 보관하고 공유하는지에 관한 명확한 한계가 필요하다.

정부는 테스트 실패 이후 무엇이 일어날지도 결정해야 한다. 이 명령은 인허가가 아니라 협력을 설명하므로, 당국자에게 출시를 직접 중단할 권한이 없을 수 있다.

그럼에도 완화 조치를 요청하거나, 기업에 경고하거나, 정부 사용을 제한하거나, 계약을 재검토할 수는 있다. 극단적인 경우 다른 법적 권한이 적용될 수 있지만, 이 체계 자체가 그런 권한을 수립하는 것은 아니다.

이 모호함은 절차의 유연성을 유지하기 때문에 협력을 장려할 수 있다. 동시에 결과를 일관되지 않게 만들 수도 있다. 한 기업은 자발적으로 출시를 미루는 반면, 다른 기업은 유사한 우려를 받고도 출시할 수 있다.

공개 보고는 기밀 정보를 노출하지 않으면서도 이런 불일치를 줄일 수 있다. 정부는 참여 건수, 광범위한 위험 범주, 평균 검토 기간, 채택된 완화 조치의 수를 공개할 수 있다.

집계 보고는 관찰자들이 이 절차에 실질적 내용이 있는지 평가할 수 있게 한다. 또한 이 체계가 사전에 선정된 소수 기업만 포괄하는지도 드러낼 수 있다.

과거의 자발적 AI 약속은 보이지 않는 준수의 약점을 보여준다. 초기 백악관 약속을 분석한 독립 연구는 책임성이 기업 행동에 대한 공개적이고 검증 가능한 공개에 달려 있다고 밝혔다.

새 체계는 기밀 보안 평가를 포함한다는 점에서 다르다. 그럼에도 동일한 구조적 교훈이 적용된다. 외부인이 기준이나 준수 여부를 검증할 수 없다면, 약속은 폭넓은 신뢰를 뒷받침할 수 없다.

대형 개발사들은 어느 정도의 기밀성을 환영할 수 있다. 모델이 위험한 사이버 기준선을 촉발했다는 사실을 공개하면 출시가 타격을 받거나 공격자에게 정보를 드러낼 수 있다. 비공개 검토는 즉각적인 시장 위기를 만들지 않고 위험을 논의할 공간을 제공한다.

정부 테스터 역시 솔직한 접근이 필요할 수 있다. 모든 발견 사항이 자동으로 공개 기록에 들어간다면 기업은 협조적이지 않을 수 있다. 민감한 결과를 보호하면 기술적 교류의 질을 높일 수 있다.

정책 과제는 그러한 솔직함을 보존하면서도 사적인 클럽이 허용 가능한 AI 출시를 정의하지 못하게 하는 것이다. 현재의 비밀주의는 당국자들이 그 균형을 찾았는지 판단하기 어렵게 만든다.

소규모 연구소는 특히 불확실성에 직면한다. 미래 모델이 자격을 갖출지, 참여 준비에 무엇이 필요한지, 초대를 거절하면 어떤 결과가 따르는지 알지 못한다.

오픈 가중치를 기반으로 개발하는 개발사는 다른 모호함에 직면한다. 기본 모델은 면제될 수 있지만, 매우 유능한 수정 버전은 위험 기준선을 넘을 수 있다. 당국자들이 그런 사례를 어떻게 다룰지는 공개 체계 어디에도 설명되어 있지 않다.

기업 고객도 주의를 기울여야 한다. 정부 검토를 받은 모델이 금융, 의료, 법률 업무 또는 핵심 인프라에 자동으로 안전한 것은 아니다. 보도에 따르면 연방 검토는 모든 운영상 실패가 아니라 국가안보와 고도화된 사이버 위험에 초점을 맞춘다.

AI 시스템을 구매하는 기업은 여전히 자체 평가가 필요하다. 데이터 처리, 접근 통제, 도구 권한, 장애 복구, 공급업체의 사고 대응 절차를 검토해야 한다.

지식 노동자들도 관련된 구분에 직면한다. 모델이 정교한 사이버 테스트를 통과하더라도, 사실을 환각하거나 기밀 데이터를 노출하거나 비즈니스 워크플로에서 권한 없는 행동을 할 수 있다.

당국자들이 그 한계를 정의하지 않는다면 “정부 검토 완료”라는 표현은 오해를 부르는 마케팅 신호가 될 수 있다. 좁은 범위의 사전 출시 평가는 배포 후 지속적인 모니터링을 대체할 수 없다.

이 때문에 투명성은 민주주의뿐 아니라 산업에도 중요하다. 구매자는 참여를 일반적 신뢰성의 증거로 여기기 전에 검토가 무엇을 포괄하는지 알아야 한다.

비밀 기준은 책임성 공백을 만든다

기밀 테스트 자료는 국가안보를 보호할 수 있지만, 이를 둘러싼 거버넌스를 숨기면 공정성, 범위, 효과성에 대한 독립적 검증이 불가능해진다.

비밀주의를 지지하는 가장 강력한 근거는 벤치마크의 무결성이다. 정부가 모든 테스트를 공개한다면, 개발사들은 근본적인 보안 역량이 아니라 정확한 문항에 맞춰 최적화할 수 있다.

적대적 행위자들은 기관이 어떤 공격 기법을 가장 중대하게 보는지도 알게 될 수 있다. 기밀 벤치마크에는 공개 문서에 안전하게 담을 수 없는 위협 인텔리전스가 포함될 수 있다.

그러한 주장이 완전한 불투명성을 정당화하지는 않는다. 당국자들은 운영 내용은 보호하면서도 체계의 구조는 공개할 수 있다. 누가 모델을 평가하는지, 이해상충을 어떻게 관리하는지, 개발사가 판단에 어떻게 이의를 제기하는지를 설명할 수 있다.

대중에게는 기준선에 대한 일반적 정의도 필요하다. 선도 기업이 새 시스템을 출시할 때마다 “최첨단”의 의미는 바뀐다. 상대적 기준은 공식 개정 없이도 달라질 수 있다.

국가안보 위험 역시 매우 광범위하다. 사이버 역량에는 취약점 발견, 익스플로잇 개발, 자격 증명 탈취, 사회공학, 자동화된 침입이 포함된다. 이러한 활동은 난이도와 잠재적 피해 측면에서 크게 다르다.

모델은 고립된 기술 과제에서는 뛰어난 성능을 보이지만, 장기간의 공격 과정에서는 실패할 수 있다. 또 다른 모델은 브라우저, 코드 실행, 자격 증명 또는 특화 도구에 연결될 때만 위험해질 수 있다.

따라서 이 체계는 원시 모델 역량과 배포된 시스템 역량을 구분해야 한다. 이 구분은 어느 기업이 완화 조치를 책임지는지에 영향을 준다.

모델 개발사는 학습과 핵심 안전장치를 통제한다. 클라우드 플랫폼은 인프라와 계정 모니터링을 통제한다. 애플리케이션 개발사는 도구, 권한, 사용자 워크플로를 통제한다.

공개된 거버넌스 모델이 없다면 책임은 이들 행위자 사이를 오갈 수 있다. 각 당사자는 다른 계층이 위험을 만들었다고 주장할 수 있다.

비밀주의는 일관되지 않은 대우도 감출 수 있다. 인맥이 탄탄한 기업의 비공개 모델은 맞춤형 검토를 받는 반면, 덜 알려진 개발사는 불확실성이나 지연에 직면할 수 있다.

그런 편애가 발생했다는 공개 증거는 없다. 문제는 외부인에게 이를 검증할 정보가 부족하다는 점이다. 책임성 규칙은 부분적으로 불평등한 대우를 감지할 수 있게 하기 위해 존재한다.

비판자들은 업계 포획도 우려한다. 비공개 논의에 초대된 기업은 자사 제품에 영향을 미치는 정의를 형성할 수 있다. 이들의 기술 지식은 필요하지만, 참여가 배타적 통제가 되어서는 안 된다.

독립 연구자, 시민사회 단체, 영향을 받는 산업은 서로 다른 전문성을 제공한다. 사이버보안 전문가는 공격 역량을 시험할 수 있고, 노동·시민권·소비자 전문가는 벤치마크의 좁은 범위 밖에 있는 위험을 식별할 수 있다.

이 프레임워크가 모든 사회적 우려를 다룰 필요는 없다. 명시된 목적은 보안이다. 다만 정부 당국은 대중이 침묵을 포괄적 대응으로 오해하지 않도록, 어떤 위험이 이 체계의 권한 범위 밖에 있는지 설명해야 한다.

자율 참여 방식은 또 다른 책임성 문제를 낳는다. 기업이 참여를 거부하면 정부는 해당 기업의 모델을 평가하지 못할 수 있다. 당국은 그 거부 사실을 공개할지 여부를 아직 공개적으로 설명하지 않았다.

기업명을 공개하면 이 절차가 비공식적 강제가 될 정도의 압박이 생길 수 있다. 반대로 모든 참여 결정을 비밀로 유지하면 이 프로그램이 얼마나 대표성을 갖는지 대중은 알 수 없다.

균형 잡힌 접근법으로는 전체 참여 현황을 공개하고, 기업명은 동의가 있을 때만 발표하는 방안이 있다. 민감한 세부 정보가 운영상 가치를 잃은 뒤 익명화된 사례 연구를 발행할 수도 있다.

이 프레임워크에는 정정 절차도 필요하다. 벤치마크는 거짓 양성과 거짓 음성을 낳는다. 비현실적인 설정 때문에 모델이 실패할 수 있고, 새로운 공격 기법을 시험이 포착하지 못해 통과할 수도 있다.

독립적인 재현 검증은 이러한 약점을 찾아내는 데 도움이 된다. 모든 방법론이 기밀로 남는다면, 외부 연구자들은 벤치마크가 실제 세계의 위험을 측정하는지 검토할 수 없다.

정부는 보안 인가를 받은 독립 검토 패널을 구성할 수 있다. 구성원들은 엄격한 규정 아래 민감한 방법론에 접근하되, 유효성과 거버넌스에 대한 비기밀 평가를 공개할 수 있다.

의회도 정기적인 기밀 브리핑과 공개 요약 보고를 받을 수 있다. 입법부의 감독이 비밀주의를 없애지는 못하겠지만, 행정부와 참여 기업을 넘어 권한을 분산시킬 수 있다.

AI 역량은 빠르게 변화하므로 만료 및 개정 규정도 중요하다. 한 세대의 모델을 기준으로 설계된 벤치마크는 새로운 도구, 학습 방법 또는 배포 방식이 등장하면 관련성을 잃을 수 있다.

백악관은 프레임워크를 얼마나 자주 갱신할지, 그리고 누가 그 갱신을 승인하는지를 명확히 해야 한다. 그렇지 않으면 상용 출시물에 계속 영향을 미치면서도 표준은 조용히 바뀔 수 있다.

이 우려가 비공개 프레임워크가 취약하다는 증거는 아니다. 이는 외부인이 그것이 강력하다고 책임 있게 결론 내릴 수 없는 이유를 보여준다.

행정부는 충분한 절차 정보를 공개해 정당성을 확립하면서도 기밀 사이버 테스트를 보존할 수 있다. 그때까지 신뢰는 주로 평가받는 기관들의 보증에 의존하게 된다.

Google News 헤드라인이 사라진 뒤 주목할 점

세 가지 신호가 이 비공개 프레임워크가 신뢰할 수 있는 보안 프로그램, 업계 표준, 혹은 단명한 자율 실험으로 자리 잡는지를 보여줄 것이다.

첫 번째 신호는 비기밀 백악관 요약본이다. 당국이 민감한 프롬프트, 공격 경로 또는 위협 인텔리전스를 공개할 필요는 없다. 대신 프레임워크의 적용 원칙, 참여 기관, 검토 단계, 데이터 보호 및 에스컬레이션 절차는 공개해야 한다.

그러한 요약은 비밀 유지가 좁은 범위로 한정됐다는 근거를 강화할 것이다. 계속된 침묵은 행정부가 단지 기술적 테스트가 아니라 거버넌스 선택까지 감추고 있음을 시사할 수 있다.

특히 오픈 모델 제외에 대한 설명을 주시해야 한다. 정부가 배포 형식이 적용 대상을 결정한다고 확인한다면, 역량만으로는 왜 충분하지 않은지 설명해야 한다.

명확한 설명은 그 절충안을 정당화할 수 있다. 정부가 검토 가능한 시스템과 완화 조치를 적용할 수 있는 제공업체에 프로그램의 초점을 맞춘다는 점을 보여줄 수 있다. 설명이 없다면 핵심 모순은 그대로 남는다.

두 번째 신호는 주요 개발사들이 다음 대형 출시를 앞두고 어떻게 행동하는지다. OpenAI, Anthropic, Google 및 기타 폐쇄형 모델 제공업체는 30일 절차가 업계의 통상 관행으로 자리 잡는지 보여줄 수 있다.

기업은 기밀 조사 결과를 공개하지 않고도 참여 사실을 발표할 수 있다. 검토로 인해 어떤 광범위한 완화 조치가 바뀌었는지 요약하고, 검토가 다루지 않은 범위를 밝힐 수도 있다.

이런 종류의 공개는 검증 가능한 영향 증거를 제공함으로써 프레임워크를 강화할 것이다. 아무런 인정 없이 출시가 반복된다면 참여가 실질적인지 상징적인지 평가하기 어려워질 것이다.

출시 시점도 중요하다. 정부 테스트 이후 모델 출시를 연기하는 개발사는 이 절차가 실질적 영향을 갖는다는 점을 보여줄 수 있다. 다만 기업과 정부는 특정 취약점이 드러나지 않도록 신중한 표현을 사용해야 한다.

검토된 모든 모델이 눈에 띄는 변화 없이 예정대로 출시된다면 두 가지 해석이 가능하다. 시스템이 통과했거나, 검토에 영향력이 부족한 경우다. 정부의 집계 보고는 이 두 결과를 구분하는 데 도움이 될 수 있다.

세 번째 신호는 오픈 웨이트 모델이 이 절차에서 영구적으로 제외되는지 여부다. 보도된 면제는 최종 정책이 아니라 초기 범위 설정 선택일 수 있다.

당국은 다운로드 가능한 시스템을 위한 별도 경로를 개발할 수 있다. 이 절차는 출시 전 가중치, 배포 통제, 출처 추적 조치 또는 개발자가 공개한 위험 평가를 검토할 수 있다.

두 범주를 아우르는 역량 기반 프레임워크는 현재의 불일치를 줄일 것이다. 다만 더 많은 자원과 수정된 버전을 평가할 더 명확한 방법이 필요해진다.

오픈 모델이 선도적인 폐쇄형 시스템에 가까운 역량을 갖추는데도 계속 면제된다면, 정부의 논리는 약해질 것이다. 그러면 이 정책은 위험보다 통제 가능성을 더 규제하게 된다.

업계 반응도 또 다른 단서를 제공할 것이다. Meta와 오픈 모델 옹호자들은 연구와 경쟁을 위해 면제가 필요하다고 주장할 수 있다. 폐쇄형 모델 개발사들은 경쟁사가 피하는 검토 비용을 자신들만 부담한다면 반발할 수 있다.

의회는 이러한 유인을 면밀히 살펴야 한다. 자율적인 행정부 프레임워크는 빠르게 움직일 수 있지만, 지속 가능한 감독을 위해서는 기밀성, 기관 권한 및 공개 보고를 규율하는 입법이 필요할 수 있다.

엔터프라이즈 구매자는 참여를 보편적 안전성 인증으로 받아들여서는 안 된다. 공급업체에 모델이 연방 검토를 거쳤는지, 어떤 광범위한 문제가 시험됐는지, 그리고 어떤 배포 위험이 여전히 자신의 책임인지 물을 수 있다.

이러한 모델을 통합하는 개발자들은 자체 통제를 유지해야 한다. 최소 권한 접근, 샌드박스 실행, 사람의 승인, 감사 로그 및 사고 대응은 연방 테스트 여부와 관계없이 여전히 필요하다.

연구자들은 기관이 기밀 벤치마크 외부에서 평가 과학을 공개하는지 모니터링해야 한다. 모델 자율성, 사이버 지원 및 안전장치 신뢰성을 측정하는 공개 방법론은 더 넓은 분야를 발전시킬 수 있다.

Google News의 뉴스 주기는 결국 다음 모델 출시나 워싱턴의 분쟁으로 옮겨갈 것이다. 해결되지 않은 거버넌스 문제는 헤드라인이 사라진 뒤에도 남는다.

신뢰할 수 있는 프레임워크에 국가안보 테스트에 대한 완전한 공개 접근이 필요한 것은 아니다. 누가 적용 대상인지, 의사결정이 어떻게 이루어지는지, 그리고 절차가 결과를 바꾸는지를 보여줄 만큼의 투명성이 필요하다.

백악관은 출시 전 가장 강력한 일부 상용 AI 시스템을 검토할 경로를 마련했다. 이는 의미 있는 정책적 조치다.

그러나 이 경로에 대한 대중의 신뢰는 아직 확립하지 못했다. 보도된 오픈 모델 제외, 자율적 구조, 공개되지 않은 규칙으로 인해 지나치게 많은 부분이 사적인 보증에 의존하고 있다.

앞으로 3개월 동안 비기밀 프레임워크 요약, 대형 출시를 둘러싼 개발사 공개, 오픈 웨이트 시스템에 대한 결정을 지켜봐야 한다. 이 신호들은 프로그램이 비공개 출발을 넘어 성숙하는지 보여줄 것이다.

그때까지 Google News를 통해 유입된 독자들은 이 프레임워크를 검증된 안전 인증이 아니라 운영 중인 것으로 보도된 체계로 받아들여야 한다. 정부는 최첨단 AI 출시물에 영향을 미치는 규칙 작성은 마쳤다. 이제 대중이 그 규칙의 적용 방식을 신뢰해야 하는 이유를 보여줘야 한다.

 
 

무료로 시작하세요

개인 지식 관리 기능을 갖춘 로컬 우선 AI 어시스턴트

더 나은 AI 경험을 위해

현재 remio는 Windows 10+ (x64)M-Chip Macs만 지원합니다.

업무를 위한 AI 파트너
remio와 더 많은 일을 해내세요

계획하고, 만들고, 완성하세요
모든 일을 한곳에서

bottom of page