top of page

Maria Cantwell AI 프레임워크, 프런티어 AI를 자체 테스트에서 독립 감사로 전환

20분 전
11분 분량

Maria Cantwell 상원의원은 대상 프런티어 모델이 대중에게 공개되기 전에 독립 감사를 의무화하는 6개 항목의 AI 프레임워크를 제시했다. Maria Cantwell AI 프레임워크는 연방 안전 기준, 지속적인 테스트, 사고 보고, 개발사 책임성도 요구한다. 이는 주로 자발적 약속이나 기업 주도 평가에 의존하는 규제 방식에 대한 직접적인 도전이다.

2026년 10월 7일 공개된 이 제안은 법안이 아니며 집행 체계도 정의하지 않는다. 하지만 가장 강력한 AI 시스템을 누가 테스트해야 하는지를 둘러싼 워싱턴의 확대되는 논쟁에서 분명한 입장을 제시한다. Cantwell은 심각한 실패가 발생한 뒤에만이 아니라, 배포 전에 연방 전문가와 독립 감사인이 참여해야 한다고 본다.

이 선택은 개발사 자체 테스트와 법적 주의 의무를 중심에 둔 제안들과 그녀의 프레임워크를 대립시킨다. 차이는 절차적인 것처럼 들릴 수 있지만, 누가 증거를 통제하는지, 누가 안전장치의 작동 여부를 판단하는지, 규제기관이 언제 개입할 수 있는지를 바꾼다.

Cantwell의 프런티어 AI 계획, 테스트를 연구소 밖으로 옮기다

핵심 변화는 또 하나의 안전 서약이 아니다. Cantwell은 대상 시스템이 출시 전에 연방 기준을 충족한다는 사실을 외부 검토자가 검증하기를 원한다.

Cantwell은 상원 상무·과학·교통위원회의 민주당 간사다. 그녀의 6개 항목 프레임워크는 국립표준기술연구소(NIST)에 고도 AI 시스템을 위한 측정 가능하고 위험 기반의 요건을 개발하도록 요청한다.

이 제안은 프런티어 AI, 즉 이례적으로 심각한 보안 또는 안전 위험을 초래할 수 있는 고성능 범용 모델에 초점을 둔다. Cantwell은 어떤 시스템이 이 범주에 속하는지 판단할 최종 법정 기준을 제시하지 않는다. 그 정의는 입법이나 기관 규칙 제정을 통해 마련되어야 한다.

대상 시스템은 배포 전에 독립 감사를 받아야 한다. 이후 정부 전문 인력과 자격을 갖춘 외부 평가자가 시스템의 운용 수명 전반에 걸쳐 계속 테스트한다.

이 검토는 AI 기반 사이버공격, 화학적 또는 생물학적 오용, 방사능 및 핵 위험, 인간 통제 상실, 안전하지 않은 자동 개선 등을 포함한 위협을 살핀다. 위험한 능력을 보이는 시스템은 더 강한 심사와 안전장치를 적용받게 된다.

프레임워크는 제한된 감독 아래 작업을 계획하고 실행하는 AI 애플리케이션인 자율 에이전트도 다룬다. Cantwell은 에이전트가 모니터링을 회피하거나, 스스로를 수정하거나, 통제 환경을 벗어날 수 있는지를 판단하는 테스트를 원한다.

그녀의 계획에는 6개의 광범위한 원칙이 담겼다. 여기에는 집행 가능한 연방 기준, 지속적 독립 테스트, 투명성과 책임성, 민관 파트너십, 사회적 피해 방지, 국제 협력이 포함된다.

처음 세 원칙이 제안의 규제 핵심을 이룬다. NIST가 기준을 만들고, 독립 전문가가 준수 여부를 시험하며, 개발사는 중대한 위험을 공개하고 심각한 사고를 보고하게 된다.

나머지 원칙은 프레임워크를 모델 연구소 너머로 확장한다. Cantwell은 기업이 방어 도구를 공공기관과 공유하고, 근로자 교육을 지원하며, 아동을 보호하고, 중대한 결정에는 인간 검토를 유지하며, 국제 기준 마련에 협력하기를 원한다.

그녀는 이 접근법을 한 문장으로 요약했다. “명확한 안전 기준, 지속적인 테스트, 심각한 실패에 대한 보고가 필요합니다.” 이 표현은 기술적 평가와 법적 책임을 결합한다.

시점도 중요하다. Cantwell은 9월 상원 본회의 연설에서 네트워크로 연결된 AI 에이전트가 사이버 활동을 조율할 수 있다고 경고했다. 그녀의 본회의 발언은 위험한 행동이 추측적 초지능을 필요로 하지 않는다고 주장했다.

그녀의 설명에 따르면, 각각의 능력은 제한적인 다수의 에이전트도 발견을 공유하고, 작업을 분담하며, 함께 목표를 추구할 수 있다. 정책적 함의는 즉각적이다. 규제기관은 가상의 미래 시스템을 기다린 뒤에야 테스트 역량을 개발해서는 안 된다.

이 우려가 6개 항목 계획을 형성한다. 이 제안은 프런티어 AI 거버넌스를 일회성 인증 절차가 아니라 지속적인 검증 문제로 본다.

모델은 예정된 평가에서는 적절하게 행동할 수 있지만, 업데이트, 도구 접근, 미세 조정 또는 새로운 환경에서의 배포로 변화할 수 있다. 지속적 감독은 그러한 변화가 통제 불능의 사고로 이어지기 전에 감지하기 위한 것이다.

따라서 이 계획은 출시 전 감사와 출시 후 모니터링을 연결한다. 또한 위험한 사이버 역량, 실패한 안전장치, 통제되지 않는 에이전트 또는 안전하지 않은 재귀적 개선에 관한 신속한 보고를 요구한다.

이것이 정치적 마찰의 첫 번째 원인이다. 개발사는 더 이상 자신의 시스템을 판단하는 데 사용되는 증거를 독점적으로 통제할 수 없게 된다.

Maria Cantwell AI 프레임워크가 NIST를 중심에 두는 이유

Cantwell의 제안은 NIST를 자발적 지침 제공자에서 집행 가능한 프런티어 AI 요건의 기술적 기반으로 전환하게 된다.

NIST는 이미 AI 측정, 평가 방법, 벤치마크, 위험 관리 지침을 개발하고 있다. 기존 AI 위험 프레임워크는 자발적이며, 조직이 거버넌스, 매핑, 측정, 관리의 네 가지 기능에 걸쳐 위험 업무를 체계화하도록 돕는다.

Cantwell의 프레임워크는 NIST에 더 중대한 역할을 요청한다. 전문 보안 지식을 보유한 기관들과 협력하면서 대상 프런티어 시스템이 충족해야 하는 기준을 개발하도록 하는 것이다.

이 구분은 일반 AI 연구소가 모든 형태의 연방 전문성을 재현할 수 없기 때문에 중요하다. 생물학적 오용을 평가하려면 사이버 침해나 핵 지식을 테스트하는 경우와 다른 시설과 인력이 필요하다.

에너지부 산하 국립연구소는 고위험 과학 리스크에 대한 전문성을 제공할 수 있다. 국방 및 정보 기관은 공개 벤치마크가 민감한 정보를 노출할 수 있는 경우 기밀 평가를 지원할 수 있다.

독립 테스트 기관은 기만, 모니터링 회피, 접근 통제, 에이전트 행동을 검토할 수 있다. 감사 법인은 개발사의 절차가 실제로 연방 요건을 준수하는지 검토할 수 있다.

Cantwell은 이러한 감사를 상장기업 재무제표 검토에 비유한다. 이 비유가 완벽하지는 않지만, 그녀가 의도한 책임 분담을 전달한다.

기업은 시스템과 내부 증거를 준비한다. 외부 당사자는 그 증거를 점검하고, 가정에 이의를 제기하며, 요구된 통제가 작동하는지를 보고할 수 있을 만큼의 접근권을 받는다.

AI 개발사에는 상당한 문서화 의무가 생기게 된다. 이들은 평가 기록, 위험 평가, 접근 로그, 사고 이력, 완화 증거, 책임 있는 의사결정 담당자를 갖춰야 한다.

모델이 안전하다는 주장만으로는 충분하지 않다. 검토자는 개발사가 그 결론에 도달한 과정을 보여주는 재현 가능한 증거를 필요로 한다.

이 요건은 기업 구매자에게도 영향을 미친다. 조달팀은 공급업체에 어떤 평가가 수행됐는지, 누가 이를 수행했는지, 어떤 한계가 남아 있는지, 사고는 어떻게 보고되는지를 묻기 시작할 수 있다.

에이전트를 배포하는 기업도 에이전트가 어떤 도구에 접근할 수 있고 누가 이를 중단할 수 있는지를 보여주는 기록이 필요하다. 검색 가능한 지식 기반은 팀이 기술적 증거를 체계화하는 데 도움이 될 수 있지만, 문서화만으로 준수가 입증되지는 않는다.

Cantwell은 오픈소스 AI에 대한 전문적 처리도 원한다. 그녀는 기준이 오픈 개발에서의 미국 리더십을 가로막지 않으면서도 재앙적 오용을 줄여야 한다고 주장한다.

이 목표는 어려운 설계 문제를 제기한다. 공개 가중치는 복제, 수정, 배포될 수 있으며, 원 개발사의 통제를 벗어날 수 있다. 중앙집중형 상업 서비스용으로 설계된 요건은 그러한 환경에 깔끔하게 적용되지 않을 수 있다.

실행 가능한 기준은 모델 생성과 이후의 수정 및 배포를 구분해야 한다. 또한 실질적으로 위험한 능력과 접근에 관한 광범위한 가정을 분리해야 한다.

이 제안은 이런 세부 사항을 해결하지 않는다. 오픈 모델에는 자동 면제나 동일한 대우가 아니라 맞춤형 안전장치가 필요하다는 원칙을 제시한다.

NIST도 자체적인 역량 과제에 직면하게 된다. 신뢰할 수 있는 기준을 만들려면 최신 기술 전문성, 안전한 테스트 인프라, 독점 정보를 보유한 연구소와의 협력이 필요하다.

역량이 변함에 따라 기준도 변해야 한다. 개발사가 특정 벤치마크에 맞춰 최적화하거나 새로운 도구가 서로 다른 운용 위험을 만들면, 고정된 벤치마크는 덜 유용해질 수 있다.

Cantwell은 정기적인 업데이트와 지속적인 검토를 요구함으로써 이 문제를 다룬다. 그러나 의회는 여전히 권한, 예산, 접근 규칙, 집행 체계를 제공해야 한다.

이런 요소가 없다면 NIST는 존중받는 기술 지침을 만들 수는 있어도 기업이 이를 따르게 할 권한은 갖지 못할 수 있다. 따라서 프레임워크의 정치적 미래는 기술적 설계만큼 중요하다.

쟁점은 독립 감사 대 개발사 자체 테스트

결정적인 갈등은 누가 프런티어 모델을 테스트하는지, 그리고 배포가 독립적 판단을 기다려야 하는지에 있다.

상원의 다른 논의에서는 주의 의무 모델을 검토해 왔다. 이 접근법에서는 개발사가 시스템을 테스트하고, 확인된 위험을 보고하며, 합리적인 예방 조치를 취하지 못한 경우 법적 조치에 직면하게 된다.

이 모델은 기업이 생성한 증거에 크게 의존한다. 정부 개입은 일반적으로 개발사의 통제가 불충분했다는 판단 이후에 이루어진다.

Cantwell의 접근법은 독립 검토를 더 앞단에 둔다. 대상 모델은 외부 감사가 적용 가능한 안전장치를 충족한다고 확인할 때까지 출시되지 않는다.

이것이 현재 프런티어 AI 규제에서 가장 분명한 분기점이다. 한 경로는 개발사를 주된 평가자로 보고 책임을 통해 실패를 규율한다. 다른 경로는 배포 전에 외부 검증을 요구한다.

상원 정책 보도는 Cantwell과 상원 다수당 대표 John Thune의 경쟁하는 계획을 설명했다. 이 보도는 모델 테스트 책임을 핵심 쟁점으로 지목했다.

자체 테스트 접근법에는 실용적 장점이 있다. 개발사는 자신의 시스템을 이해하고, 필요한 인프라를 보유하며, 학습 과정에서 새 점검 지점을 평가할 수 있다.

정부 평가자는 그 속도를 맞추기 어려울 수 있다. 느린 승인 절차는 유익한 시스템을 지연시키거나 개발사가 더 엄격한 통제를 가진 관할권 밖에서 개발하도록 부추길 수 있다.

독립 검토는 다른 약점을 다룬다. 개발사는 경쟁사보다 먼저 모델을 출시하고, 학습 비용을 회수하며, 시장 리더십을 입증해야 한다는 압박을 받는다.

이런 유인이 내부 안전팀이 부정직하게 행동한다는 점을 증명하는 것은 아니다. 다만 특히 실패한 출시가 개발사의 고객을 넘어 다른 사람들에게 영향을 줄 수 있을 때, 외부 검토가 필요한 구조적 이유를 만든다.

Cantwell의 프레임워크는 독립 감사인을 이러한 이해충돌을 견제하는 장치로 본다. 또한 개발자가 위험을 조사하고 안전장치를 검증하는 데 필요한 접근 권한과 정보를 제공하도록 요구한다.

접근 권한 문제는 논쟁거리가 될 것이다. 효과적인 테스트에는 모델 가중치, 시스템 프롬프트, 학습 세부 정보, 보안 아키텍처, 내부 평가, 사고 기록이 필요할 수 있다.

개발자들은 일부 자료에 영업비밀이나 민감한 보안 정보가 포함돼 있다고 주장할 것이다. 규제 당국은 검토자가 선별된 요약본만 받는다면 감사로 시스템을 검증할 수 없다고 맞설 것이다.

이 제안에는 독점 정보와 기밀 데이터를 처리하기 위한 안전한 절차가 필요하다. 또한 평가자가 발견한 취약점을 노출하지 못하도록 하는 규칙도 필요하다.

또 다른 쟁점은 출시를 차단하는 기준이다. 어떤 프런티어 모델도 위험이 전혀 없다는 사실을 입증할 수는 없으며, 많은 위험한 능력은 도구, 사용자, 배포 조건에 따라 달라진다.

입법자들은 방어 가능한 기준선을 마련해야 한다. 시스템이 정해진 능력 수준을 초과하는지, 필수 통제를 갖추지 못했는지, 또는 특정 평가를 통과하지 못했는지에 초점을 맞출 수 있다.

각 선택에는 상충 관계가 있다. 능력 기준은 시대에 뒤처질 수 있다. 절차 요건은 서류 작업에 보상을 줄 수 있다. 시나리오 테스트는 낯선 실패를 놓칠 수 있다.

신뢰할 수 있는 체계라면 세 가지를 모두 결합할 것이다. 능력을 평가하고, 조직적 통제를 검증하며, 적대적 조건에서 행동을 시험해야 한다.

집행 경로는 여전히 완성되지 않았다. 한 민주당 상임위 보좌관은 Roll Call에 제재는 협상과 입법 문안 작성 과정을 통해 마련돼야 한다고 말했다.

이러한 불확실성 때문에 이 계획은 현재 운영 가능한 규제 프로그램으로 기능하지 못한다. 프레임워크가 공개됐다는 이유만으로 어느 기관도 새 권한을 부여받지는 않았다.

그럼에도 이 제안은 Cantwell의 협상 입장을 규정한다는 점에서 중요하다. 그녀는 연방 기술 정책의 상당 부분을 관할하는 상임위의 민주당 최고위원이다.

초당적 AI 법안이라면 모두 그녀의 핵심 이의에 답해야 한다. 개발자가 자신의 프런티어 모델이 충분히 안전한지를 결정하는 유일한 당사자가 되어서는 안 된다는 것이다.

여섯 가지 원칙은 파국적 위험을 넘어선다

Cantwell의 프런티어 AI 계획은 연구실 안전을 소비자 보호, 노동자 정책, 인프라 보안, 국제 공조와 연결한다.

프레임워크의 첫 부분은 드물지만 심각한 사건을 겨냥한다. 이후 원칙들은 일상적인 배포 과정에서 발생할 수 있는 피해를 다룬다.

아동과 관련해 Cantwell은 AI 제품이 중독적 설계, 유해한 자료, 착취적 데이터 관행을 피해야 한다고 본다. 노동자에 대해서는 도제 프로그램, 교육, 인간 창작물 보호를 촉구한다.

중요한 결정의 경우, 그녀는 투명성, 공정성, 실질적인 인간 감독, 그리고 사람들이 결과에 이의를 제기할 수 있는 경로를 원한다. 고용, 의료, 신용이 명시된 사례다.

이러한 확장은 강점과 위험을 모두 만든다. 실제 사람들에게 영향을 미치는 일상적 결정을 무시하면서 가상의 재앙에만 AI 거버넌스가 집중할 수는 없다는 점을 인정한다.

그러나 여러 정책 영역을 결합하면 입법은 복잡해질 수 있다. 아동 안전, 고용, 의료, 경쟁, 국가 안보, 모델 평가는 서로 다른 법률과 규제기관을 수반한다.

따라서 Cantwell의 프레임워크는 하나의 패키지가 아니라 여러 법안이 될 수 있다. 이 경로는 기술적 정밀성을 높일 수 있지만, 제안의 기반인 공동의 정치적 타협을 약화시킬 수도 있다.

책임성 원칙도 주목할 만하다. 예측 가능한 피해가 설계, 배포, 수정 또는 안전장치 부재에서 비롯될 경우 개발자는 민사법과 형사법의 적용을 계속 받게 된다.

이 문구 자체가 새로운 책임 기준을 만들지는 않는다. 이는 개발자를 기존 청구로부터 보호할 광범위한 법적 면책에 반대한다는 신호다.

내부고발자 보호는 그 목표를 뒷받침한다. 직원과 계약업체는 고객, 감사인, 규제기관이 문제를 파악하기 전에 실패를 발견하는 경우가 많다.

보복 방지는 은폐된 위험을 드러내는 데 도움이 될 수 있다. 다만 입법자들은 보호되는 공개, 보고 채널, 기밀유지 규칙, 구제 수단을 정의해야 한다.

민관 협력 원칙은 처벌적 성격이 덜하다. 주요 개발자들에게 공공기관과 소규모 조직을 위해 컴퓨팅 자원, 전문지식, 방어 도구를 제공하라고 요청한다.

이는 핵심 인프라 운영자가 자동화된 공격을 탐지하는 데 도움이 될 수 있다. 또한 대학과 공익 프로젝트의 연구 접근성을 확대할 수도 있다.

그럼에도 자발적 기여라는 표현은 의무 감사와 불편하게 공존한다. 의회는 요구되는 행동과 장려되는 협력을 구분해야 한다.

국제 부문 역시 야심 차다. Cantwell은 미국이 ISO, IEC 같은 기구를 통해 공통 안전 표준을 주도하기를 원한다.

공유 표준은 여러 국가에서 사업하는 기업의 규제 준수 충돌을 줄일 수 있다. 심각한 사고를 보고하고 평가를 비교하는 공통 방법도 만들 수 있다.

프레임워크는 중대한 AI 사고나 시스템 통제 실패에 대응하기 위한 안전한 미중 위기 소통 채널을 제안한다. Cantwell은 이 개념을 냉전기의 긴급 연락선에 비유한다.

이 제안은 일부 AI 실패가 국경을 넘을 수 있음을 인정한다. 위험한 에이전트, 사이버 역량, 통제되지 않는 시스템은 국가 규제 경계를 존중하지 않을 것이다.

동시에 중국과의 정보 공유는 보안 우려를 낳는다. 당사자들은 민감한 방어 정보나 지식재산을 공개하지 않으면서 긴급 위험을 알릴 수 있는 제한적인 프로토콜이 필요하다.

Cantwell은 첨단 미국 기술에 대한 접근을 제한하는 수출 통제도 지지한다. 이는 공동 위험에 대한 협력과 전략적 역량을 둘러싼 경쟁 사이에서 또 다른 정책적 균형을 만든다.

국내 정치적 균형도 마찬가지로 어렵다. 기술 기업들은 일관되지 않은 주 규칙이 전국 단위 배포를 어렵게 만든다고 주장해 왔다.

OpenAI CEO Sam Altman은 이전에 상원의원들에게 50개의 개별 규제 체계를 준수하는 것은 어렵다고 말했다. 주 정부 관계자들은 의회가 움직이지 않는 동안 지역 법률이 보호를 제공한다고 반박한다.

이 논쟁은 2025년에 이례적으로 분명한 신호를 낳았다. 의회 보도에 따르면, 상원은 더 광범위한 법안에서 제안된 주 AI 모라토리엄을 삭제하는 데 99대 1로 표결했다.

Cantwell은 공화당 소속 Marsha Blackburn 상원의원과 함께 모라토리엄에 반대했다. 이 사건은 연방 차원의 일관성이 대체 수단 없이 주의 보호장치를 없애는 것을 의미할 수는 없음을 보여줬다.

그녀의 새 프레임워크는 가능한 대안을 제시한다. 연방 표준은 의회가 완전히 다루지 않는 분야에서 더 강력한 보호를 유지하면서 국가적 최소 기준을 설정할 수 있다.

그러나 문서는 연방 규칙이 주 법률과 어떻게 상호작용할지는 명시하지 않는다. 이 문제는 진지한 입법 협상에서 다시 제기될 것이다.

프레임워크가 여전히 해결하지 못한 문제

이 제안은 정치적으로 중요하지만, 입법 문안과 구속력 있는 기준선, 확정된 집행 체계가 없는 원칙들의 집합에 머물러 있다.

첫 번째 미해결 문제는 범위다. “프런티어 AI”는 대상을 전달하지만, 규제기관에는 측정 가능한 정의가 필요하다.

학습 연산량에만 기반한 기준은 도구나 파인튜닝을 통해 위험한 능력을 얻는 소형 모델을 제외할 수 있다. 능력 기반 테스트는 더 잘 적응할 수 있지만 신뢰할 수 있는 평가가 필요하다.

두 번째 문제는 감사 품질이다. 독립적이라는 사실이 자동으로 유능함, 일관성, 이해충돌 부재를 뜻하지는 않는다.

개발자로부터 비용을 받는 감사인은 반복 사업에 의존하게 될 수 있다. 정부가 임명한 평가는 인력 부족과 느린 조달 절차에 직면할 수 있다.

의회는 자격 기준, 이해충돌 규칙, 접근권, 보고 의무, 중대한 감사 실패에 대한 책임을 마련해야 한다. 또한 평가자의 결론에 이의를 제기하는 절차도 필요하다.

세 번째 문제는 증거다. AI의 행동은 프롬프트, 도구, 권한, 배포 환경에 따라 달라진다.

통제된 테스트에서 위험한 요청을 거부하는 모델도 에이전트가 웹을 탐색하고, 코드를 실행하거나, 다른 시스템과 조율할 수 있을 때는 다르게 행동할 수 있다.

따라서 테스트는 기저 모델뿐 아니라 완전히 배포된 시스템을 검토해야 한다. 이는 검토 대상이 되는 기업과 기술 구성요소의 수를 늘린다.

네 번째 문제는 시점이다. 출시 전 감사는 알려진 위험을 포착할 수 있지만, 업데이트 직후 곧바로 최신성이 떨어질 수도 있다.

지속적인 테스트는 도움이 되지만, 기업들은 모델 변경을 자주 출시한다. 규제기관은 어떤 변경이 새 감사를 촉발하는지, 어떤 변경이 지속적 모니터링 아래 진행될 수 있는지를 결정해야 한다.

다섯 번째 문제는 제도적 권한이다. NIST는 상당한 측정 전문성을 갖추고 있지만, AI Risk Management Framework는 여전히 자발적이다.

그 업무를 집행 가능한 표준으로 전환하려면 명확한 법적 권한이 필요하다. 기관들은 시스템을 검사하고 요건 위반 시 조치할 자원도 필요하다.

여섯 번째 문제는 사법 심사다. 모델 출시가 금지된 기업은 그 결정에 이의를 제기할 신속한 방법을 요구할 가능성이 높다.

항소 절차는 모든 안전 판단이 수년간의 소송으로 바뀌지 않게 하면서 적법 절차를 보호해야 한다. 증거에 기밀 정보가 포함될 때는 특히 어려워진다.

일곱 번째 문제는 오픈소스 개발에 관한 것이다. 소규모 연구 그룹은 대형 프런티어 연구소와 같은 규제 준수 부담을 감당할 수 없다.

전문화된 표준은 이러한 불일치를 해결할 수 있다. 그러나 부실하게 설계된 면제는 기업이 허점을 중심으로 출시 구조를 짜도록 부추길 수 있다.

Cantwell의 계획은 이 문제를 인정하지만 책임의 최종 배분을 선택하지는 않는다. 그 작업은 법률 문안과 기술적 규칙 제정에 속한다.

프레임워크는 또한 평가자가 출시 전에 파국적 능력을 식별할 수 있다고 가정한다. 이 전제는 신중하게 다뤄야 한다.

평가는 선택된 조건에서 관찰된 행동을 보여준다. 테스트되지 않은 행동이 안전하다는 점을 증명하거나 배포 후의 모든 상호작용을 예측하지는 못한다.

독립 테스트는 의사결정자가 이용할 수 있는 증거를 개선할 수 있다. 그러나 첨단 시스템의 불확실성을 제거할 수는 없다.

이 한계가 감사를 포기해야 한다는 근거가 되지는 않는다. 감사가 무엇을 테스트했는지, 무엇을 발견했는지, 무엇이 범위 밖에 남았는지에 대한 정직한 보고를 뒷받침한다.

공개 공시도 같은 원칙을 따라야 한다. 독자에게는 명확한 위험 정보가 필요하지만, 상세한 취약점 공개는 공격자에게 도움이 될 수 있다.

프레임워크는 평이한 언어의 공개와 안전한 사고 보고를 요구한다. 향후 입법은 사용자를 위한 정보와 규제기관에만 제공되는 민감한 자료를 구분해야 한다.

마지막으로, 이 제안에는 안정적인 초당적 연합이 없다. Cantwell은 원칙이 입법 및 행정 조치를 이끌어야 한다고 말하지만, 상임위 장악과 선거 결과가 향후 경로를 결정할 것이다.

Commerce Committee Chair Ted Cruz는 연방 차원의 일관성과 독립적 심사자의 역할에 관심을 표명했다. 그는 또한 정부가 모델 출시를 쉽게 중단할 수 있는 권한을 갖는 데에는 반대해 왔다.

이 입장들은 협상의 여지를 남기지만 아직 합의는 아니다. 가장 가능성 높은 타협안은 기업 테스트, 인가된 독립 감사, 정부 전문성, 책임, 사법 심사를 결합하는 방식일 것이다.

그 조합이 Cantwell을 만족시킬지는 한 가지에 달려 있다. 위험한 시스템이 대중에게 도달하기 전에 외부 평가가 실질적인 권한을 가져야 한다는 점이다.

Cantwell의 계획이 정책이 되는지 보여줄 세 가지 신호

다음 시험대는 입법자들이 프레임워크의 원칙을 집행 가능한 문구, 재원이 마련된 기관, 작동 가능한 감사 절차로 전환하는지 여부다.

첫 번째 신호는 입법 문구다. 법안은 적용 대상 모델을 정의하고, 감사를 수행할 주체를 명시하며, 접근 권한을 설정하고, 집행 권한을 가진 기관을 지정해야 한다.

정의 조항은 이 체계가 가장 대규모의 훈련 실행만 겨냥하는지, 아니면 도구와 에이전트형 배포를 통해 위험해지는 시스템까지 포함하는지를 보여줄 것이다.

집행 관련 문구는 출시 전 검토가 실제로 의무화되는지 드러낼 것이다. 규제 당국이 배포 이후에만 보고서를 요청할 수 있다면, 이 계획의 핵심 원칙은 약화될 것이다.

두 번째 신호는 상원 상무위원회 내 초당적 공조다. 10월 보도에 따르면, Cantwell은 현재 Thune과 연계된 AI 법안을 협상하고 있지 않다.

공동 제안이 나온다면 독립 감사와 자체 테스트 사이의 간극이 좁혀졌음을 보여줄 것이다. 별도의 법안이 나온다면 의원들이 기본적인 규제 모델을 두고 여전히 분열돼 있음을 뜻한다.

법안이 주 정부의 권한을 어떻게 다루는지도 주목해야 한다. 광범위한 연방법 우선 적용 조항은 앞선 주 정부 모라토리엄을 저지했던 의원들의 지지를 잃을 수 있다.

강력한 연방 보호 조치와 연계된 제한적 조항은 더 많은 지지를 끌어낼 수 있다. 세부 내용은 국가적 일관성이 공통의 최소 기준을 뜻하는지, 아니면 더 약한 상한선을 뜻하는지를 보여줄 것이다.

세 번째 신호는 NIST 및 관련 기관의 제도적 준비다. 정부가 까다로운 평가를 직접 수행하거나 감독할 수 없다면, 표준은 프런티어 시스템을 규율할 수 없다.

NIST의 기존 프레임워크는 거버넌스와 측정을 위한 출발점이 되는 용어를 제공한다. 그러나 Cantwell의 전체 계획에 필요한 보안 시설, 집행 권한 또는 인력은 제공하지 못한다.

예산 배정 요청, 새로운 테스트 파트너십, 감사자 자격 프로그램 또는 국립연구소 협약은 이행이 시작됐음을 시사할 것이다.

그러한 조치가 없다면, 의회가 폭넓은 안전 관련 문구를 채택하더라도 제안은 약화될 것이다. 평가자, 인프라, 접근 권한이 없는 규칙은 보고 절차에 그친다.

개발자와 엔터프라이즈 구매자는 최종 법률을 기다리기 전에 증빙 체계를 개선해야 한다. 팀은 지금부터 모델 접근, 평가 결과, 도구 권한, 사고 에스컬레이션, 책임 있는 인간 검토를 문서화할 수 있다.

또한 내부 보증 성명과 독립적 검증을 구분해야 한다. Cantwell의 AI 거버넌스 프레임워크는 바로 그 차이를 중심으로 설계돼 있다.

지식 근로자와 AI 사용자에게 이 논쟁은 기업이 고위험 시스템을 배포하기 전에 어떤 정보를 공개해야 하는지를 결정한다. 또한 사람들이 중대한 영향을 미치는 자동화된 결정에 이의를 제기할 수 있는지에도 영향을 미친다.

당면한 질문은 6개 항목 계획의 모든 세부 사항이 살아남느냐가 아니다. 핵심은 의회가 프런티어 AI 개발자가 자기 자신에 대한 최종 감사자로 남을 수 없다는 Cantwell의 중심 전제를 받아들이느냐다.

법안 문구, 위원회 협상, 그리고 NIST의 역량을 지켜봐야 한다. 이 신호들은 함께 Maria Cantwell AI 프레임워크가 집행 가능한 정책이 될지, 아니면 협상 문서로 남을지를 보여줄 것이다.

 
 

무료로 시작하세요

개인 지식 관리 기능을 갖춘 로컬 우선 AI 어시스턴트

더 나은 AI 경험을 위해

현재 remio는 Windows 10+ (x64) 및 M-Chip Macs만 지원합니다.

업무를 위한 AI 파트너
remio와 더 많은 일을 해내세요

계획하고, 만들고, 완성하세요
모든 일을 한곳에서

bottom of page