Maria Cantwells KI-Rahmenwerk verlagert Frontier-KI von Selbsttests zu unabhängigen Audits
Senatorin Maria Cantwell hat ein sechsteiliges KI-Rahmenwerk vorgestellt, das unabhängige Audits verlangen würde, bevor erfasste Frontier-Modelle der Öffentlichkeit zugänglich gemacht werden. Das KI-Rahmenwerk von Maria Cantwell fordert außerdem bundesweite Sicherheitsstandards, kontinuierliche Tests, die Meldung von Vorfällen und Rechenschaftspflicht für Entwickler. Es stellt Regulierungsansätze direkt infrage, die hauptsächlich auf freiwilligen Zusagen oder von Unternehmen selbst durchgeführten Bewertungen beruhen.
Der am 7. Oktober 2026 veröffentlichte Vorschlag ist kein Gesetz und definiert keine Durchsetzungsmechanismen. Dennoch bezieht er klar Stellung in Washingtons wachsender Debatte darüber, wer die leistungsfähigsten KI-Systeme testen sollte. Cantwell will Bundesexperten und unabhängige Prüfer vor der Einführung einbeziehen – nicht erst nach einem schwerwiegenden Fehlverhalten.
Damit steht ihr Rahmenwerk Vorschlägen gegenüber, die auf Selbsttests durch Entwickler und einer rechtlichen Sorgfaltspflicht beruhen. Der Unterschied klingt verfahrensbezogen, verändert jedoch, wer die Kontrolle über Belege hat, wer entscheidet, ob Schutzmaßnahmen funktionieren, und wann Regulierungsbehörden eingreifen können.
Cantwells Plan für Frontier-KI verlagert Tests aus den Laboren
Die zentrale Veränderung ist nicht ein weiteres Sicherheitsversprechen. Cantwell will, dass externe Prüfer vor der Veröffentlichung verifizieren, ob erfasste Systeme bundesweite Standards erfüllen.
Cantwell ist die ranghöchste Demokratin im Senatsausschuss für Handel, Wissenschaft und Verkehr. Ihr sechsteiliges Rahmenwerk fordert das National Institute of Standards and Technology, kurz NIST, dazu auf, messbare, risikobasierte Anforderungen für fortschrittliche KI-Systeme zu entwickeln.
Der Vorschlag konzentriert sich auf Frontier-KI, also hochleistungsfähige Allzweckmodelle, die außergewöhnlich schwere Sicherheits- oder Schutzrisiken verursachen können. Cantwell nennt keinen endgültigen gesetzlichen Schwellenwert dafür, welche Systeme in diese Kategorie fallen. Diese Definition müsste durch Gesetzgebung oder behördliche Regelsetzung entstehen.
Erfasste Systeme müssten vor ihrer Einführung unabhängige Audits durchlaufen. Staatliche Spezialisten und qualifizierte externe Evaluatoren würden sie anschließend während ihres gesamten Betriebs weiter testen.
Diese Prüfungen würden Bedrohungen wie KI-gestützte Cyberangriffe, chemischen oder biologischen Missbrauch, radiologische und nukleare Risiken, den Verlust menschlicher Kontrolle und unsichere automatisierte Selbstverbesserung untersuchen. Systeme mit gefährlichen Fähigkeiten würden einer stärkeren Prüfung und strengeren Schutzmaßnahmen unterliegen.
Das Rahmenwerk befasst sich auch mit autonomen Agenten, also KI-Anwendungen, die Aufgaben mit begrenzter Aufsicht planen und ausführen. Cantwell will testen lassen, ob Agenten Überwachung umgehen, sich selbst verändern oder kontrollierte Umgebungen verlassen können.
Ihr Plan enthält sechs übergeordnete Prinzipien. Sie umfassen durchsetzbare bundesweite Standards, kontinuierliche unabhängige Tests, Transparenz und Rechenschaftspflicht, öffentlich-private Partnerschaften, Schutz vor gesellschaftlichem Schaden und internationale Zusammenarbeit.
Die ersten drei Prinzipien bilden den regulatorischen Kern des Vorschlags. NIST würde Standards schaffen, unabhängige Experten würden die Einhaltung prüfen, und Entwickler müssten wesentliche Risiken offenlegen und schwerwiegende Vorfälle melden.
Die übrigen Prinzipien erweitern das Rahmenwerk über Modelllabore hinaus. Cantwell möchte, dass Unternehmen Schutzwerkzeuge mit öffentlichen Institutionen teilen, die Ausbildung von Beschäftigten unterstützen, Kinder schützen, menschliche Prüfung bei folgenreichen Entscheidungen beibehalten und bei internationalen Standards zusammenarbeiten.
Sie fasste den Ansatz in einem Satz zusammen: „Wir brauchen klare Sicherheitsstandards, kontinuierliche Tests und die Meldung schwerwiegender Fehler.“ Diese Formulierung verbindet technische Bewertung mit rechtlicher Rechenschaftspflicht.
Der Zeitpunkt ist bedeutsam. Cantwell nutzte im September eine Rede im Senat, um vor vernetzten KI-Agenten zu warnen, die Cyberaktivitäten koordinieren. Ihre Rede im Senat argumentierte, dass gefährliches Verhalten keine spekulative Superintelligenz voraussetzt.
Nach ihrer Darstellung können viele einzeln begrenzte Agenten Erkenntnisse austauschen, Aufgaben aufteilen und gemeinsam ein Ziel verfolgen. Die politische Konsequenz ist unmittelbar: Regulierungsbehörden können nicht auf ein hypothetisches künftiges System warten, bevor sie Testkapazitäten aufbauen.
Diese Sorge prägt den Sechs-Punkte-Plan. Der Vorschlag behandelt die Steuerung von Frontier-KI als fortlaufendes Verifikationsproblem, nicht als einmalige Zertifizierungsübung.
Ein Modell könnte sich während einer planmäßigen Bewertung akzeptabel verhalten, sich aber durch Updates, Tool-Zugriff, Fine-Tuning oder den Einsatz in einer neuen Umgebung verändern. Die kontinuierliche Aufsicht soll solche Veränderungen erkennen, bevor sie zu einem unkontrollierten Vorfall führen.
Der Plan verbindet daher Audits vor der Veröffentlichung mit Überwachung nach der Veröffentlichung. Er verlangt zudem zeitnahe Meldungen über gefährliche Cyberfähigkeiten, fehlgeschlagene Schutzmaßnahmen, unkontrollierte Agenten oder unsichere rekursive Verbesserung.
Hier liegt die erste Quelle politischer Reibung. Entwickler hätten nicht länger die ausschließliche Kontrolle über die Belege, anhand derer ihre eigenen Systeme beurteilt werden.
Warum das KI-Rahmenwerk von Maria Cantwell NIST ins Zentrum stellt
Cantwells Vorschlag würde NIST von einem Anbieter freiwilliger Leitlinien zur technischen Grundlage durchsetzbarer Anforderungen für Frontier-KI machen.
NIST entwickelt bereits KI-Messgrößen, Bewertungsmethoden, Benchmarks und Leitlinien für Risikomanagement. Sein bestehendes KI-Risikorahmenwerk ist freiwillig und hilft Organisationen, ihre Risikobemühungen über vier Funktionen hinweg zu strukturieren: Govern, Map, Measure und Manage.
Cantwells Rahmenwerk fordert NIST zu etwas Konsequenzreicherem auf. Es würde Standards entwickeln, die erfasste Frontier-Systeme erfüllen müssten, und zugleich mit Behörden zusammenarbeiten, die über spezialisiertes Sicherheitswissen verfügen.
Diese Unterscheidung ist wichtig, weil ein allgemeines KI-Labor nicht jede Form bundesstaatlicher Expertise nachbilden kann. Die Bewertung biologischen Missbrauchs erfordert andere Einrichtungen und Fachkräfte als das Testen von Cyberausnutzung oder Nuklearwissen.
Die nationalen Laboratorien des Energieministeriums könnten Fachwissen zu wissenschaftlichen Risiken mit gravierenden Folgen beitragen. Verteidigungs- und Geheimdienste könnten klassifizierte Bewertungen unterstützen, wenn öffentliche Benchmarks sensible Informationen preisgeben würden.
Unabhängige Testorganisationen könnten Täuschung, das Umgehen von Überwachung, Zugriffskontrollen und Agentenverhalten untersuchen. Prüfgesellschaften könnten bewerten, ob die Prozesse eines Entwicklers tatsächlich den bundesweiten Anforderungen entsprechen.
Cantwell vergleicht diese Audits mit der Prüfung von Jahresabschlüssen börsennotierter Unternehmen. Die Analogie ist unvollkommen, vermittelt jedoch die von ihr beabsichtigte Aufgabenverteilung.
Ein Unternehmen bereitet seine Systeme und internen Belege vor. Eine externe Partei erhält ausreichend Zugang, um diese Belege zu prüfen, Annahmen infrage zu stellen und darüber zu berichten, ob die erforderlichen Kontrollen funktionieren.
Für KI-Entwickler würde dies eine erhebliche Dokumentationspflicht schaffen. Sie bräuchten Bewertungsaufzeichnungen, Risikobewertungen, Zugriffsprotokolle, Vorfallhistorien, Nachweise zu Minderungsmaßnahmen und klar benannte verantwortliche Entscheidungsträger.
Die Behauptung, ein Modell sei sicher, würde nicht ausreichen. Prüfer bräuchten reproduzierbare Belege dafür, wie der Entwickler zu diesem Schluss gekommen ist.
Diese Anforderung würde auch Unternehmenskäufer betreffen. Beschaffungsteams könnten Anbieter zunehmend fragen, welche Bewertungen durchgeführt wurden, wer sie vorgenommen hat, welche Einschränkungen bestehen bleiben und wie Vorfälle gemeldet werden.
Unternehmen, die Agenten einsetzen, müssten zudem Aufzeichnungen darüber führen, auf welche Tools ein Agent zugreifen kann und wer ihn stoppen kann. Eine durchsuchbare Wissensdatenbank kann Teams helfen, technische Belege zu organisieren, doch Dokumentation allein belegt keine Konformität.
Cantwell fordert außerdem eine spezialisierte Behandlung von Open-Source-KI. Ihrer Ansicht nach sollten Standards katastrophalen Missbrauch reduzieren, ohne die amerikanische Führungsrolle bei offener Entwicklung zu behindern.
Dieses Ziel wirft eine schwierige Gestaltungsfrage auf. Offene Modellgewichte können kopiert, verändert und außerhalb der Kontrolle des ursprünglichen Entwicklers eingesetzt werden. Anforderungen, die für einen zentralisierten kommerziellen Dienst konzipiert sind, lassen sich möglicherweise nicht nahtlos auf diese Umgebung übertragen.
Ein praktikabler Standard müsste zwischen Modellerstellung und nachgelagerter Veränderung sowie Bereitstellung unterscheiden. Er müsste außerdem tatsächlich gefährliche Fähigkeiten von pauschalen Annahmen über Zugang trennen.
Der Vorschlag löst diese Details nicht. Er etabliert den Grundsatz, dass offene Modelle maßgeschneiderte Schutzmaßnahmen benötigen, keine automatische Ausnahme oder identische Behandlung.
NIST stünde vor einer eigenen Kapazitätsherausforderung. Glaubwürdige Standards zu formulieren erfordert aktuelles technisches Fachwissen, sichere Testinfrastruktur und die Zusammenarbeit von Laboren, die proprietäre Informationen besitzen.
Standards müssen sich zudem mit den Fähigkeiten weiterentwickeln. Ein fester Benchmark kann weniger nützlich werden, wenn Entwickler gezielt dafür optimieren oder neue Tools andere operative Risiken schaffen.
Cantwell begegnet diesem Problem mit der Forderung nach regelmäßigen Aktualisierungen und kontinuierlicher Prüfung. Der Kongress müsste jedoch weiterhin Befugnisse, Finanzierung, Zugangsregeln und Durchsetzungsmechanismen bereitstellen.
Ohne diese Elemente könnte NIST angesehene technische Leitlinien entwickeln, ohne die Macht zu haben, Unternehmen zu deren Befolgung zu verpflichten. Die politische Zukunft des Rahmenwerks ist daher ebenso wichtig wie seine technische Ausgestaltung.
Der Konflikt lautet: unabhängige Audits gegen Selbsttests durch Entwickler
Der entscheidende Konflikt besteht darin, wer Frontier-Modelle testen darf und ob ihre Einführung auf ein unabhängiges Urteil warten muss.
Andere Beratungen im Senat haben ein Modell der Sorgfaltspflicht erwogen. Nach diesem Ansatz würden Entwickler ihre Systeme testen, erkannte Risiken melden und rechtlich belangt werden können, wenn sie keine angemessenen Vorsichtsmaßnahmen getroffen haben.
Das Modell stützt sich stark auf von Unternehmen erzeugte Belege. Staatliche Eingriffe würden im Allgemeinen einer Feststellung folgen, dass die Kontrollen des Entwicklers unzureichend waren.
Cantwells Ansatz verlagert die unabhängige Prüfung nach vorn. Erfasste Modelle dürften nicht veröffentlicht werden, bis ein externes Audit bestätigt hat, dass sie die geltenden Schutzmaßnahmen erfüllen.
Das ist die deutlichste Trennlinie in der aktuellen Regulierung von Frontier-KI. Der eine Weg behandelt Entwickler als primäre Evaluatoren und nutzt Haftung, um Fehlverhalten zu sanktionieren. Der andere verlangt externe Verifizierung vor der Einführung.
Ein Bericht zur Senatspolitik beschrieb konkurrierende Pläne von Cantwell und dem Mehrheitsführer im Senat, John Thune. Er bezeichnete die Verantwortung für Modelltests als zentrale Frage.
Der Ansatz der Selbsttests hat praktische Vorteile. Entwickler verstehen ihre Systeme, verfügen über die notwendige Infrastruktur und können neue Kontrollpunkte während des Trainings bewerten.
Staatliche Evaluatoren könnten Schwierigkeiten haben, dieses Tempo zu erreichen. Ein langsames Genehmigungsverfahren könnte nützliche Systeme verzögern oder Entwickler dazu bewegen, in Rechtsräumen mit strengeren Kontrollen außerhalb ihrer Grenzen zu entwickeln.
Unabhängige Prüfung adressiert eine andere Schwäche. Entwickler stehen unter Druck, Modelle vor der Konkurrenz zu veröffentlichen, Trainingskosten wieder einzuspielen und Marktführerschaft zu demonstrieren.
Diese Anreize belegen nicht, dass interne Sicherheitsteams unehrlich handeln. Sie schaffen jedoch einen strukturellen Grund für externe Kontrolle – besonders wenn eine fehlgeschlagene Veröffentlichung Menschen außerhalb des Kundenkreises eines Entwicklers betreffen kann.
Cantwells Rahmenwerk betrachtet unabhängige Prüfer als Kontrollinstanz für diesen Konflikt. Es verpflichtet Entwickler außerdem, den Zugang und die Informationen bereitzustellen, die zur Untersuchung von Risiken und zur Überprüfung von Schutzmaßnahmen erforderlich sind.
Die Frage des Zugangs wird umstritten sein. Wirksame Tests könnten Modellgewichte, System-Prompts, Trainingsdetails, Sicherheitsarchitektur, interne Bewertungen und Aufzeichnungen zu Vorfällen erfordern.
Entwickler werden argumentieren, dass einige Materialien Geschäftsgeheimnisse oder sensible Sicherheitsinformationen enthalten. Regulierungsbehörden werden entgegnen, dass eine Prüfung ein System nicht verifizieren kann, wenn die Prüfer nur ausgewählte Zusammenfassungen erhalten.
Der Vorschlag wird sichere Verfahren für den Umgang mit geschützten und klassifizierten Daten benötigen. Außerdem wird er Regeln brauchen, die verhindern, dass ein Prüfer die von ihm entdeckten Schwachstellen offenlegt.
Ein weiterer Streitpunkt betrifft den Maßstab für die Blockierung einer Veröffentlichung. Bei keinem Frontier-Modell lässt sich ein Risiko von null nachweisen, und viele gefährliche Fähigkeiten hängen von Tools, Nutzern und Einsatzbedingungen ab.
Gesetzgeber müssten einen belastbaren Schwellenwert festlegen. Sie könnten darauf abstellen, ob ein System definierte Fähigkeitsstufen überschreitet, erforderliche Kontrollen fehlen oder bestimmte Bewertungen nicht besteht.
Jede Entscheidung bringt Zielkonflikte mit sich. Fähigkeitsschwellen können veralten. Prozessanforderungen können Bürokratie belohnen. Szenariotests können unbekannte Fehler übersehen.
Ein glaubwürdiges Regime würde alle drei Ansätze kombinieren. Es würde Fähigkeiten bewerten, organisatorische Kontrollen überprüfen und Verhalten unter adversarialen Bedingungen testen.
Der Durchsetzungsweg ist weiterhin nicht ausgearbeitet. Ein demokratischer Mitarbeiter des Ausschusses sagte Roll Call, dass Sanktionen erst durch Verhandlungen und die Ausarbeitung von Gesetzen entstehen müssten.
Diese Ungewissheit verhindert, dass der Plan heute als operatives Regulierungsprogramm funktioniert. Keine Behörde hat allein deshalb neue Befugnisse erhalten, weil das Rahmenwerk veröffentlicht wurde.
Der Vorschlag ist dennoch wichtig, weil er Cantwells Verhandlungsposition definiert. Sie ist die ranghöchste Demokratin im Ausschuss, der für weite Teile der föderalen Technologiepolitik zuständig ist.
Jedes parteiübergreifende KI-Gesetz wird ihren zentralen Einwand aufgreifen müssen: Ein Entwickler sollte nicht die einzige Partei sein, die entscheidet, ob sein eigenes Frontier-Modell sicher genug ist.
Die sechs Prinzipien reichen über katastrophale Risiken hinaus
Cantwells Plan für Frontier-KI verknüpft Laborsicherheit mit Verbraucherschutz, Arbeitnehmerpolitik, Infrastruktursicherheit und internationaler Koordinierung.
Der erste Teil des Rahmenwerks richtet sich auf seltene, aber schwere Ereignisse. Die späteren Prinzipien behandeln Schäden, die bei gewöhnlichem Einsatz entstehen können.
Für Kinder möchte Cantwell, dass KI-Produkte süchtig machendes Design, schädliche Inhalte und ausbeuterische Datenpraktiken vermeiden. Für Arbeitnehmer fordert sie Ausbildungsplätze, Weiterbildung und Schutz für menschliche kreative Arbeit.
Bei folgenreichen Entscheidungen möchte sie Transparenz, Fairness, wirksame menschliche Aufsicht und einen Weg für Betroffene, Ergebnisse anzufechten. Beschäftigung, Gesundheitsversorgung und Kreditvergabe werden als Beispiele genannt.
Diese Ausweitung schafft sowohl Stärke als auch Risiko. Sie erkennt an, dass KI-Governance nicht nur auf hypothetische Katastrophen fokussieren kann, während tägliche Entscheidungen mit Auswirkungen auf reale Menschen ignoriert werden.
Die Verbindung vieler Politikbereiche kann Gesetze jedoch komplizieren. Kindersicherheit, Beschäftigung, Gesundheitsversorgung, Wettbewerb, nationale Sicherheit und Modellbewertung betreffen unterschiedliche Gesetze und Regulierungsbehörden.
Cantwells Rahmenwerk könnte daher mehrere Gesetze statt eines Pakets werden. Dieser Weg könnte die technische Präzision verbessern, aber den gemeinsamen politischen Kompromiss hinter dem Vorschlag schwächen.
Auch das Prinzip der Rechenschaftspflicht verdient Aufmerksamkeit. Entwickler würden weiterhin dem Zivil- und Strafrecht unterliegen, wenn vorhersehbare Schäden aus Design, Einsatz, Änderungen oder fehlenden Schutzmaßnahmen resultieren.
Die Formulierung schafft für sich genommen keinen neuen Haftungsmaßstab. Sie signalisiert Widerstand gegen umfassende rechtliche Schutzschilde, die Entwickler vor bestehenden Ansprüchen schützen würden.
Der Schutz von Whistleblowern unterstützt dieses Ziel. Beschäftigte und Auftragnehmer erkennen Fehler oft, bevor Kunden, Prüfer oder Regulierungsbehörden sie identifizieren können.
Schutz vor Vergeltung kann helfen, verborgene Risiken ans Licht zu bringen. Gesetzgeber müssten jedoch geschützte Meldungen, Meldekanäle, Vertraulichkeitsregeln und Rechtsmittel definieren.
Das Prinzip der öffentlich-privaten Partnerschaft ist weniger strafend. Es fordert führende Entwickler auf, Rechenressourcen, Fachwissen und defensive Tools für öffentliche Einrichtungen und kleinere Organisationen bereitzustellen.
Das könnte Betreibern kritischer Infrastruktur helfen, automatisierte Angriffe zu erkennen. Es könnte auch den Forschungszugang für Universitäten und Projekte im öffentlichen Interesse erweitern.
Dennoch steht die Sprache freiwilliger Beiträge in einem Spannungsverhältnis zu verpflichtenden Prüfungen. Der Kongress müsste zwischen vorgeschriebenem Verhalten und geförderter Zusammenarbeit unterscheiden.
Der internationale Abschnitt ist ebenso ambitioniert. Cantwell möchte, dass die Vereinigten Staaten gemeinsame Sicherheitsstandards über Gremien wie ISO und IEC anführen.
Gemeinsame Standards könnten Compliance-Konflikte für Unternehmen reduzieren, die in vielen Ländern tätig sind. Sie könnten auch gemeinsame Methoden für die Meldung schwerwiegender Vorfälle und den Vergleich von Bewertungen schaffen.
Das Rahmenwerk schlägt einen sicheren Krisenkanal zwischen den Vereinigten Staaten und China für größere KI-Vorfälle oder Ausfälle der Systemkontrolle vor. Cantwell vergleicht das Konzept mit der Notfallleitung des Kalten Krieges.
Der Vorschlag erkennt an, dass manche KI-Fehler Grenzen überschreiten würden. Ein gefährlicher Agent, eine Cyberfähigkeit oder ein unkontrolliertes System würde nationale Regulierungsgrenzen nicht respektieren.
Gleichzeitig wirft der Informationsaustausch mit China Sicherheitsbedenken auf. Die Parteien bräuchten eng gefasste Protokolle, die dringende Risiken kommunizieren, ohne sensible Verteidigungsinformationen oder geistiges Eigentum offenzulegen.
Cantwell unterstützt außerdem Exportkontrollen, die den Zugang zu fortschrittlicher amerikanischer Technologie beschränken. Dies schafft ein weiteres politisches Gleichgewicht zwischen Zusammenarbeit bei gemeinsamen Gefahren und Wettbewerb um strategische Fähigkeiten.
Das innenpolitische Gleichgewicht ist ebenso schwierig. Technologieunternehmen haben argumentiert, dass uneinheitliche Regeln der Bundesstaaten einen landesweiten Einsatz erschweren.
OpenAI-CEO Sam Altman sagte Senatoren zuvor, die Einhaltung von 50 getrennten Regulierungssystemen wäre schwierig. Vertreter der Bundesstaaten entgegnen, dass lokale Gesetze Schutz bieten, während der Kongress untätig bleibt.
Diese Debatte führte 2025 zu einem ungewöhnlich deutlichen Signal. Der Senat stimmte mit 99 zu 1 dafür, ein vorgeschlagenes Moratorium für KI-Regeln der Bundesstaaten aus einem umfassenderen Gesetz zu streichen, wie Berichte aus dem Kongress darlegen.
Cantwell schloss sich der republikanischen Senatorin Marsha Blackburn bei der Ablehnung des Moratoriums an. Die Episode zeigte, dass föderale Einheitlichkeit nicht einfach bedeuten kann, Schutzmaßnahmen der Bundesstaaten abzuschaffen, ohne sie zu ersetzen.
Ihr neues Rahmenwerk bietet eine mögliche Alternative. Bundesstandards könnten eine nationale Untergrenze schaffen und zugleich stärkere Schutzmaßnahmen in Bereichen bewahren, die der Kongress nicht vollständig abdeckt.
Das Dokument erklärt jedoch nicht, wie Bundesregeln mit Gesetzen der Bundesstaaten interagieren würden. Dieses Thema wird bei jeder ernsthaften Gesetzesverhandlung wiederkehren.
Was das Rahmenwerk weiterhin offenlässt
Der Vorschlag ist politisch bedeutsam, bleibt jedoch eine Reihe von Prinzipien ohne Gesetzestext, verbindliche Schwellenwerte oder ein festgelegtes Durchsetzungssystem.
Die erste offene Frage betrifft den Geltungsbereich. „Frontier-KI“ beschreibt das Ziel, doch Regulierungsbehörden benötigen eine messbare Definition.
Ein Schwellenwert, der nur auf Trainingsrechenleistung basiert, könnte kleinere Modelle ausschließen, die durch Tools oder Fine-Tuning gefährliche Fähigkeiten erlangen. Ein fähigkeitsbasierter Test kann sich besser anpassen, erfordert jedoch zuverlässige Bewertungen.
Die zweite Frage betrifft die Prüfungsqualität. Unabhängig bedeutet nicht automatisch kompetent, konsistent oder frei von Interessenkonflikten.
Von Entwicklern bezahlte Prüfer können von wiederkehrenden Aufträgen abhängig werden. Von der Regierung ernannte Prüfer können mit Personalmangel und langsamer Beschaffung konfrontiert sein.
Der Kongress bräuchte Qualifikationsstandards, Konfliktregeln, Zugangsrechte, Berichtspflichten und Haftung für schwerwiegende Prüfungsfehler. Außerdem wären Verfahren nötig, um die Schlussfolgerung eines Prüfers anzufechten.
Die dritte Frage betrifft die Beweislage. Das Verhalten von KI verändert sich je nach Prompts, Tools, Berechtigungen und Einsatzumgebungen.
Ein Modell, das eine gefährliche Anfrage in einem kontrollierten Test ablehnt, kann sich anders verhalten, wenn ein Agent browsen, Code ausführen oder sich mit anderen Systemen koordinieren kann.
Tests müssen daher das vollständig eingesetzte System untersuchen, nicht nur das zugrunde liegende Modell. Das erweitert die Zahl der Unternehmen und technischen Komponenten, die einer Überprüfung unterliegen.
Die vierte Frage betrifft den Zeitpunkt. Eine Prüfung vor der Veröffentlichung kann bekannte Risiken erkennen, doch nach einem Update sofort veralten.
Kontinuierliche Tests helfen, allerdings veröffentlichen Unternehmen häufig Modelländerungen. Regulierungsbehörden müssen entscheiden, welche Änderungen eine neue Prüfung auslösen und welche unter laufender Überwachung fortgeführt werden können.
Die fünfte Frage betrifft institutionelle Befugnisse. NIST verfügt über erhebliche Messkompetenz, doch sein AI Risk Management Framework bleibt freiwillig.
Um seine Arbeit in durchsetzbare Standards zu überführen, wäre eine klare gesetzliche Befugnis erforderlich. Behörden bräuchten außerdem Ressourcen, um Systeme zu prüfen und bei Verstößen gegen Anforderungen tätig zu werden.
Die sechste Frage betrifft die gerichtliche Überprüfung. Ein Unternehmen, dem die Veröffentlichung eines Modells untersagt wird, würde wahrscheinlich einen schnellen Weg verlangen, diese Entscheidung anzufechten.
Ein Berufungsverfahren muss ein ordnungsgemäßes Verfahren schützen, ohne jede Sicherheitsentscheidung in jahrelange Rechtsstreitigkeiten zu verwandeln. Das wird besonders schwierig, wenn die Beweise klassifizierte Geheimdienstinformationen umfassen.
Die siebte Frage betrifft die Open-Source-Entwicklung. Eine kleine Forschungsgruppe kann nicht dieselbe Compliance-Last tragen wie ein großes Frontier-Labor.
Spezialisierte Standards können diese Diskrepanz beheben. Schlecht gestaltete Ausnahmen könnten Unternehmen jedoch dazu ermutigen, Veröffentlichungen um Schlupflöcher herum zu strukturieren.
Cantwells Plan erkennt das Problem an, entscheidet jedoch nicht über eine endgültige Verteilung der Verantwortung. Diese Arbeit gehört in gesetzliche Formulierungen und technische Regelsetzung.
Das Rahmenwerk setzt außerdem voraus, dass Prüfer katastrophale Fähigkeiten vor der Veröffentlichung identifizieren können. Diese Prämisse verdient Vorsicht.
Bewertungen zeigen beobachtetes Verhalten unter ausgewählten Bedingungen. Sie beweisen weder, dass ungetestetes Verhalten sicher ist, noch sagen sie jede Interaktion nach dem Einsatz voraus.
Unabhängige Tests können die Entscheidungsgrundlage verbessern. Sie können Unsicherheit bei fortschrittlichen Systemen nicht beseitigen.
Diese Einschränkung spricht nicht dafür, Prüfungen aufzugeben. Sie spricht für eine ehrliche Berichterstattung darüber, was eine Prüfung getestet hat, was sie festgestellt hat und was außerhalb ihres Umfangs blieb.
Öffentliche Offenlegungen sollten demselben Prinzip folgen. Leser benötigen klare Risikoinformationen, doch die Veröffentlichung detaillierter Schwachstellen kann Angreifern helfen.
Das Rahmenwerk fordert verständliche Offenlegungen und sichere Meldungen von Vorfällen. Künftige Gesetze müssen Informationen für Nutzer von sensiblem Material trennen, das Regulierungsbehörden vorbehalten ist.
Schließlich fehlt dem Vorschlag eine stabile parteiübergreifende Koalition. Cantwell sagt, die Prinzipien sollten Gesetzgebung und Maßnahmen der Exekutive leiten, doch die Kontrolle über Ausschüsse und Wahlergebnisse werden den weiteren Weg prägen.
Der Vorsitzende des Commerce Committee, Ted Cruz, hat Interesse an föderaler Einheitlichkeit und einer Rolle für unabhängige Prüfer geäußert. Er hat sich zugleich dagegen ausgesprochen, der Regierung eine leicht auszuübende Befugnis zur Unterbindung von Modellveröffentlichungen zu geben.
Diese Positionen lassen Raum für Verhandlungen, aber noch keine Einigung. Der wahrscheinliche Kompromiss würde unternehmenseigene Tests, lizenzierte unabhängige Prüfungen, staatliche Fachkompetenz, Haftung und gerichtliche Überprüfung kombinieren.
Ob diese Kombination Cantwell zufriedenstellt, wird von einem Punkt abhängen: Externe Bewertung muss echte Autorität haben, bevor ein gefährliches System die Öffentlichkeit erreicht.
Drei Signale werden zeigen, ob Cantwells Plan zur Politik wird
Der nächste Test besteht darin, ob Gesetzgeber die Prinzipien des Rahmenwerks in durchsetzbare Formulierungen, finanzierte Institutionen und einen praktikablen Prüfprozess überführen.
Das erste Signal ist der Gesetzestext. Ein Gesetzentwurf müsste erfasste Modelle definieren, festlegen, wer Audits durchführt, Zugangsrechte schaffen und die Behörde mit Durchsetzungsbefugnis benennen.
Die Definitionen werden zeigen, ob der Rahmen nur auf die größten Trainingsläufe zielt oder auch Systeme umfasst, die durch Tools und agentenbasierte Bereitstellung gefährlich werden.
Die Formulierungen zur Durchsetzung werden offenlegen, ob eine Prüfung vor der Veröffentlichung tatsächlich verpflichtend ist. Können Regulierungsbehörden Berichte erst nach der Bereitstellung anfordern, wäre das zentrale Prinzip des Plans geschwächt.
Das zweite Signal ist parteiübergreifende Einigkeit innerhalb des Senate Commerce Committee. Cantwell verhandelt laut Berichten aus dem Oktober derzeit nicht über den mit Thune verbundenen KI-Gesetzentwurf.
Ein gemeinsamer Vorschlag würde zeigen, dass sich die Kluft zwischen unabhängigen Audits und Selbsttests verringert hat. Getrennte Gesetzesentwürfe würden darauf hindeuten, dass Gesetzgeber beim grundlegenden Regulierungsmodell weiterhin gespalten sind.
Achten Sie darauf, wie die Gesetzgebung die Befugnisse der Bundesstaaten behandelt. Eine weitreichende Präemptionsklausel könnte Unterstützung von Gesetzgebern verlieren, die das frühere Moratorium für Bundesstaaten verhindert haben.
Eine begrenzte Klausel, die an starke bundesweite Schutzvorkehrungen geknüpft ist, könnte mehr Unterstützung gewinnen. Die Details werden zeigen, ob nationale Einheitlichkeit einen gemeinsamen Mindeststandard oder eine schwächere Obergrenze bedeutet.
Das dritte Signal ist die institutionelle Vorbereitung bei NIST und verwandten Behörden. Standards können Frontier-Systeme nicht regeln, sofern der Staat keine anspruchsvollen Bewertungen durchführen oder beaufsichtigen kann.
Der bestehende Rahmen von NIST bietet ein erstes Vokabular für Governance und Messung. Er stellt jedoch weder die sicheren Einrichtungen, Durchsetzungsbefugnisse noch die personelle Ausstattung bereit, die für Cantwells vollständigen Plan nötig wären.
Anträge auf Mittelzuweisungen, neue Testpartnerschaften, Programme zur Qualifizierung von Auditoren oder Vereinbarungen mit nationalen Laboren würden darauf hindeuten, dass die Umsetzung begonnen hat.
Das Ausbleiben dieser Schritte würde den Vorschlag schwächen, selbst wenn der Kongress weitreichende Sicherheitsvorgaben verabschiedet. Eine Regel ohne Prüfer, Infrastruktur und Zugang wird zu einer bloßen Berichtspflicht.
Entwickler und Unternehmenskäufer sollten nicht auf das endgültige Gesetz warten, bevor sie ihre Nachweise verbessern. Teams können bereits jetzt Modellzugriffe, Evaluationsergebnisse, Tool-Berechtigungen, Eskalationsprozesse für Vorfälle und verantwortliche menschliche Überprüfung dokumentieren.
Sie sollten außerdem zwischen einer internen Erklärung zur Absicherung und einer unabhängigen Verifizierung unterscheiden. Cantwells KI-Governance-Rahmen basiert auf genau diesem Unterschied.
Für Wissensarbeiter und KI-Nutzer entscheidet die Debatte darüber, welche Informationen Unternehmen vor der Bereitstellung risikoreicherer Systeme offenlegen müssen. Sie beeinflusst auch, ob Menschen folgenreiche automatisierte Entscheidungen anfechten können.
Die unmittelbare Frage lautet nicht, ob jedes Detail des Sechs-Punkte-Plans Bestand hat. Entscheidend ist, ob der Kongress Cantwells zentraler Prämisse zustimmt: Entwickler von Frontier-KI können nicht ihre eigenen abschließenden Prüfer bleiben.
Verfolgen Sie den Gesetzestext, die Ausschussverhandlungen und die Kapazitäten von NIST. Zusammen werden diese Signale zeigen, ob der Maria-Cantwell-KI-Rahmen zu durchsetzbarer Politik wird oder ein Verhandlungsdokument bleibt.



