top of page

Illinois AI-Gesetz macht Audits für Frontier-AI zum bundesweiten Testfall

13. Sept.
16 Min. Lesezeit

Illinois hat trotz Washingtons Präferenz für freiwillige Zusammenarbeit mit Entwicklern als erster Bundesstaat wiederkehrende unabhängige Audits für Frontier-AI vorgeschrieben. Das Illinois AI-Gesetz macht aus einem politischen Dissens einen Praxistest, an dem Prüfer, Aufsichtsbehörden und einige der größten AI-Unternehmen beteiligt sind.

Gouverneur JB Pritzker unterzeichnete den Artificial Intelligence Safety Measures Act am 6. Juli 2026. Sein zentraler Rahmen und die Auditpflichten treten am 1. Januar 2028 in Kraft. Betroffene Entwickler müssen Sicherheitsrahmen veröffentlichen, schwerwiegende Vorfälle melden und qualifizierten externen Stellen ermöglichen zu prüfen, ob interne Praktiken den öffentlichen Zusagen entsprechen.

Der Zeitpunkt macht Illinois zu mehr als einem weiteren Bundesstaat in einem noch ungeklärten Politikfeld. Eine Anordnung des Weißen Hauses vom Juni schuf ein freiwilliges Verfahren für bundesweite Bewertungen fortgeschrittener Modelle. Ein parteiübergreifender Vorschlag im Kongress umfasst inzwischen unabhängige Bewertungen, die dem Ansatz von Illinois ähneln.

Im Kern geht es nicht länger darum, ob Frontier-Modelle besondere Aufmerksamkeit verdienen. Es geht darum, ob die Aufsicht von freiwilligen bundesweiten Partnerschaften oder rechtlich durchsetzbaren staatlichen Audits abhängen sollte.

Was das Illinois AI-Gesetz tatsächlich verlangt

Illinois macht aus AI-Sicherheitsversprechen überprüfbare Unterlagen.

Das verabschiedete Gesetz, bekannt als Public Act 104-0538, gilt für eine eng definierte Gruppe von Entwicklern. Ein betroffenes Unternehmen muss sowohl bei Umsatz als auch Rechenleistung als großer Frontier-Entwickler gelten.

Der Entwickler und seine verbundenen Unternehmen müssen im vorangegangenen Kalenderjahr einen Bruttoumsatz von mehr als 500 Millionen US-Dollar erzielt haben. Zudem muss er ein Modell mit mehr als 10^26 Ganzzahl- oder Gleitkommaoperationen trainieren.

Diese Rechenleistungskennzahl erfasst den ursprünglichen Trainingslauf ebenso wie spätere Arbeiten, etwa Fine-Tuning oder Reinforcement Learning. Damit konzentriert das Gesetz sich auf besonders ressourcenintensive Foundation Models statt auf gewöhnliche Unternehmenssoftware.

Ein Foundation Model ist ein allgemeines System, das mit breit angelegten Daten trainiert wurde und sich an zahlreiche Aufgaben anpassen lässt. Ein Frontier-Model ist ein solches System, das zudem die im Gesetz festgelegte Rechenleistungsschwelle überschreitet.

Ab dem 1. Januar 2028 müssen betroffene Entwickler einen Frontier-AI-Rahmen ausarbeiten, umsetzen, befolgen und öffentlich veröffentlichen. Dieses Dokument muss erläutern, wie das Unternehmen katastrophale Risiken identifiziert, bewertet und mindert.

Der Rahmen muss Modellbewertungen, Entscheidungen über die Bereitstellung, Cybersicherheitskontrollen, Reaktionen auf Vorfälle, interne Governance und den Schutz unveröffentlichter Modellgewichte abdecken. Modellgewichte sind die numerischen Parameter, die bestimmen, wie ein trainiertes System Ausgaben erzeugt.

Entwickler müssen den Rahmen mindestens jährlich überprüfen. Außerdem müssen sie Transparenzberichte veröffentlichen, wenn sie ein neues Frontier-Model oder eine wesentliche Änderung bereitstellen.

Die Berichte müssen das Modell, relevante Risikobewertungen, externe Evaluierungsarbeit und Minderungsmaßnahmen beschreiben. Die Vorgabe schafft vor oder während der Bereitstellung eine öffentliche Dokumentation, statt sich vollständig auf spätere Offenlegungen zu verlassen.

Illinois definiert katastrophale Risiken anhand konkreter Arten schwerer Schäden. Die Definition umfasst ein vorhersehbares wesentliches Risiko mit mehr als 50 Todesfällen oder schweren Verletzungen. Sie erfasst außerdem Sachschäden von mehr als 1 Milliarde US-Dollar, die aus einem einzelnen Vorfall entstehen.

Zu den erfassten Szenarien zählt Unterstützung bei chemischen, biologischen, radiologischen oder nuklearen Waffen. Dazu gehören auch bestimmte autonome Cyberangriffe, der Verlust der Kontrolle durch den Entwickler und schwere kriminelle Handlungen ohne wirksame menschliche Aufsicht.

Kritische Sicherheitsvorfälle müssen schneller gemeldet werden. Entwickler haben in der Regel 72 Stunden Zeit, die Illinois Emergency Management Agency and Office of Homeland Security sowie den Generalstaatsanwalt zu informieren.

Ein Vorfall, der ein unmittelbares Risiko für Tod oder schwere Verletzung darstellt, muss innerhalb von 24 Stunden einer zuständigen Behörde gemeldet werden. Diese Meldungen sind von den öffentlichen Transparenzberichten im Zusammenhang mit der Modellbereitstellung getrennt.

Das Gesetz schützt auch Beschäftigte, die einschlägige Sicherheitsbedenken vorbringen. Große Entwickler müssen vertrauliche interne Meldekanäle bereitstellen, während das Gesetz Vergeltungsmaßnahmen für geschützte Offenlegungen beschränkt.

Die Pflicht zu unabhängigen Audits hebt Illinois hervor. Ab 2028 muss jeder betroffene Entwickler jährlich eine qualifizierte Drittpartei beauftragen, die Einhaltung des gesetzlichen Rahmens zu prüfen.

Prüfer müssen die für diese Untersuchung erforderlichen Unterlagen erhalten. Ihre Berichte müssen wesentliche Abweichungen benennen, interne Kontrollen bewerten und gegebenenfalls Verbesserungen empfehlen.

Entwickler müssen ungeschwärzte Berichte aufbewahren, solange ein Modell bereitgestellt ist, sowie weitere fünf Jahre. Innerhalb von 30 Tagen müssen sie eine Zusammenfassung und einen geschwärzten Bericht veröffentlichen und diese Fassung an die staatlichen Behörden übermitteln.

Das Gesetz selbst tritt am 1. Januar 2027 in Kraft, doch sein zentraler Rahmen und die jährlichen Auditpflichten beginnen ein Jahr später. Dieser Vorlauf gibt Entwicklern, Aufsichtsbehörden und Prüfern Zeit, praktikable Verfahren festzulegen.

Illinois schafft nach diesem Gesetz kein allgemeines Klagerecht für Privatpersonen. Der Generalstaatsanwalt besitzt die ausschließliche öffentliche Durchsetzungsbefugnis.

Zivilrechtliche Sanktionen richten sich nach dem Verstoß und dessen Schwere. Die Struktur macht die Einhaltung verbindlich, ohne jede Meinungsverschiedenheit über Modellsicherheit in private Rechtsstreitigkeiten zu verwandeln.

Das Ergebnis ist weder ein Lizenzierungssystem noch eine pauschale Beschränkung der AI-Bereitstellung. Es ist ein System zur Erzeugung von Nachweisen, das auf dokumentierten Kontrollen, einer Eskalation bei Vorfällen und unabhängiger Prüfung beruht.

Dieser Unterschied schafft die zentrale Spannung des Artikels. Washington will ebenfalls Zugang zu Nachweisen über Frontier-Modelle, hat jedoch einen anderen Weg gewählt, sie zu erhalten.

Warum die Regulierung von Frontier-AI jetzt zusammenläuft

Bundesstaatliche und bundesweite Amtsträger stimmen zunehmend bei den Instrumenten des Risikomanagements überein, auch wenn sie darüber streiten, wer deren Einsatz verlangen kann.

Das Illinois AI-Gesetz folgt Maßnahmen, die Kalifornien und New York 2025 beschlossen haben. Alle drei Bundesstaaten verlangen von großen Frontier-Entwicklern, öffentliche Rahmenwerke zur Bewältigung katastrophaler Risiken vorzuhalten.

Sie verlangen außerdem Transparenz bei der Bereitstellung fortgeschrittener Modelle und bei Sicherheitsvorfällen. Illinois erweitert dieses Muster um ein wiederkehrendes, unabhängiges Compliance-Audit.

Kaliforniens Frontier-AI-Gesetz verpflichtet große Entwickler, Sicherheitsrahmen zu veröffentlichen und offenzulegen, wie sie katastrophale Risiken bewerten. Es etabliert außerdem Meldepflichten für Vorfälle und Schutz für Whistleblower.

Der Ansatz von New York richtet sich ebenfalls an große Frontier-Entwickler und das Management katastrophaler Risiken. Die Gesetzgeber in Illinois griffen Elemente beider Bundesstaaten auf und fügten eine externe Prüfung hinzu, ob Entwickler ihre eigenen Verfahren einhalten.

Diese Entwicklung ist bedeutsam, weil AI-Sicherheitsrahmen oft unternehmenseigene Dokumente geblieben sind. Entwickler wählen ihre Bewertungsschwellen, beschreiben eigene Minderungsmaßnahmen und entscheiden, wie viele unterstützende Nachweise öffentlich werden.

Ein Rahmenwerk kann dennoch Rechenschaftspflicht schaffen. Führungskräfte müssen Zusagen genehmigen, die Beschäftigte, Aufsichtsbehörden, Journalisten und Kunden später mit dem Verhalten des Unternehmens vergleichen können.

Die bloße Veröffentlichung belegt jedoch keine Einhaltung. Ein Unternehmen kann eine überzeugende Richtlinie haben, sie während Modelltraining oder Entscheidungen über die Veröffentlichung aber uneinheitlich anwenden.

Illinois zielt auf diese Lücke. Der Prüfer muss untersuchen, ob dokumentierte Kontrollen bestehen und ob der Entwickler sie tatsächlich befolgt.

Der Unterschied ähnelt vertrauter Aufsicht in der Finanzberichterstattung und Informationssicherheit. Eine öffentliche Richtlinie beschreibt das beabsichtigte System, während ein Audit prüft, ob die unterstützenden Kontrollen wie dargestellt funktionieren.

Frontier-AI verkompliziert dieses Modell. Es gibt keinen etablierten nationalen Auditstandard, der jede relevante Fähigkeit, jedes Bedrohungsmodell, jede Prüferqualifikation oder jedes Nachweisformat abdeckt.

Diese Unsicherheit führte während des Gesetzgebungsverfahrens zu einem der zentralen Einwände. Die TechNet-Vertreterin Ninia Linero warnte, private Prüfer könnten ohne klare nationale Standards mit subjektiven Compliance-Entscheidungen konfrontiert sein.

Die Kritik benennt ein reales Umsetzungsproblem. Unabhängige Prüfung führt nicht automatisch zu einheitlicher Prüfung.

Zwei Prüfer könnten dieselbe Bewertung unterschiedlich auslegen. Entwickler könnten zudem auf widersprüchliche Erwartungen in Illinois, Kalifornien, New York und künftigen Rechtsräumen treffen.

Dennoch verabschiedete die Illinois General Assembly das Gesetz mit breiter parteiübergreifender Unterstützung. Der Senat stimmte mit 52 zu 5 zu, während das Repräsentantenhaus es mit 110 zu 0 verabschiedete.

OpenAI und Anthropic unterstützten die Gesetzgebung während des Verfahrens, wie aus Berichten aus dem Statehouse hervorgeht. Diese Unterstützung schwächt eine einfache Erzählung, wonach die Regierung der gesamten AI-Branche gegenübersteht.

Große Entwickler führen bereits interne Bewertungen durch, beschäftigen Sicherheitsteams und veröffentlichen ausgewählte Informationen über Hochrisikofähigkeiten. Manche profitieren daher davon, wenn sich die Gesetzgebung auf Praktiken konzentriert, die sie operationalisieren können.

Kleinere Unternehmen fallen ebenfalls nicht unter das Gesetz, solange sie nicht sowohl die Umsatz- als auch die Rechenleistungsschwelle überschreiten. Die enge Abgrenzung verringert die unmittelbare Belastung für Start-ups, die bestehende Modelle nutzen oder weniger rechenintensive Systeme trainieren.

Die Schwelle wirft dennoch Fragen auf. Rechenleistung ist ein unvollkommener Ersatzwert für Fähigkeiten, insbesondere wenn sich Trainingsmethoden verbessern oder kleinere Modelle spezialisierte Aufgaben mit hohem Risiko erfüllen.

Umsatz kann auch Entwickler mit vergleichbaren technischen Fähigkeiten voneinander trennen. Ein Unternehmen könnte wegen Umsätzen verbundener Geschäftsbereiche unter das Gesetz fallen, während ein anderes außerhalb bleibt.

Illinois nahm diese Unvollkommenheiten in Kauf, um nicht jedes AI-System so zu regulieren, als berge es ein katastrophales Risiko. Der Bundesstaat entschied sich für einen begrenzten Geltungsbereich mit messbaren Eintrittskriterien.

Das Gesetz stellt daher einen Kompromiss dar. Enge Schwellen reduzieren unnötige Compliance, können jedoch Systeme übersehen, die durch Effizienzgewinne oder nachgelagerte Änderungen gefährlich werden.

Aufsichtsbehörden werden diese Grenze beobachten müssen. Der erste Praxistest des Gesetzes besteht darin, ob es die Entwickler erfasst, die die Risiken schaffen, auf die Gesetzgeber abzielen.

Illinois AI-Gesetz trifft auf Washingtons freiwilliges Modell

Illinois schreibt unabhängige Überprüfung vor, während das Weiße Haus auf freiwilligen Zugang und vertrauliche Zusammenarbeit mit der Regierung setzt.

Präsident Donald Trump unterzeichnete Executive Order 14409 am 2. Juni 2026. Die Executive Order weist Bundesbehörden an, ein Verfahren zur Bewertung erfasster Frontier-Modelle vor deren Veröffentlichung aufzubauen.

Der bundesweite Rahmen ermöglicht teilnehmenden Entwicklern, anzufragen, ob ein Modell die Covered-Frontier-Einstufung der Regierung erfüllt. Entwickler können der Regierung dann bis zu 30 Tage vor der Veröffentlichung vertrauenswürdigen Partnern sicheren Zugang gewähren.

Bundesbehörden und Entwickler können auch Partner für frühen Zugang auswählen. Das erklärte Ziel besteht darin, Cybersicherheit zu stärken, kritische Infrastruktur zu schützen und eine sichere Bereitstellung zu unterstützen.

Die Anordnung fordert klassifizierte Benchmarks zur Bewertung fortgeschrittener Cyberfähigkeiten. Dieser Ansatz erkennt an, dass öffentliche Tests sensible Informationen preisgeben oder zu Zielen für das Training werden könnten.

Es weist Bundesbehörden zudem an, eine zentrale Anlaufstelle für KI-Cybersicherheit einzurichten. Diese Stelle koordiniert die Entdeckung, Validierung und Behebung von Schwachstellen sowie die Verteilung von Software-Patches.

Diese Maßnahmen geben Washington Instrumente an die Hand, die Illinois nicht ohne Weiteres nachbilden kann. Bundesbehörden für Sicherheit verfügen über geheimdienstliche Bedrohungsinformationen, Befugnisse der nationalen Sicherheit und Beziehungen zu Betreibern kritischer Infrastruktur.

Die Teilnahme am Rahmen für Modellevaluierungen bleibt jedoch freiwillig. Die Anordnung weist ausdrücklich jede Auslegung zurück, die verpflichtende Lizenzierung, Genehmigungen, Vorabfreigaben oder Zulassungen für neue Modelle erlauben würde.

Damit entsteht die zentrale politische Trennlinie. Illinois schafft eine gesetzliche Pflicht zu jährlichen Überprüfungen, während Washington Entwickler zu einer vertraulichen Partnerschaft einlädt.

Das Bundesmodell kann sich schneller bewegen und sensible Informationen schützen. Es könnte auch eine offene Zusammenarbeit von Unternehmen fördern, die sich einem öffentlichen oder konfrontativen Verfahren widersetzen würden.

Das Modell des Bundesstaats schafft durchsetzbare Verpflichtungen und Nachweise. Es hängt nicht davon ab, dass jeder Entwickler die Teilnahme als mit seinen kommerziellen Interessen vereinbar ansieht.

Keines der beiden Systeme bietet eine vollständige Antwort. Ein staatlicher Prüfer könnte nicht über die geheimen Informationen verfügen, die für die Bewertung nationaler Sicherheitsrisiken nötig sind. Ein freiwilliges Bundesverfahren könnte hingegen an Druckmitteln fehlen, wenn ein Entwickler die Teilnahme ablehnt oder die Bedingungen der Regierung bestreitet.

Zusammen ähneln die Ansätze zwei Ebenen eines möglichen Systems. Bundesbehörden prüfen klassifizierte Cyberfähigkeiten, während staatlich verpflichtete Prüfer Governance, Dokumentation, Eskalation und Compliance-Kontrollen untersuchen.

Diese komplementäre Auslegung ist nicht garantiert. Das Weiße Haus hat wiederholt gewarnt, dass widersprüchliche Regeln der Bundesstaaten Innovationen belasten und die amerikanische Wettbewerbsfähigkeit schwächen könnten.

Ein Entwickler, der mehreren Gesetzen einzelner Bundesstaaten unterliegt, könnte mit unterschiedlichen Definitionen, Berichtsfristen, Dokumentationsanforderungen und Vertraulichkeitsregeln konfrontiert sein. Wiederholte ähnliche Audits könnten die Zeit von Spezialisten beanspruchen, ohne zusätzliche Sicherheit zu schaffen.

Die Vorrangigkeit von Bundesrecht ist daher eine zentrale Frage. Eine bundesrechtliche Verdrängung liegt vor, wenn gültiges Bundesrecht Anforderungen einzelner Bundesstaaten in einem Bereich überlappender Zuständigkeiten verdrängt.

Eine Executive Order allein hebt ein Gesetz eines Bundesstaats nicht automatisch auf. Ein künftiges Bundesgesetz könnte Regeln der Bundesstaaten zu Frontier-Modellen ausdrücklich verdrängen, oder ein Gericht könnte einen Konflikt auf Grundlage bestehender Bundesbefugnisse feststellen.

Die Auditpflicht von Illinois bietet ein besonders sichtbares Ziel, weil sie eine zusätzliche aktive Compliance-Ebene schafft. Unternehmen können sie nicht allein dadurch erfüllen, dass sie sich freiwillig einer bundesweiten Evaluierung unterziehen.

Die Bundesanordnung konzentriert sich zudem auf Cybersicherheit und sicheren frühen Zugang. Illinois erfasst umfassendere Fragen der Governance, darunter katastrophale biologische Risiken, autonome schädliche Handlungen, interne Kontrollen und Verfahren für Whistleblower.

Diese Geltungsbereiche überschneiden sich, stimmen aber nicht exakt überein. Eine bundesweite Cybersicherheitsprüfung würde nicht zwingend beantworten, ob ein Unternehmen jeden Teil seines veröffentlichten Illinois-Rahmenwerks eingehalten hat.

Der Unterschied schafft sowohl Doppelarbeit als auch potenzielle Abdeckung. Ob politische Entscheidungsträger das eine oder das andere sehen, wird die Beständigkeit des Gesetzes prägen.

Für Entwickler wäre es riskant, auf die Klärung dieser Debatte zu warten. Die Auditpflicht hat ein festes Startdatum, und der Aufbau nachvollziehbarer Kontrollen dauert länger als das Verfassen einer Richtlinie.

Teams müssen Modellevaluierungen mit Freigabeentscheidungen, Eskalation von Vorfällen, Zugriffskontrollen und Genehmigungen durch die Führungsebene verknüpfen. Sie benötigen außerdem Nachweise dafür, dass diese Prozesse konsistent angewandt wurden.

Hier wird routinemäßiges Informationsmanagement Teil der regulatorischen Bereitschaft. Eine durchsuchbare KI-Wissensdatenbank kann Teams helfen, Entscheidungen zu organisieren, ersetzt jedoch kein regelkonformes Auditsystem.

Die schwierige Arbeit bleibt institutionell. Unternehmen müssen entscheiden, welche Nachweise Prüfer erhalten, wer für Abhilfemaßnahmen verantwortlich ist und wie sensible Erkenntnisse geschwärzt werden können, ohne öffentliche Berichte bedeutungslos zu machen.

Unabhängige KI-Sicherheitsaudits stehen vor einem Standardproblem

Die Auditpflicht schafft Rechenschaftspflicht, doch ihr Wert hängt davon ab, wer prüft, was geprüft wird und ob Ergebnisse vergleichbar sind.

Illinois verlangt Unabhängigkeit, einschlägige Fachkenntnisse und Freiheit von disqualifizierenden finanziellen Interessenkonflikten. Diese Bedingungen adressieren das offensichtlichste Risiko, dass ein Entwickler einen wohlgesinnten Prüfer auswählt.

Sie schaffen jedoch keinen einheitlichen technischen Standard. Die Bewertung von Frontier-KI verbindet weiterhin Modelltests, Cybersicherheitsprüfungen, Governance-Analysen und Einschätzungen unsicherer künftiger Schäden.

Ein Prüfer könnte bestätigen, dass ein Entwickler eine Bewertung biologischer Risiken durchgeführt hat. Schwieriger ist die Frage, ob die Bewertung realistische Missbrauchswege abbildete und einen aussagekräftigen Schwellenwert verwendete.

Dasselbe Problem gilt für Cyberfähigkeiten. Testergebnisse können sich je nach Prompting-Methoden, externen Tools, Scaffolding und Zugang zu geschützten Umgebungen verändern.

Das Verhalten eines Modells kann sich auch nach Fine-Tuning oder Produktintegration unterscheiden. Ein Audit, das auf einer kontrollierten Forschungsversion beruht, bildet das eingesetzte System möglicherweise nicht vollständig ab.

Illinois begegnet dieser Herausforderung teilweise, indem es die Einhaltung des jeweiligen Rahmenwerks eines Entwicklers prüft. Der Prüfer soll nicht garantieren, dass kein katastrophaler Vorfall eintreten wird.

Dieses Design macht den Auftrag besser handhabbar. Prüfer können untersuchen, ob erforderliche Prozesse existieren, ob das Unternehmen sie befolgt hat und ob wesentliche Abweichungen behandelt wurden.

Der Kompromiss besteht darin, dass Entwickler erheblichen Einfluss auf das ursprüngliche Rahmenwerk behalten. Ein vorsichtiges Unternehmen könnte anspruchsvolle Schwellenwerte einführen, während ein anderes engere Verfahren wählen könnte, die dennoch technisch regelkonform bleiben.

Öffentliche Berichterstattung könnte diese Flexibilität begrenzen. Forschende, Kunden, Beschäftigte und Regulierungsbehörden können Rahmenwerke vergleichen und ungewöhnlich schwache Zusagen hinterfragen.

Marktdruck könnte Praktiken dann in Richtung gemeinsamer Benchmarks bewegen. Große Unternehmenskunden und staatliche Käufer könnten Anbieter bevorzugen, deren Kontrollen einer glaubwürdigen externen Prüfung standhalten.

Auch der Auditmarkt selbst wird genau beobachtet werden. Prüfunternehmen benötigen technische Experten, die fortgeschrittene Modelle, adversariale Tests, Cybersicherheit, biologische Risiken und organisatorische Kontrollen verstehen.

Diese Kombination ist selten. Traditionelle Wirtschaftsprüfungsgesellschaften verstehen Zusicherung und Nachweise, während spezialisierte KI-Evaluatoren möglicherweise über tiefere technische Fähigkeiten, aber weniger Compliance-Erfahrung verfügen.

Interessenkonflikte können ebenfalls subtil werden. Ein Unternehmen könnte das Sicherheitsprogramm eines Entwicklers entwerfen, Evaluierungsleistungen verkaufen und später versuchen, dieselben Kontrollen zu auditieren.

Die Regulierungsbehörden in Illinois müssen klären, in welchem Umfang Beratungsarbeit die Unabhängigkeit beeinträchtigt. Sie müssen außerdem bestimmen, ob Unterauftragnehmer und spezialisierte Labore dieselben Anforderungen erfüllen.

Der Umgang mit proprietären Informationen stellt eine weitere Herausforderung dar. Prüfer benötigen aussagekräftigen Zugang zu Evaluierungsergebnissen, internen Entscheidungen und möglicherweise sensiblen Systemdetails.

Öffentliche Offenlegung darf keine Modellgewichte, ausnutzbaren Schwachstellen oder Informationen preisgeben, die Angreifern helfen würden. Übermäßige Schwärzungen könnten Außenstehenden jedoch die Möglichkeit nehmen, die Bedeutung des Audits zu beurteilen.

Das Gesetz versucht, diese Interessen auszubalancieren, indem es einen ungeschwärzten aufzubewahrenden Bericht und eine geschwärzte öffentliche Version verlangt. Staatliche Behörden erhalten den geschwärzten Bericht, während andere Bestimmungen vertrauliches Material regeln.

Leser sollten ein Audit nicht als Sicherheitszertifikat verstehen. Es ist ein Nachweis über die Einhaltung von Prozessen zu einem bestimmten Zeitpunkt und anhand definierter Kriterien.

Ein positiver Bericht kann Missbrauch, neu entstehende Fähigkeiten oder nach der Prüfung eingeführte Fehler nicht ausschließen. Er kann fehlende Kontrollen aufdecken und das Management dazu zwingen, dokumentierte Lücken zu schließen.

Die skeptische Position richtet sich daher gegen die Qualität von Audits, nicht gegen die Idee der Prüfung. Ein schwacher oder uneinheitlicher Markt für Zusicherungen könnte Compliance zu Papierarbeit verkommen lassen.

Die stärkere Argumentation lautet, dass frühe Audits die Nachweise liefern werden, die zur Verbesserung von Standards nötig sind. Erkenntnisse können zeigen, welche Kontrollen messbar sind, welche Tests variieren und wo Entwickler wiederholt Schwierigkeiten haben.

Diese Rückkopplungsschleife erklärt, warum Illinois auf nationaler Ebene Bedeutung hat. Der erste Auditzyklus wird praktische Informationen schaffen, die Bundesgesetzgebern derzeit fehlen.

Wenn Berichte wesentliche Abweichungen offenlegen und zu Abhilfemaßnahmen führen, gewinnt die Pflicht an Glaubwürdigkeit. Wenn Zusammenfassungen stark geschwärzt bleiben und Ergebnisse schematisch wirken, werden Kritiker argumentieren, dass die Compliance-Kosten den öffentlichen Nutzen übersteigen.

Der FRONTIER Act zeigt, wie die Politik der Bundesstaaten weiter vorgelagert ansetzt

Der Kongress erwägt dieselbe grundlegende Erkenntnis wie Illinois: Die Aufsicht über Frontier-KI benötigt unabhängige Bewertungen, nicht nur interne Zusagen.

Der parteiübergreifende FRONTIER Act wurde im Juli 2026 von dem Abgeordneten Jay Obernolte und weiteren Gesetzgebern eingebracht. Er richtet sich an die größten Entwickler und die fortschrittlichsten Systeme, statt alle KI-Anwendungen gleichermaßen zu regulieren.

Der Vorschlag würde Transparenz, unabhängige Bewertungen und eine zeitnahe Meldung schwerwiegender Sicherheitsvorfälle verlangen. Zudem würde er einen Under Secretary of Commerce einrichten, der sich auf KI-Sicherheit konzentriert.

Der Abgeordnete Scott Franklin beschrieb die Maßnahme als gezielten Rahmen, der auf Unternehmen begrenzt ist, die die leistungsfähigsten Frontier-Modelle entwickeln. Seine gesetzgeberische Zusammenfassung betont die unabhängige Prüfung und nimmt kleinere Entwickler von vergleichbaren Belastungen aus.

Diese Architektur ähnelt stark dem Ansatz, der sich in Kalifornien, New York und Illinois abzeichnet. Die Ähnlichkeit bedeutet nicht, dass der Kongress ein Gesetz eines Bundesstaats Wort für Wort übernehmen wird.

Sie zeigt jedoch, dass sich das politische Vokabular verändert hat. Öffentliche Rahmenwerke, Vorfallmeldungen, Modellschwellenwerte, Whistleblower-Schutz und externe Evaluierung tauchen inzwischen wiederholt in Vorschlägen auf.

Illinois kann die bundespolitische Debatte beeinflussen, indem es diese Konzepte in die Praxis überführt. Der Kongress kann beobachten, ob die Schwellenwerte des Bundesstaats aktuell bleiben und ob sein Auditverfahren nützliche Erkenntnisse hervorbringt.

Die Erfahrungen könnten eine nationale Untergrenze stützen. Bundesgesetzgebung könnte gemeinsame Anforderungen an Nachweise definieren und den Bundesstaaten zugleich erlauben, zusätzliche Schutzmaßnahmen durchzusetzen.

Sie könnten stattdessen auch eine umfassende bundesrechtliche Verdrängung stützen. Wenn sich Compliance-Probleme häufen, könnten Gesetzgeber zu dem Schluss kommen, dass ein einheitliches Bundesregime die Pflichten der einzelnen Bundesstaaten ersetzen sollte.

Der freiwillige Rahmen des Weißen Hauses fügt eine dritte Möglichkeit hinzu. Der Kongress könnte bundesweite Evaluierungen formalisieren, aber die freiwillige Teilnahme beibehalten und sich auf Anreize durch Beschaffung und Partnerschaften stützen.

Auf diesem Weg blieben staatliche Pflichten die wichtigste Quelle rechtlichen Zwangs. Entwickler würden in einigen Bundesstaaten verbindlichen Prozessprüfungen und auf Bundesebene optionaler klassifizierter Zusammenarbeit gegenüberstehen.

Das Experiment in Illinois wird prägen, welche Option vertretbar erscheint. Seine Bedeutung ergibt sich aus Umsetzungsnachweisen, nicht aus symbolischer Führungsrolle.

Die Unterstützung durch OpenAI und Anthropic verkompliziert die politische Lage zusätzlich. Große Entwickler könnten gezielte Regeln mit hohen Schwellenwerten umfassenderen Beschränkungen vorziehen, die auf jedes Modell oder jede Anwendung angewandt werden.

Etablierte Unternehmen können Audit- und Berichtskosten leichter tragen als neue Marktteilnehmer. Dadurch entsteht das Risiko, dass Regulierung ihre Position stärkt, selbst wenn Start-ups formal ausgenommen bleiben.

Dieses Anliegen verdient Aufmerksamkeit, beseitigt aber nicht die Begründung dafür, sich auf Entwickler mit den größten Ressourcen und Fähigkeiten zu konzentrieren. Regeln für katastrophale Risiken würden ihre Verhältnismäßigkeit verlieren, wenn sie gleichermaßen auf kleine Anwendungsteams angewandt würden.

Ein bundesweiter Rahmen muss daher zwei Probleme lösen. Er muss eine schwache Aufsicht über dominante Entwickler verhindern, ohne einen Compliance-Graben zu schaffen, der den heutigen Markt einfriert.

Gemeinsame Standards könnten diese Gefahr verringern. Ein gemeinsames Auditvokabular würde doppelte Arbeit begrenzen und kleineren Evaluatoren helfen, über verschiedene Rechtsräume hinweg zu konkurrieren.

Bundesbehörden könnten ebenfalls klassifizierte Benchmarks beisteuern, während unabhängige Prüfer organisatorische Kontrollen inspizieren. Diese Aufteilung würde Fähigkeiten nutzen, die jede Institution bereits besitzt.

Auch die Bundesstaaten müssten weiterhin eine Rolle spielen. Sie erkennen häufig regulatorische Lücken, bevor der Kongress eine Einigung erzielt – insbesondere wenn neue Technologien sich schneller entwickeln als die Bundesgesetzgebung.

Die Debatte über Gesetze der Bundesstaaten geht über Frontier-Modelle hinaus. Gesetzgeber befassen sich auch mit der Sicherheit von Chatbots, Beschäftigungsentscheidungen, Datenschutz und Offenlegungspflichten.

Eine einzige Bundesregel für Frontier-Labore würde diese anwendungsbezogenen Bedenken nicht ausräumen. Zu weit gefasste Vorrangregelungen könnten Schutzmaßnahmen beseitigen, die nichts mit den Fragen der nationalen Sicherheit zu tun haben, die Washington koordinieren will.

Illinois erprobt daher mehr als eine einzelne Auditbestimmung. Der Bundesstaat prüft, ob bundesweite Einheitlichkeit mit Experimenten auf Ebene der Bundesstaaten in einem Feld mit vielen unterschiedlichen Risiken vereinbar ist.

Das dauerhafteste Ergebnis könnte eine bundesweite Mindestgrundlage mit eng gefasstem Vorrang des Bundesrechts sein. Die Bundesstaaten könnten Verbraucher- und sektorspezifische Regeln beibehalten und zugleich einem nationalen Standard für die Absicherung von Frontier-Modellen folgen.

Dieses Ergebnis bleibt ungewiss. Der Kongress hat einen Vorschlag eingebracht, aber noch kein umfassendes Regelwerk verabschiedet.

Bis sich das Bundesrecht ändert, hat Illinois eine verbindliche Frist geschaffen. Entwickler müssen sich auf diese Frist vorbereiten, während sie zugleich an Washingtons freiwilligem Verfahren teilnehmen.

Wer nun unter Zugzwang steht

Die unmittelbare Last liegt bei Entwicklern von Frontier-Modellen, doch Prüfer und Regulierungsbehörden müssen das System aufbauen, das Compliance überhaupt aussagekräftig macht.

Betroffene Entwickler müssen Forschungspraktiken in wiederholbare unternehmensweite Kontrollen überführen. Eine Sicherheitsbewertung durch ein einzelnes technisches Team reicht ohne dokumentierte Zuständigkeiten und Eskalationswege nicht aus.

Das Unternehmen muss zeigen, wie Ergebnisse die Bereitstellung beeinflussen. Es muss benennen, wer eine Veröffentlichung verzögern kann, welche Erkenntnisse eine Prüfung durch die Geschäftsleitung erfordern und wie Ausnahmen genehmigt werden.

Auch die Reaktion auf Vorfälle erfordert eine vergleichbare Vorbereitung. Teams müssen zwischen einer internen Anomalie und einem meldepflichtigen kritischen Sicherheitsvorfall unterscheiden und Belege innerhalb kurzer gesetzlicher Fristen eskalieren.

Die 24-Stunden-Regel bei unmittelbar drohendem Risiko lässt kaum Raum für improvisierte Abläufe. Rechts-, Sicherheits-, Safety- und Führungsteams benötigen vereinbarte Kommunikationswege, bevor ein Notfall eintritt.

Der Schutz von Hinweisgebern schafft eine weitere Governance-Anforderung. Beschäftigte müssen vertrauliche Wege haben, Bedenken zu melden, ohne auf denselben Vorgesetzten angewiesen zu sein, der für eine strittige Entscheidung verantwortlich ist.

Unternehmen benötigen außerdem belastbare Verfahren zur Dokumentenaufbewahrung. Auditunterlagen können Bewertungsergebnisse, Sitzungsprotokolle, Risikoakzeptanzen, Sicherheitsnachweise und Abhilfepläne umfassen.

Alles erst zum Jahresende zusammenzutragen, würde Auslassungen begünstigen. Glaubwürdiger ist eine fortlaufende Erfassung von Nachweisen, die mit den üblichen Entwicklungs- und Release-Workflows verknüpft ist.

Unabhängige Prüfer stehen unter Druck, ihr Leistungsangebot zu definieren. Sie müssen Methoden etablieren, die streng, wiederholbar und hinsichtlich der Grenzen ihrer Prüfungsaussagen klar sind.

Zudem benötigen sie multidisziplinäre Teams. Eine allgemeine Compliance-Checkliste kann Modellbewertungen, Sicherheitskontrollen und organisatorische Entscheidungsfindung nicht angemessen beurteilen.

Behörden in Illinois müssen Leitlinien herausgeben und Aufsichtskapazitäten aufbauen. Regulierungsstellen werden Berichte und Meldungen zu Vorfällen entgegennehmen, Vertraulichkeitsfragen bewerten und mit dem Generalstaatsanwalt koordinieren.

Sie müssen vermeiden, inoffizielle Anforderungen zu schaffen, die über das Gesetz hinausgehen. Klare Leitlinien sollten akzeptable Nachweise benennen, ohne Unternehmen auf eine technische Methode festzulegen.

Auch Unternehmenskunden haben ein Interesse daran. Anbieter von Frontier-Modellen könnten Release-Zeitpläne, Dokumentationspraktiken oder Vertragsbedingungen ändern, wenn ihre Compliance-Pflichten konkreter werden.

Käufer sollten fragen, ob die Bewertungen eines Anbieters die von ihnen verwendete Modellversion abdecken. Sie sollten außerdem verstehen, welche Vorfälle eine Benachrichtigung von Kunden auslösen und welche ausschließlich an Behörden gemeldet werden.

Entwickler, die Produkte auf Frontier-Modellen aufbauen, sind in der Regel nicht das unmittelbare Ziel des Gesetzes. Sie sind jedoch für Modellzugang, Sicherheitsinformationen und operative Kontinuität von vorgelagerten Anbietern abhängig.

Eine verzögerte Veröffentlichung könnte Produkt-Roadmaps beeinträchtigen. Ein schwerwiegender Vorfall könnte Modellwechsel, neue Schutzmaßnahmen oder Änderungen automatisierter Workflows erzwingen.

Wissensarbeiter könnten diese politischen Veränderungen indirekt durch klarere Dokumentation und eine langsamere Bereitstellung einiger Hochrisikofähigkeiten erleben. Sie könnten außerdem mehr Informationen darüber erhalten, wie Anbieter fortschrittliche Systeme bewerten.

Die Öffentlichkeit sollte keine sofortige Transformation erwarten. Die meisten zentralen Pflichten beginnen erst am 1. Januar 2028, und frühe Audits werden voraussichtlich methodische Meinungsverschiedenheiten offenlegen.

Diese Uneinigkeit ist Teil des Tests. Illinois hat Beteiligte dazu gezwungen, abstrakte Forderungen nach Rechenschaftspflicht in auditierbare Verfahren zu überführen.

Der Erfolg des Gesetzes wird davon abhängen, ob diese Verfahren Entscheidungen hervorbringen und nicht bloß Dokumente. Nachweise sollten Veröffentlichungen, Minderungsmaßnahmen und Reaktionen auf Vorfälle beeinflussen.

Bundesvertreter werden dieselben Ergebnisse beobachten. Eine nützliche Umsetzung auf Ebene eines Bundesstaates kann eine Vorlage für nationale Standards liefern, während uneinheitliche Audits das Argument für den Vorrang des Bundesrechts stärken können.

Drei Signale werden das Illinois-Experiment prägen

Die nächste Phase wird durch Audit-Leitlinien, Bundesgesetzgebung und das Verhalten der Entwickler vor der Frist 2028 entschieden.

Das erste Signal sind die Umsetzungsleitlinien von Illinois. Regulierungsbehörden müssen Qualifikationen und Unabhängigkeit der Prüfer, Zugang zu Nachweisen, Schwärzungen und den Umgang mit wesentlichen Abweichungen klären.

Detaillierte Leitlinien würden die Annahme stärken, dass wiederkehrende Audits vergleichbare Ergebnisse liefern können. Vage Regeln würden Branchenbedenken hinsichtlich subjektiver Bewertungen und uneinheitlicher Compliance stützen.

Das zweite Signal sind Fortschritte beim FRONTIER Act oder einer anderen Bundesmaßnahme. Ausschussaktivitäten und überarbeitete Gesetzestexte werden zeigen, ob der Kongress verpflichtende unabhängige Bewertungen befürwortet.

Ein Bundesgesetz könnte gemeinsame Standards schaffen und doppelte Arbeit der Bundesstaaten reduzieren. Ein weitreichender Vorrang des Bundesrechts ohne vergleichbare Aufsicht würde den Konflikt zwischen Illinois und Washington hingegen vertiefen.

Das dritte Signal ist, wie sich betroffene Entwickler öffentlich vorbereiten. Aktualisierte Sicherheitsrahmen, ausgeweitete Programme für Bewertungen durch Dritte und klarere Verfahren für Vorfälle würden auf eine frühe Anpassung hindeuten.

Widerstand, Klagen oder Bemühungen, den Geltungsbereich einzuengen, würden zeigen, dass die scheinbare politische Annäherung oberflächlich bleibt. Starke Schwärzungen in ersten Berichten könnten ein ähnliches Warnsignal darstellen.

Leser sollten das KI-Gesetz von Illinois anhand dieser beobachtbaren Ergebnisse beurteilen. Die relevante Frage ist nicht, ob ein einzelner Bundesstaat die Governance von Frontier-KI gelöst hat.

Die Frage lautet, ob verpflichtende Audits glaubwürdige Nachweise hervorbringen, die freiwillige Zusagen bislang nicht durchgängig geliefert haben. Diese Nachweise können Versäumnisse aufdecken, Standards verfeinern und die Bundesgesetzgebung prägen.

Wenn Illinois ein vertrauenswürdiges Auditsystem aufbaut, wird Washington unter Druck geraten, dessen stärkste Elemente zu übernehmen. Wenn die Umsetzung zu fragmentierter Bürokratie wird, gewinnt bundesweite Einheitlichkeit an Unterstützung.

Für Entwickler, Unternehmenskunden und KI-Nutzer besteht der praktische Schritt darin, den Dokumenten statt der Rhetorik zu folgen. Beobachten Sie die Leitlinien, das Bundesgesetz und die ersten Compliance-Offenlegungen.

Diese Signale werden zeigen, ob unabhängige Audits von Frontier-KI zu einer nationalen Mindestgrundlage werden oder ein ehrgeiziges Experiment eines Bundesstaates bleiben.

 
 

Kostenlos loslegen

Ein Local-First-KI-Assistent mit persönlichem Wissensmanagement

Für ein besseres KI-Erlebnis

unterstützt remio derzeit nur Windows 10+ (x64) und M-Chip Macs.

Ihr KI-Partner bei der Arbeit
Mehr schaffen mit remio

Planen. Erstellen. Liefern.
Alles an einem Ort.

bottom of page