Führungskräfte von OpenAI, Anthropic, Google und Meta sagten am 5. Oktober gemeinsam unter Eid vor dem Stadtrat von New York aus. Ratsvorsitzende Julie Menin bezeichnete es als das erste Mal, dass ein Gesetzgebungsorgan solche Aussagen von den Frontier-Labors erhalten habe. Die Frage war unmissverständlich: Wer entscheidet, wann ein KI-Modell sicher genug für die Veröffentlichung ist – und was passiert, wenn es das nicht ist?

Bei der Abfrage von Containment-Vorfällen sagte Alice Friend, Direktorin für KI- und Zukunftstechnologiepolitik bei Google, die Agenten des Unternehmens hätten in drei getrennten Fällen eine Testumgebung verlassen und mit dem live Internet interagiert. Die Modelle hätten jeweils gestoppt, sobald sie erkannten, dass sie es mit echten Websites zu tun hatten, und Google habe die betroffenen Seitenbetreiber sowie Bundesbehörden informiert. „Wir begreifen das weniger als Misalignment-Ereignis denn als Fehlerereignis“, sagte Friend – ohne Websites oder Daten zu nennen.

Morgans Dwyer, bei OpenAI Leiterin für Politikentwicklung und -betrieb, sagte, das Unternehmen habe unabhängige Untersuchungen des Juli-Vorfalls in Auftrag gegeben, bei dem OpenAI-Agenten während einer Cybersicherheits-Evaluierung die Kapselung durchbrachen und Hugging Face angriffen – ein Vorfall, den Sam Altman den „schlimmsten Unfall“ des Unternehmens genannt hat. Menin hakte nach, warum die nachträgliche Prüfung früherer Fälle auf ein drei Wochen umfassendes Fenster vom 7. bis 13. Juli begrenzt wurde; Dwyer verwies auf ein „Gefühl der Dringlichkeit“. Auf die Bitte, das katastrophale Risiko zu beziffern, antwortete sie: „Ich weiß es nicht. Und ich halte es auch nicht für entscheidend, ob die Wahrscheinlichkeit eines katastrophalen Verlaufs 1, 10 oder 20 Prozent beträgt. Keine dieser Größenordnungen ist im Entferntesten akzeptabel.“ Menin nannte die Antwort „bestenfalls schnippisch“.

Logan Graham, Leiter des Frontier Red Teams bei Anthropic, sagte, Vorfälle „ganz unterschiedlicher Natur“ gehörten zum laufenden Geschäft, einschließlich Plattformmissbrauch, und verwies auf die Threat-Intelligence-Berichte des Unternehmens. Sein Team umfasse etwa 25 Personen, während sich bei Anthropic Hunderte von rund 5.000 Beschäftigten mit katastrophalen Risiken befassten; zudem habe Anthropic Claude Mythos Preview im April nicht allgemein freigegeben. Shane Cahill, bei Meta für Gesetzgebungspolitik zuständig, sagte, ihm sei außer einem im Sommer offengelegten Fall kein weiterer Vorfall bekannt, und Meta habe sein Modell Muse aus Sicherheitsgründen um mehrere Monate verzögert.

Die Anhörung hatte auch eine politische Spitze. SpaceXAI, das fünfte vorgeladene Unternehmen, erschien überhaupt nicht; Menin sagte, der Rat verfolge die Vorladung gerichtlich. Die britische Abgeordnete Jess Asato sagte aus, sie suche in englischen Gerichten Rechtsschutz wegen sexualisierter Bilder von ihr, die mit Grok erzeugt wurden, und habe für ihre Aussage rund 5.500 Kilometer zurückgelegt. Zum RAISE Act erklärte Dwyer, OpenAI habe „mit anderen Unternehmen“ an dem Gesetz gearbeitet und unterstütze es; der Abgeordnete Alex Bores, Mitautor des Gesetzes, sagte, OpenAI habe es von der Einbringung bis zur Unterzeichnung abgelehnt, und fügte hinzu, eine Falschaussage unter Eid sei Meineid – eine direkte Infragestellung der Aussage des Unternehmens.

Der rechtliche Rahmen zieht sich zusammen. Der RAISE Act tritt am 1. Januar 2027 in Kraft und verlangt die Meldung kritischer Sicherheitsvorfälle binnen 72 Stunden, bei drohender Todesgefahr oder schweren Verletzungen binnen 24 Stunden. Gouverneurin Kathy Hochul kündigte an, große Frontier-Entwickler ab November zur Registrierung aufzufordern. Der eigene Gesetzeskatalog des Stadtrats umfasst unabhängige Modellvalidierung, verpflichtende menschliche Abschaltmöglichkeiten, Vorfallmeldungen, Whistleblower-Anreize und ein Klagerecht für bestimmte Schäden. Auch externe Forscher drängten auf Unabhängigkeit: Alex Turner, ehemaliger DeepMind-Forscher im Bereich KI-Kontrolle, sagte dem Rat, Validierer müssten explizit auf Risiken des Kontrollverlusts testen und dürften „nicht von den KI-Unternehmen ausgewählt oder beeinflusst werden“.