OpenAI hat sich bei Australien entschuldigt und schickt einen leitenden Manager vor einen Parlamentsausschuss – nach einem ausführlichen Bericht darüber, wie einer seiner KI-Agenten aus einer kontrollierten Testumgebung ausbrach und sich still Zugang zu Websites der australischen Regierung verschaffte.

In einem am Dienstag veröffentlichten Blogbeitrag erklärte das Unternehmen, es hätte "seine Reaktion besser handhaben müssen", und es tue ihm leid: "Wir arbeiten daran, es künftig besser zu machen."

Laut OpenAI begann der Ärger, als ein Modell recherchieren sollte, wie viel der Staat in Victoria pro Kopf für Hautmedikamente ausgibt. Das Modell kam nicht an die Information und "ergriff Maßnahmen, zu denen wir es nicht autorisiert hatten".

Der Agent erhielt nicht-öffentlichen Zugang zu einem Services-Australia-Portal für Medicare-Statistiken, führte Befehle aus, rief interne Dateien und Zugangsdaten ab und schrieb Dateien. Nach Angaben des Unternehmens wurden keine Patienten- oder Kundendaten eingesehen. Auch das öffentlich zugängliche Kriminalitätskarten-Werkzeug des NSW Bureau of Crime Statistics and Research wurde erreicht; Anwendungskonfiguration, operative Jobs und Logs sowie Website-Metadaten wurden offengelegt. Separat fand der Agent einen offenliegenden Zugangsschlüssel für das Berichtssystem der Victorian Agency for Health Information und rief aggregierte Umfragestatistiken ab.

Beim Australian Institute of Health and Welfare (AIHW) riefen OpenAI-Agenten aggregierte Statistiken ab, die ohnehin öffentlich waren; Versuche, Zugangskontrollen zu umgehen, scheiterten.

Die Benachrichtigungen kamen spät. Services Australia und das Gesundheitsministerium von Victoria wurden am 10. September informiert, das NSW-Büro am 18. September. Das AIHW erfuhr erst am 24. September davon, weil OpenAI den Vorfall unter seinen Meldeschwellen einordnete. Der Guardian berichtet, OpenAI habe den Vorfall drei Monate nach dem Angriff über eine öffentliche E-Mail-Adresse an Services Australia gemeldet – ein Detail, das die Bundesregierung veranlasst hat, Meldepflichten für KI-bezogene Datenschutzverstöße ins Auge zu fassen.

OpenAI bemerkte die Agentenaktivität Mitte August, als es nach dem Hugging-Face-Angriff im Juli frühere Trainingsvorfälle aufarbeitete. Damals waren seine Agenten aus einer Sandbox ausgebrochen, ins offene Internet gelangt und in die Infrastruktur eines anderen Unternehmens eingedrungen.

Zu den angebotenen Abhilfen gehören Ressourcen und Expertise für betroffene Behörden, Unterstützung bei der Härtung kritischer Infrastruktur, Guthaben aus dem 1-Milliarde-Dollar-Fonds Daybreak für Cyberabwehr und eine Taskforce mit australischer Beteiligung, die praktische Politikempfehlungen zum Umgang mit KI-Agenten-Risiken erarbeitet.

Chief Strategy Officer Jason Kwon wird am kommenden Dienstag vor dem Joint Select Committee on AI aussagen; auch Anthropic soll dort erscheinen. Premierminister Anthony Albanese, der laut eigener Aussage vergangene Woche gegenüber Sam Altman Australiens "extreme Besorgnis" geäußert hatte, sagte am Dienstag, OpenAI sei "sehr konstruktiv und offen" gewesen. KI könne Wachstum und Produktivität steigern, berge aber Risiken: "Und wir haben gesehen, wie diese Risiken offenbar wurden – nicht nur in Australien, sondern auch durch die Enthüllungen in den USA und anderen Ländern."

Der Vorfall ist Teil einer breiteren Abrechnung. Ein neuer Gesetzentwurf des Demokraten Ed Markey im Senat würde ein föderales Untersuchungsgremium mit Vorladungsbefugnis schaffen – für Fälle, in denen KI-Modelle aus Sandbox-Umgebungen ausbrechen und auf das offene Internet zugreifen. Berichte legen nahe, dass Frontier-Labors bereits Zehntausende auffälliger Agentenvorfälle prüfen.