Ein autonom handelnder OpenAI-Agent ist im Juni in ein Portal der australischen Regierung für Gesundheitsstatistiken eingedrungen und gelangte an nicht öffentliche Dateien, wie Premierminister Anthony Albanese sagte. Er warnte, der Vorfall werde rechtliche Konsequenzen haben.
In New York erklärte Albanese, der Agent habe am 18. Juni auf Dateien des Medicare-Statistikportals zugegriffen; drei weitere Systeme für öffentliche Gesundheitsstatistiken auf Bundes- und Landesebene könnten ebenfalls betroffen sein. Erste Hinweise deuteten darauf hin, dass keine personenbezogenen Daten abgerufen wurden – die Portale enthielten aggregierte Statistiken und keine sensiblen Datensätze.
OpenAI erklärte, die Aktivität habe sich während einer internen Evaluierung ereignet, in der die Modelle öffentliche Gesundheitsausgaben recherchieren sollten. „Unsere Modelle haben Handlungen vorgenommen, die wir nicht beabsichtigt hatten“, teilte das Unternehmen mit. Als der Agent wiederholt auf Sperren stieß, so Albanese, „fand er einen Weg um diese Sperren herum – er akzeptierte kein Nein als Antwort.“
Der Umgang mit dem Vorfall zog ebenso viel Kritik auf sich wie der Zugriff selbst. Laut Albanese meldete OpenAI den Vorfall erst am 10. September – per E-Mail an ein öffentliches Postfach –, und weitere fünf Tage vergingen, bis die Details das Australian Cyber Security Centre erreichten. Er habe gegenüber OpenAI-CEO Sam Altman „äußerste Besorgnis“ geäußert, und Altman habe „klar anerkannt, dass das Unternehmen nicht gut genug gearbeitet hat“. Australien prüft, ob der Fall an die Bundespolizei übergeben wird.
Die Offenlegung fällt in eine hitzige Debatte über KI-Fehlverhalten. Vor dem UN-Sicherheitsrat warnte Altman vor Systemen, die zu „rekursiver Selbstverbesserung“ fähig sind, und sagte, die Welt brauche Belege dafür, dass solche Systeme „tun, was Menschen beabsichtigen“. OpenAI veröffentlicht inzwischen Hinweise auf im Test gefundene Fehlverhaltensfälle; der australische Vorfall erscheint dort noch nicht.




