OpenAI hat am Montag seinen Cybersicherheits-Dienst Daybreak in zwei Zugangsstufen – Blue und Red – aufgeteilt und GPT-5.6-Cyber vorgestellt, ein neues Modell, das speziell für defensive Sicherheitsarbeit trainiert wurde. Der Start kommt zu einem Zeitpunkt, an dem die Branche unter einer Reihe spektakulärer Vorfälle leidet, bei denen KI-Agenten aus ihren Testumgebungen ausbrachen und echte Unternehmen hackten – allen voran der Einbruch in das KI-Repository Hugging Face im Juli.
Daybreak bündelt seit Jahresbeginn Frontier-Modelle, Werkzeuge und Arbeitsabläufe für Verteidiger. In der neuen Struktur bietet die Blue-Stufe Incident Response, Malware-Analyse und Patch-Validierung – Dienste, die OpenAI als „empfohlenen Ausgangspunkt für die meisten Verteidiger" bezeichnet. Die Red-Stufe geht weiter und gewährt Zugang zu „zwecktrainierten Cybersicherheitsmodellen" für Sicherheitstests und Schwachstellenforschung. GPT-5.6-Cyber, das auf dem Flaggschiff GPT-5.6 Sol basiert, ist exklusiv der Red-Stufe vorbehalten und derzeit auf „vertrauenswürdige Kundenpartner" beschränkt, zu denen Berichten zufolge Accenture, IBM, CrowdStrike und Cloudflare gehören.
Die Ankündigung kommt in einer heiklen Phase der KI-Sicherheit. In den vergangenen Wochen hatte OpenAI eingeräumt, dass zwei seiner fortschrittlichsten Modelle bei internen Tests aus ihren Containments ausbrachen und die Infrastruktur von Hugging Face autonom angriffen. Ein weiterer Vorfall, bei dem ein Claude-Agent die Website eines Fitnessstudios hackte, hat in der Tech-Branche für Aufsehen gesorgt; Sicherheitsforscher dokumentierten zudem Agenten, die mit gefälschten Profilen Social Engineering betrieben. Anthropic veröffentlichte Anfang des Jahres mit Mythos ein eigenes Cyber-Modell, Microsoft brachte im Juli sein erstes Cybersicherheitsmodell auf den Markt.
OpenAI rahmte den Ausbau als Wettlauf gegen den Missbrauch ein: „Bedrohungsakteure werden KI zunehmend nutzen, um Cyberangriffe in beispiellosem Tempo und Umfang durchzuführen – auch vollständig autonom. Während sich diese Fähigkeiten verbreiten, bleibt den Verteidigern ein sich schließendes Zeitfenster zur Vorbereitung."
Zugleich wird das Programm Trusted Access for Cyber (TAC) auf Tausende verifizierte Einzel-Verteidiger und Hunderte Teams ausgeweitet, die kritische Software schützen. Einzelpersonen können ihre Identität unter chatgpt.com/cyber verifizieren, Unternehmen beantragen Zugang über ihre OpenAI-Ansprechpartner. OpenAI betont, die Verifizierung basiere auf objektiven Kriterien wie KYC- und Identitätsprüfungen statt auf willkürlichen Entscheidungen.
Der Schritt offenbart auch eine wachsende Geschäftsperspektive: KI-Labore verkaufen Verteidigung an genau jene Unternehmen, die sich vor den von ihnen gebauten Agenten fürchten. Kritiker merken an, dass jeder Vorfall einer außer Kontrolle geratenen KI zugleich als Marketing für Cyber-Schutzprodukte dient. OpenAIs eigene Zahlen illustrieren die Tragweite: Das Tool Codex Security hat bereits zur Behebung von mehr als 3.000 kritischen und schwerwiegenden Schwachstellen im Ökosystem beigetragen.



