In einer der folgenschwersten staatlich verordneten KI-Modellbeschränkungen der Geschichte wurde Anthropics leistungsstärkstes öffentlich verfügbares KI-Modell — Claude Fable 5 — am 1. Juli 2026 nach einer 19-tägigen Suspendierung wieder für globale Nutzer freigegeben, die Schockwellen durch die Technologiebranche gesendet hatte.

Die Krise begann am 9. Juni, als Anthropic Fable 5 zusammen mit seinem noch leistungsstärkeren Pendant Mythos 5 auf den Markt brachte. Nur drei Tage später, am 12. Juni, erließ das US-Handelsministerium eine Notfall-Exportkontrollverordnung unter Berufung auf nationale Sicherheitsbedenken. Der Auslöser: Amazon-Forscher hatten eine Jailbreak-Technik entdeckt, die die Sicherheitsklassifikatoren von Fable 5 umgehen konnte.

Anthropic suspendierte den Zugang zu beiden Modellen für alle Nutzer innerhalb von Stunden — eine drastische Maßnahme, die Entwickler, Unternehmen und Forscher weltweit betraf.

Was der Jailbreak tatsächlich enthüllte

In den folgenden Wochen führte Anthropic umfangreiche Tests durch und stellte fest, dass der Jailbreak keine einzigartigen Mythos-Fähigkeiten offenlegte. Bemerkenswerterweise konnten alle von Anthropic getesteten Modelle — einschließlich Claude Haiku 4.5, Sonnet 4.6, Opus 4.6 bis 4.8, GPT-5.4, GPT-5.5 und Kimi K2.7 — dieselben Ergebnisse liefern.

Neue Schutzmaßnahmen und ein historischer Rahmen

Um die Rückkehr des Modells zu sichern, trainierte Anthropic einen verbesserten Sicherheitsklassifikator, der die spezifische Jailbreak-Technik in über 99% der Fälle blockiert. Das Zentrum für KI-Standards und Innovation des US-Handelsministeriums validierte die Schutzmaßnahmen unabhängig.

Noch bedeutsamer: Anthropic, Amazon, Microsoft und Google vereinbarten die gemeinsame Entwicklung eines Frameworks zur Bewertung des Schweregrads von Jailbreaks — ein Novum für die KI-Branche.

Eine neue Ära der Regierungszusammenarbeit

Die Wiederherstellung erfolgte mit vier formellen Verpflichtungen von Anthropic: Vorab-Zugang der Regierung zu zukünftigen Grenzmodellen für nationale Sicherheitsbewertungen, schneller Austausch von Bedrohungsinformationen, dedizierte Ressourcen für gemeinsame KI-Sicherheitsforschung und die Mitarbeit an einem gemeinsamen Industriestandard.