Schach fiel 1997 an Deep Blue. Go fiel 2016 an AlphaGo. Poker-Bots schlagen Profis seit Jahren. Stratego mit seinen verborgenen Armeen und langen, blufflastigen Partien hielt seinen Rekord – bis ein akademisches Forscherteam eine KI entwickelte, die den besten Spieler der Geschichte für wenige tausend Dollar besiegte.
Das System heißt Ataraxos, und das in der Fachzeitschrift Nature veröffentlichte Ergebnis ist eindeutig: In 20 Online-Partien gegen Pim Niemeijer – viermaliger Weltmeister und mehr als 600 Wochen lang die Nummer eins der Weltrangliste – gewann Ataraxos 15, spielte vier Unentschieden und verlor einmal. Bei der Stratego-Weltmeisterschaft 2025 erging es Herausforderern noch schlechter: Die KI gewann 38 von 40 Partien.
Die Schwierigkeit von Stratego ist strukturell. Beide Seiten verbergen 40 Figuren, deren Ränge der Gegner nicht kennt; Identitäten werden erst im Kampf offenbart. Das ergibt mehr als eine Dezillion möglicher Aufstellungen und Partien, die bis zu 2.000 Züge dauern können – ein gewaltiges Problem unvollständiger Information, anders als die 1.326 möglichen Hände bei Texas Hold'em. Frühere KIs, darunter DeepMinds DeepNash, taten sich mit dem geforderten Bluff-Gleichgewicht schwer.
Ataraxos, entwickelt von Forschenden der Carnegie Mellon University, des MIT, der NYU und Stanford, lernte in 163 Millionen Partien gegen sich selbst, ergänzte aber etwas, das DeepNash nie hatte: ein zweites „Überzeugungs"-Netz, das aus den Zügen des Gegners dessen verborgene Figuren errät. Statt jede mögliche Anordnung durchzurechnen, zieht die KI plausible Stichproben, spielt Kandidatenzüge durch und wählt aus. Effizienz war eingeplant: Das Team schrieb einen Simulator, der auf Grafikkarten Millionen Züge pro Sekunde ausführt.
Der Kostenunterschied ist die Schlagzeile für alle außerhalb der Brettspielwelt. DeepNash wurde zwei bis drei Monate auf 1.024 speziellen Google-Chips trainiert – die Autoren schätzen den Aufwand auf 3 bis 4,5 Millionen Dollar. Ataraxos brauchte 16 GPUs für eine Woche plus vier GPUs für vier Tage. Dieselbe Architektur besiegte laut den Forschenden auch drei Weltmeister der schnelleren Variante Barrage Stratego, meisterte das kooperative Kartenspiel Hanabi und schlug Spitzenbots im chinesischen Kartenspiel dou dizhu – nun arbeiten sie daran, die Strategien erklärbar zu machen.




