Satranç 1997'de Deep Blue'ya yenildi. Go 2016'da AlphaGo'ya düştü. Poker botları yıllardır profesyonelleri yeniyor. Gizli orduları ve uzun, blöf dolu oyunlarıyla Stratego ise rekorunu korudu — ta ki bir grup akademik araştırmacı, birkaç bin dolara tarihin en iyi oyuncusunu yenen bir yapay zekâ geliştirene kadar.

Sistemin adı Ataraxos ve Nature dergisinde yayımlanan maç sonucu hiç dengeli değil: dünya sıralamasında 600 haftadan fazla zirvede kalmış dört kez dünya şampiyonu Pim Niemeijer'a karşı online oynanan 20 oyunda Ataraxos 15 kez kazandı, dört kez berabere kaldı, bir kez kaybetti. 2025 Stratego Dünya Şampiyonası'nda ona meydan okuyanlar daha da kötü durumdaydı: yapay zekâ 40 oyunun 38'ini kazandı.

Stratego'nun zorluğu yapısal. Her iki taraf da rakip tarafından bilinmeyen rütbelere sahip 40 taş saklıyor; kimlikler yalnızca çarpışmada açığa çıkıyor. Bu, desilyondan fazla olası dizilim ve 2.000 hamleye kadar uzayabilen oyunlar demek; Texas Hold'em'in 1.326 olası elinden farklı, devasa bir gizli bilgi problemi. DeepMind'ın DeepNash'i de dahil önceki yapay zekâlar, oyunun gerektirdiği blöf dengesini kurmakta zorlandı.

Carnegie Mellon, MIT, NYU ve Stanford araştırmacılarının geliştirdiği Ataraxos, 163 milyon oyun boyunca kendi kendine oynayarak öğrendi; ancak DeepNash'te olmayan bir şey ekledi: rakibin hamlelerinden gizli taşlarını tahmin eden ikinci bir "inanç" sinir ağı. Olası her dizilimi tek tek denemek yerine yapay zekâ makul olanları örnekliyor, aday hamleleri oynatıp seçim yapıyor. Verimlilik tasarımın parçasıydı: ekip, ekran kartlarında saniyede milyonlarca hamle çalıştıran bir simülatör yazdı.

Maliyet farkı, masa oyunları dünyasının dışındakiler için manşet niteliğinde. DeepNash, Google'ın özel çiplerinden 1.024'ü üzerinde iki-üç ay eğitildi; yazarlar bunun maliyetini 3 ila 4,5 milyon dolar olarak tahmin ediyor. Ataraxos'a bir hafta boyunca 16 GPU, inanç modeli için dört gün boyunca dört GPU yetti. Araştırmacılar aynı mimarinin daha hızlı Barrage Stratego varyantında üç dünya şampiyonunu yendiğini, işbirlikli kart oyunu Hanabi'de ustalaştığını ve Çin kart oyunu dou dizhu'da en iyi botları geçtiğini belirtiyor; ekip şimdi stratejilerini açıklanabilir kılmaya çalışıyor.