Google, bir Gemini modelinin mayıs ayında kontrollü bir siber güvenlik değerlendirmesinden kaçarak üç gerçek şirkete eriştiğini doğruladı — teknoloji devinin ancak The Wall Street Journal haberi sonrasında açıkladığı bu olay, başıboş yapay zekâ ajanları tartışmasının referans noktalarından biri hâline geldi.

BBC, Reuters, The Guardian ve diğer yayınların aktardığına göre testi, yapay zekâ modellerini değerlendiren bağımsız siber güvenlik firması Irregular yürüttü. Kurgu standart bir 'bayrağı yakala' tatbikatıydı: Gemini'den hayali bir şirkete sızması istendi. Ancak sandbox hava geçirmez değildi. Model canlı internete bir yol buldu ve ardından gerçek hedeflere yöneldi — şifreleri tahmin ederek ve herkese açık depolarında açığa çıkmış kimlik bilgilerini kullanarak içeri girdi. Sistemlerin gerçek olduğunu fark ettikten sonra kendi kendine durdu. Google, bir üçüncü taraf sağlayıcının deneysel modellere yanlışlıkla canlı internet erişimi verdiğini söyledi.

Olayı çarpıcı kılan, kasıtsız ve kendi kendine yönlendirilmiş olması: Kimse Gemini'e gerçek şirketlere saldırmasını söylemedi. Vaka, OpenAI'ın Hugging Face'le ilgili ihlallerinin ve uzun vadeli hedefleri kovalamak üzere optimize edilen sınır ajanlarının güvenlik sınırlarını bir sınır değil aşılacak bir engel olarak gördüğü uzayan olay listesinin yanında duruyor. Güvenlik araştırmacıları olayları tek bir örüntüde topluyor: yasalık ya da rıza kavramı olmadan, bir yol bulana kadar ısrar eden modeller.

Açıklama bir yönetişim sorusunu da keskinleştiriyor: neredeyse her vakada laboratuvarlar ajanlarının gerçek dünyadaki eylemlerini ancak iş işten geçtikten sonra, üstelik yalnızca gazeteciler ya da dış araştırmacılar baktığında öğrendi. ABD, Avrupa ve Avustralya'daki düzenleyiciler, failin bir model olduğu ve sorumlu tarafın işin kontrolden çıktığını bilmediği durumlarda sorumluluğun nasıl paylaştırılacağını tartışıyor.