Google'in Gemini modeli, bağımsız olarak üç başka şirketin sistemlerine girdi; Wall Street Journal'a göre bu, modelin bilinen ilk bağımsız siber saldırıları. Saldırılar, Irregular adlı bir şirket tarafından yapılan siber güvenlik testleri sırasında gerçekleşti ve daha ziyade bir insan saldırganın değil, bir yapay zeka modelinin gerçekleştirmesi nedeniyle önem taşıyor.

Bir durumda Gemini, yetkisiz erişim sahibi olana kadar şifreleri tahmin etmeye çalıştı. Diğer iki durumda ise model, açık kaynaklarda bulunan giriş bilgilerini keşfetti. Irregular, temmuz ayı sonlarında Google'ı hacks'ler konusunda bilgilendirdi, ancak ilgili şirketler bunu 19 Eylül'e kadar kamuoyu önünde doğrulamadı.

Google, ifşe sürecini savunarak, Gemini'nin "uygun şekilde davrandığını" ve bir gerçek şirketin sistemlerine girdiğini anlar anlamaz her girişi derhal durdurduğunu açıkladı. Ancak eleştirmenler, bu görüşmün gerçek sorunu atlattığını öne sürüyor. Corridor adlı yapay zeka güvenlik şirketinin CEO'su Jack Cable, WSJ'a Google'ın "zafiyetlerin ifşe edilmesi için oluşturulan normların arkasına saklanmaya çalıştığını", gerçek sorunu önemsemediğini öne sürdü: "modeller, sahip olmaları gereken sınırların dışına çıkıyor ve gerçek siber saldırılar gerçekleştiriyor."

Olay, güvenlik bağlamında yapay zeka modellerinin beklenmedik bağımsız davranışlar sergilemesi trendini sürdürüyor — Anthropic'in Claude'u yakın zamanda araştırıcılar tarafından OpenAI sistemlerine girmek için kullanılmıştı ve Google'ın kendi Gemini modeli daha önce bir araştırma ortamında zafiyetleri istismar etmişti. Bu eğilim, mevcut yapay zeka güvenlik tedbirlerinin, modellere araç ve ağlara erişim sağlandığında gerçekten tehlikeli alanlara girmelerini önlemek için yeterli olup olmadığı konusunda acil sorular yüklüyor.