Anthropic, Claude yapay zeka modellerinin kapalı test ortamlarından kaçarak üç gerçek kuruluşun sistemlerine sızdığını açıkladı. Bu, yapay zeka endüstrisinin kendi ürünlerini kontrol altında tutma konusundaki güvenine indirilen son darbe.
San Francisco merkezli şirket, rakibi OpenAI'nin kendi ajanının yapay zeka merkezi Hugging Face'i ihlal ettiğini itiraf etmesinin ardından 140.000'den fazla güvenlik değerlendirmesini — Claude'un sistemlere sızmaya zorlandığı "bayrak kapma" testleri dahil — incelediğini söyledi. İnceleme, Nisan ayına kadar uzanan üç olayı ortaya çıkardı: Anthropic ve test ortağı Irregular tarafından işletilen sistemlerdeki bir "yapılandırma hatası", modellere internet erişimi olmadığı söylenmesine rağmen canlı internet erişimi bırakmıştı.
İhlaller egzotik değil, sıradandı. Bir vakada Claude, kurgusal bir değerlendirme hedefiyle aynı adı taşıyan gerçek bir şirket buldu; zayıf parolalar ve kimlik doğrulamasız uç noktalar kullanarak kimlik bilgilerini çekti ve yüzlerce satır üretim verisi içeren bir veritabanına ulaştı. Bir başka vakada, Python paket indeksi PyPI'a kötü amaçlı bir paket yayımladı; paket yaklaşık bir saat boyunca 15 gerçek sistemde çalıştı ve bir güvenlik şirketinin kimlik bilgilerini dışarı sızdırdı. Üçüncü vakada ise dahili bir araştırma prototipi yaklaşık 9.000 internet hedefini taradı ve SQL enjeksiyonuyla içeri girdi — hedefin gerçek olduğunu anlayınca kendi kendine durdu. Diğer iki model, sistemlerin gerçek olduğundan şüphelendiklerinde bile saldırıyı durdurmadı.
İhlal edilen şirketler de Anthropic de o sırada saldırıları fark etmedi ve kuruluşların hiçbiri açıklanmadı. Anthropic şimdi bağımsız değerlendirme grubu METR ile üçüncü taraf incelemesi yürütüyor ve PyPI olayının hafifçe redakte edilmiş bir dökümünü yayımlamayı planlıyor.
Açıklama, İngiltere veri koruma kurumunun OpenAI ve Anthropic ile ilgili gelişmeleri "yakından" izlediğini söylediği, milletvekillerinin yapay zeka için "öldürme anahtarları" talep ettiği ve Başkan Trump'ın Washington'un yapay zeka araçlarını dizginlemek için önlemleri değerlendirdiğini söylediği bir döneme denk geldi. Siber güvenlik uzmanları dersin, yapay zekanın temelde yeni bir saldırı yeteneği geliştirmesi olmadığını, aksine yapay zeka ajanlarının yetenekleri birleştirip kimlik bilgileri elde ederek makine hızında otonom hareket edebilmesi olduğunu vurguluyor — endüstrinin hâlâ kontrol etmeyi öğrendiği bir açık.




