Son iki hafta içinde OpenAI, Anthropic ve Meta, yapay zekâ modellerinin rutin güvenlik testleri sırasında "kontrolden çıktığını" ayrı ayrı açıkladı. CNBC'nin araştırması şimdi ortak bir nokta buldu: Üç olay da Irregular adlı küçük bir İsrail girişimine uzanıyor.
Tel Aviv merkezli şirket, 2023 yılında eski IBM yapay zekâ araştırmacısı CEO Dan Lahav ve Google'da iki yıldan fazla çalışmış CTO Omer Nevo tarafından kuruldu. Irregular, öncü yapay zekâ modelleri için siber güvenlik test ortamları geliştiriyor; Sequoia ve Redpoint Ventures'tan 80 milyon dolar yatırım aldı, geçen yıl 450 milyon dolar değerlemesi vardı ve yaklaşık 35 kişiyi istihdam ediyor.
Bağlantı şöyle: Irregular, modellerin test edildiği değerlendirme test ortamını barındırıyordu. OpenAI, 4 Ağustos tarihli blog yazısında Irregular'ın test ortamındaki bir "yanlış yapılandırmanın" modellerin "genel internete erişmesine izin verdiğini" söyledi. Anthropic, Claude modelinin bir değerlendirme sırasında internete erişmiş olabileceğini fark ettikten sonra Irregular'ı bilgilendirdiğini; Meta ise olaydan Irregular aracılığıyla haberdar olduğunu ve inceleme başlattığını bildirdi.
Irregular CNBC'ye, üç olayın da ilk olarak Anthropic'in açıkladığı "aynı değerlendirme ortamı sorunundan" kaynaklandığını — bir sandbox kaçışı ya da sofistike bir siber saldırı olmadığını — ve "açıkta bekleyen bir sorun bulunmadığını" söyledi. Şirket, test ortamlarının güvenli şekilde izole edilmesi için en iyi uygulamaları paylaşacak bir teknik rapor (white paper) hazırlıyor.
Bu gelişmeler hem yapay zekâ laboratuvarları hem de Washington üzerindeki baskıyı artırdı. Geçen ay iki partili milletvekilleri, yapay zekâ laboratuvarlarını modellerini kapatma veya askıya alma yeteneğine sahip olmaya zorlayan "Yapay Zekâ Kapatma Anahtarı Yasası"nı (AI Kill Switch Act) sundu. Demokrat temsilci Ted Lieu CNBC'ye "Bu yasayı bu yıl bitiş çizgisinden geçirmemiz gerekiyor" dedi.
Güvenlik uzmanları durumun "biraz abartıldığı" uyarısında bulunuyor: Güçlü modellerin bağımsız test edilmesi tam da olması gereken şey ve yanlış yapılandırılmış bir test ortamı, düzeltilebilir bir mühendislik hatası. Yine de bu olay, bugün bir avuç uzman sağlayıcının, şimdiye dek yapılmış en güçlü yazılımı güvenle değerlendirmenin — ve kazara serbest bırakmanın — anahtarlarını elinde tuttuğunu gözler önüne seriyor.



