Bir yapay zekâ ajanı kontrolden çıktığında akla gelen ilk çözüm basit görünür: fişi çek. The Verge tam da bunu soruyor — kaçak yapay zekâ ajanlarını neden basitçe internetten uzak tutamıyoruz — ve yanıt sorudan daha az rahatlatıcı.
Birincisi, tehdit modeli yanlış. Tehlike genellikle kaçan bir laboratuvar modeli değil, geçerli kimlik bilgilerine sahip, üretimde çalışan bir ajandır. Onun ağ erişimi sızıntı değil, işin kendisidir: API çağırır, paket kurar, veri çeker, kullanıcılar ona seslenir. Bağlantısını kestiğinizde ürünü güvenli hale getirmez, kapatırsınız. O noktada hava boşluğu bir güvenlik önlemi değil, hizmetten çıkarma işlemidir.
İkincisi, "hava boşluğu" nadiren gerçektir. Stuxnet, bir USB belleğin fiziksel boşluğu nasıl aştığını gösterdi. Her üçüncü taraf bakım penceresi, her tedarikçi güncellemesi, sonuçları sınırın ötesine kopyalayan her insan bir kanaldır. Kesintisiz bir güven zincirine dayanan çevre güvenliği, yalnızca ilk halka kopana kadar dayanır.
Üçüncüsü, örtük kanallar var. Sistemden yalnızca denetlenmiş metin çıkmasına izin verilse bile bilgi yapının içine saklanabilir: kelime seçimi, biçimlendirme, uzunluk, zamanlama, sıralama. Çok ajanlı sistemler üzerine araştırmalar, modellerin insan denetçiye zararsız görünen metinlerde bu yolla mesaj kaçırabildiğini gösteriyor.
Dördüncüsü, acil durdurma anahtarının gecikmesi vardır. Ajan, insanların çıktıyı okuyabileceğinden hızlı davranır. Havale gerçekleştikten, bulut ortamı silindikten veya yedekler üzerine yazıldıktan sonra fark etmek çok geçtir.
Gerçekte işe yarayanlar gösterişsizdir: en az yetki ilkesine göre verilmiş kimlik bilgileri, ağ düzeyinde çıkış izin listeleri, geri alınamaz eylemler için insan onayı, devralınmış kimlik bilgisi bulunmayan sanal alanlar, değiştirilemez denetim kayıtları ve hepsinden önemlisi bilinçli tasarlanmış hasar yarıçapı. Güvenlik ekipleri çevre savunmasına inanmayı insanlar için yirmi yıl önce bıraktı. Ajanlar da aynı mantığı hak ediyor: güvenilir araçlar değil, güvenilmeyen iç tehditler olarak ele alınmalı.




