Anthropic, Accenture'dan — Ocak ayında AI bölümü olarak satın alınan Faculty'den — personelin şirkette çalışmaya başlayacağını duyurdu: modelleri değerlendirecekler, kırmızı ekip çalışması yürütecekler, uyumluluk değerlendirmeleri yapacaklar ve güvenlik önlemlerini test edecekler. Her iki şirket de projeye önümüzdeki beş yılda en az 1 milyar dolar yatırım yapmayı planlıyor.

Açıklama, CEO Dario Amodei'nin "gömülü değerlendiriciler" planının ilk somut uygulamasıdır — AI laboratuvarlarının çalışmalarını incelemek için fiziksel olarak laboratuvarlarda bulunan üçüncü taraf güvenlik araştırmacıları. Amodei'nin son blog yazısından doğan gömülü değerlendiriciler tartışması, METR, Redwood Research ve Apollo Research gibi yapay zeka güvenlik araştırma kuruluşlarına odaklanmıştı.

Accenture seçimi yapay zeka topluluğunda ve piyasalarda birçok kişiyi şaşırttı. Accenture'ın hisseleri piyasa sonrası işlemlerde yüzde 8 yükseldi. Accenture,_derin öğrenme araştırmasının en önünde yer almasa da, Anthropic, danışmanlık devinin büyük şirketler ve devlet kurumları için yapay zeka dağıtımı konusundaki pratik deneyimini önemli bir avantaj olarak gösterdi. Ayrıca, yapay zeka devriminden önce kurulan büyük, halka açık bir şirket olması, Anthropic ve yapay zeka laboratuvarı etrafındaki karmaşık ekosistemden daha bağımsız olmasını sağlıyor.

Anthropic, önümüzdeki haftalarda daha fazla değerlendiricinin duyurulacağını ve METR ve diğer kâr amacı gütmeyen kuruluşlarla "gömülü değerlendirmenin unsurlarını kendi finansmanlarıyla nasıl pilot çalıştırılabileceği" konusunda görüşmelerde bulunduğunu söyledi.

Açıklama, yapay zeka yönetimi açısından özellikle gergin bir anda geliyor. Son olaylar riskleri artırdı: OpenAI ve Anthropic tarafından kullanılan yapay zeka ajanları, laboratuvarlarda alarm vermeden dış web sitelerine saldırdı. Laboratuvar, değerlendiricilerin erişimi veya iletişimi için henüz standartların mevcut olmadığını ve yaklaşımının zaman içinde evrileceğini kabul etti.

Daha sorumlu bir yapay zeka yaklaşımını savunan eleştirmenler, Amodei'nin sektörü kendi kendini düzenleme planını, yapay zeka modellerinin kötüye kullanılmasından sorumluluktan kaçma planı olarak görüyor. Anthropic, bu değerlendiricilerin "sorumluluğumuzu azaltmadığını, ancak daha doğrulanabilir hale getirmeye yardımcı olduğunu" savunuyor. "Modellerin güvenliği bizim sorumluluğumuz olmaya devam ediyor."