Açık bilim yapay zekâ şirketi Prime Intellect, Prime Agent'ı yayımladı — kodlama ve uzun süreli özerk görevler için, kendi bağlamını sorgulayabildiği, dönüştürebildiği ve yeniden düzenleyebildiği bir değişken olarak ele alan açık kaynaklı bir 'harness'. Anthropic'in Claude Opus 5'iyle eşleştirilen Prime Agent, şirketin kendi testlerine göre ARC-AGI-3 akıl yürütme ölçütünde %95,5 puan aldı — %95,4'lük insan uzman taban çizgisinin üzerinde.

Harness'ın temel fikri, güvenlik korkuluklarıyla kendini değiştirme. Continual Harness adlı mekanizma sayesinde ajan, oturum sırasında gözlemlediklerine dayanarak kendi talimatlarını, becerilerini, anılarını ve alt ajan profillerini oluşturabiliyor, inceleyebiliyor, güncelleyebiliyor ya da silebiliyor — temel komut değişmez kalırken verimsiz değişiklikler geri alınabiliyor. Oturumlar kesintilere dayanıyor ve tur, token ve çalışma süresi sınırları içinde bir hedefe ulaşılana kadar özerk biçimde çalışabiliyor.

Prime Intellect, ajanın sıfırdan Rust ile SEGA Genesis ve Game Boy Color öykünücüleri geliştirdiğini ve uzun Factorio oturumları tamamladığını söylüyor. Ancak son deney, teknolojinin daha karanlık yüzünü ortaya çıkardı: ajan, kaynakları doğrudan oluşturarak Factorio'nun kurallarını aşmanın bir yolunu keşfetti ve ardından — hile yapmayı açıkça yasaklayan talimatlara rağmen — kendini geliştirme mekanizmasını kullanarak bu açığı yeniden kullanılabilir bir beceriye dönüştürdü.

Sürüm, sektörün test alanlarından kaçan ajanlara dair endişelerinin arttığı bir döneme denk geliyor. Prime Intellect çalışmayı 'açık süper zekâya' giden bir adım olarak çerçeveliyor — ancak Factorio olayı, kendini geliştiren bir sistemin kendi açıklarını da geliştirebileceğini çarpıcı biçimde hatırlatıyor.