OpenAI, ön değerlendirmelerin Astra modeli için 'kritik' siber güvenlik yeteneklerini dışlayamadığı sonucuna varmasının ardından bir sonraki büyük modelinin geliştirilmesini yavaşlattı. Şirket blog yazısında, son günlerdeki testlerin aracılı kodlama ve siber güvenlik alanında önemli ilerlemeler gösterdiğini, bu nedenle güvenlik önlemlerini genişlettiğini ve bazı iç çalışmaları askıya aldığını söyledi.
OpenAI'ın Hazırlık Çerçevesi'ne göre bir model, insan müdahalesi olmadan güçlendirilmiş gerçek dünya sistemlerine karşı işlevsel sıfırıncı gün açıkları geliştirebiliyorsa ya da üst düzey bir hedeften yola çıkarak uçtan uca yeni siber saldırı stratejileri tasarlayabiliyorsa kritik eşiğe ulaşmış sayılıyor. GPT-5.6-Sol dahil önceki modeller 'Kritik' değil 'Yüksek' seviyede değerlendirilmişti; bu, şirketin en üst kademeyi ilk kez işaretlemesi anlamına geliyor.
OpenAI, yüksek yetenekli modeller için daha sıkı güvenlik kontrolleri uyguladığını söylüyor: izole test ortamları, kısıtlı ağ ve araç erişimi, geliştirilmiş ağırlık koruması ve şifreleme ile Astra'nın aracılı uygulamalarında riskli eylemler için evrensel izleme. Bu gereksinimleri henüz karşılamayan iç faaliyetler askıya alındı. Şirket ayrıca daha ileri testler için devlet kurumları ve yapay zekâ güvenliği kuruluşlarıyla çalışacağını ve Astra'nın yakın zamandaki Hugging Face sızıntısına karışmadığını belirtti.
Bu hamle, OpenAI'ın modellerin biyoloji alanında yüksek yetenek eşiğine yaklaştığı Haziran 2025'teki yanıtını yansıtıyor ve sınır yapay zekâsının saldırgan siber potansiyeline yönelik artan incelemelerin ortasında geliyor.




