Hacktron AI’daki güvenlik araştırmacıları, OpenAI’ın dahili yazılım depolarına girmek için Anthropic’in Claude Opus 5 modelini kullandı — yapay zeka ofansif siber güvenliği nasıl dönüştürdüğünün etkileyici bir örneği.

Üç kişilik ekip tüm saldırı zincirini 72 saatten kısa sürede ve yapay zeka model token maliyetlerinde 3.000 dolardan az harcayarak gerçekleştirdi. Saldırı, OpenAI’ın herkese açık Discourse forumunda (community.openai.com) başladı; araştırmacılar burada libheif görüntü işleme kütüpüphanesinde bir bellek zayıflığı tespit etti. Daha önceki bir Claude modeli çalışan bir exploit oluşturmakta zorlandı, ancak Anthropic’in Temmuz ayında Claude Opus 5’i yayımlamasının ardından ekip birkaç saat içinde tam fonksiyonel bir uzaktan kod çalıştırma exploit’i üretti.

Saldırı oradan OpenAI’ın kimlik altyapısına yöneldi. Hacktron, herkese açık forum için oluşturulan oturum belirteçlerinin ChatGPT ve Codex dahil OpenAI’ın dahili hizmetleri genelinde geçerli kaldığını keşetti. Bu tek oturum açma açığı, araştırmacıların herkese açık bir zayıflıktan OpenAI’ın özel GitHub monoreposuna erişime kadar ilerlemesini sağladı.