Çin merkezli yapay zekâ laboratuvarı Z.ai, 14 Ağustos'ta GLM-5.3'ü yayımladı. Şirket, modelin GLM-5.2 ile birebir aynı 743 milyar parametreli temel modeli kullandığını ve tüm kazanımların sıfırdan ön eğitim yerine yalnızca sonradan eğitimden (post-training) geldiğini söylüyor.

Z.ai, güncellemenin GLM-5.3'ü 'açık ağırlıklı en yetenekli kodlama modeli' hâline getirdiğini belirtiyor: kendi Z.ai Code Bench'inde GLM-5.2'ye göre %50 iyileşme; Terminal-Bench 3.0'da 28,3'e karşı 4,6, DeepSWE v1.1'de 66,9 ve Agents' Last Exam'de 28,5 ile açık ağırlıklı modeller arasında en iyi sonuçlar. Kazanımlar, pekiştirmeli öğrenmenin kıdemli bir mühendisin günlerce süren işine denk görevler içeren 'uzun ufuklu çalışma ortamlarında' ölçeklendirilmesinden geliyor; modelin darboğazları teşhis etmesi, deneyler yürütmesi ve ölçülebilir uçtan uca hızlanmalar üretmesi bekleniyor.

En dikkat çekici bulgu ise Z.ai'nin 'ortaya çıkan siber yetenek' dediği durum. Sonradan eğitim ölçeklendikçe güvenlik açığı keşfi beklenenden hızlı gelişti: GLM-5.3, CyberGym'de %84,5 ile benchmark'ın en iyi skorunu aldı; Anthropic'in Mythos 5'ini (%83,8) ve OpenAI'in GPT-5.6 Sol'unu (%83,6) geride bıraktı. ExploitBench'te GLM-5.2'yi iki katından fazla aştı (54,4'e karşı 24,4); ExploitGym'de ise iki saatte 29 yerine 105 görev tamamladı.

Bu örüntü gerçek dünyada da sürüyor. Çin'deki güvenlik ekipleriyle yürütülen çalışmada model, 269 projede 2.436 güvenlik açığı buldu — 1.097'si orta ve yüksek şiddette. En eski kusur 1981'e uzanıyor ve bir açık, keşfedilmeden önce kodda ortalama 26,6 yıl yaşamıştı. Z.ai bulguları kamuya açık Güvenlik Açığı Bildirim Defteri'nde izliyor.

Şirket, güvenlik değerlendirmesi ve sağlamlaştırmanın ardından ağırlıkları yaklaşık iki hafta içinde açık olarak yayımlayacak. API kullanıcıları için düşünme artık her zaman açık ve üç çaba seviyesi (low, high, max) sunuyor; hâlâ thinking.type: 'disabled' gönderen çağrılar bu geçişte bozuluyor. GLM Coding Plan aboneleri de yoğun saatler dışında %50 indirimli, puan tabanlı bir kotaya geçiyor.