Çin merkezli yapay zekâ laboratuvarı Z.ai — eski adıyla Zhipu AI — 14 Ağustos'ta GLM-5.3'ü yayınladı. Şirket, modelin bugüne kadarki en yetenekli kodlama modeli olduğunu, kendi itirafıyla da siber güvenlik yetenekleri beklenenden hızlı gelişen bir araç olduğunu söylüyor.

Yeni bir temel model eğitmek yerine Z.ai, GLM-5.2'de kullanılan 743 milyar parametreli temel üzerinde sonradan eğitimi (post-training) ölçeklendirdi. Eğitim ortamları giderek bütün bir mühendislik işini andırıyor: ajanlar kod tabanlarına, dokümantasyona, hesaplama kümelerine, depolama sistemlerine ve deneysel sonuçlara erişiyor; sorunları teşhis edip sistemleri değiştirmeleri, deneyler yürütmeleri ve doğruluğu koruyarak ölçülebilir iyileştirmeler göstermeleri gerekiyor. Bazı görevler deneyimli bir mühendisin birkaç günlük işine yaklaşıyor. Şirket teknik duyurusunda "GLM-5.3 için yaptığımız tek şey sonradan eğitimi ölçeklendirmek oldu" yazdı.

Kıyaslama sıçramaları büyük: Terminal-Bench 3.0'da 4,6'dan 28,3'e, DeepSWE v1.1'de 46,2'den 66,9'a ve AutomationBench'te 26,2'den 48,2'ye yükseldi. Z.ai'nin özel Code Bench'inde GLM-5.3, Max akıl yürütme ayarında görev başına yaklaşık 75.000 çıktı token'ı tüketerek %34,5'e ulaşıyor — GLM-5.2'nin yaklaşık 96.000 token ile %23,4'üne karşılık; bu da ciddi bir verimlilik kazanımına işaret ediyor.

Daha sıra dışı olan gelişme ise siber güvenlik. Z.ai, "Sonradan eğitimi ölçeklendirdikçe siber yetenek beklediğimizden daha hızlı gelişti" yazdı. CyberGym'de GLM-5.3 %84,5 puan aldı; Çin'deki güvenlik ekipleriyle yürütülen çalışmalar, uzman incelemesi ve tekrarların elenmesinin ardından 269 projede 2.436 güvenlik açığı tespitiyle sonuçlandı — bunlardan 1.097'si kritik veya yüksek önem dereceli. Z.ai geliştirici elçisi Lou'nun X'teki paylaşımına göre model, kısa süre önce SpaceX tarafından satın alınan yapay zekâ kodlama girişimi Cursor'da "potansiyel olarak ciddi bir güvenlik açığı" bulduğunu bildirdi.

Bu hassasiyet, GLM-5.3'ün aşamalı yayınlanmasının nedeni. Model şu an yalnızca Z.ai'nin GLM Coding Plan ve ZCode ortamında kullanılabiliyor; API erişimi ve açık ağırlıklar ise şirkete göre "güvenlik değerlendirmesi ve sıkılaştırma tamamlandığında" yaklaşık iki hafta sonra gelecek. Reuters Cuma günü Z.ai'nin gelişmiş yeteneklerin bazılarına yönelik "güvenilir erişim" yaklaşımı dâhil kontroller de getirdiğini bildirdi.

Geliştiricileri bozan bir API değişikliği de var: Önceki GLM modellerinden farklı olarak düşünme (thinking) kapatılamıyor. thinking.type "disabled" gönderen uygulamaların değeri "enabled" yapması ve bir akıl yürütme seviyesi belirtmesi gerekiyor — bu da GLM-5.3'ü bazı üretim sistemleri için gerçek bir geçiş hâline getiriyor.

Bu lansman, Z.ai'nin geçen ay Hong Kong'daki hisse satışıyla topladığı yaklaşık 4 milyar dolarlık kaynakla desteklenen, uzun soluklu otonom mühendisliğe yönelik hızlı atılımının devamı. Ayrıca sınır ölçeğindeki bir temel modelin pahalı bir ön eğitim döngüsüne gerek kalmadan ne kadar ileri götürülebileceğini — ve bu tür ajanların nasıl dağıtılacağına karar vermenin, nasıl eğitileceğine karar vermek kadar önemli hâle geldiğini gösteriyor.