Geri Dön
SiTech Professional Insights
Z.ai, GLM-5.3'ü yayınladı: daha güçlü kodlama ve beliren siber yetenekler
SiTech Team2 წთ. საკითხავი

Z.ai, GLM-5.3'ü yayınladı: daha güçlü kodlama ve beliren siber yetenekler

Z.ai'ye göre GLM-5.3, GLM-5.2 ile aynı temel modeli koruyor ve tüm kazanım ölçeklenen eğitim sonrası aşamasından geliyor: kodlamada yüzde 50 sıçrama, açık modeller arasında zirve sonuçlar ve beklenenden hızlı gelişen siber yetenekler.

Z.ai, yeni amiral gemisi modeli GLM-5.3'ü yayınladı; GLM-5.2'ye kıyasla tüm iyileşme eğitim sonrası (post-training) aşamasından geliyor — temel model değişmedi. Şirketin 14 Ağustos 2026 tarihli duyurusuna göre güncelleme, karmaşık kodlama ve uzun ufuklu görevlerde belirgin kazanım sağlıyor; siber yetenekler ise ekibin beklediğinden hızlı gelişti.

Kodlama: açık ağırlıklı modeller arasında liderlik

Z.ai, GLM-5.3'ü kodlama için en yetenekli açık ağırlıklı model olarak tanımlıyor: şirketin kendi Z.ai Code Bench testinde GLM-5.2'ye göre yüzde 50 iyileşme var. Terminal Bench 3.0'da model 28,3 puan alırken GLM-5.2 4,6'da kalıyor; Agents' Last Exam'de sonuç 28,5'e 23,8. DeepSWE v1.1'de skor 46,2'den 66,9'a çıkıyor. Kapalı modellerle fark her yerde kapanmış değil: Terminal Bench 3.0'da Fable 5 33,7, GPT-5.6 Sol ise 34,6 puan alıyor.

Şirket token verimliliğini de öne çıkarıyor: en yüksek akıl yürütme düzeyinde GLM-5.3, görev başına yaklaşık 75 bin çıktı tokenıyla yüzde 34,5'e ulaşırken GLM-5.2 96 bin tokenla yüzde 23,4'te kalıyordu.

Kendiliğinden gelişen siber yetenekler

Eğitim karışımına güvenlik açığı bulma verileri eklendi; amaç kusur analizini iyileştirmekti. Z.ai'ye göre yetenek bekleneden fazla büyüdü: model tek tek hataları saptamaktan çok aşamalı sömürü zincirleri planlamaya geçti. CyberGym'de yüzde 84,5 ile benchmarktaki en iyi sonucu alıyor; Mythos 5 (83,8) ve GPT-5.6 Sol'un (83,6) önünde. ExploitBench'te sonuç 24,4'ten 54,4'e, yani iki katından fazlasına çıktı; ancak Mythos 5 (78,0) ve GPT-5.6 Sol (76,5) hâlâ açık ara önde. Z.ai net bir örüntüye dikkat çekiyor: benchmark sömürü zincirinde ne kadar yukarıdaysa kazanım o kadar büyük, kapalı modellerle kalan fark da o kadar geniş.

Gerçek projelerdeki bulgular ve sürüm planı

Çin'deki güvenlik ekipleriyle yürütülen çalışmada, şirkete göre modelleri uzman incelemesi ve tekrar ayıklamasının ardından 269 açık kaynak projede 2.436 güvenlik açığı buldu; bunların 1.097'si kritik veya yüksek riskli. En eski hata 1981'e uzanıyor ve bir açık ortalama 26,6 yıl boyunca keşfedilmeden kaldı. Kamuya açık Security Disclosure Ledger süreci kaydediyor: 53 açık şimdiye dek ifşa edildi, 2.383'ü hâlâ ambargo altında. Modelin ağırlıkları, güvenlik değerlendirmesi ve sağlamlaştırma tamamlandıktan sonra lansmandan yaklaşık iki hafta sonra yayımlanacak.

SSiTech

SiTech — AI destekli web geliştirme

Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.