Z.ai, GLM-5.3-Flash'ı Duyurdu: Frontier Zekâ, Onda Bir Maliyetle

Çinli Z.ai, 320 milyar parametreli ve yalnızca 18 milyar etkin parametreye sahip çok modlu modeli GLM-5.3-Flash'ı duyurdu. Model, GLM-5.2'yi onda bir fiyata geçiyor ve kodlamada Claude Opus 4.8'e yaklaşıyor.
Ne oldu
26 Ağustos'ta Çinli yapay zekâ laboratuvarı Z.ai, GLM-5 serisinin ilk yerel çok modlu modeli olan GLM-5.3-Flash'ı duyurdu. Modelin 320 milyar toplam parametresi var, ancak token başına yalnızca 18 milyar parametre etkin. Selefi GLM-5.2'yi kıyaslama testlerinde yaklaşık onda bir fiyata geçiyor ve kodlama ile ajan görevlerinde Claude Opus 4.8'e yaklaşıyor.
Ucuz çıkarım için mimari
Model, seyrek (sparse) ve doğrusal (linear) dikkat mekanizmalarını hibrit bir yapıda birleştiriyor ve ölçekleme verimliliği için Manifold-Constrained Hyper-Connections (mHC) kullanıyor. GLM-4.5 serisine kıyasla katman sayısı neredeyse yarıya inmiş (45'e karşı 92); bu sayede bir milyon token bağlamında bile sunum maliyetleri düşük kalıyor.
Rakamlar ve sessiz bir deneme
Yayından önce model, OpenCode ve OpenRouter'da "ox-alpha" adıyla anonim olarak çalıştı ve haftanın en popüler modeli oldu — tüm trafik Çin yapımı yapay zekâ çiplerinde karşılandı. Artificial Analysis Intelligence Index v4.1.1'de görev başına yaklaşık 0,045 dolarla 57 puan alıyor; DeepSWE v1.1'de 63,4'e ulaşıyor, GLM-5.2 ise 46,2'de kalıyor.
Neden önemli
Frontier ve bütçe modelleri arasındaki fark daralıyor: üst düzey kodlama ve ajan performansının maliyetin küçük bir kısmına inmesi, nelerin otomatikleştirilebileceğini değiştiriyor.