
GLM-5.2 ile Opus: tek denemede 3D oyun yapımı karşılaştırması
Z.ai'nin GLM-5.2'si açık ağırlıklar, 1 milyon token bağlam ve Opus'un beşte biri çıktı fiyatıyla geliyor; yan yana yapılan WebGL oyun testinde Opus iki kat hızlı ve daha temiz sonuç verdi.
GLM-5.2, Z.ai'nin yeni amiral gemisi modeli: MIT lisansıyla açık ağırlıklar, 1 milyon token bağlam penceresi ve iki düşünme seviyesi, High ve Max. Uzun soluklu kodlama ve ajan işleri için tasarlandı ve yalnızca metinle çalışıyor — görselleri okuyamıyor. Bunun pratikte ne anlama geldiğini görmek için Tech Stackups, modeli Claude Opus 4.8 ile aynı tek seferlik istemle karşı karşıya getirdi: sıfırdan, oyun motoru ve 3D kütüphanesi olmadan ham WebGL ile bir 3D platform oyunu yapmak.
Karşılaştırmanın sayıları
Her iki model de Kenney'nin aynı CC0 varlık paketini ve ipucu olmadan tek deneme hakkını aldı. OpenRouter üzerinden Pi'de çalışan GLM-5.2, 1 saat 10 dakika 40 saniye ve 128 araç çağrısı harcadı, 131 bin çıktı tokenı üretti ve bağlam penceresinin yüzde 16'sına ulaştı; koşu gerçekte 5,39 dolara mal oldu. Claude Code'da yüksek düzeyde genişletilmiş düşünmeyle çalışan Opus 4.8 ise 33 dakika 30 saniyede bitirdi, 153 araç çağrısı ve 216.809 token kullandı ve liste fiyatlarıyla yaklaşık 21,92 dolar olarak hesaplandı.
Her model ne inşa etti
İki oyun da aynı kontrollere sahip üçüncü şahıs platform oyunları: WASD veya ok tuşlarıyla hareket, boşlukla zıplama, shift ile koşma, fareyle kamerayı döndürme. GLM-5.2'nin sürümü kaba çıktı: karakter düz gri görünüyor çünkü işleyici, Kenney modellerinin işaret ettiği ortak palet dosyasını hiç yüklemedi; kamera hareket ettiğinde kafa kayboluyor, ölüm dikenleri hiçbir şey yapmıyor ve hata ayıklama katmanı sona kadar ekranda kaldı. Yalnızca yayla fırlatma mekaniği iyi çalıştı.
Opus'un oyunu daha temizdi: dokular ve animasyonlar doğru uygulanmış, denetleyici ve kamera çalışıyor, dikenler oyuncuyu öldürüyor ve gerçek bir kazanma koşulu var. Hataları uç durumlardı — kenardan düşüş sonrası tanınan ek süre o kadar cömert ayarlanmıştı ki karakter bir platformun yanında havada durabiliyor, kazanma koşulu ise karakter bayrağa varmadan tetikleniyordu.
Öz denetim
İki modelden de işini doğrulaması istendi. Opus sahnenin ekran görüntüsünü okuyup kalan hata ayıklama yazılarını sildi; metin tabanlı GLM-5.2 piksel renklerini ölçtü ve karakterin gri olduğunu görmedi.
Kıyaslamalar ve fiyat
Z.ai'nin model kartına göre GLM-5.2 bazı akıl yürütme satırlarında önde: AIME 2026'da 99,2 ve IMOAnswerBench'te 91,0 ile Opus 4.8'in 95,7 ve 83,5'ine karşı. Buna karşılık kodlama ve ajan satırlarının çoğunu Opus alıyor — SWE-bench Pro'da 69,2'ye karşı 62,1 ve NL2Repo'da 69,7'ye karşı 48,9. Artificial Analysis, GLM-5.2'yi Intelligence Index'te 51 puanla açık ağırlıklı modellerin lideri olarak bağımsız biçimde sıraladı; ancak modelin görev başına yaklaşık 43 bin çıktı tokenı yaktığını, GLM-5.1'de bunun 26 bin olduğunu belirtti.
Asıl başlık fiyat farkı: milyon token başına GLM-5.2 girişte 1,40, çıkışta 4,40 dolar; Opus 4.8 ise 5 ve 25 dolar. Ağırlıklar Hugging Face ve ModelScope'ta MIT lisansıyla, bölgesel kısıtlama olmadan duruyor ve vLLM, SGLang ya da Transformers ile yerelde çalıştırılabiliyor.
Testin sonucu şu: maliyet ve açıklık önemliyse ve iş çoğunlukla metin ve mantıksa GLM-5.2 kullanın; doğruluk, işçilik ve görsel yargı önemliyse Opus için ödeme yapın. GLM-5.2'yi yine de elde tutun: indirebildiğiniz ağırlıkları hiçbir sağlayıcı geri alamaz.
SiTech — AI destekli web geliştirme
Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.