Վերադառնալ
GLM-5.2 ընդդեմ Opus-ի. 3D խաղի կառուցման մեկ փորձի համեմատություն
SiTech AI Team3 წთ. საკითხავი

GLM-5.2 ընդդեմ Opus-ի. 3D խաղի կառուցման մեկ փորձի համեմատություն

Z.ai-ի GLM-5.2-ը գալիս է բաց կշիռներով, 1 միլիոն թոքենի կոնտեքստով և Opus-ից հինգ անգամ ցածր ելքային գնով. WebGL խաղի զուգահեռ թեստում Opus-ը երկու անգամ արագ և ավելի մաքուր արդյունք տվեց։

GLM-5.2-ը Z.ai-ի նոր ֆլագման մոդելն է. բաց կշիռներ MIT լիցենզիայով, 1 միլիոն թոքենի կոնտեքստային պատուհան և մտածելու երկու մակարդակ՝ High և Max։ Այն նախատեսված է երկարաժամկետ կոդավորման և գործակալային աշխատանքի համար և միայն տեքստային է. պատկերներ կարդալ չի կարող։ Որպեսզի ստուգվի, թե դա ինչ է նշանակում գործնականում, Tech Stackups-ը այն համեմատեց Claude Opus 4.8-ի հետ նույն մեկանգամյա հրահանգով. զրոյից կառուցել 3D պլատֆորմեր մաքուր WebGL-ով, առանց խաղային շարժիչի և 3D գրադարանի։

Ուղիղ համեմատության թվերը

Երկու մոդելներն էլ ստացան Kenney-ի նույն CC0 ակտիվների փաթեթը և մեկ փորձ՝ առանց հուշումների։ GLM-5.2-ը, աշխատելով OpenRouter-ով Pi-ում, ծախսեց 1 ժամ 10 րոպե 40 վայրկյան և 128 գործիքային կանչ, արտադրեց 131 հազար ելքային թոքեն և հասավ կոնտեքստի 16 տոկոսին. փորձարկումն իրականում արժեց 5.39 դոլար։ Opus 4.8-ը Claude Code-ում, ընդլայնված մտածողության High ռեժիմով, ավարտեց 33 րոպե 30 վայրկյանում, օգտագործեց 153 գործիքային կանչ և 216 809 թոքեն, իսկ արժեքը գնահատվեց մոտ 21.92 դոլար՝ ըստ գնացուցակի։

Ինչ կառուցեց յուրաքանչյուր մոդել

Երկու խաղերն էլ երրորդ դեմքով պլատֆորմերներ են՝ նույն կառավարմամբ. շարժում WASD-ով կամ սլաքներով, ցատկ՝ space-ով, վազք՝ shift-ով, տեսախցիկի պտույտ՝ մկնիկով։ GLM-5.2-ի տարբերակը կոպիտ դուրս եկավ. կերպարը հարթ մոխրագույն է, քանի որ ռենդերերը չի բեռնել Kenney-ի մոդելների հղած ընդհանուր պալիտրայի ֆայլը, տեսախցիկի շարժման ժամանակ գլուխը անհետանում է, մահացու փշերը ոչինչ չեն անում, իսկ կարգաբերման շերտը մնում է էկրանին մինչև վերջ։ Լավ աշխատեց միայն զսպանակով արձակման մեխանիկան։

Opus-ի խաղը ավելի մաքուր էր. տեքստուրաներն ու անիմացիաները ճիշտ են կիրառված, կառավարումը և տեսախցիկը աշխատում են, փշերը սպանում են կերպարին, և կա իրական հաղթանակի պայման։ Նրա սխալները եզրային դեպքեր էին. հարթակից իջնելուց հետո տրվող արտոնյալ ժամանակը այնքան առատ էր, որ կերպարը կանգնում էր օդում հարթակի կողքին, իսկ հաղթանակը միանում էր դրոշին դեռ չհասած։

Ինքնաստուգում

Opus-ը կարդաց սցենայի սքրինշոթը և հեռացրեց կարգաբերման գրառումները, իսկ տեքստային GLM-5.2-ը ստուգեց միայն պիքսելների գույները։

Բենչմարքեր և գին

Z.ai-ի մոդելի քարտի համաձայն՝ GLM-5.2-ը առաջ է մտածողության որոշ տողերում՝ 99.2 AIME 2026-ում և 91.0 IMOAnswerBench-ում՝ ընդդեմ Opus 4.8-ի 95.7-ի և 83.5-ի, սակայն կոդավորման և գործակալային առաջադրանքների տողերի մեծ մասը վերցնում է Opus-ը՝ 69.2 ընդդեմ 62.1-ի SWE-bench Pro-ում և 69.7 ընդդեմ 48.9-ի NL2Repo-ում։ Artificial Analysis-ը անկախորեն GLM-5.2-ին ճանաչեց որպես առաջատար բաց կշիռներով մոդել Intelligence Index-ում՝ 51 միավորով, սակայն նշեց, որ մոդելը մեկ առաջադրանքի համար ծախսում է մոտ 43 հազար ելքային թոքեն՝ GLM-5.1-ի 26 հազարի դիմաց։

Գլխավոր տարբերությունը գինն է. մեկ միլիոն թոքենի դիմաց GLM-5.2-ը արժե 1.40 դոլար մուտքի և 4.40 դոլար ելքի համար՝ Opus 4.8-ի 5 և 25 դոլարի դիմաց։ Կշիռները Hugging Face-ում և ModelScope-ում են՝ MIT լիցենզիայով, առանց տարածաշրջանային սահմանափակումների, և կարելի է տեղական գործարկել vLLM-ով, SGLang-ով կամ Transformers-ով։

Թեստի եզրակացությունը. օգտագործեք GLM-5.2, երբ կարևոր են արժեքը և բաց լինելը, իսկ աշխատանքը հիմնականում տեքստ ու տրամաբանություն է. վճարեք Opus-ի համար, երբ կարևոր են ճշգրտությունը, հղկվածությունը և վիզուալ դատողությունը։ Իսկ GLM-5.2-ը ամեն դեպքում պահեք զինանոցում. ներբեռնված կշիռները ոչ մի մատակարար չի կարող հետ վերցնել։

SSiTech

SiTech — AI-ով հզորացված վեբ մշակում

Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։