Z.ai-ը ներկայացրել է GLM-5.3-Flash-ը՝ ֆրոնտիեր մակարդակ մեկ տասներորդ գնով

Չինական Z.ai-ը ներկայացրել է GLM-5.3-Flash-ը՝ 320 միլիարդ պարամետրով մուլտիմոդալ մոդել, որից ակտիվ է ընդամենը 18 միլիարդը։ Այն GLM-5.2-ին գերազանցում է տաս անգամ ցածր գնով և մոտենում Claude Opus 4.8-ին կոդավորման մեջ։
Ինչ տեղի ունեցավ
Օգոստոսի 26-ին չինական Z.ai արհեստական բանականության լաբորատորիան ներկայացրեց GLM-5.3-Flash-ը՝ GLM-5 շարքի առաջին բուն մուլտիմոդալ մոդելը։ Այն ունի 320 միլիարդ ընդհանուր, բայց ընդամենը 18 միլիարդ ակտիվ պարամետր մեկ թոքենի համար։ Նախորդ GLM-5.2-ին գերազանցում է թեստերում մոտավորապես մեկ տասներորդ գնով և մոտենում է Claude Opus 4.8-ին կոդի ու գործակալային առաջադրանքներում։
Արխիտեկտուրա էժան ինֆերենսի համար
Մոդելը համատեղում է sparse և linear ուշադրության մեխանիզմները հիբրիդային լուծմամբ և օգտագործում Manifold-Constrained Hyper-Connections (mHC) տեխնիկան։ GLM-4.5 շարքի համեմատ շերտերի թիվը գրեթե կրկնակի կրճատվել է (45՝ 92-ի դիմաց), ինչի շնորհիվ սպասարկման ծախսերը ցածր են մնում նույնիսկ մեկ միլիոն թոքենի կոնտեքստում։
Թվեր և անանուն փորձարկում
Թողարկումից առաջ մոդելը անանուն աշխատել է «ox-alpha» անվան տակ OpenCode և OpenRouter հարթակներում՝ դառնալով շաբաթվա ամենահայտնի մոդելը, ընդ որում ամբողջ տրաֆիկը սպասարկվել է չինական AI չիպերով։ Artificial Analysis Intelligence Index v4.1.1-ում այն հավաքում է 57 միավոր՝ մոտ 0,045 դոլար մեկ առաջադրանքի համար, իսկ DeepSWE v1.1-ում՝ 63,4՝ GLM-5.2-ի 46,2-ի դիմաց։
Ինչու է դա կարևոր
Frontier և բյուջետային մոդելների միջև տարբերությունը շարունակում է կրճատվել. առաջատար կոդավորումն ու գործակալային հնարավորությունները գնի մի մասի դիմաց փոխում են այն, ինչ իրականում հնարավոր է ավտոմատացնել։