Վերադառնալ
SiTech Team⏱️ 1 წთ. საკითხავი

Z.ai-ը ներկայացրել է GLM-5.3-Flash-ը՝ ֆրոնտիեր մակարդակ մեկ տասներորդ գնով

Z.ai-ը ներկայացրել է GLM-5.3-Flash-ը՝ ֆրոնտիեր մակարդակ մեկ տասներորդ գնով

Չինական Z.ai-ը ներկայացրել է GLM-5.3-Flash-ը՝ 320 միլիարդ պարամետրով մուլտիմոդալ մոդել, որից ակտիվ է ընդամենը 18 միլիարդը։ Այն GLM-5.2-ին գերազանցում է տաս անգամ ցածր գնով և մոտենում Claude Opus 4.8-ին կոդավորման մեջ։

Ինչ տեղի ունեցավ

Օգոստոսի 26-ին չինական Z.ai արհեստական բանականության լաբորատորիան ներկայացրեց GLM-5.3-Flash-ը՝ GLM-5 շարքի առաջին բուն մուլտիմոդալ մոդելը։ Այն ունի 320 միլիարդ ընդհանուր, բայց ընդամենը 18 միլիարդ ակտիվ պարամետր մեկ թոքենի համար։ Նախորդ GLM-5.2-ին գերազանցում է թեստերում մոտավորապես մեկ տասներորդ գնով և մոտենում է Claude Opus 4.8-ին կոդի ու գործակալային առաջադրանքներում։

Արխիտեկտուրա էժան ինֆերենսի համար

Մոդելը համատեղում է sparse և linear ուշադրության մեխանիզմները հիբրիդային լուծմամբ և օգտագործում Manifold-Constrained Hyper-Connections (mHC) տեխնիկան։ GLM-4.5 շարքի համեմատ շերտերի թիվը գրեթե կրկնակի կրճատվել է (45՝ 92-ի դիմաց), ինչի շնորհիվ սպասարկման ծախսերը ցածր են մնում նույնիսկ մեկ միլիոն թոքենի կոնտեքստում։

Թվեր և անանուն փորձարկում

Թողարկումից առաջ մոդելը անանուն աշխատել է «ox-alpha» անվան տակ OpenCode և OpenRouter հարթակներում՝ դառնալով շաբաթվա ամենահայտնի մոդելը, ընդ որում ամբողջ տրաֆիկը սպասարկվել է չինական AI չիպերով։ Artificial Analysis Intelligence Index v4.1.1-ում այն հավաքում է 57 միավոր՝ մոտ 0,045 դոլար մեկ առաջադրանքի համար, իսկ DeepSWE v1.1-ում՝ 63,4՝ GLM-5.2-ի 46,2-ի դիմաց։

Ինչու է դա կարևոր

Frontier և բյուջետային մոդելների միջև տարբերությունը շարունակում է կրճատվել. առաջատար կոդավորումն ու գործակալային հնարավորությունները գնի մի մասի դիմաց փոխում են այն, ինչ իրականում հնարավոր է ավտոմատացնել։

📖 Աղբյուր