Վերադառնալ
Qwen3.8-2.4T-A95B՝ Qwen-Max դասի առաջին մոդելը բաց կշիռներով
SiTech Team2 წთ. საკითხავი

Qwen3.8-2.4T-A95B՝ Qwen-Max դասի առաջին մոդելը բաց կշիռներով

Qwen թիմը հրապարակել է Qwen3.8-2.4T-A95B մոդելը՝ 2.4 տրիլիոն պարամետրով փորձագետների խառնուրդ, որն առաջին անգամ Qwen-Max դասի համակարգը հասանելի է դարձնում բաց կշիռներով։

Max դասի առաջին մոդելը բաց թողարկմամբ

Qwen թիմը Hugging Face-ում հրապարակել է Qwen3.8-2.4T-A95B մոդելը և ներկայացնում է այն որպես Qwen-ի բաց մոդելների ընտանիքի ամենաունակավոր սերունդը. սա առաջին դեպքն է, երբ Qwen-Max դասի մոդելը դառնում է բաց հասանելի։ Կշիռները տրամադրվում են Transformers ձևաչափով և համատեղելի են vLLM, SGLang ու TokenSpeed սերվերային լուծումների հետ. քարտը նշում է qwen3.8-max արտոնագիրը և անցյալ ամսվա 55,519 ներբեռնում։

Ճարտարապետորեն սա փորձագետների խառնուրդ է՝ ընդհանուր 2.4 տրիլիոն պարամետր, ակտիվ՝ 95 միլիարդ, բաշխված 92 շերտերի վրա 512 փորձագետով, որոնցից յուրաքանչյուր թոքենի համար գործարկվում են տասը ուղղորդված և մեկ ընդհանուր փորձագետ։ Հերթափոխվում են Gated DeltaNet և Gated Attention բլոկները, իսկ մոդելը մարզվել է բազմաթոքեն կանխատեսմամբ։ Համատեքստի երկարությունը 262,144 թոքեն է՝ ընդարձակելի մինչև 1,010,000։

Հենանիշների արդյունքները

Հրապարակված համեմատությունը Qwen3.8-Max-ին՝ այս կշիռների վրա կառուցված հոսթինգային տարբերակին, կանգնեցնում է Opus 4.8-ի, Fable 5-ի և GPT-5.6 Sol (max)-ի դիմաց։ Այն ստանում է 86.6 Terminal Bench 2.1-ում, 67.7՝ SWE-bench Pro-ում, 56.6՝ DeepSWE 1.1-ում և 93.0՝ PaperBench-ում։ Ընդհանուր ունակություններում նշվում է 92.6՝ GPQA Diamond-ում, 43.6՝ HLE-ում և 82.8՝ IFBench-ում, ինչպես նաև 92.9՝ 256K թոքեն համատեքստով MRCR v2 թեստում։

Առավելությունը համընդհանուր չէ. Fable 5-ը առաջ է մնում SWE-bench Pro-ում՝ 80.0 ընդդեմ 67.7-ի, իսկ GPT-5.6 Sol (max)-ը Terminal Bench 2.1-ում գրանցում է 88.8՝ Qwen-ի 86.6-ի դիմաց։

Միայն տեքստ և անջատելի չէ մտածողությունը

Հրապարակված մոդելը տեքստային է և յուրաքանչյուր փոխազդեցության համար պահանջում է մտածողության ռեժիմ. բազմամոդալ մուտքը չի աջակցվում, իսկ մտածողությունը հնարավոր չէ անջատել, ուստի յուրաքանչյուր պատասխան սկսվում է think պիտակներով շրջանակված դատողությամբ։ Մտածողության խորությունը կարգավորվում է reasoning_effort պարամետրով, իսկ preserve_thinking-ը պահպանում է նախորդ հաղորդագրությունների դատողության համատեքստը և լռելյայն միացված է բոլոր աշխատանքների համար։ Գործակալային աշխատանքի համար քարտը խորհուրդ է տալիս հատկացնել մինչև 262,144 ելքային թոքեն դատողությանը և 131,072՝ վերջնական պատասխանին։

Max անվանումը վերաբերում է հոսթինգային տարբերակին. թիմի խոսքով՝ Qwen3.8-Max-ը բաց կշիռների վրա ավելացնում է տեսողական մուտք, առանց մտածողության ռեժիմ, 1M համատեքստ՝ լռելյայն, և պաշտոնական ներկառուցված գործիքներ։

SSiTech

SiTech — AI-ով հզորացված վեբ մշակում

Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։