Geri qayıt
Qwen3.8-2.4T-A95B: Qwen-Max sinfindən açıq çəkilərlə ilk model
SiTech Team2 წთ. საკითხავი

Qwen3.8-2.4T-A95B: Qwen-Max sinfindən açıq çəkilərlə ilk model

Qwen komandası 2,4 trilyon parametrli ekspert qarışığı modeli Qwen3.8-2.4T-A95B-ni yayımlayıb. Qwen-Max sinfindən bir sistem ilk dəfə açıq çəkilərlə təqdim olunur; kontekst pəncərəsi 262 min tokendir.

Açıq buraxılışda ilk Max sinfindən model

Qwen komandası Hugging Face-də Qwen3.8-2.4T-A95B modelini yayımlayıb və onu Qwen-in açıq modellər ailəsinin indiyədək ən bacarıqlı nəsli adlandırır; bu, Qwen-Max sinfindən bir modelin ilk dəfə açıq şəkildə buraxılması deməkdir. Çəkilər Transformers formatındadır və vLLM, SGLang, TokenSpeed kimi server həlləri ilə uyğundur. Model kartında qwen3.8-max lisenziyası və ötən ay üçün 55.519 endirmə göstərilib.

Arxitektura baxımından bu, ekspert qarışığıdır: cəmi 2,4 trilyon parametr, onlardan 95 milyardı aktivdir; 512 ekspertli 92 qat üzrə bölünüb və hər token üçün on yönləndirilmiş və bir ümumi ekspert işə düşür. Yığın növbəli olaraq Gated DeltaNet və Gated Attention bloklarından istifadə edir, model isə çox-tokenli proqnozla öyrədilib. Kontekst uzunluğu təbii olaraq 262.144 tokendir və 1.010.000-ə qədər genişləndirilə bilər.

Benchmark nəticələri

Yayımlanan müqayisə bu çəkilər üzərində qurulmuş hostinq versiyası Qwen3.8-Max-ı Opus 4.8, Fable 5 və GPT-5.6 Sol (max) ilə üz-üzə qoyur. Model Terminal Bench 2.1-də 86,6; SWE-bench Pro-da 67,7; DeepSWE 1.1-də 56,6 və PaperBench-də 93,0 bal toplayır. Ümumi bacarıqlarda GPQA Diamond üzrə 92,6; HLE üzrə 43,6 və IFBench üzrə 82,8, həmçinin 256K token kontekstli MRCR v2 testində 92,9 göstərilir.

Üstünlük hər yerdə deyil: Fable 5 SWE-bench Pro-da 80,0 ilə 67,7 öndə qalır, GPT-5.6 Sol (max) isə Terminal Bench 2.1-də Qwen-in 86,6-sına qarşı 88,8 bal yığır.

Yalnız mətn və söndürülə bilməyən düşünmə

Buraxılan model mətn əsaslıdır və hər qarşılıqlı əlaqə üçün düşünmə rejimi tələb edir: multimodal giriş dəstəklənmir, düşünmə isə söndürülə bilməz, buna görə hər cavab yekun çıxışdan əvvəl think teqləri içində mühakimə ilə başlayır. Düşünmə dərinliyi reasoning_effort parametri ilə tənzimlənir, preserve_thinking isə əvvəlki mesajlardakı mühakimə kontekstini saxlayır və bütün iş yükləri üçün standart olaraq aktivdir. Agent işləri üçün kart mühakiməyə 262.144, yekun cavaba isə 131.072 çıxış tokeni ayırmağı tövsiyə edir.

Max adı hostinq versiyasına aiddir: komandaya görə Qwen3.8-Max açıq çəkilərin üzərinə vizual giriş, düşünməsiz rejim, standart 1M kontekst və rəsmi daxili alətlər əlavə edir.

SSiTech

SiTech — AI ilə gücləndirilmiş veb hazırlanması

Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.