Назад
Qwen3.8-2.4T-A95B: перша відкрита модель класу Qwen-Max
SiTech Team2 წთ. საკითხავი

Qwen3.8-2.4T-A95B: перша відкрита модель класу Qwen-Max

Команда Qwen опублікувала Qwen3.8-2.4T-A95B — модель-мікс експертів на 2,4 трильйона параметрів, яка вперше відкриває систему класу Qwen-Max, із контекстом на 262 тис. токенів.

Перша модель класу Max у відкритому доступі

Команда Qwen опублікувала на Hugging Face модель Qwen3.8-2.4T-A95B, назвавши її найздібнішим поколінням у відкритій родині моделей Qwen і першим випадком, коли модель класу Qwen-Max випускають у відкритому доступі. Ваги постачаються у форматі Transformers і сумісні з такими серверними стеками, як vLLM, SGLang і TokenSpeed; картка моделі вказує ліцензію qwen3.8-max і 55 519 завантажень за минулий місяць.

Архітектурно це суміш експертів: 2,4 трильйона параметрів загалом і 95 мільярдів активних, розподілених на 92 шари з 512 експертами, з яких на кожен токен спрацьовують десять маршрутизованих і один спільний експерт. Стек по черзі використовує блоки Gated DeltaNet і Gated Attention, а модель тренували з багатотокенним передбаченням. Довжина контексту — 262 144 токени, з розширенням до 1 010 000.

Результати бенчмарків

Опубліковане порівняння ставить Qwen3.8-Max — хостингову версію на цих вагах — проти Opus 4.8, Fable 5 і GPT-5.6 Sol (max). Вона набирає 86,6 на Terminal Bench 2.1, 67,7 на SWE-bench Pro, 56,6 на DeepSWE 1.1 і 93,0 на PaperBench. Серед загальних можливостей заявлено 92,6 на GPQA Diamond, 43,6 на HLE і 82,8 на IFBench, а також 92,9 на тесті пошуку MRCR v2 з контекстом 256K токенів.

Перевага не є тотальною. Fable 5 залишається попереду на SWE-bench Pro — 80,0 проти 67,7, а GPT-5.6 Sol (max) показує 88,8 на Terminal Bench 2.1 проти 86,6 у Qwen.

Лише текст, і міркування не вимкнути

Опублікована версія — текстова й вимагає режиму міркування для кожної взаємодії: мультимодальне введення не підтримується, а міркування не можна вимкнути, тож кожна відповідь починається з роздумів у think-тегах перед фінальним результатом. Глибину міркувань регулює параметр reasoning_effort, а preserve_thinking зберігає контекст роздумів із попередніх повідомлень і типово увімкнений для всіх навантажень. Для агентних задач картка радить виділяти до 262 144 вихідних токенів на міркування та 131 072 на фінальну відповідь.

Назва Max стосується хостингової збірки: за словами команди, Qwen3.8-Max додає поверх відкритих ваг візуальне введення, режим без міркувань, контекст 1M за замовчуванням і офіційні вбудовані інструменти.

SSiTech

SiTech — веброзробка з підтримкою AI

Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.