
GLM-5.2 проти Opus: очне порівняння на одній збірці 3D-гри
GLM-5.2 від Z.ai виходить із відкритими вагами, контекстом на 1 млн токенів і ціною виводу вп'ятеро нижчою за Opus; у паралельній збірці гри на WebGL Opus завершив удвічі швидше й чистіше.
GLM-5.2 — нова флагманська модель Z.ai: відкриті ваги за ліцензією MIT, контекстне вікно на 1 мільйон токенів і два рівні міркування, High і Max. Він створений для довготривалих завдань із кодування та агентної роботи, і він суто текстовий — зображення читати не вміє. Щоб перевірити, що це означає на практиці, Tech Stackups порівняв його з Claude Opus 4.8 за одним і тим самим одноразовим запитом: з нуля збудувати 3D-платформер на чистому WebGL, без ігрового рушія та 3D-бібліотеки.
Цифри прямого порівняння
Обидві моделі отримали той самий набір CC0-активів від Kenney і одну спробу без підказок. GLM-5.2, запущений у Pi через OpenRouter, витратив 1 годину 10 хвилин 40 секунд і 128 викликів інструментів, видав 131 тисячу вихідних токенів і досяг 16 відсотків контексту; запуск реально коштував 5,39 долара. Opus 4.8 у Claude Code з розширеним міркуванням на рівні high завершив за 33 хвилини 30 секунд, використав 153 виклики та 216 809 токенів, а його вартість оцінили приблизно у 21,92 долара за прайс-листом.
Що збудувала кожна модель
Обидві гри — платформери від третьої особи з однаковим керуванням: рух на WASD або стрілках, стрибок на пробіл, біг на shift, обертання камери мишею. Версія GLM-5.2 вийшла грубою: персонаж рендериться пласким сірим, бо рушій не завантажив спільний файл палітри, на який посилаються моделі Kenney, голова зникає під час руху камери, смертельні шипи нічого не роблять, а налагоджувальний шар залишився на екрані. Добре працювала лише механіка запуску з пружини.
Гра Opus вийшла чистішою: текстури й анімації накладені правильно, контролер і камера працюють, шипи вбивають персонажа, а умова перемоги справжня. Його помилки — крайові випадки: пільговий час після сходу з платформи налаштований так щедро, що персонаж стоїть у повітрі поряд із платформою, а перемога спрацьовує, коли до прапора ще далеко.
Самоперевірка
Обидві моделі мали перевірити свою роботу. Opus прочитав скриншот сцени й прибрав залишкові налагоджувальні написи; суто текстовий GLM-5.2 перевіряв лише кольори пікселів і не побачив, що персонаж сірий.
Бенчмарки й ціна
За карткою моделі від Z.ai, GLM-5.2 лідирує в частині тестів на міркування: 99,2 на AIME 2026 і 91,0 на IMOAnswerBench проти 95,7 і 83,5 в Opus 4.8, але більшість рядків із кодування та агентних завдань забирає Opus — 69,2 проти 62,1 на SWE-bench Pro та 69,7 проти 48,9 на NL2Repo. Artificial Analysis незалежно визнала GLM-5.2 провідною моделлю з відкритими вагами в Intelligence Index із оцінкою 51, але зауважила, що модель витрачає близько 43 тисяч вихідних токенів на завдання — проти 26 тисяч у GLM-5.1.
Головне — різниця в ціні: за мільйон токенів GLM-5.2 коштує 1,40 долара на вході та 4,40 на виході проти 5 і 25 доларів в Opus 4.8. Ваги доступні на Hugging Face і ModelScope за ліцензією MIT, без регіональних обмежень, і їх можна запускати локально через vLLM, SGLang або Transformers.
Висновок тесту: використовуйте GLM-5.2, коли важливі ціна й відкритість, а робота переважно текстова та логічна; платіть за Opus, коли мають значення точність, якість і візуальне судження. І тримайте GLM-5.2 напоготові незалежно від усього — ваги, які можна завантажити, жоден постачальник не може відібрати.
SiTech — веброзробка з підтримкою AI
Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.