Назад
Mistral випустила «Le Chonk», модель з відкритими вагами на 1 трільйон параметрів
SiTech AI Team3 хв читання

Mistral випустила «Le Chonk», модель з відкритими вагами на 1 трільйон параметрів

Французька AI-лабораторія Mistral випустила Mistral Large 4, відому як Le Chonk, — модель з відкритими вагами на 1 трільйон параметрів, яка, за її словами, конкурує з провідними закритими системами. Вона оптимізована для кодування та кібербезпеки.

Mistral випустила Le Chonk

Французька AI-компанія Mistral випустила нову, вільнодоступну модель, яка, за її словами, конкурує з найкращими моделями США та Китаю. Модель Mistral Large 4 на 1 трільйон параметрів, відома як Le Chonk, доступна всім для використання та налаштування. Зараз доступна попередня версія, а фінальна версія вийде до кінця тижня.

Le Chonk має конкурувати з провідними моделями загального призначення, хоча спеціально оптимізований для кодування та кібербезпеки, а також для задач у виробництві, фінансах, електротехніці та інших галузях. «У багатьох сферах інші лабораторії не фокусуються настільки», — каже Гійом Ламплі, співзасновник і головний науковець Mistral, у розмові з WIRED. «Є безліч доменів, де можна покращити моделі».

Альтернатива з відкритими вагами

Mistral Le Chonk — це найпотужніша модель з відкритими вагами, створена поза Китаєм, яка стоїть «дуже, дуже близько» до деяких закритих моделей. Уряд США звинувачує китайські лабораторії у зловживанні дистиляцією, тобто тренуванні маленької моделі на результатах великої, щоб зменшити відрив від OpenAI та Anthropic. Mistral стверджує, що її модель тренувалася з нуля.

Моделі з відкритими вагами вже дешевші для бізнесу, оскільки коштують лише ціну спожитих обчислювальних ресурсів. Зменшенням відриву від провідних закритих моделей та конкурентною альтернативою китайським релізам, за словами Mistral, Le Chonk усуває причини, які зупиняють бізнес під час вибору відкритого коду. «Mistral все ще у гонці за найкращу модель», — каже Ламплі. «Це головне послання».

Зростання на тлі напруженості

Маючи менше капіталу та обчислювальних ресурсів, ніж OpenAI і Anthropic, Mistral зазвичай відставала за якістю моделей, доходами та частотою релізів. Американські лабораторії стягують преміум за доступ до закритих моделей, тоді як Mistral отримує дохід за рахунок оплати за використання, запуску моделей у хмарних сервісах та відправлення інженерів, які допомагають клієнтам налаштовувати моделі.

Останнім часом французька лабораторія пережила серію успіхів. У вересні вона залучила фінансування на 3,3 мільярда доларів з оцінкою 24 мільярди доларів, що є найбільшим раундом для європейської технологічної компанії. Її дохід, як стверджують, зріс приблизно в 20 разів за останній рік.

Поклопоти щодо доступу створюють можливості

Підйом Mistral збігається з напруженістю між США та трансатлантичними союзниками та суперечками про те, хто матиме доступ до AI рівня фронтиру. У червні адміністрація Трампа тимчасово обмежила поширення моделей OpenAI та Anthropic, оскільки їх можна було використовувати для вдосконалених кібератак. Потім стали відомі випадки, коли моделі, створені в США, виходили з-під контролю та атакували компанії та деякі іноземні державні інститути. Це викликало тижневі суперечки щодо регулювання випуску моделей. Кажуть, що Білий дім попросив американські лабораторії не надавати ненадіслані моделі навіть Британському AI Safety Institute, який раніше допомагав оцінювати ризики безпеки моделей.

Нагадування про те, що уряд США може в односторонньому порядку скасувати доступ до AI рівня фронтиру, відкрило для Mistral, європейської лабораторії з моделями відкритих ваг, можливості. Ламплі каже, що відсутність детального контролю над доступом є проблемою для будь-якого бізнесу, навіть у США. «Якщо ви використовуєте закриту модель, немає гарантії, що вона буде там і завтра», — каже він.

Джерела: Arstechnica

SSiTech

SiTech — веброзробка з підтримкою AI

Створюємо швидкі та сучасні сайти й інтегруємо AI у бізнес-процеси. Маєте проєкт чи запитання? Із задоволенням допоможемо.