GPT-5.6 Sol — модель OpenAI, яка автономно донавчила меншу модель Luna
Нова модель OpenAI GPT-5.6 Sol самостійно виконала пост-тренування меншої моделі Luna — завдання, яке раніше вимагало команди старших дослідників.
OpenAI оголосила, що їхня нова флагманська модель GPT-5.6 Sol самостійно виконала пост-тренування меншої моделі Luna. Після початкового попереднього тренування Luna, Sol оптимізував її для певних навичок та поведінок власними силами.
Що саме таке GPT-5.6 Sol?
Назва "Sol" — скорочення від "Systems Optimization Learner" — символізує перехід від моделі, яка просто відповідає, до моделі, яка може керувати власним процесом вдосконалення.
Як працювало автономне пост-тренування?
Найдивовижніша частина — "досить неспецифічний запит", який використав дослідник. Інструкції включали:
- Знаходження правильних конфігурацій тренування
- Вибір відповідних графічних процесорів
- Запуск скрипту тренування
- Перевірку, що все працює правильно
Внутрішній механізм оцінювання
OpenAI створила внутрішній набір оцінювання на основі реальних дослідницьких завдань ШІ. Ці завдання включають налагодження дослідницьких систем, оптимізацію ядер та рецептів тренування, проведення експериментів з машинним навчанням та вдосконалення іншої моделі.