GPT-5.6 Sol — OpenAI-ի մոդելը, որն ինքնուրույն հետվարժեցրել է Luna փոքր մոդելը
OpenAI-ի նոր GPT-5.6 Sol մոդելը ինքնուրույն հետվարժեցրել է Luna փոքր մոդելը՝ առաջադրանք, որը նախկինում պահանջում էր ավագ հետազոտողների թիմ:
OpenAI-ն հայտարարեց, որ իր նոր դրոշակակիր մոդելը՝ GPT-5.6 Sol-ը, ինքնուրույն իրականացրել է Luna փոքր մոդելի հետվարժեցումը: Luna-ի նախնական վարժեցումից հետո Sol-ն այն օպտիմալացրել է որոշակի հմտությունների և վարքագծի համար:
Ի՞նչ է GPT-5.6 Sol-ը
«Sol» անվանումը՝ «Systems Optimization Learner»-ի հապավումը, խորհրդանշում է անցումը պարզապես պատասխանող մոդելից այն մոդելի, որը կարող է ղեկավարել սեփական բարելավման գործընթացը:
Ինչպե՞ս աշխատեց ինքնավար հետվարժեցումը
Ամենազարմանալին հետազոտողի օգտագործած «ոչ լրիվ որոշակի հուշումն» է: Հրահանգները ներառում էին՝
- Ճիշտ վարժեցման կոնֆիգուրացիաների գտնելը
- Համապատասխան GPU-ների ընտրությունը
- Վարժեցման սկրիպտի գործարկումը
- Ամեն ինչի ճիշտ աշխատելու ստուգումը
Ներքին գնահատման մեխանիզմ
OpenAI-ն կառուցել է ներքին գնահատման համակարգ՝ հիմնված իրական AI հետազոտական առաջադրանքների վրա: Այս առաջադրանքները ներառում են հետազոտական համակարգերի debug անելը, միջուկների և վարժեցման բաղադրատոմսերի օպտիմալացումը: