GPT-5.6 Sol — OpenAI'nin Daha Küçük Luna Modelini Otonom Olarak Sonradan Eğiten Modeli
OpenAI'nin yeni GPT-5.6 Sol modeli, daha küçük Luna modelini bağımsız olarak sonradan eğitti — daha önce kıdemli araştırmacılardan oluşan bir ekip gerektiren bir görev.
OpenAI, yeni amiral gemisi modeli GPT-5.6 Sol'ün, daha küçük Luna modelini bağımsız olarak sonradan eğittiğini (post-training) duyurdu. Luna'nın ilk ön eğitiminden sonra Sol, onu belirli beceriler ve davranışlar için kendi başına optimize etti.
GPT-5.6 Sol Tam Olarak Nedir?
"Sol" adı — "Systems Optimization Learner" kısaltması — yalnızca yanıt veren bir modelden kendi gelişim sürecini yönlendirebilen bir modele geçişi simgeliyor.
Otonom Sonradan Eğitim Nasıl Çalıştı?
En şaşırtıcı kısım, araştırmacının kullandığı "oldukça belirsiz komut" idi. Talimatlar şunları içeriyordu:
- Doğru eğitim konfigürasyonlarını bulmak
- Uygun GPU'ları seçmek
- Eğitim betiğini başlatmak
- Her şeyin doğru çalıştığını doğrulamak
Dahili Değerlendirme Mekanizması
OpenAI, gerçek AI araştırma görevlerine dayalı dahili bir değerlendirme paketi oluşturdu. Bu görevler, araştırma sistemlerinde hata ayıklama, çekirdekleri ve eğitim tariflerini optimize etme, makine öğrenimi deneylerini çalıştırma ve başka bir modeli geliştirmeyi içerir.