
GPT-6 Sol və Claude Opus 5.5: nəticə sabit deyilsə, ucuzluq nə qazandırır
The New Stack OpenAI-nin GPT-6 Sol və Anthropic-in Claude Opus 5.5 modellərini üç çətin developer testində beş dəfə yoxlayıb. Sol təxminən altı dəfə ucuz başa gəlib, lakin 15 cəhdin üçündə səhv edib, Opus 5.5 isə hamısında qüsursuz olub.
OpenAI GPT-6 Sol-u 22 sentyabr 2026-cı ildə buraxıb və biznes iş axınlarında onun Claude Opus 5-i bir tapşırığın xərcinin 9%-nə üstələdiyini iddia edir: Sol Zapier-in AutomationBench testində 33,2%, Opus 5 isə 26,9% toplayır. Həmin gün Anthropic Claude Opus 5.5-i buraxdığı üçün The New Stack-dən Jessica Wachtel testi bu modelə qarşı aparıb.
Qiymət siyahısına görə Sol milyon giriş tokeni üçün 2 dollar, milyon çıxış tokeni üçün 10 dollar tələb edir; bu GPT-5.6 Sol-un yarı qiymətidir. Claude Opus 5.5 isə 4 və 20 dollardır. Yəni Sol daha çox token xərcləsə də, yenə ucuz başa gələ bilər.
Üç test, hər biri beş cəhd
Birinci mərhələ heç-heçə bitdi: hər iki model Python ilə yazılmış ödəniş servisinə yerləşdirilmiş üç xətanı tapdı, 40 uğursuz CI işini təsnif etdi və saxta SDK haqqında 20 suala heç bir metod uydurmadan cavab verdi. Daha çətin variantlar, 3 664 sətirlik qəza hesabatı və 120 gizli testlə qiymətləndirilən spesifikasiya tətbiqi də bərabər bitdi. Modelləri yalnız təkrar cəhdlər ayırdı.
Hər iki model eyni sorğularla və özünün ən yüksək səy səviyyəsində API vasitəsilə çağırıldı, hər test beş dəfə təkrarlandı. CI təsnifatında model 40 uğursuz iş üçün yenidən cəhd, bloklama və ya növbətçi çağırma qərarı verir; qəza jurnalları beş servisdən gələn 3 664 sətri və yeddi sualı əhatə edir; həlledici spesifikasiyası isə iki səhifəlik mətndən kod işlətmədən asılılıq həlledicisi yazmağı tələb edir.
Rəqəmlər nə göstərir
OpenAI-nin iddiasına ən yaxın test olan CI təsnifatında hər iki model 5-dən 5 etdi. Opus 5.5 bir cəhddə ortalama 1 dəqiqə 27 saniyə, 11 127 çıxış tokeni və 0,24 dollar xərclədi; Sol isə 18 saniyə, 1 143 token və 0,02 dollar, yəni xərcin 8%-i. Bu, OpenAI-nin reklam etdiyi 9% ilə üst-üstə düşür.
Qəza jurnallarında mənzərə dəyişdi: Opus 5.5 beş cəhdin hamısında qüsursuz idi, Sol yalnız ikisində. Sol iki dəfə eyni müştərini buraxdı; həmin müştərinin ödənişi uğurlu təkrar cəhddən 52 saniyə sonra təsdiqlənmişdi. Bir cəhddə də 28 yerinə 27 uğursuz ödəniş saydı. Opus 5.5 ortalama 6 dəqiqə 44 saniyə, 53 308 çıxış tokeni və 1,68 dollar xərclədi; Sol 1 dəqiqə 41 saniyə, 7 073 token və 0,30 dollar, eyni jurnalı 25% az giriş tokeni ilə oxudu.
Həlledici spesifikasiyasında Opus 5.5 bütün cəhdləri, Sol beşdən dördünü keçdi: 78-ci sətirdə artıq bağlayıcı mötərizə modulu idxal zamanı çökdürdü və 120 testin hamısı uğursuz oldu. Opus 5.5 ortalama 9 dəqiqə 40 saniyə, 70 687 çıxış tokeni və 1,42 dollar xərclədi; Sol 6 dəqiqə 28 saniyə, 21 435 token və 0,22 dollar.
Daha ucuz, amma həmişə doğru deyil
15 cəhdin hamısında Opus 5.5 qüsursuz idi, Sol 12 dəfə. Sol-un 15 cəhdi cəmi 2,68 dollar başa gəldi, yəni Opus 5.5-in 16,72 dollarının təxminən 16%-i. Wachtel istifadəni səhvin qiymətinə görə bölür: nəticəni insanın və ya test dəstinin yoxladığı yüksək həcmli işlərdə Sol uyğundur və bu qiymətlərlə onu iki dəfə işlədib müqayisə etmək mümkündür; səhvin baha başa gəldiyi və heç kimin yoxlamadığı hallarda isə Opus 5.5. Sol-un səhvləri yoxlamadan yan keçən tiplərdir: qaytarma siyahısından düşən müştəri və ya idxal olunmayan fayl.
SiTech — AI ilə gücləndirilmiş veb hazırlanması
Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.