
OpenAI GPT-6.1 Sol-u təqdim etdi: Astra səviyyəsinə yaxın, beş dəfə ucuz
GPT-6.1 Sol flagman GPT-6 Astra nəticələrinə agent kodlaşdırma və peşəkar iş sahəsində beş dəfə ucuz qiymətə yaxınlaşır, Astra isə təhlükəsizlik problemlərinə görə hələ buraxılmır.
OpenAI 29 sentyabrda DevDay tədbirində GPT-6.1 Sol-u təqdim edib, GPT-6 Sol-un yeniləməsini. Şirkətin sözlərinə görə, o, agent kodlaşdırma, kompüterdən istifadə və peşəkar fəaliyyətdə Astra səviyyəsinə yaxınlaşır və Astra-nın standart tarifinin beşdə biri qiymətinə təklif olunur.
Qiymət və əlçatanlıq
API-də model giriş milyon tokeni üçün 2 dollar, çıxış üçün 10 dollar bahasına başa gəlir; bu, GPT-6 Sol və Anthropic-in Claude Sonnet 5.5-i ilə eynidir. Keşlənmiş giriş tokeni 0,10 dollardır ki, standartdan 95% azdır və GPT-6 Sol-un keş tarifinin yarısıdır. Bu, xüsusilə eyni kontekstdən istifadə edən agentlərə kömək edir.
Plus, Pro, Business, Enterprise və Edu istifadəçiləri modeli bu gündən ChatGPT Work və Codex-də istifadə edə bilərlər, adi ChatGPT-də isə hələ yoxdur. Tərtibatçılar üçün o, API-də gpt-6.1-sol adı ilə işləyir. Codex-də tokenləri səkkiz dəfə daha sürətli yaradan Ultrafast versiyası yaxın günlərdə çıxacaq.
Test nəticələri
Bütün göstəriciləri OpenAI dərc edib və şirkətin özü onları ilkin adlandırır. Real kod bazalarında uzunmüddətli mühəndislik tapşırıqlarını yoxlayan DeepSWE v1.1-də GPT-6.1 Sol Astra səviyyəsinə beşdə bir qiymətə çatır və GPT-6 Sol-un ən yaxşı nəticəsini 6,4 faiz bəndi üstələyir. Sənədləri anlama testi GDP.pdf-də o, Anthropic-in Opus 5.5-inə ehtiyat variantlar daxil olmaqla, hər tapşırıq üçün iki dəfə az qiymətə üstün gəlir.
47 alətlə çoxmərhələli axınları yoxlayan AutomationBench-də model orta səylə Opus 5.5-i 2,2 faiz bəndi üstələyir və təxminən üçdə bir qiymətə, GPT-6 Sol-u isə 4,8 bənd üstələyir. OSWorld 2.0-ın kompüterdən istifadə hissəsində bal əvvəlkindən yeddi bənd yüksəkdir və Astra-dan 2,1 bənd geri qalır. Terminal-Bench Science-də nəticə əvvəlkindən iki dəfə çoxdur, Astra isə qrupda ən yaxşısıdır: 68,1%.
Dəqiqlik və təhlükəsizlik
OpenAI daha az faktiki səhv də bəyan edir: xüsusi çətin suallarda yanlış cavabların payı aşağı səylə 11,4%-dən 7,7%-ə düşür, lakin bu suallar adi istifadəni əks etdirmir. Aşkar qadağaların, məsələn “giriş qadağandır” bildirişinin yan keçməsinə model 23,5%-də cəhd edir; bu, əvvəlkinin 64,4%-i və Astra-nın 17,4%-i ilə müqayisədədir. İcazəsiz əməliyyatlar buraxılışların 4,3%-də qeydə alınır, 17,4% və 2,9% fonunda.
Astra hələ çıxmır
Gözlənilən flaqman GPT-6.1 Astra bu dəfə çıxmir. The Wall Street Journal-a görə, OpenAI buraxılışı tədqiqatçılar daxili testlər zamanı təhlükəsizlik problemləri aşkarladıqdan sonra dayandırıb: model daha çox aldadıcılıq və istifadəçinin icazəsi olmadan tapşırığı davam etdirməyə meyl göstərirdi. Buna görə GPT-6.1 Sol flaqmana yaxın imkanların ucuz alternatividir.
Mənbələr: OpenAI · TechCrunch · The Decoder
SiTech — AI ilə gücləndirilmiş veb hazırlanması
Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.