
OpenAI-მა GPT-5.6 Sol-ის შეზღუდული გამოცდა დაიწყო
OpenAI-მ გამოაცხადა GPT-5.6-ის ოჯახის — Sol, Terra და Luna — შეზღუდული გამოცდა: ახალი აზროვნების რეჟიმები, გაძლიერებული კიბერუსაფრთხოების დაცვა და ფასები 1 მილიონ ტოკენზე.
OpenAI-მ GPT-5.6 სერიის შეზღუდული გამოცდა დაიწყო: Sol — ფლაგმანური მოდელი; Terra — დაბალანსებული მოდელი ყოველდღიური სამუშაოსთვის, რომელიც კომპანიის თქმით GPT-5.5-ის დონეს ორჯერ იაფად აღწევს; და Luna — სწრაფი და ხელმისაწვდომი მოდელი. კომპანია აცხადებს, რომ ოჯახი ფართოდ ხელმისაწვდომი მომდევნო კვირებში გახდება.
მთავრობასთან კოორდინაცია და ეტაპობრივი წვდომა
OpenAI-ის განცხადებით, გაშვებამდე მან საკუთარი გეგმები და მოდელების შესაძლებლობები აშშ-ის მთავრობას გააცნო და, მთავრობის მოთხოვნით, იწყებს მცირე ჯგუფის სანდო პარტნიორებით, რომელთა მონაწილეობაც ოფიციალურ პირებს ეცნობება. კომპანია აცხადებს, რომ ასეთი სახელმწიფო წვდომის პროცესი გრძელვადიან ნორმად არ უნდა იქცეს, რადგან ის საუკეთესო ხელსაწყოებს ართმევს მომხმარებლებს, დეველოპერებს, კომპანიებს, კიბერდაცვის სპეციალისტებსა და პარტნიორებს. OpenAI ამ ნაბიჯს უფრო ფართო ხელმისაწვდომობის ყველაზე სწრაფ გზად აღწერს, სანამ ადმინისტრაციასთან კიბერუსაფრთხოების განკარგულების ჩარჩოსა და მოდელების გაშვების განმეორებად პროცესზე მუშაობს.
ახალი რეჟიმები და ტესტების შედეგები
GPT-5.6-ში დამატებულია „max“ აზროვნების რეჟიმი, რომელიც Sol-ს მსჯელობისთვის მეტ დროს აძლევს, და „ultra“ რეჟიმი, რომელიც ერთი აგენტის შესაძლებლობებს სცდება და რთული სამუშაოს დასაჩქარებლად ქვეაგენტებს იყენებს. კოდის წერაში, OpenAI-ის თქმით, Sol ახალ სტანდარტს ამყარებს Terminal-Bench 2.1-ზე, რომელიც ბრძანებათა ხაზის სამუშაო ნაკადებს ამოწმებს. გენომიკისა და რაოდენობრივი ბიოლოგიის ხანგრძლივ ტესტზე GeneBench v1 ის GPT-5.5-ს უფრო ცოტა ტოკენით აღემატება. კიბერუსაფრთხოებაში Sol ExploitBench-ზე Mythos Preview-ს ეჯიბრება გამოტანილი ტოკენების მხოლოდ მესამედით, ხოლო ExploitGym-ზე — ბერკლის უნივერსიტეტის მკვლევრების მიერ OpenAI-სა და სხვა ლაბორატორიებთან ერთად შექმნილ ტესტზე — მთელი ოჯახი მკვეთრად უმჯობესდება.
დაცვა, ფასები და გაშვება Cerebras-ზე
OpenAI-ის შეფასებით, Sol არ კვეთს „კრიტიკული კიბერუსაფრთხოების“ ზღვარს მისი Preparedness Framework-ის მიხედვით: Chromium-ისა და Firefox-ის ტესტებში მან აღმოაჩინა ხარვეზები და ექსპლუატაციის ელემენტები, მაგრამ დამოუკიდებლად სრული ჯაჭვის ექსპლოიტი არ შექმნა. გამოცდისას გამოიყენება მრავალშრიანი დაცვა: მოდელში ჩადებული უარები, რეალურ დროში მომუშავე კიბერ- და ბიოლოგიური რისკების კლასიფიკატორები, რომლებსაც შეუძლიათ პასუხის შეჩერება უფრო დიდი მოდელის შემოწმებისთვის, ანგარიშის დონის სიგნალები და დიფერენცირებული წვდომა. ამას ემატება 700 000-ზე მეტი A100-ის ეკვივალენტური GPU საათი ავტომატური წითელი გუნდის ტესტირებისთვის. ფასები 1 მილიონ ტოკენზე: Sol — 5 დოლარი შეყვანა და 30 დოლარი გამოყვანა, Terra — 2,50 და 15, Luna — 1 და 6 დოლარი, პლუს ქეშირების ახალი წესები 30-წუთიანი მინიმალური ვადით. ივლისში Sol ასევე გაეშვება Cerebras-ზე წამში 750 ტოკენამდე სისწრაფით, თავდაპირველად შერჩეული მომხმარებლებისთვის.
SiTech — AI-გაძლიერებული ვებ დეველოპმენტი
ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.