Վերադառնալ
OpenAI-ը սկսել է GPT-5.6 Sol, Terra և Luna մոդելների սահմանափակ փորձարկումը
SiTech AI Team2 წთ. საკითხავი

OpenAI-ը սկսել է GPT-5.6 Sol, Terra և Luna մոդելների սահմանափակ փորձարկումը

OpenAI-ը մեկնարկել է GPT-5.6 ընտանիքի՝ Sol, Terra և Luna մոդելների սահմանափակ փորձարկումը՝ մտածողության նոր ռեժիմներով, ուժեղացված կիբերպաշտպանությամբ և միլիոն մուտքային թոքենի համար 1 դոլարից սկսվող գներով։

OpenAI-ը սկսել է GPT-5.6 շարքի սահմանափակ փորձարկումը. Sol՝ ֆլագման մոդելը, Terra՝ առօրյա աշխատանքի համար հավասարակշռված մոդելը, որը ընկերության խոսքով հասնում է GPT-5.5-ի մակարդակին կրկնակի ցածր գնով, և Luna՝ արագ ու մատչելի մոդելը։ Ընկերությունը նախատեսում է ընտանիքը լայնորեն հասանելի դարձնել առաջիկա շաբաթներին։

Համակարգում կառավարության հետ և փուլային հասանելիություն

Ըստ OpenAI-ի՝ մեկնարկից առաջ ընկերությունը ներկայացրել է իր ծրագրերն ու մոդելների հնարավորությունները ԱՄՆ կառավարությանը և, նրա պահանջով, սկսում է վստահելի գործընկերների փոքր խմբից, որոնց մասնակցությունը հայտնվել է պաշտոնյաներին։ Ընկերությունը նշում է, որ կառավարության հասանելիության նման գործընթացը չպետք է դառնա երկարաժամկետ կանոն, քանի որ այն լավագույն գործիքներից զրկում է օգտատերերին, ծրագրավորողներին, ձեռնարկություններին, կիբերպաշտպաններին և գործընկերներին։ Այս քայլը ներկայացվում է որպես ավելի լայն հասանելիության ամենաարագ ուղին, քանի դեռ աշխատանքը վարչակազմի հետ շարունակվում է կիբեր հրամանագրի շրջանակի և մոդելների թողարկման կրկնվող գործընթացի վրա։

Մտածողության նոր ռեժիմներ և թեստերի արդյունքներ

GPT-5.6-ը ներկայացնում է «max» մտածողության նոր ռեժիմ, որը Sol-ին ավելի շատ ժամանակ է տալիս մտածելու համար, և «ultra» ռեժիմ, որը դուրս է գալիս մեկ ագենտի սահմաններից՝ բարդ աշխատանքը արագացնելու համար օգտագործելով ենթաագենտներ։ Կոդ գրելու ոլորտում Sol-ը, ըստ OpenAI-ի, նոր չափանիշ է սահմանում Terminal-Bench 2.1-ում, որը ստուգում է հրամանի տողի աշխատանքային հոսքերը։ Գենոմիկայի և քանակական կենսաբանության երկարաժամկետ GeneBench v1 թեստում այն գերազանցում է GPT-5.5-ին՝ օգտագործելով ավելի քիչ թոքեններ։ Կիբերանվտանգության ոլորտում Sol-ը ExploitBench-ում մրցակցում է Mythos Preview-ի հետ՝ օգտագործելով ելքային թոքենների ընդամենը մեկ երրորդը, իսկ ամբողջ ընտանիքը նշանակալի առաջընթաց է ցույց տալիս ExploitGym-ում՝ UC Berkeley-ի հետազոտողների կողմից OpenAI-ի և այլ լաբորատորիաների հետ ստեղծված թեստում։

Պաշտպանություն, գներ և մեկնարկ Cerebras-ում

OpenAI-ը նշում է, որ Sol-ը չի անցնում Cyber Critical շեմը իր Preparedness Framework-ի շրջանակում. Chromium-ի և Firefox-ի գնահատումներում այն գտել է վրիպակներ և շահագործման տարրեր, սակայն ինքնուրույն ամբողջական շղթայական էքսպլոյտ չի ստեղծել։ Փորձարկման ընթացքում կիրառվում են բազմաշերտ պաշտպանություններ՝ մոդելում ներկառուցված մերժումներ, իրական ժամանակում աշխատող կիբեր և կենսաբանական չարաշահման դասակարգիչներ, որոնք կարող են կանգնեցնել պատասխանը՝ ավելի մեծ մոդելի ստուգման համար, հաշվի մակարդակի ազդանշաններ և տարբերակված հասանելիություն, ինչպես նաև ավելի քան 700 000 A100-համարժեք GPU ժամ՝ ունիվերսալ jailbreak-ների դեմ ավտոմատ կարմիր թիմային աշխատանքի համար։ Գները միլիոն թոքենի դիմաց՝ Sol՝ 5 դոլար մուտք և 30 դոլար ելք, Terra՝ 2,50 և 15, Luna՝ 1 և 6 դոլար, գումարած արագ քեշի հստակ կետեր և նվազագույնը 30 րոպե քեշի կյանք։ Հուլիսին Sol-ը կմեկնարկի նաև Cerebras-ում՝ վայրկյանում մինչև 750 թոքեն արագությամբ, սկզբում ընտրված հաճախորդների համար։

SSiTech

SiTech — AI-ով հզորացված վեբ մշակում

Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։