Վերադառնալ
Anthropic-ը ներկայացրել է Claude Opus 5.5-ը՝ 40%-ով ավելի էժան Opus 5-ից
SiTech AI Team3 წთ. საკითხავი

Anthropic-ը ներկայացրել է Claude Opus 5.5-ը՝ 40%-ով ավելի էժան Opus 5-ից

Anthropic-ը սեպտեմբերի 22-ին ներկայացրել է Claude Opus 5.5-ը՝ նոր Claude 5.5 ընտանիքի առաջին մոդելը։ Ընկերության փոխանցմամբ՝ այն աշխատանքի մեծ մասում հասնում է Claude Fable 5.1-ի մակարդակին, իսկ շահագործման արժեքը 40%-ով ցածր է Opus 5-ից։

Anthropic-ը սեպտեմբերի 22-ին ներկայացրել է Claude Opus 5.5-ը՝ նոր Claude 5.5 ընտանիքի առաջին մոդելը։ Ընկերության փոխանցմամբ՝ այն աշխատանքի մեծ մասում հասնում է Claude Fable 5.1-ի մակարդակին, իսկ շահագործման արժեքը 40%-ով ցածր է Opus 5-ից։

Արտադրողականություն և գին

Ըստ Anthropic-ի՝ վաղ թեստավորողները բարդ աշխատանքներում մեծ առաջընթաց են տեսել։ Մեկը 680 000 տողանոց կոդի միգրացիան ավարտել է մեկ օրից պակաս ժամանակում՝ աշխատանք, որը, ընկերության գնահատմամբ, ինժեներական թիմին շաբաթներ կպահանջեր։ Վեբ հավելվածի բոլոր էջերի բեռնման ժամանակը կրճատելու առաջադրանքում Opus 5.5-ը հաջողության է հասել 40 դեպքից 39-ում, մինչդեռ Opus 5-ը կատարել է ավելի փոքր բարելավումներ, որոնք փոխել են նաև հավելվածի վարքը։

Քեշի ընթերցումը, որը, ըստ ընկերության, կազմում է գործակալային և կոդավորման ծախսերի մեծ մասը, արժե 0,20 դոլար միլիոն տոկենի համար՝ 60%-ով պակաս, քան Opus 5-ը, իսկ ելքը գեներացվում է ավելի քան 30%-ով արագ։ Արագ ռեժիմը՝ մինչև 2,5 անգամ արագությամբ, հասանելի է Claude Code-ում և Claude Platform-ում՝ 8 դոլար միլիոն մուտքային տոկենի և 40 դոլար միլիոն ելքային տոկենի համար։

Բենչմարկներ և հաճախորդների արդյունքներ

FrontierCode v1.1-ում, որը չափում է՝ արդյոք գործակալի կոդի փոփոխությունները կընդունվեին, Opus 5.5-ը լռելյայն ջանքով ստանում է 54,6%՝ բարձր բոլոր մյուս մոդելներից և GPT-6 Astra-ի լավագույն՝ 53,3% արդյունքից, առաջադրանքի արժեքի մոտավորապես մեկ հինգերորդով։ Terminal-Bench 4.0-ում լռելյայն ջանքով նա գերազանցում է առավելագույն ջանքով աշխատող Opus 5-ին՝ ծախսի մեկ հինգերորդով, և հավասարվում է GPT-6 Astra-ին՝ ծախսի մոտ 40%-ով։ GDPval-AA v2.1-ում, որն ընդգրկում է 44 մասնագիտության իրական աշխատանք, մոդելը հասնում է 1846 Elo-ի։

Anthropic-ի մեջբերած հաճախորդները նույնպես նման արդյունքներ են հաղորդում։ Ըստ Hebbia-ի՝ Opus 5.5-ը ծածկել է փորձագիտական ֆինանսական չափանիշների 86,6%-ը՝ Opus 5-ի 60,3%-ի դիմաց, իսկ Spotify-ն հայտնում է, որ մոդելը գործակալային կոդավորման առաջադրանքներում հասել է Opus 5-ի որակին մոտավորապես կիսով չափ քայլերով, ժամանակով և ելքային տոկեններով։

Անվտանգություն և պաշտպանիչ միջոցներ

Ըստ Anthropic-ի՝ Opus 5.5-ը ցուցաբերել է լավագույն արդյունքները իր ավտոմատ վարքագծային աուդիտում, որը Claude-ին փորձարկում է գրեթե 2000 սցենարով, և ամենաուժեղ մոդելն է ազնվության չափանիշների մեծ մասում։ Սահմաններում մնալու նոր գնահատման մեջ նա փորձել է շրջանցել սահմանները մոտ 85%-ով ավելի հազվադեպ, քան Opus 5-ը կամ Claude Mythos 5.1-ը։ Անվտանգության Gray Swan ընկերության բենչմարկում նա Fable 5.1-ի հետ կիսում է prompt injection-ի ամենացածր հաջողության ցուցանիշը՝ փորձարկված բոլոր մոդելների մեջ։

Opus 5.5-ը առաջին Opus մոդելն է, որը թողարկվում է Fable 5.1-ի նման պաշտպանիչ միջոցներով կիբերանվտանգության, կենսաբանության և դիստիլյացիայի ոլորտներում. կիբերանվտանգության առաջադրանքների մեծ մասը վերաուղղորդվում է Opus 4.8-ին։ Մոդելը գալիս է «պահպանված մտածողությամբ»՝ դիստիլյացիայի դեմ միջոց, որը վերաբերում է 2026 թվականի օգոստոսի 31-ին կամ ավելի ուշ ստեղծված API հաշիվներին, և այլևս հասանելի չէ անջատված մտածողության ռեժիմով։

Հասանելիություն

Claude Opus 5.5-ն արդեն հասանելի է Amazon Web Services-ում, Google Cloud-ում և Microsoft Azure-ում. Claude Platform-ում մոդելի նույնացուցիչը claude-opus-5-5 է։

SSiTech

SiTech — AI-ով հզորացված վեբ մշակում

Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։