Վերադառնալ
Anthropic-ը թողարկել է Claude Sonnet 5.5-ը՝ մինչև 30%-ով ավելի էժան
SiTech AI Team2 წთ. საკითხავი

Anthropic-ը թողարկել է Claude Sonnet 5.5-ը՝ մինչև 30%-ով ավելի էժան

Anthropic-ը ներկայացրել է Claude 5.5 ընտանիքի երկրորդ մոդելը՝ Claude Sonnet 5.5-ը։ Ընկերության խոսքով՝ այն պատասխանը գեներացնում է ավելի քան 30%-ով արագ և Sonnet 5-ի համեմատ մինչև 30%-ով ավելի էժան է մեկ առաջադրանքում։

Anthropic-ը 2026 թվականի սեպտեմբերի 28-ին թողարկել է Claude Sonnet 5.5-ը՝ Claude 5.5 ընտանիքի երկրորդ մոդելը։ Ընկերությունը այն ներկայացնում է որպես Sonnet 5-ի նկատելի բարելավում. մոդելը պատասխանը գեներացնում է ավելի քան 30%-ով արագ և նույն աշխատանքի համար ավելի քիչ թոքեն ծախսում, ինչի շնորհիվ առաջադրանքի արժեքը նվազում է մինչև 30%-ով։

Sonnet 5.5-ը դիրքավորվում է որպես Claude Opus 5.5-ի ավելի էժան ու արագ լրացում։ Opus 5.5-ը նախատեսված է բարդ աշխատանքի համար, որը պահանջում է զգույշ դատողություն, իսկ Sonnet 5.5-ը կողմնորոշված է հստակ սահմանված առօրյա առաջադրանքների վրա՝ սխալների ուղղում, փաստաթղթերի, ներկայացումների և աղյուսակների պատրաստում։ Բարձր ծանրաբեռնվածության հավելվածների համար նախատեսված Claude Haiku 5.5-ը ընտանիքին կմիանա առաջիկա շաբաթներին։

Արդյունքները Opus 5.5-ին մոտ

Sonnet 5-ի համեմատ ամենամեծ թռիչքը կոդ գրելիս է։ Ագենտային կոդավորման Terminal-Bench 4.0 թեստում Sonnet 5.5-ը հավաքում է 70,6%, իսկ Sonnet 5-ը՝ 10,3%։ Cursor-ի իրական սեսիաների վրա հիմնված CursorBench 4.0-ում արդյունքը 34,1%-ից բարձրանում է 55,5%-ի և ընդամենը երկու կետով զիջում է Opus 5.5-ին (57,8%)։ FrontierCode 1.1-ում Xhigh ռեժիմում հավաքում է 52,1%, նախորդից տասը կետ ավելի, իսկ առաջադրանքի արժեքը մոտ 15 անգամ ցածր է։

Գիտելիքի աշխատանք և դատողություն

GDPval-AA v2.1 թեստում, որն ընդգրկում է 44 մասնագիտության և ինը ոլորտի առաջադրանքներ, Sonnet 5.5-ը ստանում է 1844 միավոր՝ գրեթե հավասար Opus 5.5-ին (1846) և մոտ 400 միավորով բարձր Sonnet 5-ից։ Դիագրամների ճանաչման Chartography թեստում ցուցանիշը 15,6%-ից աճում է 61,6%-ի։ Anthropic-ը նշում է, որ թեստային միավորները արտացոլում են մոդելի հնարավորությունների միայն մի մասը, և բարդ, բաց աշխատանքում Opus 5.5-ը մնում է էականորեն ավելի ուժեղ։

Նույն թոքենի գինը, ավելի քիչ թոքեն մեկ առաջադրանքում

Թոքենների գինը Sonnet 5-ի համեմատ չի փոխվել՝ 2 դոլար միլիոն մուտքային թոքենի համար, 10 դոլար՝ ելքայինի և 0,20 դոլար՝ քեշի ընթերցման համար։ Խնայողությունը գալիս է ոչ թե գնի իջեցումից, այլ թոքենների արդյունավետ ծախսից, այդ իսկ պատճառով ընկերությունը նվազումը նկարագրում է որպես մինչև 30% մեկ առաջադրանքում։ Ելքի գեներացումը նույնպես ավելի քան 30%-ով արագացել է։ Վաղ փորձարկողները նշել են, որ մոդելը արագ հասկանում է կոդային բազան և ավելի հաճախ խմբավորում գործիքների կանչերը։

Հասանելիություն և նոր պաշտպանական միջոցներ

Claude Sonnet 5.5-ը հասանելի է Amazon Web Services-ում, Google Cloud-ում և Microsoft Azure-ում՝ զրոյական տվյալների պահպանման պայմանով, իսկ մոդելի նույնացուցիչը claude-sonnet-5-5 է։ Քանի որ կիբերանվտանգության հնարավորությունները մոտ են Opus 5-ին, սա առաջին Sonnet-ն է կիբերպաշտպանությամբ. բարձր ռիսկի հարցումները տեսանելիորեն ուղղվում են Sonnet 5-ին, իսկ սովորական ծրագրավորումը չի տուժում։ Առաջին անգամ ավելացվել են նաև դասակարգիչներ, որոնք արգելափակում են դատողության արտահանումը և հակազդում distillation հարձակումներին։

SSiTech

SiTech — AI-ով հզորացված վեբ մշակում

Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։