Anthropic-ը թողարկել է Claude Fable 5.1 և Mythos 5.1 մոդելները

Anthropic-ը ներկայացրել է Claude Fable 5.1 և Mythos 5.1 մոդելները. ագենտային աշխատանքի ծախսը նվազում է մինչև 45%-ով, տվյալները մնում են հաճախորդի ամպում, իսկ թեստերի արդյունքները զգալիորեն աճել են։
Ինչ տեղի ունեցավ
Սեպտեմբերի 1-ին Anthropic-ը ներկայացրեց Claude Fable 5.1 և Claude Mythos 5.1 մոդելները։ Սա նույն մոդելն է՝ պաշտպանության տարբեր մակարդակներով. Fable 5.1-ը հասանելի է բոլորին, իսկ Mythos 5.1-ը՝ միայն վստահելի հասանելիության ծրագրերով՝ կիբերանվտանգության և կենսաբանության աշխատանքների համար։
Ավելի էժան և ավելի գաղտնի
Fable 5.1-ը սովորական ծանրաբեռնվածության դեպքում մոտ 25%-ով էժան է Fable 5-ից, իսկ ագենտային աշխատանքներում՝ մինչև 45%-ով, քեշի ընթերցման նվազած գնի շնորհիվ։ Նոր Enterprise Frontier Safeguards-ը խոստանում է ամբողջական գաղտնիություն՝ տվյալները պահվում են հաճախորդի, ոչ թե Anthropic-ի ամպում։ Ներդրումը կսկսվի աշնանը։
Թեստեր և պաշտպանություն
Terminal-Bench-Science 0.1 թեստում արդյունքը 52.6% է (Fable 5-ը՝ 24.7%), Terminal-Bench 4.0-ում՝ 55.8%, AutomationBench-ում՝ 31.4%։ Կիբերանվտանգության զտիչները 60%-ով քիչ սխալ ազդանշան են տալիս, իսկ մոդելը կարող է գտնել խոցելիություններ, բայց ոչ ստեղծել էքսպլոյթներ։