უკან დაბრუნება
Anthropic-მა Claude Opus 5.5 წარადგინა — Opus 5-ზე 40%-ით იაფი მოდელი
SiTech AI Team2 წთ. საკითხავი

Anthropic-მა Claude Opus 5.5 წარადგინა — Opus 5-ზე 40%-ით იაფი მოდელი

Anthropic-მა 22 სექტემბერს ახალი Claude 5.5 ოჯახის პირველი მოდელი — Claude Opus 5.5 — წარადგინა. კომპანიის მტკიცებით, ის სამუშაოს უმეტეს ნაწილში Claude Fable 5.1-ის დონეს აღწევს, თუმცა Opus 5-ზე 40%-ით იაფია.

Anthropic-მა 22 სექტემბერს წარადგინა Claude Opus 5.5 — ახალი Claude 5.5 ოჯახის პირველი მოდელი. კომპანიის განცხადებით, ის სამუშაოს უმეტეს ნაწილში Claude Fable 5.1-ის დონეს აღწევს, მუშაობა კი Opus 5-ზე 40%-ით იაფია.

წარმადობა და ფასი

Anthropic-ის ცნობით, ადრეულმა ტესტირებამ რთულ ამოცანებზე მკვეთრი გაუმჯობესება აჩვენა: ერთმა მომხმარებელმა 680 000 სტრიქონის კოდის მიგრაცია დღეზე ნაკლებ დროში დაასრულა — სამუშაო, რომელსაც, კომპანიის შეფასებით, ინჟინრების გუნდს კვირები დასჭირდებოდა. ვებ-აპლიკაციის ყველა გვერდზე ჩატვირთვის დროის შემცირების ტესტში მოდელმა 40 შემთხვევიდან 39-ში მიზანს მიაღწია, Opus 5-მა კი უფრო მცირე ცვლილებები შეიტანა, რომლებმაც აპლიკაციის ქცევაც შეცვალეს.

Cache-ის წაკითხვა — რაც, კომპანიის თქმით, აგენტური და კოდირების ხარჯების უმეტეს ნაწილს შეადგენს — მილიონ ტოკენზე 0,20 დოლარი ღირს, რაც Opus 5-ზე 60%-ით იაფია; გამოსავალი ტექსტი კი 30%-ზე მეტად სწრაფად გენერირდება. Claude Code-სა და Claude Platform-ზე ხელმისაწვდომია სწრაფი რეჟიმი 2,5-მდე გამრავლებული სიჩქარით — მილიონი შემავალი ტოკენი 8 დოლარი, მილიონი გამომავალი ტოკენი კი 40 დოლარი.

ბენჩმარკები და მომხმარებლების შედეგები

FrontierCode v1.1-ზე, რომელიც ზომავს, მიიღებოდა თუ არა აგენტის მიერ შეტანილი კოდის ცვლილებები, Opus 5.5 ნაგულისხმევი ძალისხმევით 54,6%-ს აღწევს — ყველა სხვა მოდელზე მაღლა და GPT-6 Astra-ს საუკეთესო 53,3%-ზე მეტს, დავალებაზე ხარჯის დაახლოებით მეხუთედით. Terminal-Bench 4.0-ზე ის ნაგულისხმევი ძალისხმევით უსწრებს მაქსიმალურ რეჟიმში მომუშავე Opus 5-ს ხარჯის მეხუთედით და უტოლდება GPT-6 Astra-ს ხარჯის დაახლოებით 40%-ით. GDPval-AA v2.1-ზე, რომელიც 44 პროფესიის რეალურ სამუშაოს ამოწმებს, მოდელი 1846 Elo-ს აღწევს.

კომპანიის მიერ მოყვანილი მომხმარებლების შედეგებიც მსგავსია: Hebbia-ს ცნობით, ფინანსური სამუშაოების ექსპერტულ კრიტერიუმებზე Opus 5.5-მა 86,6% დაფარა, Opus 5-მა კი 60,3%; Spotify-ს ტესტებში მან Opus 5-ის ხარისხს იგივე დონეზე მიაღწია აგენტურ კოდირებაში ნახევარი ნაბიჯებით, დროითა და გამომავალი ტოკენებით.

უსაფრთხოება და დაცვის მექანიზმები

Anthropic-ის თქმით, Opus 5.5-მა ყველაზე მაღალი შედეგი აჩვენა მათ ავტომატურ ქცევით აუდიტში, რომელიც Claude-ს დაახლოებით 2000 სცენარში ამოწმებს, და ყველაზე ძლიერი მოდელია სანდოობის უმეტეს საზომში. ახალ შემოწმებაში მან დადგენილი საზღვრების გვერდის ავლა დაახლოებით 85%-ით ნაკლებად სცადა, ვიდრე Opus 5 ან Claude Mythos 5.1. უსაფრთხოების კომპანია Gray Swan-ის ბენჩმარკზე მას Fable 5.1-თან ერთად ყველაზე დაბალი prompt-injection-ის წარმატების მაჩვენებელი აქვს.

Opus 5.5 პირველი Opus მოდელია, რომელიც Fable 5.1-ის მსგავსი დაცვის მექანიზმებით გამოდის კიბერუსაფრთხოების, ბიოლოგიისა და დისტილაციის მიმართულებებზე; კიბერუსაფრთხოების უმეტეს დავალებას სისტემა Opus 4.8-ზე გადაამისამართებს. მოდელი „შენარჩუნებული აზროვნების“ რეჟიმით გამოდის — ეს დისტილაციის საწინააღმდეგო ზომაა, რომელიც 2026 წლის 31 აგვისტოს ან უფრო გვიან შექმნილ API ანგარიშებს ეხება; აზროვნების გამორთვით მისი გამოყენება აღარ შეიძლება.

ხელმისაწვდომობა

Claude Opus 5.5 უკვე ხელმისაწვდომია Amazon Web Services-ზე, Google Cloud-სა და Microsoft Azure-ზე; Claude Platform-ზე მოდელის იდენტიფიკატორია claude-opus-5-5.

SSiTech

SiTech — AI-გაძლიერებული ვებ დეველოპმენტი

ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.