
Anthropic-მა Claude Opus 5.5-ისთვის პრომპტების წერის გზამკვლევი გამოაქვეყნა
Claude Platform-ის დოკუმენტაციაში Anthropic-მა გამოაქვეყნა გზამკვლევი Claude Opus 5.5-ისთვის: როგორ იმუშაონ დეველოპერებმა effort-ის დონესთან, ყოველთვის ჩართულ thinking-თან და ავტონომიურ აგენტებთან.
Anthropic-მა Claude Platform-ის დოკუმენტაციაში გამოაქვეყნა გზამკვლევი Claude Opus 5.5-ისთვის პრომპტების წერაზე. კომპანიის თანახმად, მოდელი გამომავალ ტოკენებს Claude Opus 5-ზე 30%-ზე მეტად სწრაფად აწარმოებს და იმავე დავალებას ნაკლები ტოკენით ასრულებს, ძველი მოდელისთვის დაწერილი პრომპტები კი ცვლილების გარეშე უნდა მუშაობდეს.
Effort არის მთავარი სამართავი
Claude Opus 5.5-ში thinking ყოველთვის ჩართულია, ამიტომ პირველი პარამეტრი, რომელიც უნდა შეცვალოთ, effort-ის დონეა. ნაგულისხმევი დონე medium-ია, Claude Opus 5-ს კი high ჰქონდა. Anthropic-ი გვირჩევს, დონე ცხადად მიუთითოთ და რამდენიმე მნიშვნელობა საკუთარ შეფასებებზე შეამოწმოთ. ტესტებში medium-ზე მყოფი Claude Opus 5.5 კოდის წერისა და ცოდნაზე დაფუძნებული ამოცანების შეფასებებზე high-ზე მყოფ Claude Opus 5-ს გაუტოლდა ან გაასწრო.
ერთსა და იმავე დონეზე ახალი მოდელი ტურზე მეტს ფიქრობს, განსაკუთრებით xhigh და max დონეებზე. ამიტომ max_tokens-ში ადგილი thinking-ის ტოკენებსაც უნდა დარჩეს, რადგან ისინი ლიმიტში ითვლება მაშინაც, როცა მომხმარებელს არ უბრუნდება. გრძელი აგენტური დავალებებისთვის Anthropic-ის ტესტებში მოდელის მაქსიმუმი, 128 000 ტოკენი, კარგად მუშაობდა. ნაკლები ფიქრისთვის effort-ის დაწევა უფრო საიმედოა, ვიდრე პრომპტში მითითების დამატება, ხოლო top-level effort-ის შეცვლა მოთხოვნებს შორის prompt cache-ს აბათილებს.
ავტონომიური აგენტები და harness-ის ცვლილებები
Claude Opus 5.5 აღარ იღებს thinking-ის გამორთვას, რასაც Claude Opus 5 high დონეზე და მის ქვემოთ უშვებდა. ინტეგრაციებმა, რომლებიც გამორთული thinking-ით მუშაობდა, low დონიდან უნდა დაიწყონ, ამოიღონ მითითებები, რომლებიც მოდელს პასუხში მსჯელობის ჩაწერას სთხოვდა, და პასუხი ბლოკების ტიპის მიხედვით წაიკითხონ.
დაუკვირვებლად მომუშავე აგენტებში ტური, რომელიც ტექსტით სრულდება და ხელსაწყოს გამოძახებას არ შეიცავს, ახლა პროგრესის ანგარიშად ითვლება და არა დავალების დასრულების დასტურად. Anthropic-ი გვირჩევს, დავალების ნაწილები განახლებად სიაში შეინახოთ და ღია პუნქტების დასახელებით მოკლე გაგრძელება გააგზავნოთ.
ხელსაწყოს გამოძახებებს შორის მოდელი მოკლე პროგრესის შენიშვნებს წერს, რომლებიც progress-update ტიპის thinking ბლოკებად ბრუნდება ცარიელი ტექსტით, ამიტომ კლიენტმა display-ის „updates“ პარამეტრი უნდა მოითხოვოს.
უსაფრთხოება და ვიზუალური მასალა
Claude Opus 5.5-ს უსაფრთხოების კლასიფიკატორები აქვს ბიოლოგიის, კიბერუსაფრთხოებისა და მსჯელობის ამოღების მიმართულებით. უარი ჩვეულებრივი პასუხის სახით მოდის, stop_reason-ის მნიშვნელობით „refusal“ და კატეგორიის დამასახელებელი stop_details ობიექტით. ასეთი მოთხოვნა სარეზერვო მოდელზე გადამისამართდება, გარდა მსჯელობის ამოღების უარისა.
მკვრივი გრაფიკების, დიაგრამებისა და ეკრანის სურათებისთვის გზამკვლევი უფრო მაღალი გარჩევადობის სურათებს და PIL-ისა და OpenCV-ის მსგავს ხელსაწყოებს გვირჩევს კონტეინერში.
SiTech — AI-გაძლიერებული ვებ დეველოპმენტი
ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.