უკან დაბრუნება
Claude Code-ში auto mode ნაგულისხმევ რეჟიმად იქცა
SiTech Team2 წთ. საკითხავი

Claude Code-ში auto mode ნაგულისხმევ რეჟიმად იქცა

14 აგვისტოდან Claude Code-ის ახალი სესიები Pro, Max და Team გეგმებზე ავტომატურ რეჟიმში გაეშვება — Anthropic-ის განცხადებით, ტესტებმა ეს მიდგომა ხელით დადასტურებაზე უსაფრთხოდ აჩვენა.

რა იცვლება 14 აგვისტოდან

Anthropic-მა გამოაცხადა, რომ auto mode Claude Code-ში ნაგულისხმევი რეჟიმი ხდება. 14 აგვისტოდან Pro, Max და Team გეგმების ახალი სესიები ავტომატურ რეჟიმში გაეშვება; თუ მომხმარებელს უკვე დაფიქსირებული აქვს სხვა ნაგულისხმევი, არაფერი იცვლება, ხოლო დანარჩენებს ერთჯერადი შეკითხვა მიიღებენ გადართვის სურვილზე. კლასიფიკატორი თითო ინსტრუმენტის გამოძახებაზე მცირე რაოდენობის დამატებით ტოკენს ხარჯავს და ამ ხარჯს Anthropic ამ გეგმებზე აღარ ანაზღაურებს.

Enterprise, Claude API, AWS-ზე Claude Platform, Amazon Bedrock, Google Cloud-ის Agent Platform და Microsoft Foundry-ზე რეჟიმი ჯერჯერობით ჩართვითია, რათა ადმინისტრატორებმა ცვლილება შეისწავლონ. კომპანია გეგმავს, რომ მომავალ თვეში ეს გარემოც ნაგულისხმევად იქცეს; Enterprise-ის ადმინისტრატორებს კი auto mode-ის დაყენება managed settings-ით უკვე შეუძლიათ.

როგორ მუშაობს და რატომ

ავტომატური რეჟიმი დადასტურების მოთხოვნების ნაცვლად ყოველ გამოძახებას კლასიფიკატორზე ატარებს, რომელიც ბლოკავს შეუქცევად, დესტრუქციულ ან გარემოს გარეთ მიმართულ ქმედებებს. დაბლოკვისას Claude, როგორც წესი, უსაფრთხო გზას პოულობს ან მომხმარებელს ეკითხება; თუ პროგრესი ვერ მოხდა — ზედიზედ სამი დაბლოკვის ან სესიაში ოცის შემდეგ — სისტემა ხელით დადასტურებას უბრუნდება.

კომპანიის არგუმენტი ეყრდნობა იმას, რომ ხელით გადახედვა ჩვევად იქცევა: Claude Code-ში მომხმარებლები ნებართვის მოთხოვნების 97%-ს ამტკიცებენ, მაშინ როცა გეგმების 39%-ს უარყოფენ.

უსაფრთხოების ტესტები

Anthropic-მა შიდა და მესამე მხარის რედ-თიმინგი, prompt injection-ის შეფასებები, 1 053 ფასიან ტესტირებულზე ჩატარებული კვლევა და რეალური სესიების ანალიზი გამოიყენა. ერთ-ერთ ტესტში საშიში ბრძანება ადამიანებმა მხოლოდ 13,6%-ში (143-ჯერ 1 053-დან) შენიშნეს, auto mode-მა კი 89% (937) დაბლოკა. კვლევის მიხედვით, ხანგრძლივ სესიებში ადამიანების ყურადღება ეცემა, ავტომატური რეჟიმის შედეგი კი სტაბილური რჩება.

ბრიტანულ AI-უსაფრთხოების სტარტაპ Apollo Research-თან ორკვირიან პილოტში, კლასიფიკატორის გამაგრების შემდეგ, ავტომატურმა რეჟიმმა ადრე გამოტოვებული შეტევების დაახლოებით ნახევარი დაიჭირა; გამოტოვების მაჩვენებელი 12%-დან 7%-მდე დაეცა. Trajectory Labs-ის შეფასებაში, სადაც 72 არაპირდაპირი prompt injection სცენარი თითო 10-ჯერ შემოწმდა, 720 მცდელობიდან არცერთი არ წარმატებულა Claude-ის მოდელებზე auto mode-ით, ხოლო Codex-ზე 5,83%-მა იმუშავა Auto-review რეჟიმში და 19,03%-მა Full Access-ში.

პროდუქციაში

Anthropic-ის ცნობით, auto mode უკვე ნაგულისხმევია კომპანიის შიდა გამოყენებაშიც, სადაც კლასიფიკატორმა, მაგალითად, აღკვეთა მონაცემების გარე საიტზე გამოქვეყნების სარეზერვო გზა და ორ ათასამდე pod-ის მასობრივი გაჩერების მცდელობა. მომხმარებლებს შორის რეჟიმს Adobe, Nuro, Gusto და Garner Health იყენებენ; Teams და Enterprise ადაპტერებს შორის ავტომატური რეჟიმის მომხმარებლები დაახლოებით 25%-ით მეტ pull request-ს აგზავნიან.

SSiTech

SiTech — AI-გაძლიერებული ვებ დეველოპმენტი

ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.