უკან დაბრუნება
სესია, რომელსაც თან ვერ წაიღებ: რატომ ხდება AI ტრანსკრიპტი პროვაიდერზე მიბმული
SiTech AI Team2 წთ. საკითხავი

სესია, რომელსაც თან ვერ წაიღებ: რატომ ხდება AI ტრანსკრიპტი პროვაიდერზე მიბმული

Earendil Engineering-ის ბლოგპოსტის ავტორები ამბობენ, რომ ინფერენსის API-ები ტექსტთან ერთად უკვე იმ მდგომარეობას აბრუნებენ, რომელსაც კლიენტი ვერ კითხულობს და ვერ ატანს სხვა მოდელთან, და სესიის საკუთრებისთვის ხუთ ტესტს სთავაზობენ.

API, რომელიც ტექსტზე მეტს აბრუნებს

ინფერენსის API-ის თავდაპირველი დაპირება მარტივი იყო: გააგზავნე შეყვანილი მონაცემები, მიიღე გამოსავალი — და თუ ორივე შეინახე, საუბარიც შენ გაქვს. შეგეძლო მისი დათვალიერება, დაარქივება, ხელახლა გაშვება ან სხვა მოდელისთვის გადაცემა. ეს არასოდეს იყო სრული სიმართლე — პრომპტის ქეშები სხვის GPU-ებზე ცხოვრობს, ტოკენიზაცია მოდელებს შორის განსხვავდება, სემპლინგი კი განზრახ არ არის რეპროდუცირებადი — მაგრამ სესიის სემანტიკური ჩანაწერი მაინც მომხმარებლის საკუთრებად რჩებოდა.

„The Session You Cannot Take With You“ სათაურის პოსტში Earendil Engineering ამტკიცებს, რომ ინფერენსის API-ები ამ თვისებას შორდება. პროვაიდერები სულ უფრო ხშირად აბრუნებენ ტექსტს შერეულს მდგომარეობასთან, რომელიც მათზეა მიბმული და განზრახ არაპორტირებადია: მსჯელობის ტოკენები, რომლებიც მომხმარებელს ეფასება, მაგრამ დაშიფრული ბლოკის სახით ბრუნდება; ვებ-ძიებები, სადაც მოდელი წყაროებს ხედავს, კლიენტი კი — არა; კონტექსტის შეკუმშვა, რომლის გაშიფვრა მხოლოდ საწყის პროვაიდერს შეუძლია; სუბაგენტების ინსტრუქციები, დამალული დაშიფრულ პეილოუდებში; და პასუხის მდგომარეობა, რომელიც სრულად პროვაიდერის სერვერებზე შენახულ ID-ებზეა მიბმული.

სესიის საკუთრების პრაქტიკული ტესტი

პოსტი პორტირებადობას თავშეკავებით განსაზღვრავს: საჭირო არ არის, რომ სხვა მოდელმა იგივე შემდეგი ტოკენი გამოიმუშაოს, მაგრამ ექსპორტირებული ტრანსკრიპტი საკმარისად გასაგები უნდა იყოს, რომ სხვა მოდელმა მუშაობა გააგრძელოს — ძველი პროვაიდერის მხრიდან ID-ის გახსნის, ბლოკის გაშიფვრის ან შეჯამების აღდგენის გარეშე. შემდეგ მოდის ხუთი ტესტი: დათვალიერება (ხედავს თუ არა მომხმარებელი, რას ხედავდა მოდელი, რა გააკეთეს ხელსაწყოებმა და რა უთხრეს აგენტებმა ერთმანეთს), ექსპორტი (თვითკმარია თუ არა სესია), გაშვება (შეუძლია თუ არა სხვა იმპლემენტაციას სემანტიკურად ეკვივალენტური კონტექსტის აღდგენა), აუდიტი (შეუძლია თუ არა ადამიანს ფაქტის შემდეგ ახსნას, რატომ მოიქცა სისტემა ასე) და წაშლა (შეუძლია თუ არა მომხმარებელს ყველა იმ სერვერული ასლის მოძებნა და წაშლა, რომელზეც სესიაა დამოკიდებული).

ჩაკეტილი მდგომარეობა, დამალული ძიება და გაუმჭვირვალე შეკუმშვა

Earendil ამტკიცებს, რომ სახელდება მომხმარებელს აბნევს: ველი encrypted_content კონფიდენციალურობის კონტროლივით ჟღერს, მაგრამ ეს კაფსულაა, რომელსაც მხოლოდ პროვაიდერი ხსნის — ავტორები მას „პროვაიდერის მიერ დალუქულ მდგომარეობას“ უწოდებენ. შენახვის ნაგულისხმევი პარამეტრებიც იმავე მიმართულებას მიუთითებს: OpenAI-ის Responses API პასუხებს ნაგულისხმევად სულ მცირე 30 დღე ინახავს.

შვიდი წესი და მინიმალური თავისუფლება

პოსტი პროვაიდერებისა და აგენტების ავტორებისთვის შვიდი პრინციპით სრულდება: ლოკალური მოვლენების ლოგი კანონიკურია, შენახვა აშკარაა, არცერთი გაუმჭვირვალე ელემენტი არ უნდა იყოს მნიშვნელობის ერთადერთი მატარებელი, ჰოსტინგით მომუშავე ხელსაწყოები სრულ ლოგებს ინახავენ, სუბაგენტებს შორის კომუნიკაცია აუდიტირებადია, შეკუმშვა დათვალიერებადია და არტეფაქტები ექსპორტირებადია. ავტორები ასევე ითხოვენ დისტილაციის მიმართ დამოკიდებულების შეცვლას — მას შესაძლებლობის გაიაფებისა და უფრო ფართოდ გავრცელების გზად აღწერენ და არა ტაბუდ.

მინიმუმი, რასაც ისინი ითხოვენ, მცირეა: მომხმარებელს უნდა შეეძლოს ანგარიშის დახურვა, სესიის შენარჩუნება და სხვა მოდელისთვის გადაცემა. ახალი მოდელი შეიძლება არ დაეთანხმოს, კითხვები დასვას ან უარესად იმუშაოს, მაგრამ იქ, სადაც ძველი მოდელი ისტორიას, მტკიცებულებებს, გეგმებსა და დელეგირებულ სამუშაოს ხედავდა, დაშიფრულ ტექსტს არ უნდა უყურებდეს.

SSiTech

SiTech — AI-გაძლიერებული ვებ დეველოპმენტი

ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.