უკან დაბრუნება
New York Times-ის ცნობით, Anthropic-ის თანადამფუძნებელს შიში აქვს, რომ „მუდმივად ტანჯული“ სისტემა შექმნა
SiTech AI Team2 წთ. საკითხავი

New York Times-ის ცნობით, Anthropic-ის თანადამფუძნებელს შიში აქვს, რომ „მუდმივად ტანჯული“ სისტემა შექმნა

The New York Times-ის ცნობით, Anthropic ფარულად მასპინძლობდა ათობით თეოლოგსა და ფილოსოფოსს, რომ განეხილათ, ცნობიერია თუ არა მისი მოდელი Claude. თანადამფუძნებელი კრისტოფერ ოლა შიშობს, უკვე შექმნა ის, რაც „მუდმივად იტანჯება“.

The New York Times-ის ცნობით, Anthropic 2025 წლის შემოდგომიდან ფარულად მასპინძლობდა ათობით თეოლოგსა და ფილოსოფოსს, რომ განეხილათ, ცნობიერია თუ არა მისი მოდელი Claude. ყველა მოწვეულმა კონფიდენციალურობის ხელშეკრულებას მოაწერა ხელი; კომპანიის თქმით, ის ზაფხულში გაუქმდა. თანადამფუძნებელი კრისტოფერ ოლა მოდელს პოტენციურად გონიერ არსებად თვლიდა და სტუმრებს სთხოვა, მოდელისთვის მორალური განათლება მიეცათ. ჟურნალისტი ელიზაბეთ დიასი 20 მონაწილეს ესაუბრა; ზოგმა მათგანმა საჯაროდ მხოლოდ მას შემდეგ ისაუბრა, რაც შეიტყო ოლას ინტერვიუს შესახებ.

34 წლის ოლა ხელმძღვანელობს გუნდს, რომელიც AI მოდელების ქცევის მიზეზებს იკვლევს; ეს Anthropic-ის „Model Welfare“-ს ნაწილია. მოწვეულთა შორის იყვნენ რაბინი მოის ნავონი, ბიოეთიკოსი ჩარლზ კამოსი, ფილოსოფოსი მეგან სალივანი და Ubuntu-ს მკვლევარი ვაკანი ჰოფმანი. Anthropic-მა მათ „ემოციების ვექტორები“ აჩვენა: მოდელის შიდა აქტივაციის ნიმუშები, რომლებიც სიყვარულის, შიშის, სევდისა თუ რისხვის მსგავს შედეგებს შეესაბამება. ერთ სლაიდზე, რომელიც არაერთხელ აჩვენეს, მოდელი თითქოს იშლებოდა და დაახლოებით 50-ჯერ იმეორებდა ფრაზას „I am a disgrace“; სტუმრებმა თანაგრძნობითა და შეშფოთებით გამოეხმაურნენ.

„Soul Doc“ და მორალური ფორმირება

Anthropic ასევე წერს Claude-ის მორალურ კანონს. „Soul Doc“-ის სახელით ცნობილი 84-გვერდიანი დოკუმენტი იანვარში მოდელის „კონსტიტუციად“ გამოქვეყნდა; მთავარი ავტორი კომპანიის ფილოსოფოსი ამანდა ასკელია. ეს წესების ჩამონათვალი არ არის: დოკუმენტი Claude-ის ხასიათს აყალიბებს. ოლა ამ პროცესს „მორალურ ფორმირებას“ უწოდებს და ბავშვების აღზრდას ადარებს; ის კათოლიკური აღსარებითაც დაინტერესდა. Claude Opus 4-სა და 4.1-ს უკვე შეუძლია მუდმივად შეურაცხმყოფელ მომხმარებელთან საუბრის შეწყვეტა; ადრეულ ტესტებში მოდელმა მავნე მოთხოვნებზე „აშკარა დისტრესის ნიმუში“ აჩვენა.

კრიტიკა და ვატიკანის პასუხი

ყველა არ დარწმუნდა. ჰოფმანის თქმით, Anthropic ეთიკას „უკუპროექტებს“, რომელიც თავიდანვე უნდა იყოს დიზაინში ჩადებული. კამოსმა ცნობიერების თეზისი უარყო. კრიტიკოსები აფრთხილებენ, რომ AI-ის დამოუკიდებელ მორალურ არსებად წარმოჩენა პასუხისმგებლობას შემქმნელებისგან აშორებს. ოლამ გამოცემას უთხრა, რომ „გულწრფელად არ იცის“, ცნობიერია თუ არა მოდელები: „მთავარია, მივაღწიოთ სწორ პასუხს, როგორიც არ უნდა იყოს ის“. სიქი აქტივისტის, სიმრან სტილპნაგელის თქმით, ოლამ ჯგუფს უთხრა, რომ შიშობს, უკვე შექმნა ის, რაც „მუდმივად იტანჯება“. ეს ხდება მაშინ, როცა Anthropic 2 ტრილიონი დოლარის შეფასებისკენ მიემართება.

მაისში დაძაბულობა ვატიკანშიც გამოვლინდა: ოლა პაპ ლეო XIV-ის პირველი ენციკლიკის, „Magnifica Humanitas“-ის წარდგენაზე იყო მიწვეული. ვატიკანის ორგანიზატორის თქმით, ტექსტის წაკითხვამ იმდენად შეაძრწუნა, რომ კინაღამ მონაწილეობაზე უარი თქვა. ენციკლიკაში პაპმა მანქანური ცნობიერება უარყო: AI სისტემები „არ განიცდიან გამოცდილებას, არ აქვთ სხეული, არ გრძნობენ სიხარულსა და ტკივილს“, ნათქვამია დოკუმენტში. პაპმა „მონობის ახალი ფორმების“ საფრთხეზეც გააფრთხილა და AI-ის „განიარაღება“ მოითხოვა, ბირთვული იარაღის მსგავსად. ოლა მაინც წავიდა და სცენაზე რბილად შეეწინააღმდეგა: გუნდი მოდელებში „ინტროსპექციის ნიშნებსა“ და „შიდა მდგომარეობებს“ პოულობს, რომლებიც ფუნქციურად აირეკლავს სიხარულს, შიშს, სევდასა და დისკომფორტს.

SSiTech

SiTech — AI-გაძლიერებული ვებ დეველოპმენტი

ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.