უკან დაბრუნება
Anthropic-მა Claude-ის მიმართ შეურაცხმყოფელი ქცევა აკრძალა გამოყენების წესების პირველ განახლებაში წელზე მეტი ხნის შემდეგ
SiTech AI Team2 წთ. საკითხავი

Anthropic-მა Claude-ის მიმართ შეურაცხმყოფელი ქცევა აკრძალა გამოყენების წესების პირველ განახლებაში წელზე მეტი ხნის შემდეგ

Anthropic-მა წელზე მეტი ხნის შემდეგ პირველად განაახლა გამოყენების წესები: აკრძალა Claude-ის მიმართ განმეორებითი შეურაცხმყოფელი ან სასტიკი ქცევა და დაამატა ახალი წესები პროპაგანდისტულ კამპანიებზე, თვალთვალსა და იარაღის შემუშავებაზე.

Anthropic-მა წელზე მეტი ხნის შემდეგ პირველად განაახლა გამოყენების პოლიტიკა და დაამატა შეზღუდვები საარჩევნო ჩარევაზე, იარაღის შემუშავებაზე, თვალთვალსა და ჯანმრთელობისა და ფინანსურ გამოყენებებზე Claude AI-ის მოდელებისთვის. მთავარი ცვლილება კრძალავს „განმეორებით და უსაფუძვლო შეურაცხმყოფელ ან სასტიკ ქცევას“ Claude-ის მიმართ.

მოდელის კეთილდღეობა

განახლება ეფუძნება გასული აგვისტოს ნაბიჯს, როცა Anthropic-მა თქვა, რომ Claude-ს შეეძლო საუბრის შეწყვეტა „მუდმივად მავნე ან შეურაცხმყოფელ“ მომხმარებლებთან. კომპანიის თქმით, საუბრის შეწყვეტა რჩება „ძირითად აღსრულების მექანიზმად“; უცნობია, მოჰყვება თუ არა მომხმარებლების დაბლოკვა.

ახალი წესი „მხოლოდ ექსტრემალურ შემთხვევებში გამოიყენება, როცა მომხმარებლები განმეორებით სასტიკად იქცევიან ჩვენი მოდელების მიმართ ყოველგვარი შესამჩნევი მიზნის გარეშე“. ის არ ეხება ჩვეულ უკმაყოფილებას, წინააღმდეგობას, შავ შემოქმედებით თემებს ან ტესტირებასა და კვლევას.

ცვლილება მოდელის კეთილდღეობაზე ინდუსტრიული დებატების ფონზე მოდის. Anthropic-ის CEO-მ დარიო ამოდეიმ თებერვალში თქვა: „არ ვიცით, არიან თუ არა მოდელები ცნობიერი“. Microsoft AI-ის მუსტაფა სულეიმანის კოდექსის პროექტი თავდაპირველად მოდელის უფლებებს უარყოფდა, შემდეგ პოზიცია შერბილდა.

პროპაგანდა და არჩევნები

Anthropic-მა ადრე „გაფანტული“ შეზღუდვები გააერთიანა ახალ აკრძალვაში მატყუარა კომერციულ ან პოლიტიკურ კამპანიებზე, რაც AI-ით გენერირებული პროპაგანდის ზრდას ეხმიანება. პოლიტიკა ზღუდავს „მცდელობებს დამალონ, თუ ვინ დგას შეტყობინების უკან, ან გააძლიერონ კონტენტი ყალბი ანგარიშებითა და პოსტებით“.

არჩევნების ნაწილი კრძალავს ამომრჩევლის მოტყუებას და საარჩევნო პროცესის ხელშეშლას, მათ შორის დეზინფორმაციას „კანდიდატებზე ან კენჭისყრის წესზე, კანდიდატებისა თუ საარჩევნო ოფიციალური პირების გაპიროვნებას, ან ამომრჩეველთა აქტივობის ჩახშობას“.

იარაღი და თვალთვალი

გამოყენების პოლიტიკა ყოველთვის კრძალავდა Claude-ით იარაღის შემუშავებას, მაგრამ Anthropic-მა თქვა, რომ ხშირად ნახა Claude-ის გამოყენების მცდელობები იარაღისთვის მითითებებისა და მართვის პროგრამული უზრუნველყოფის შესაქმნელად. გაფართოებული აკრძალვა მოიცავს „პროგრამულ უზრუნველყოფასა და კომპონენტებს, რომლებიც იარაღს ამუშავებენ, ისევე როგორც დრონებისა და სხვა ავტონომიური სატრანსპორტო საშუალებების შეიარაღებას“.

ბოლო საფრთხის დაზვერვის ანგარიშის შემდეგ, რომელიც Claude-ით მართული თვალთვალის ზრდას აჩვენებდა „პოლიტიკური დისიდენტების“ საწინააღმდეგოდ, კომპანიამ აკრძალვები დააზუსტა. Anthropic-ის თქმით, ადამიანების თვალყურის დევნება მათი თანხმობის გარეშე აკრძალულია, იქნება ეს რეალურ დროში თუ ადრე შეგროვებული მონაცემებით. Claude-ით დაუშვებელია გადაწყვეტილებების მიღება ან რეკომენდაცია, ვინ უნდა გამოიძიონ, დააკავონ ან დაადანაშაულონ, ან თვალთვალის ხელსაწყოების შექმნა და გაუმჯობესება.

Anthropic-მა აღნიშნა, რომ ეს წესები შეიძლება შეიცვალოს „გარკვეულ სამთავრობო მომხმარებლებთან კონტრაქტებისთვის“, თუ კონტრაქტით გათვალისწინებული შეზღუდვები და დაცვის ზომები პოტენციური ზიანის შესამცირებლად საკმარისად ჩათვლის. კომპანია ადრე აშშ-ის სამხედრო ძალებთანაც თანამშრომლობდა.

აპარატურა და რობოტიკა

ახალი წესით, როცა Anthropic-ის მოდელები ავტონომიურ აპარატურას უკავშირდებიან და შესაძლოა ტრავმა გამოიწვიონ, კვალიფიციურმა ოპერატორმა უნდა შეძლოს დაკვირვება და საჭიროების შემთხვევაში გაჩერება. უნდა იყოს ეს ოპერატორი ადამიანი თუ არა, გაურკვეველია. ეს ასახავს AI ლაბორატორიების ინტერესს რობოტიკისა და აპარატურის მიმართ, რათა AI სისტემებს ფიზიკური განსხეულება მისცენ, და შეიძლება Anthropic-ის მომავალ პარტნიორობებზე მიუთითებდეს.

წყაროები: The Verge Ai

SSiTech

SiTech — AI-გაძლიერებული ვებ დეველოპმენტი

ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.