Anthropic და Accenture ფრონტიე AI მოდელების ჩაშენებულ შეფასებაზე შეთანხმდნენ

Anthropic-მა Accenture-თან პარტნიორობა გამოაცხადა: ფრონტიე მოდელებს კომპანიის შიგნიდან, თანამშრომლის დონის წვდომით შეაფასებენ. ორივე მხარე ხუთ წელიწადში მინიმუმ 1 მილიარდ დოლარს დახარჯავს — რას ნიშნავს „ჩაშენებული შეფასება“ AI უსაფრთხოებისთვის?
რა მოხდა
Anthropic-მა გამოაცხადა პარტნიორობა Accenture-თან ფრონტიე ხელოვნური ინტელექტის მოდელების დამოუკიდებელი შეფასებისთვის. სამუშაოს Accenture-ის სპეციალიზებული AI ბიზნესი Faculty უხელმძღვანელებს და მოიცავს მოდელების შეფასებასა და რედ-თიმინგს, alignment-ის შემოწმებას და უსაფრთხოების მექანიზმების ტესტირებას.
რატომ არის ეს მნიშვნელოვანი
საუბარია „ჩაშენებულ შეფასებაზე“ (embedded evaluation) — შემფასებლები კომპანიის შიგნით მუშაობენ და თანამშრომლის დონის წვდომა აქვთ. ეს მათ საშუალებას აძლევს, ნახონ, როგორ ყალიბდება მოდელი ტრენინგის დროს, თვალი ადევნონ გადაწყვეტილებებს და პირდაპირ ესაუბრონ თანამშრომლებს. ასე შეუძლიათ შეამოწმონ, რომ კომპანია უსაფრთხოების ვალდებულებებს იცავს და ბრმა ზონები გამოავლინონ.
ფული და ღია კითხვები
ორივე კომპანია ხუთი წლის განმავლობაში მინიმუმ 1 მილიარდი დოლარის ინვესტიციას გეგმავს. თუმცა ჯერ არ არსებობს სტანდარტები, თუ რაზე უნდა ჰქონდეთ შემფასებლებს წვდომა და როგორ უნდა აცნობონ შედეგების შესახებ. Anthropic ამბობს, რომ Accenture-ს პირდაპირ დააფინანსებს, გრძელვადიანად კი თანხები საერთო ან სახელმწიფო წყაროებიდან უნდა მოვიდეს. პარტნიორობა არაექსკლუზიურია — კომპანია METR-თან და სხვა არაკომერციულ შემფასებლებთან მოლაპარაკებებს აწარმოებს.