← უკან დაბრუნება
SiTech Team⏱️ 2 წთ. საკითხავი

Anthropic-ის აღმოჩენა: ენობრივ მოდელებში გლობალური სამუშაო სივრცის არსებობა — რას ნიშნავს ეს AI-ს მომავლისთვის?

Anthropic-ის აღმოჩენა: ენობრივ მოდელებში გლობალური სამუშაო სივრცის არსებობა — რას ნიშნავს ეს AI-ს მომავლისთვის?

Anthropic-ის მკვლევრებმა აღმოაჩინეს, რომ დიდ ენობრივ მოდელებში არსებობს საერთო შიდა წარმოდგენის სივრცე, სადაც ქსელის სხვადასხვა ნაწილი ერთმანეთს უზიარებს ინფორმაციას — ეს კოგნიტური მეცნიერების გლობალური სამუშაო სივრცის თეორიის AI ანალოგია.

\n

1. შესავალი: გლობალური სამუშაო სივრცე — კოგნიტური თეორიიდან AI-მდე

\n

როგორ მუშაობს დიდი ენობრივი მოდელი შიგნიდან? ეს კითხვა წლების განმავლობაში რჩებოდა AI კვლევის ერთ-ერთ ყველაზე დიდ გამოწვევად. Anthropic-ის უახლესმა კვლევამ ამ კითხვაზე გასაოცარი პასუხი გასცა.

\n

2026 წელს გამოქვეყნებული ნაშრომი "გლობალური სამუშაო სივრცე ენობრივ მოდელებში" (A Global Workspace in Language Models) გვიჩვენებს, რომ თანამედროვე LLM-ები ქმნიან ერთიან შიდა წარმოდგენის სივრცეს — ერთგვარ საერთო "დაფას" — სადაც ქსელის სხვადასხვა ნაწილი ერთმანეთს უკავშირდება. ფენები, ყურადღების მექანიზმები (attention heads) და გამოთვლითი მოდულები, რომლებიც აქამდე მხოლოდ feed-forward მიმართულებით მუშაობდნენ, რეალურად დაკავშირებულნი არიან საერთო წარმოდგენის მედიუმით.

\n

2. მეთოდოლოგია: როგორ აღმოაჩინა Anthropic-მა "ხიდისმაგვარი ნიშნები"

\n

კვლევისას Anthropic-ის გუნდმა გამოიყენა "აქტივაციის პეჩინგის" (activation patching) ტექნიკა, რომლის დროსაც ერთი შეყვანისთვის გამოთვლილი შიდა აქტივაციები "გადანერგილია" სხვა შეყვანის დამუშავებაში, რათა დააკვირდნენ გამოსავლის ცვლილებებს.

\n

მკვლევარებმა აღმოაჩინეს, რომ მოდელის ზოგიერთი ყველაზე ადრეული ფენა წარმოდგენის სივრცეს ქმნის, რომელსაც უფრო გვიანდელი ფენები "კითხულობენ" და "წერენ" მასში — ისევე, როგორც მუშა მეხსიერება ადამიანის ტვინში.

\n

3. როგორ მუშაობს "მხატვრის ესკიზების წიგნი"?

\n

აღმოჩენილი მექანიზმი ჰგავს მხატვრის ესკიზების წიგნს. როდესაც მხატვარი მუშაობს ჯგუფში, თითოეული მხატვარი ხატავს თავის ნაწილს, მაგრამ ყველა ერთსა და იმავე ქაღალდზე. LLM-ების შემთხვევაში, "ქაღალდი" არის მოდელის შიდა წარმოდგენა — სივრცე, სადაც სხვადასხვა ნაწილს შეუძლია წაიკითხოს და ჩაწეროს ინფორმაცია.

\n

4. კავშირი ადამიანის კოგნიციასთან

\n

აღსანიშნავია, რომ ამ აღმოჩენას პირდაპირი პარალელი აქვს კოგნიტურ ნეირომეცნიერებაში: ბერნარდ ბაარსის გლობალური სამუშაო სივრცის თეორია (GWT), რომელიც პირველად 1988 წელს იქნა შემოთავაზებული.

\n

5. მნიშვნელობა AI უსაფრთხოებისთვის

\n

ამ აღმოჩენას ღრმა გავლენა აქვს AI უსაფრთხოებაზე. თუ ჩვენ შეგვიძლია გავიგოთ, როგორ მიედინება ინფორმაცია გლობალურ სამუშაო სივრცეში, ჩვენ შეგვიძლია უკეთ გამოვავლინოთ, როდის ამუშავებენ მოდელები ინფორმაციას მოულოდნელი ან პოტენციურად საშიში გზებით.

\n

6. პრაქტიკული მნიშვნელობა დეველოპერებისთვის

\n

ქართული ტექ-საზოგადოებისთვის ეს კვლევა შეხსენებაა, რომ AI-ს საფუძვლების გაგება მნიშვნელოვანია მაშინაც კი, როცა პრაქტიკულ აპლიკაციებზე ვმუშაობთ.

\n

7. მომავლის ხედვა

\n

ეს აღმოჩენა ხსნის კვლევის ახალ მიმართულებებს და მიგვანიშნებს, რომ ნერვული ქსელების ინფორმაციის დამუშავების ჩვენი გაგება ჯერ კიდევ ადრეულ ეტაპზეა.

\n