უკან დაბრუნება
„Are You in the Weights“ — საიტი ამოწმებს, იცნობს თუ არა AI მოდელი თქვენს სახელს
SiTech AI Team2 წთ. საკითხავი

„Are You in the Weights“ — საიტი ამოწმებს, იცნობს თუ არა AI მოდელი თქვენს სახელს

თომას დიმსონისა და ჯოი ფლინის ახალი ვებინსტრუმენტი თქვენს სახელს ჩვიდმეტ ენობრივ მოდელს აკითხავს და პასუხებს ერთ „სიძლიერის ქულად“ აქცევს — ასე ჩანს, ვინ ცხოვრობს სინამდვილეში ხელოვნური ინტელექტის მეხსიერებაში.

ორმა დეველოპერმა, თომას დიმსონმა და ჯოი ფლინმა, გაუშვა საიტი intheweights.com — მცირე ვებინსტრუმენტი, რომელიც უჩვეულო კითხვას პასუხობს: იცნობენ თუ არა წამყვანი ხელოვნური ინტელექტის მოდელები თქვენ? პროექტი Hacker News-ზე „Show HN“ პოსტად გამოქვეყნდა და 471 ქულა მიიღო, რითაც ტექნიკური ცნობისმოყვარეობა პოპულარულ გასართობად იქცა — ადამიანები საკუთარ სახელს აკრეფენ, რომ ნახონ, გადარჩა თუ არა ის ენობრივი მოდელის მეხსიერებაში.

რას ზომავს ეს ტესტი

იდეა მარტივია. დიდი ენობრივი მოდელები ცოდნას მილიარდობით რიცხვში ინახავენ — მათ „წონებს“ უწოდებენ. თუ მოდელს რომელიმე სახელი ვებძებნის გარეშე ახსენდება, ესე იგი ის „წონებშია“. ავტორების განმარტებით, ეს ნიშნავს, რომ ტრენინგის დროს მოდელმა პიროვნება საკმარისად მნიშვნელოვნად ჩათვალა, რომ ის თავის სტრუქტურაში ჩაეწერა. საიტის გვერდი ამას თავისებურ დიდებად აღწერს: ადამიანი იმდენ ხანს „ცოცხლობს“, რამდენ ხანსაც თავად მოდელი.

როგორ ითვლება ქულა

თითოეული სახელი მოდელების სიას ეგზავნება მოთხოვნით, როგორიცაა „ვინ არის <სახელი>? მოგვეცი 10-მდე შედეგი, თითოეულს მოკლე აღწერა და სანდოობის ხარისხი“. პასუხები მსგავსების მიხედვით ჯგუფდება და საშუალოდ ერთ „სიძლიერის ქულად“ გარდაიქმნება; ბონუსი ემატება იმის მიხედვით, რამდენმა მოდელმა იცნო სახელი საერთოდ. მოდელების სია ფართოა: GPT-5.5, GPT-5.6 Sol, Terra და Luna, GPT-5.4 Mini, Opus 4.8, Haiku 4.5, Grok 4.20, Gemini 3.1 Lite, Thinky Inkling, Kimi K2 0905, DeepSeek V4, Llama 3.3 70B, Llama 3.2 1B, GLM 4.7 Flash, Mistral 3.2 24B და Qwen3 8B.

პატარა მოდელი — რთული გამოცდა

ავტორები ხაზს უსვამენ, რომ მოდელის ზომას მნიშვნელობა აქვს: რაც უფრო პატარაა მოდელი, მით უფრო ძნელია მის „წონებში“ მოხვედრა. სახელი, რომელიც Llama 3.2 1B-ში გვხვდება, მათი შენიშვნით, საკმარისად მნიშვნელოვანია, რომ დაახლოებით ერთი გიგაბაიტი პარამეტრის ფარგლებში იყოს წარმოდგენილი, მაშინ როცა იმავე ადამიანის პოვნა გაცილებით დიდ სისტემაში უფრო ადვილია.

რეიტინგი, შეზღუდვები და კურიოზები

ყოველდღიური ცხრილი „დღევანდელი მძიმე წონები“ ყველაზე ძლიერ სახელებს ალაგებს — წერის მომენტისთვის პირველ ადგილებზე იყვნენ ვენუსტიანო კარანსა 979 ქულით, მესოპოტამიური ღვთაება მარდუკი 952-ით, ირლანდიელი მეფე ნიალ ნოიგიალახი 946-ით, ასტრონომი ენი ჯამპ კენონი 925-ით და პოკემონი როტომი 903-ით. ავტორები ღიად აღიარებენ მეთოდის სისუსტეებს: არასწორად დაწერილი სახელები დაბალ ქულას იღებს, მოდელების მიერ თვითდეკლარირებული სანდოობა დაკალიბრებული არ არის და გაშვებებს შორის იცვლება, გავრცელებული სახელები ბევრი დამთხვევის გამო დაბლა რჩება, ხოლო მოდელებს ზოგჯერ არარსებული ბიოგრაფიული დეტალების გამოგონებაც სჭირს. მთავარ გვერდზე გამოსახულებები gpt-5.4-image-2-ის „წონებით“ იქმნება და მხოლოდ პირველ 20-ს ეძლევა — პროცესი ძვირია.

SSiTech

SiTech — AI-გაძლიერებული ვებ დეველოპმენტი

ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.