უკან დაბრუნება
ტესტი, რომელიც ამტკიცებს, რომ 170 000 ინგლისური სიტყვიდან რამდენი იცით, კრიტიკას იწვევს
SiTech AI Team2 წთ. საკითხავი

ტესტი, რომელიც ამტკიცებს, რომ 170 000 ინგლისური სიტყვიდან რამდენი იცით, კრიტიკას იწვევს

Hacker News-ზე გამოქვეყნებულმა ვებ-ტესტმა, რომელიც ამტკიცებს, რომ 170 000 ინგლისური სიტყვიდან რამდენს იცნობთ, 501 ქულა და 555 კომენტარი მოაგროვა — დისკუსია მეთოდოლოგიასა და ტესტის სიგრძეს შეეხო.

Google Cloud Run-ზე განთავსებული ვებ-აპლიკაცია მარტივ კითხვას სვამს — რამდენი იცით ინგლისური ენის დაახლოებით 170 000 სიტყვიდან? — და პასუხს 100 კითხვისგან შემდგარი ტესტით იძლევა, რომელიც ერთ რიცხვით სრულდება. Hacker News-ზე გამოქვეყნებულმა პოსტმა 501 ქულა და 555 კომენტარი მოაგროვა, თუმცა დისკუსია თავად რიცხვზე ნაკლებად, მისი გამოთვლის წესზე მიდიოდა.

როგორ მუშაობს ტესტი მისივე ახსნით

აპლიკაციის გვერდი „როგორ ითვლება ეს“, რომელსაც კომენტატორები ციტირებენ, ამბობს, რომ ინგლისური ენის ოქსფორდის ლექსიკონის (მეორე გამოცემა) მიხედვით მიმდინარე ხმარებაში დაახლოებით 171 476 სიტყვაა. შემთხვევითი სიტყვების ნაცვლად ინსტრუმენტი სტრატიფიცირებულ შერჩევას იყენებს და ენას ხუმრობითი სიხშირის მიხედვით ხუთ სირთულის ზოლად ყოფს: საბაზისო (~3 000 სიტყვა), საშუალო (~7 000), გაფართოებული (~10 000), ექსპერტული (~25 000) და „ბუნდოვანი“ (40 000+). შეფასება თითოეულ ზოლში სიზუსტისა და ზოლის ზომის ნამრავლების ჯამია.

ეს არითმეტიკა მაშინვე ეჭვქვეშ დადგა: ზოლები ჯამში დაახლოებით 85 000 სიტყვას იძლევა და არა 170 000-ს, ამიტომ ყველა კითხვაზე სწორად პასუხის გაცემის შემთხვევაშიც „მეცნიერული შეფასება“ ენის დაახლოებით ნახევარია. რამდენიმე კომენტატორმა ზუსტად ეს შედეგი მიიღო — 85 000 სიტყვა უშეცდომო გავლის შემდეგ.

რა კითხვები გაუჩნდათ სიტყვებსა და განმარტებებს

მომხმარებლები ცალკეული სიტყვების კლასიფიკაციას აპროტესტებდნენ. ერთი კომენტატორის თქმით, „breviary“ საშუალო დონეზე იყო მოხსენიებული, რაც მისთვის ზედმეტად მარტივია; სხვები იცავდნენ, რომ სიტყვა კათოლიკეებისა და შუა საუკუნეების ხელნაწერების მკითხველებისთვის ნაცნობია. „Metamorphosis“ და „kinetic“ ექსპერტულ დონეზე იყო მოთავსებული, რაც ზოგს დაუჯერებლად მოეჩვენა. „Hippopotomonstrosesquippedaliophobia“ კი „საჩვენებელ“ სიტყვად მოიხსენიეს — მისი ნაწილების გამო, რაც, ერთი მკითხველის სიტყვებით, ლექსიკაზე ნაკლებად და ტრივიაზე მეტადაა დამოკიდებული.

ზოგიერთი განმარტება ბუნდოვნადაც შეფასდა — მაგალითად, „lethargy“ განმარტებული როგორც „ლეთარგიულობის მდგომარეობა“. ტესტის ფორმატი გამოცნობას აადვილებდა: კომენტატორების დაკვირვებით, ყველაზე გრძელი ვარიანტი ხშირად სწორი იყო, ხოლო არასწორი პასუხები ხშირად ერთსა და იმავე ნიმუშს მიჰყვებოდა — სწორი მნიშვნელობა, საწინააღმდეგო მნიშვნელობა და ორი შეუსაბამო ვარიანტი.

ტემპი, მიკერძოება და მომხმარებლების სურვილები

ყველაზე ხშირი საჩივარი ტექნიკური იყო: სამი დაწკაპუნება თითო სიტყვაზე, სადაც ერთიც საკმარისი იქნებოდა, და 100 სიტყვა, რომელიც ბოლომდე უნდა გაიარო. ნაწილმა ადრევე შეწყვიტა. ერთი კომენტატორის აზრით, ტესტი ადაპტური თითქმის არ არის; სხვები ვარაუდობდნენ, რომ ყველას ერთი და იგივე სიტყვების სია უჩვენდება, თუმცა ზოგი სხვა სიტყვებსაც ხედავდა. შემოთავაზებულ გამოსწორებებს შორის იყო გაცილებით დიდი სიტყვების ნაკრების ტესტირება და თითო მომხმარებლისთვის კითხვების შერჩევა, შეფასების ყოველი პასუხის შემდეგ განახლება, ღილაკი „არ ვიცი“ და შეცდომების შეჯამება.

თრედში გამოქვეყნებული შედეგები დაახლოებით 61 000-დან 85 000 სიტყვამდე მერყეობდა. ერთმა კომენტატორმა, რომელმაც აპლიკაციის რიცხვი 1970 წლის Shorter Oxford English Dictionary-დან შემთხვევით აღებულ ნიმუშს შეადარა, დაასკვნა, რომ მაჩვენებელი გაზვიადებულია; სხვისი აზრით, სიტყვების სია ლათინურ და ბერძნულ ფესვებზეა გადახრილი, რაც ამ ენების მატარებლებს უპირატესობას აძლევს.

SSiTech

SiTech — AI-გაძლიერებული ვებ დეველოპმენტი

ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.