Վերադառնալ
170 հազար անգլերեն բառերի թեստը քննադատության արժանացավ մեթոդաբանության համար
SiTech AI Team3 წთ. საკითხავი

170 հազար անգլերեն բառերի թեստը քննադատության արժանացավ մեթոդաբանության համար

Անգլերենի շուրջ 170 հազար բառից քանիսն եք ճանաչում գնահատող վեբ հավելվածը Hacker News-ում հավաքեց 501 միավոր և 555 մեկնաբանություն. օգտվողները կասկածի տակ դրեցին ընտրանքի մեթոդը, բառերի գոտիներն ու տեմպը։

Google Cloud Run-ում տեղակայված վեբ հավելվածը պարզ հարց է տալիս՝ անգլերենի շուրջ 170 հազար բառից քանի՞սն եք ճանաչում, և պատասխանում է 100 հարցից բաղկացած թեստով, որն ավարտվում է մեկ թվով։ Hacker News-ում հրապարակումը հավաքել է 501 միավոր և 555 մեկնաբանություն, սակայն քննարկման մեծ մասը ոչ թե թվի, այլ այն հաշվարկելու եղանակի մասին էր։

Ինչպես է թեստը աշխատում ըստ իր իսկ բացատրության

Հավելվածի «Ինչպես է սա հաշվարկվում» էջը, որը մեջբերում են մեկնաբանները, նշում է, որ Օքսֆորդի անգլերեն բառարանը (երկրորդ հրատարակություն) գործածության մեջ հաշվում է մոտավորապես 171 476 բառ։ Պատահական բառերի փոխարեն գործիքը, ըստ իր նկարագրության, օգտագործում է շերտավորված ընտրանք և լեզուն բաժանում է բարդության հինգ գոտիների՝ ըստ գործածության հաճախականության՝ հիմնական (~3 000 բառ), միջին (~7 000), առաջադեմ (~10 000), փորձագիտական (~25 000) և «անհասկանալի» (40 000+)։ Գնահատականը յուրաքանչյուր գոտում ճշգրտության ու գոտու չափի արտադրյալների գումարն է։

Այս թվաբանությունը անմիջապես հարցեր առաջացրեց. գոտիները միասին տալիս են մոտ 85 000 բառ, ոչ թե 170 000, այսինքն՝ բոլոր հարցերին ճիշտ պատասխանած օգտվողն անգամ ստանում է լեզվի մոտավորապես կեսին հավասար «գիտական գնահատական»։ Մի քանի մեկնաբան հենց այդպիսի արդյունք հաղորդեցին՝ 85 000 բառ անթերի անցումից հետո։

Ինչ առարկություններ եղան բառերի ու սահմանումների վերաբերյալ

Օգտվողները վիճարկում էին առանձին բառերի դասակարգումը։ Ըստ մեկ մեկնաբանի՝ «breviary» բառը նշված էր որպես միջին մակարդակ, ինչը նրա կարծիքով չափազանց հեշտ տեղ է այն բառի համար, որը շատ ընթերցողներ երբեք չեն տեսել. մյուսները պաշտպանում էին՝ նշելով, որ այն ծանոթ է կաթոլիկներին և միջնադարյան ձեռագրերի ընթերցողներին։ «Metamorphosis»-ը և «kinetic»-ը նշված էին փորձագիտական մակարդակում, ինչը ոմանց անհավանական թվաց։ Իսկ «Hippopotomonstrosesquippedaliophobia»-ն անվանվեց ցուցադրական բառ՝ ճանաչելի միայն իր մասերի շնորհիվ, ինչը, ըստ մեկ ընթերցողի, ավելի շուտ վիկտորինա է, քան բառապաշար։

Որոշ սահմանումներ էլ քննադատվեցին որպես անորոշ, օրինակ՝ «lethargy»-ն՝ «լեթարգիայի վիճակ» ձևակերպմամբ։ Ընտրովի պատասխանների ձևաչափը նաև հեշտացնում էր գուշակելը. մեկնաբանների դիտարկմամբ՝ ամենաերկար տարբերակը հաճախ ճիշտ էր, իսկ սխալ պատասխանները հաճախ կրկնում էին նույն կաղապարը՝ ճիշտ իմաստ, հակառակ իմաստ և երկու անկապ տարբերակ։

Տեմպ, կողմնակալություն և օգտվողների ցանկությունները

Ամենահաճախ դժգոհությունը տեխնիկական էր՝ երեք սեղմում մեկ բառի համար, որտեղ մեկը բավական կլիներ, և 100 բառ, որ պետք է անցնել։ Ոմանք շուտ դադարեցին։ Մեկ մեկնաբան պնդում էր, որ թեստը գրեթե հարմարվողական չէ, մյուսները կարծում էին, որ բոլորին նույն բառացանկն են ցույց տալիս, թեև ոմանք այլ բառեր էին տեսնում։ Առաջարկվող լուծումների թվում էին շատ ավելի մեծ բառացանկի փորձարկումն ու յուրաքանչյուր օգտվողի համար հարցերի ընտրանքը, գնահատականի թարմացումը յուրաքանչյուր պատասխանից հետո, «չգիտեմ» կոճակը և սխալ պատասխանների ամփոփումը։

Քննարկման մեջ հրապարակված արդյունքները տատանվում էին մոտ 61 000-ից մինչև 85 000 բառ։ Մեկ մեկնաբան, որը հավելվածի թիվը համեմատել էր 1970 թվականի Shorter Oxford English Dictionary-ից պատահական ընտրանքի հետ, եզրակացրեց, որ ցուցանիշը ուռճացված է. մյուսի կարծիքով՝ բառացանկը խիստ թեքված է դեպի լատինական և հունական արմատները, ինչը առավելություն է տալիս այդ լեզուների կրողներին։

SSiTech

SiTech — AI-ով հզորացված վեբ մշակում

Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։