Վերադառնալ
Շարադրություն. LLM դարաշրջանի անհասկանալի ձախողումները դառնում են նորմա
SiTech AI Team3 წთ. საკითხავი

Շարադրություն. LLM դարաշրջանի անհասկանալի ձախողումները դառնում են նորմա

ihatethefuture.com բլոգում հրապարակված շարադրությունը պնդում է, որ LLM-ով արագացված մշակումը սովորեցնում է թե՛ ստեղծողներին, թե՛ օգտատերերին ընդունել «երբեմն ուղղակի վատ է» արտահայտությունը՝ ձախողումների իրական պատճառները փնտրելու փոխարեն։

ihatethefuture.com բլոգում հրապարակված շարադրությունը (հեղինակի կեղծանունը՝ patrickxia) գլխավորել է Hacker News-ը։ Հեղինակի պնդմամբ՝ LLM-ով արագացված մշակույթը աստիճանաբար նորմա է դարձնում ձախողումները, որոնց պատճառը ոչ ոք չի փորձում բացատրել։

«Stupid thing sucks»

Տեքստը սկսվում է մուլտֆիլմի երկու կադրով, որտեղ հերոսը փորձում է անցնել չբացվող դռնից։ Խոչընդոտը կոնկրետ է. սկզբում ճանապարհին մարդու մարմին է, ապա՝ մոտ մեկ միլիարդ դոլար արժողությամբ ոսկի։ Երկու դեպքում էլ հերոսը մրմնջում է «stupid thing sucks» (մոտավորապես՝ «հիմար բան, ուղղակի վատ») ու գնում առաջ։ Հեղինակը սա «դռների ողջամիտ մոդել» չի համարում. ձախողումն ուներ կոնկրետ պատճառ, իսկ մեղադրանքն ընկավ սխալ օբյեկտի վրա։

Jev-ը և «AI-powered» նշանը

Հետո շարադրությունն անցնում է Jev-ին՝ TypeSafe AI-ի մոդելին, որը վերադարձնում է տիպավորված արժեքներ հավանականության գնահատականների հետ միասին։ Ըստ հեղինակի՝ դրա առավելությունները արագությունն ու էժանությունն են, իսկ հարցն այն է, թե ինչ է լինում կառուցելուց հետո։ Գնորդները գրեթե չեն անցկացնում գնահատումներ (evals). անթափանց հարցեր են տալիս Jev-ին, ստանում անթափանց պատասխաններ ու նշում «AI-powered» վանդակը։ Երբ ներքևի մակարդակի տրամաբանությունը կոտրվում է, բացատրություն է դառնում «դե, AI-ն սխալվում է», իսկ սխալների բյուջեն, ձախողման ռեժիմներն ու թեստային հավաքածուները հետաձգվում են։ Ձախողումների տեմպը ի վերջո օգտատերն ինքն է բացահայտում։

Շարադրությունը կանխավ պատասխանում է ակնհայտ պաշտպանությանը. Jev-ը վերադարձնում է վստահության գնահատականներ։ Իսկ ի՞նչ կանեք դրանցով։ Ողջամիտ որոշման համար հարկավոր է հասկանալ, թե որքան լավ է գնահատականը տրամաչափված, և պատկերացում ունենալ անորոշության գնի մասին։ Ըստ հեղինակի՝ լավագույն դեպքում մարդիկ դրանք օգտագործում են «ծիսական» ձևով, վատագույն դեպքում՝ որպես ձախողված հարցման արդարացում. կարծես «73% վստահ» պատասխանը ձեզ 27% սխալի բյուջե հատկացնի։

Պատասխանատվությունը և հետաքննության վերջնակետը

Երբ կայքում կոճակը փչանում է, ինժեները սովորաբար պատկերացնում է, թե ինչ պետք է տեղի ունենար. խախտվել է պայմանագիր, DNS-ը ձախողվել է, ինչ-որ մեկը թողարկել է սկրիպտ՝ սինտաքսի սխալներով մեկ ուղու վրա, մշակիչը անսպասելի բացառություն է նետել։ Մերկ HTTP 500-ը վերլուծելու հասանելիություն կարող է չլինել, բայց կա մարդ, ում աշխատանքն է հասկանալ, թե ինչու վերջնակետը չի աշխատում։ Շատ օգտատերերի փորձը, սակայն, ավելի մոտ է «երբեմն ուղղակի վատ է» արտահայտությանը։

Շարադրության հիմնական վախը այն չէ, որ LLM-ով առաջնորդվող մշակումը ավելի շատ ձախողումներ կառաջացնի։ Կառաջացնի, արդեն առաջացրել է. դա նոր ձևով կառուցելու գինն է։ Վախն այն է, որ «երբեմն ուղղակի վատ է» արտահայտությունը գնալով դառնում է ինքնին հետաքննության ընդունելի ավարտը։ Հեղինակը դա կորուստ է համարում, քանի որ արագացված աշխատանքը կարող է նաև օգնել լուծել այդ խնդիրները. որակի ստուգման ավտոմատացված գործընթացները չեն գրվում ինժեներական ժամանակի բացակայության պատճառով, իսկ այն գնահատումը, որը կփոխարինի Jev-ին կամ կարդարացնի նրա կիրառությունը, «ընդամենը մի քանի prompt հեռավորության վրա է»։ Շարադրությունն ավարտվում է փոխաբերությամբ. մենք կառուցում ենք համակարգեր, որտեղ ո՛չ օգտատերը, ո՛չ ստեղծողը չեն ուզում ստուգել, թե արդյոք դռան հետևում մարմին կա։

SSiTech

SiTech — AI-ով հզորացված վեբ մշակում

Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։