Վերադառնալ
AI գործակալներն ավելի շատ աշխատանք են կատարում մոդելի մշակման մեջ, բայց որոշումները կայացնում են մարդիկ
SiTech AI Team2 წთ. საკითხავი

AI գործակալներն ավելի շատ աշխատանք են կատարում մոդելի մշակման մեջ, բայց որոշումները կայացնում են մարդիկ

Ֆուդանի համալսարանի թիմը վերլուծել է իր իսկ մոդելային նախագծի 700-ից ավելի առաջադրանքի մատյան. AI-ն օգտագործվել է վերանայված առաջադրանքների 96,5%-ում, սակայն մեթոդների վերաբերյալ որոշումների 85,5%-ը եւ նպատակների ու ծավալի 93,4%-ը կայացրել են մարդիկ:

Չինաստանի Ֆուդանի համալսարանի հետազոտողները ուսումնասիրել են սեփական նախագիծը՝ պարզելու, թե ով է կայացնում որոշումները, երբ AI գործակալները մոդել են ստեղծում, եւ վերլուծել 56 մասնակցի 700-ից ավելի առաջադրանքի մատյան:

Նախագծի արդյունքը Atria Dawn Preview-ն է՝ mixture-of-experts ճարտարապետությամբ 744 միլիարդ պարամետրանի մոդել: Ուսուցման յուրաքանչյուր առաջադրանք կապված է իրական միջավայրի հետ եւ ստուգվում թեստերով, չափիչներով կամ աղբյուրների ապացույցներով: Թիմի խոսքով՝ մոդելը առաջատար է 16 չափանիշներից հինգում՝ այդ թվում վեբ որոնման ու կիբերանվտանգության, բայց ընդհանուր առավելություն չունի:

Գործակալները վերցնում են ավելի շատ աշխատանք

Առաջադրանքների 96,5%-ում AI օգտագործվել է: Չորս շաբաթում մեկ մուտքագրմանը բաժին ընկնող գործակալային գործողությունների մեդիանան 11-ից բարձրացել է 28,5-ի, թիմը սակայն զգուշացնում է՝ սա ինքնավարության աճ չէ. մարդու յուրաքանչյուր որոշում պարզապես ավելի շատ գործակալային քայլեր էր առաջացնում:

Մասնակիցները գնահատել են նաեւ՝ կկարողանա՞ն ավարտել իրենց մասը առանց AI-ի: AI-ի աջակցությամբ ավարտված 455 առաջադրանքից 151-ը՝ մոտ մեկ երրորդը, անհնարին էր առանց դրա, իսկ դրանք բաշխվել են 56 մասնակիցներից 27-ի վրա: AI-ը հնարավոր է դարձրել աշխատանք, որն այլապես երբեք չէր սկսվի:

AI-ը առաջարկում է, մարդն ընտրում

Մեթոդների եւ պարամետրերի դեպքում ամենատարածված սխեման «AI-ը առաջարկում է, մարդն ընտրում» էր՝ 55,4%: Այդ որոշումների 85,5%-ը կայացրել են մարդիկ, AI-ը՝ ընդամենը 9,2%, իսկ նպատակների ու ծավալի վերջին խոսքը 93,4% դեպքում մարդունն էր:

Գծապատկեր՝ վերջնական որոշումը հիմնականում մարդիկ են կայացնում

Երբ ինչ-որ բան սխալ է ընթանում, պատկերը նույնն է: Դժվարության գրանցված 588 առաջադրանքից 76%-ը առաջ է շարժվել մարդու միջամտությամբ, 23%-ը լուծել է գործակալը, իսկ օգնությունը հիմնականում եղել է համատեքստ (35,2%) կամ ախտորոշում (34,7%), ոչ թե ձեռքի աշխատանք:

«Ռետինե կնիքի» ռիսկը

Երբ ամեն որոշում հենվում է մարդու ստուգելիքից երկար գործակալային շղթայի վրա, վերահսկողությունը բարդանում է. ամենավատ դեպքում մարդիկ դառնում են ստուգողներ, որոնք կարող են միայն ֆորմալ հաստատել տեսածը, գրում են հեղինակները: Շատ մասնակիցներ գործակալներին ինքնավար ռեժիմով են գործարկել՝ հարմարավետությունից ելնելով, ոչ թե AI-ի լիազորությունների շուրջ գիտակցված ընտրությամբ:

Հոդվածը լույս է տեսել ռեկուրսիվ ինքնակատարելագործման բանավեճի պահին. Anthropic-ը գտնում է, որ սեփական հաջորդին մշակող AI-ը կարող է իրականանալ սպասվածից շուտ, եւ տնօրեն Դարիո Ամոդեյը կոչ է անում ոլորտի համար արագության սահմանափակում սահմանել, իսկ առաջատար AI ընկերությունների հազարից ավելի աշխատակիցներ զգուշացրել են, որ իրենց կազմակերպությունները կարող են լինել AI հետազոտությունների ավտոմատացման շեմին:

SSiTech

SiTech — AI-ով հզորացված վեբ մշակում

Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։