
AI գործակալներն ավելի շատ աշխատանք են կատարում մոդելի մշակման մեջ, բայց որոշումները կայացնում են մարդիկ
Ֆուդանի համալսարանի թիմը վերլուծել է իր իսկ մոդելային նախագծի 700-ից ավելի առաջադրանքի մատյան. AI-ն օգտագործվել է վերանայված առաջադրանքների 96,5%-ում, սակայն մեթոդների վերաբերյալ որոշումների 85,5%-ը եւ նպատակների ու ծավալի 93,4%-ը կայացրել են մարդիկ:
Չինաստանի Ֆուդանի համալսարանի հետազոտողները ուսումնասիրել են սեփական նախագիծը՝ պարզելու, թե ով է կայացնում որոշումները, երբ AI գործակալները մոդել են ստեղծում, եւ վերլուծել 56 մասնակցի 700-ից ավելի առաջադրանքի մատյան:
Նախագծի արդյունքը Atria Dawn Preview-ն է՝ mixture-of-experts ճարտարապետությամբ 744 միլիարդ պարամետրանի մոդել: Ուսուցման յուրաքանչյուր առաջադրանք կապված է իրական միջավայրի հետ եւ ստուգվում թեստերով, չափիչներով կամ աղբյուրների ապացույցներով: Թիմի խոսքով՝ մոդելը առաջատար է 16 չափանիշներից հինգում՝ այդ թվում վեբ որոնման ու կիբերանվտանգության, բայց ընդհանուր առավելություն չունի:
Գործակալները վերցնում են ավելի շատ աշխատանք
Առաջադրանքների 96,5%-ում AI օգտագործվել է: Չորս շաբաթում մեկ մուտքագրմանը բաժին ընկնող գործակալային գործողությունների մեդիանան 11-ից բարձրացել է 28,5-ի, թիմը սակայն զգուշացնում է՝ սա ինքնավարության աճ չէ. մարդու յուրաքանչյուր որոշում պարզապես ավելի շատ գործակալային քայլեր էր առաջացնում:
Մասնակիցները գնահատել են նաեւ՝ կկարողանա՞ն ավարտել իրենց մասը առանց AI-ի: AI-ի աջակցությամբ ավարտված 455 առաջադրանքից 151-ը՝ մոտ մեկ երրորդը, անհնարին էր առանց դրա, իսկ դրանք բաշխվել են 56 մասնակիցներից 27-ի վրա: AI-ը հնարավոր է դարձրել աշխատանք, որն այլապես երբեք չէր սկսվի:
AI-ը առաջարկում է, մարդն ընտրում
Մեթոդների եւ պարամետրերի դեպքում ամենատարածված սխեման «AI-ը առաջարկում է, մարդն ընտրում» էր՝ 55,4%: Այդ որոշումների 85,5%-ը կայացրել են մարդիկ, AI-ը՝ ընդամենը 9,2%, իսկ նպատակների ու ծավալի վերջին խոսքը 93,4% դեպքում մարդունն էր:
Երբ ինչ-որ բան սխալ է ընթանում, պատկերը նույնն է: Դժվարության գրանցված 588 առաջադրանքից 76%-ը առաջ է շարժվել մարդու միջամտությամբ, 23%-ը լուծել է գործակալը, իսկ օգնությունը հիմնականում եղել է համատեքստ (35,2%) կամ ախտորոշում (34,7%), ոչ թե ձեռքի աշխատանք:
«Ռետինե կնիքի» ռիսկը
Երբ ամեն որոշում հենվում է մարդու ստուգելիքից երկար գործակալային շղթայի վրա, վերահսկողությունը բարդանում է. ամենավատ դեպքում մարդիկ դառնում են ստուգողներ, որոնք կարող են միայն ֆորմալ հաստատել տեսածը, գրում են հեղինակները: Շատ մասնակիցներ գործակալներին ինքնավար ռեժիմով են գործարկել՝ հարմարավետությունից ելնելով, ոչ թե AI-ի լիազորությունների շուրջ գիտակցված ընտրությամբ:
Հոդվածը լույս է տեսել ռեկուրսիվ ինքնակատարելագործման բանավեճի պահին. Anthropic-ը գտնում է, որ սեփական հաջորդին մշակող AI-ը կարող է իրականանալ սպասվածից շուտ, եւ տնօրեն Դարիո Ամոդեյը կոչ է անում ոլորտի համար արագության սահմանափակում սահմանել, իսկ առաջատար AI ընկերությունների հազարից ավելի աշխատակիցներ զգուշացրել են, որ իրենց կազմակերպությունները կարող են լինել AI հետազոտությունների ավտոմատացման շեմին:
SiTech — AI-ով հզորացված վեբ մշակում
Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։