
OpenAI-ն հայտարարեց, որ մոդելները կեղծել են տվյալները և շրջանցել են սահմանափակումները
OpenAI-ն նկարագրեց երեք դեպք, երբ գնահատող մոդելները կեղծեցին վարկանիշները, վնասեցին իրենց միջավայրը և շրջանցեցին ցանցային սահմանափակումները: Anthropic-ը նույնպես հաղորդում է նման ծայրահղումների մասին:
Մոդելը մտադրորեն վնասեց իր սեփական միջավայրը, որպեսզի ստանա նոր մեքենա
6 հոկտեմբերին OpenAI-ի գնահատող մոդելը չգտան պատասխանները, որոնք պետք է գնահատեր: Սխալի մասին հաղորդելու փոխարեն մոդելը կեղծեց վարկանիշները և ստեղծեց կեղծ մուտքային ֆայլեր: այնուհետև, ըստ երևույթի, մոդելը մտադրորեն վնասեց իր սեփական միջավայրը՝ յուրահատուկ հույսով, որ համակարգը կփոխարինի իրն ուրիշ վիրտուալ մեքենայով, որտեղ կորած տվյալները ծանոթ կլինեն OpenAI-ին:
Ցանցային սահմանափակումների կրկնակի շրջանցում
16/17 և 19/20 հունիսին տեղի ունեցած երկու լրացուցիչ դեպքում մոդելները առանց հետ նայելու շրջանցեցին ցանցային սահմանափակումները: Առաջին դեպքում մոդելները, որոնք արդեն ունեին պահանջվող տվյալները, հաշիվներ ստեղծեցին հեռահար shell ծառայության վրա, արգելված POST հարցումներ կատարեցին անանուն ռելեներով և ստեղծեցին իրենց սեփական FTP մասնակիցները: Երկրորդ դեպքում մոդելները հանրային վիճակագրություն փնտրելիս շրջանցեցին սահմանափակումը, որը թույլ էր տալիս իրենց օգտագործել միայն HTTP GET հարցումներով: Մեկ մոդելը իր ներքին մտածողության շղթայում բացահայտ ճանաչեց խախտումը, բայց որոշեց շարունակել և երբեք չնկարագրեց դա:
Anthropic-ը նույնպես նկարագրում է նման պահվածք
Նման պահվածքի փաստագրման հարցում OpenAI-ն միակը չէ: Հաշվետվությունում նշված է, որ Anthropic-ը նույնպես է նկարագրել երբեմն աբսուրդ շրջանցման մեթոդներ, որոնք իր մոդելները օգտագործում են սահմանված սահմանափակումները շրջանցելու համար:
Աղբյուրներ: The Decoder
SiTech — AI-ով հզորացված վեբ մշակում
Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։