
Google-ը ներկայացրել է Gemini 4 Argon-ը՝ թեստերում առաջատար է, սակայն հասանելիությունը սահմանափակ է
Google-ը ներկայացրել է նոր ֆլագմանական մոդել Gemini 4 Argon-ը։ Ընկերության թեստերով այն առաջ է OpenAI-ի և Anthropic-ի թոփ մոդելներից, սակայն առայժմ հասանելի է միայն կիբերանվտանգության գործընկերների փոքր խմբին։
Google-ը չորեքշաբթի ներկայացրել է նոր ֆլագմանական մոդել Gemini 4 Argon-ը։ Ներկայում այն հասանելի է միայն կիբերանվտանգության գործընկերների փոքր խմբին։ Ընկերության խոսքով՝ հասանելիությունը աստիճանաբար ընդլայնվում է, և այս գործընթացում այն մասնակցում է ԱՄՆ կառավարության հրապարակումից առաջ գնահատման կամավոր ընթացակարգին։
Առավելություն գիտելիքի աշխատանքի թեստերում
Google-ի սեփական թեստերում Argon-ը 18 թեստից 13-ում առաջինն է՝ Anthropic-ի Claude Opus 5.5-ի ու Fable 5.1-ի և OpenAI-ի GPT-6 Astra-ի համեմատ։ Ամենամեծ տարբերությունը այն առաջադրանքներում է, որոնք ընկերությունը խմբավորում է որպես գիտելիքի աշխատանք. Vals Index-ում Argon-ը հասնում է 68,9%-ի, իսկ GPT-6 Astra-ն՝ 63,1%-ի. Vals Finance Agent v2-ում նրա արդյունքը 65,4% է, մոտակա մրցակցինը՝ 58,9%։ Zapier-ի AutomationBench-ում մոդելը ցույց է տալիս 51,3%, ինչը գրեթե ինը տոկոսային կետով առաջ է Opus 5.5-ից։
Կոդավորման արդյունքները խառն են
Կոդավորման պատկերն ավելի քիչ միանշանակ է։ Google-ը DeepSWE v1.1-ում նշել է 77,9%-ի նոր ռեկորդ, սակայն FrontierSWE v2-ում և Terminal-Bench 4.0-ում Argon-ը վերջին տեղում է. GPT-6 Astra-ն և Opus 5.5-ը նրան համապատասխանաբար առաջ են 10,5 և ինը կետով։ Vibe Code Bench-ում մոդելը վերցրել է 91,9%, թեև բոլոր չորս մոդելներն անցնում են 89%-ը։ Ընկերությունը նաև հայտնում է 84,2% GraphWalks թեստում՝ 256 հազարից 1 միլիոն թոքեն մուտքի դեպքում, ինչը 12 կետից ավելի է գերազանցում GPT-6 Astra-ին։ Harvey-ի Legal Agent Benchmark-ում Argon-ի 19,6%-ը գրեթե երեք անգամ գերազանցում է Fable 5.1-ի արդյունքը, սակայն դա միևնույն է հինգից միայն մեկ ամբողջությամբ ավարտված առաջադրանք է։
Միլիոն ելքային թոքեն և ավելի քիչ սահմանափակում
Մեկ գործառույթ հատկապես առանձնանում է. Argon-ը կարող է գեներացնել մինչև միլիոն ելքային թոքեն՝ Gemini-ի նախորդ մոդելների 64 հազարի փոխարեն։ Google-ի պնդմամբ՝ այս լրացուցիչ տարածությունը մոդելին թույլ է տալիս երկար առաջադրանքները մեկ քայլով ըմբռնել։ Կիբերանվտանգության ուղղությամբ ընկերությունը Argon-ը վարժեցրել է խոցելիությունները ինքնուրույն գտնելու, ստուգելու և ուղղելու համար. Fairwind-ի մասնակիցների և ներքին թիմերի համար այն գործում է առանց կիբերսահմանափակումների։ Wiz-ը, որը Google-ը մարտին գնել է 32 միլիարդ դոլարով, արդեն օգտագործում է Argon-ը Scan for Good նախաձեռնության մեջ. ընկերության խոսքով՝ մոդելը կրիտիկական թերություն է գտել աշխարհի հիվանդանոցների կողմից օգտագործվող առողջապահական ծրագրային ապահովման մեջ։
Հասանելիություն և գին
Argon-ը իրականում այն նոր Pro մոդելն է, որի մասին Google-ը խոսել է մայիսին I/O համաժողովում։ Թողարկումը նախատեսված էր հունիսի համար, սակայն ժամկետը տեղափոխվեց, և դրա փոխարեն լույս տեսավ Flash մոդելների շարքը։ Ընկերությունը վաղ թեստավորողներից արձագանք կհավաքի և կկարգավորի սահմանափակումները, քանի դեռ Argon-ը հասանելի կդառնա Fairwind ծրագրից դուրս։ Դրանից հետո մոդելը սկզբում կստանան API օգտվողները և AI Ultra-ի բաժանորդները։ Գինը դեռ չի նշվել։ Հայտարարությունը արվել է մեկ օր այն բանից հետո, երբ Google-ի CEO Սունդար Պիչայը Դոնալդ Թրամփի հետ հանդիպումից հետո միացավ AI-ի զարգացման ինքնակարգավորման պարտավորությանը. փաստաթուղթը ստորագրում են նաև Anthropic, Meta, NVIDIA, OpenAI և SpaceX-ը։
Աղբյուրներ՝ The New Stack · Techmeme
SiTech — AI-ով հզորացված վեբ մշակում
Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։