
Google-მა Gemini 4 Argon წარადგინა: ტესტებში ლიდერია, წვდომა კი შეზღუდულია
Google-მა ახალი ფლაგმანური მოდელი Gemini 4 Argon წარადგინა. კომპანიის ტესტებით ის OpenAI-სა და Anthropic-ის ტოპ მოდელებს უსწრებს, თუმცა ჯერჯერობით მხოლოდ კიბერუსაფრთხოების პარტნიორების მცირე ჯგუფისთვისაა ხელმისაწვდომი.
Google-მა ოთხშაბათს ახალი ფლაგმანური მოდელი Gemini 4 Argon წარადგინა. ამჟამად ის მხოლოდ კიბერუსაფრთხოების პარტნიორების მცირე ჯგუფისთვისაა ხელმისაწვდომი. კომპანიის თქმით, წვდომა ეტაპობრივად ფართოვდება და ამ პროცესში ის აშშ-ის მთავრობის გამოქვეყნებამდე შეფასების ნებაყოფლობით პროცედურაში მონაწილეობს.
ტესტებში უპირატესობა ცოდნის სამუშაოზე
Google-ის საკუთარ ტესტებში Argon 18 ტესტიდან 13-ში პირველია Anthropic-ის Claude Opus 5.5-სა და Fable 5.1-თან და OpenAI-ის GPT-6 Astra-სთან შედარებით. ყველაზე დიდი სხვაობა იმ ამოცანებზეა, რომლებსაც კომპანია ცოდნის სამუშაოდ აჯგუფებს: Vals Index-ზე Argon 68,9%-ს აღწევს, GPT-6 Astra კი 63,1%-ს; Vals Finance Agent v2-ზე მისი შედეგი 65,4%-ია, უახლოესი მეტოქის კი 58,9%. Zapier-ის AutomationBench-ზე მოდელი 51,3%-ს აჩვენებს, რაც Opus 5.5-ს თითქმის ცხრა პროცენტული პუნქტით უსწრებს.
კოდირებაში შედეგები შერეულია
კოდირების სურათი ნაკლებად ცალსახაა. Google-მა DeepSWE v1.1-ზე 77,9%-იანი ახალი რეკორდი აღნიშნა, თუმცა FrontierSWE v2-სა და Terminal-Bench 4.0-ზე Argon ბოლო ადგილზეა: GPT-6 Astra და Opus 5.5 მას, შესაბამისად, 10,5 და ცხრა პუნქტით უსწრებენ. Vibe Code Bench-ზე მოდელმა 91,9% აიღო, თუმცა ოთხივე მოდელი 89%-ს სცდება. კომპანია ასევე იტყობინება 84,2%-ს GraphWalks ტესტში 256 ათასიდან 1 მილიონ ტოკენამდე შეყვანისთვის, რაც GPT-6 Astra-ს 12 პუნქტზე მეტით აღემატება. Harvey-ის Legal Agent Benchmark-ზე Argon-ის 19,6% Fable 5.1-ის შედეგს თითქმის სამჯერ აღემატება, თუმცა ეს მაინც ხუთიდან მხოლოდ ერთი სრულად დასრულებული ამოცანაა.
მილიონი გამომავალი ტოკენი და ნაკლები შეზღუდვა
ერთი ფუნქცია განსაკუთრებით გამოირჩევა: Argon-ს მილიონამდე გამომავალი ტოკენის გენერირება შეუძლია, Gemini-ის წინა მოდელების 64 ათასის ნაცვლად. Google-ის მტკიცებით, ეს დამატებითი სივრცე მოდელს ხანგრძლივი ამოცანების ერთ ნაბიჯში გააზრების საშუალებას აძლევს. კიბერუსაფრთხოების მიმართულებით კომპანიამ Argon მოწყვლადობების დამოუკიდებლად მოსაძებნად, შესამოწმებლად და გასასწორებლად გაწვრთნა; Fairwind-ის მონაწილეებისთვის და შიდა გუნდებისთვის ის კიბერშეზღუდვების გარეშე გამოდის. Wiz, რომელიც Google-მა მარტში 32 მილიარდ დოლარად შეიძინა, Argon-ს უკვე იყენებს Scan for Good ინიციატივაში; კომპანიის თქმით, მოდელმა მსოფლიოს საავადმყოფოების მიერ გამოყენებულ ჯანდაცვის პროგრამულ უზრუნველყოფაში კრიტიკული ხარვეზი იპოვა.
წვდომა და ფასი
Argon სინამდვილეში ის ახალი Pro მოდელია, რომელზეც Google-მა მაისში I/O კონფერენციაზე ისაუბრა. გამოშვება ივნისისთვის იგეგმებოდა, თუმცა ვადა გადაიწია და სამაგიეროდ Flash მოდელების სერია გამოვიდა. კომპანია ადრეული ტესტერებისგან გამოხმაურებას შეაგროვებს და შეზღუდვებს მორგებს, სანამ Argon Fairwind პროგრამის გარეთ გახდება ხელმისაწვდომი. ამის შემდეგ მოდელს პირველად API მომხმარებლები და AI Ultra-ს გამომწერები მიიღებენ. ფასი ჯერ არ დასახელებულა. განცხადება გაკეთდა ერთი დღით მას შემდეგ, რაც Google-ის CEO სუნდარ პიჩაი დონალდ ტრამპთან შეხვედრის შემდეგ შეუერთდა AI-ის განვითარების თვითრეგულირების ვალდებულებას; დოკუმენტს Anthropic, Meta, NVIDIA, OpenAI და SpaceX-იც აწერს ხელს.
წყაროები: The New Stack · Techmeme
SiTech — AI-გაძლიერებული ვებ დეველოპმენტი
ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.