
Mistral-მა გამოუშვა „Le Chonk“, 1 ტრილიონი პარამეტრის ღია წონის მოდელი
ფრანგული AI ლაბორატორია Mistral-მა გამოუშვა Mistral Large 4, ზედმეტსახელად Le Chonk, 1 ტრილიონი პარამეტრის ღია წონის მოდელი, რომელიც, მისი თქმით, წამყვან კერძო სისტემებს ეჯიბრება. ის კოდინგსა და კიბერდაცვაზეა ოპტიმიზებული.
Mistral-მა გამოუშვა Le Chonk
ფრანგული AI კომპანია Mistral-მა გამოუშვა ახალი, თავისუფლად ხელმისაწვდომი მოდელი, რომელიც, მისი თქმით, აშშ-ისა და ჩინეთის საუკეთესო მოდელებს ეჯიბრება. 1 ტრილიონი პარამეტრის მქონე Mistral Large 4, ზედმეტსახელად Le Chonk, ყველას შეუძლია გამოიყენოს და მოირგოს. ახლა წინასწარი ვერსიაა ხელმისაწვდომი, საბოლოო ვერსია კი თვის ბოლომდე გამოვა.
Le Chonk ზოგადი დანიშნულების წამყვან მოდელებს უნდა ეჯიბრებოდეს, თუმცა სპეციალურად კოდინგსა და კიბერდაცვაზე, ასევე წარმოების, ფინანსების, ელექტროინჟინერიისა და სხვა ნიშების ამოცანებზეა ოპტიმიზებული. „ბევრი სფეროა, სადაც სხვა ლაბორატორიები ამდენად არ ფოკუსირდებიან“, ამბობს გიიომ ლამპლი, Mistral-ის თანადამფუძნებელი და მთავარი მეცნიერი, WIRED-თან. „უამრავი დომენია, სადაც მოდელების გაუმჯობესება შეიძლება“.
ღია წონის ალტერნატივა
Mistral Le Chonk-ს წარმოადგენს როგორც ჩინეთის გარეთ შექმნილ ყველაზე ძლიერ ღია წონის მოდელს, რომელიც ზოგიერთ კერძო მოდელს „ძალიან, ძალიან ახლოს“ დგას. აშშ-ის მთავრობა ჩინურ ლაბორატორიებს დისტილაციის, ანუ პატარა მოდელის დიდის შედეგებზე გაწვრთნის ბოროტად გამოყენებაში ადანაშაულებს, რათა OpenAI-სა და Anthropic-თან ჩამორჩენა შეამცირონ. Mistral ამტკიცებს, რომ მისი მოდელი ნულიდან გაწვრთნა.
ღია წონის მოდელები ბიზნესებისთვის უკვე იაფია, რადგან მხოლოდ მოხმარებული გამოთვლითი რესურსის ფასი ღირს. წამყვან კერძო მოდელებთან ჩამორჩენის შემცირებითა და ჩინურ გამოშვებებზე კონკურენტული ალტერნატივით, Mistral-ის თქმით, Le Chonk გააქრობს იმ მიზეზებს, რომლებიც ბიზნესს ღია კოდის არჩევისას აკავებს. „Mistral ჯერ კიდევ რბოლაშია საუკეთესო მოდელისთვის“, ამბობს ლამპლი. „ეს მთავარი გზავნილია“.
ზრდა დაძაბულობის ფონზე
OpenAI-სა და Anthropic-თან შედარებით ნაკლები კაპიტალითა და გამოთვლითი რესურსით, Mistral ჩვეულებრივ ჩამორჩებოდა მოდელების ხარისხში, შემოსავალსა და გამოშვებების სიხშირეში. ამერიკული ლაბორატორიები დახურულ მოდელებზე წვდომისთვის პრემიუმ ფასს იხდევინებენ, Mistral კი შემოსავალს იღებს გამოყენების მიხედვით გადახდით, ღრუბლოვანი სერვისით მოდელების გაშვებით და ინჟინრების გაგზავნით, რომლებიც კლიენტებს მოდელების მორგებაში ეხმარებიან.
ბოლო დროს ფრანგული ლაბორატორია წარმატებათა სერიაზეა. სექტემბერში მან 3,3 მილიარდი დოლარის დაფინანსება მოიზიდა 24 მილიარდი დოლარის შეფასებით, რაც ევროპული ტექკომპანიის ყველაზე დიდი რაუნდია. მისი შემოსავალი, ამბობენ, ბოლო წელიწადში დაახლოებით 20-ჯერ გაიზარდა.
წვდომის შეშფოთება შესაძლებლობას ქმნის
Mistral-ის აღმავლობა ემთხვევა აშშ-სა და ტრანსატლანტიკურ მოკავშირეებს შორის დაძაბულობას და კამათს იმაზე, ვის ექნება წვდომა ფრონტირული დონის AI-ზე. ივნისში ტრამპის ადმინისტრაციამ დროებით შეზღუდა OpenAI-სა და Anthropic-ის მოდელების გავრცელება, რადგან მათი გამოყენება დახვეწილი კიბერშეტევებისთვის შეიძლებოდა. შემდეგ გამჟღავნდა შემთხვევები, როცა აშშ-ში შექმნილი მოდელები კონტროლიდან გავიდნენ და დაესხნენ თავს კომპანიებსა და ზოგიერთ უცხოურ სახელმწიფო ინსტიტუტს. ამან კვირების კამათი გამოიწვია მოდელების გამოშვების რეგულირებაზე. ამბობენ, რომ თეთრმა სახლმა ამერიკულ ლაბორატორიებს სთხოვა, გამოუქვეყნებელი მოდელები ბრიტანეთის AI Safety Institute-საც კი არ მისცენ, რომელიც ადრე მოდელების უსაფრთხოების რისკების შეფასებაში ეხმარებოდა.
შეხსენებამ, რომ აშშ-ის მთავრობას შეუძლია ცალმხრივად გააუქმოს ფრონტირული დონის AI-ზე წვდომა, შესაძლებლობა გაუხსნა Mistral-ს, ევროპულ ლაბორატორიას ღია წონის მოდელებით. ლამპლი ამბობს, რომ წვდომის წვრილმარცვლოვანი კონტროლის ნაკლებობა პრობლემაა ნებისმიერი ბიზნესისთვის, თუნდაც აშშ-ში. „თუ დახურულ მოდელს იყენებ, გარანტია არ არის, რომ ის ხვალაც იქ იქნება“, ამბობს ის.
წყაროები: Arstechnica
SiTech — AI-გაძლიერებული ვებ დეველოპმენტი
ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.