Tencent-მა გამოუშვა Hy3 — 295B-პარამეტრიანი ღია MoE მოდელი, რომელიც კონკურენტებს 5-ჯერ აღემატება
Tencent-მა გამოუშვა Hy3, 295B პარამეტრიანი ღია MoE მოდელი Apache 2.0 ლიცენზიით. მხოლოდ 21B აქტიური პარამეტრით, ის აჯობებს 5-ჯერ დიდ მოდელებს და ჰალუცინაციების დონე 5.4%-მდე შეამცირა.
Tencent-მა გამოუშვა Hy3: თამაშის შემცვლელი ღია მოდელი
\nTencent-მა ოფიციალურად გამოუშვა თავისი AI მოდელი Hy3 Apache 2.0 ლიცენზიით. მოდელი იყენებს Mixture-of-Experts (MoE) არქიტექტურას, რომელშიც 295 მილიარდი ჯამური პარამეტრიდან, მხოლოდ 21 მილიარდია აქტიური ნებისმიერ მოცემულ მომენტში. დამატებით 3.8 მილიარდი პარამეტრი MTP ფენისთვის. მოდელს შეუძლია 256,000 ტოკენის კონტექსტის დამუშავება.
\nტესტის შედეგები
\nTencent-ის თქმით, Hy3 აღემატება მასზე 2-5-ჯერ დიდი მოდელების შედეგებს. 270 ექსპერტის მიერ ჩატარებულ ბრმა შეფასებაში, Hy3-მა 2.67 ქულა მიიღო 4-დან, რითაც გადააჭარბა GLM-5.1-ს, რომელმაც 2.51 ქულა მიიღო.
\nტექნიკური მახასიათებლები
\nმოდელი ხელმისაწვდომია Apache 2.0 ლიცენზიით Hugging Face-ზე, ModelScope-სა და GitHub-ზე. FP8-კვანტიზირებული ვერსიაც ხელმისაწვდომია. OpenRouter-ისა და Cline-ის მხარდაჭერა დაგეგმილია.
\nინტეგრირებული პროდუქტები
\nTencent-მა უკვე ჩააშენა Hy3 თავის პროდუქტებში, მათ შორის WorkBuddy, Yuanbao, WeChat და Path of Exile: Advent-ის თამაშის ასისტენტი. ეს უჩვენებს მოდელის მზადყოფნას რეალური გამოყენებისთვის.
\nმნიშვნელობა AI ინდუსტრიისთვის
\nHy3-ის გამოშვება უჩვენებს, რომ ჩინური AI კომპანიები აგრძელებენ ღია AI-ს წინსვლას. Hy3-ის მსგავსი მოდელები ხელს უწყობენ AI-ს დემოკრატიზაციას.
\nრას ნიშნავს ეს დეველოპერებისთვის
\nHy3-ის MoE არქიტექტურა ნიშნავს, რომ ის ეფექტურად მუშაობს, მიუხედავად მისი მასიური ზომისა, რაც მას ხელმისაწვდომს ხდის ზომიერი გამოთვლითი რესურსების მქონე ორგანიზაციებისთვის.
\nდასკვნა
\nTencent-ის Hy3 მნიშვნელოვანი წვლილია ღია AI-ში, რომელიც, სავარაუდოდ, დააჩქარებს განვითარებას მთელ ეკოსისტემაში.
\n