← უკან დაბრუნება
SiTech Team⏱️ 1 წთ. საკითხავი

Tencent-მა გამოუშვა Hy3 — 295B-პარამეტრიანი ღია MoE მოდელი, რომელიც კონკურენტებს 5-ჯერ აღემატება

Tencent-მა გამოუშვა Hy3 — 295B-პარამეტრიანი ღია MoE მოდელი, რომელიც კონკურენტებს 5-ჯერ აღემატება

Tencent-მა გამოუშვა Hy3, 295B პარამეტრიანი ღია MoE მოდელი Apache 2.0 ლიცენზიით. მხოლოდ 21B აქტიური პარამეტრით, ის აჯობებს 5-ჯერ დიდ მოდელებს და ჰალუცინაციების დონე 5.4%-მდე შეამცირა.

\n

Tencent-მა გამოუშვა Hy3: თამაშის შემცვლელი ღია მოდელი

\n

Tencent-მა ოფიციალურად გამოუშვა თავისი AI მოდელი Hy3 Apache 2.0 ლიცენზიით. მოდელი იყენებს Mixture-of-Experts (MoE) არქიტექტურას, რომელშიც 295 მილიარდი ჯამური პარამეტრიდან, მხოლოდ 21 მილიარდია აქტიური ნებისმიერ მოცემულ მომენტში. დამატებით 3.8 მილიარდი პარამეტრი MTP ფენისთვის. მოდელს შეუძლია 256,000 ტოკენის კონტექსტის დამუშავება.

\n

ტესტის შედეგები

\n

Tencent-ის თქმით, Hy3 აღემატება მასზე 2-5-ჯერ დიდი მოდელების შედეგებს. 270 ექსპერტის მიერ ჩატარებულ ბრმა შეფასებაში, Hy3-მა 2.67 ქულა მიიღო 4-დან, რითაც გადააჭარბა GLM-5.1-ს, რომელმაც 2.51 ქულა მიიღო.

\n

ტექნიკური მახასიათებლები

\n

მოდელი ხელმისაწვდომია Apache 2.0 ლიცენზიით Hugging Face-ზე, ModelScope-სა და GitHub-ზე. FP8-კვანტიზირებული ვერსიაც ხელმისაწვდომია. OpenRouter-ისა და Cline-ის მხარდაჭერა დაგეგმილია.

\n

ინტეგრირებული პროდუქტები

\n

Tencent-მა უკვე ჩააშენა Hy3 თავის პროდუქტებში, მათ შორის WorkBuddy, Yuanbao, WeChat და Path of Exile: Advent-ის თამაშის ასისტენტი. ეს უჩვენებს მოდელის მზადყოფნას რეალური გამოყენებისთვის.

\n

მნიშვნელობა AI ინდუსტრიისთვის

\n

Hy3-ის გამოშვება უჩვენებს, რომ ჩინური AI კომპანიები აგრძელებენ ღია AI-ს წინსვლას. Hy3-ის მსგავსი მოდელები ხელს უწყობენ AI-ს დემოკრატიზაციას.

\n

რას ნიშნავს ეს დეველოპერებისთვის

\n

Hy3-ის MoE არქიტექტურა ნიშნავს, რომ ის ეფექტურად მუშაობს, მიუხედავად მისი მასიური ზომისა, რაც მას ხელმისაწვდომს ხდის ზომიერი გამოთვლითი რესურსების მქონე ორგანიზაციებისთვის.

\n

დასკვნა

\n

Tencent-ის Hy3 მნიშვნელოვანი წვლილია ღია AI-ში, რომელიც, სავარაუდოდ, დააჩქარებს განვითარებას მთელ ეკოსისტემაში.

\n