← უკან დაბრუნება
SiTech Team⏱️ 1 წთ. საკითხავი

Alibaba-ს Qwen-მა Qwen3.8-27B გამოაქვეყნა: ღია წონები, ვიზია, 262K კონტექსტი

Alibaba-ს Qwen-მა Qwen3.8-27B გამოაქვეყნა: ღია წონები, ვიზია, 262K კონტექსტი

Qwen-ის გუნდმა Hugging Face-ზე FP8 ფორმატში გამოაქვეყნა Qwen3.8-27B — კომპაქტური მოდელი native ვიზიით, 262 144 ტოკენიანი კონტექსტითა და რეგულირებადი აზროვნებით. გამოშვება Hacker News-ის ტოპში ავიდა.

რა მოხდა

Alibaba-ს Qwen-ის გუნდმა Hugging Face-ზე გამოაქვეყნა Qwen3.8-27B FP8 ფორმატში — კომპაქტური და განლაგებისთვის მოსახერხებელი მოდელი, რომელსაც კომპანია ღია მოდელების ოჯახის ყველაზე ძლიერ თაობად მიიჩნევს. 14 აგვისტოს გამოშვება Hacker News-ის ტოპში ავიდა და დღეში 1 400-ზე მეტი ქულა დააგროვა.

რა არის შიგნით

Qwen3.8-27B native ვიზუალურ-ენობრივი მოდელია: ესმის სურათები და ვიდეოები, native მხარდაჭერა აქვს 262 144 ტოკენიანი კონტექსტისთვის (გაფართოებადი ერთ მილიონ ტოკენამდე) და გთავაზობთ აზროვნების მოქნილ კონტროლს. FP8 ვერსია წვრილმარცვლოვან კვანტიზაციას იყენებს და, Qwen-ის მტკიცებით, თითქმის იდენტურ შედეგს იძლევა — Transformers-ის, vLLM-ისა და SGLang-ის მხარდაჭერით.

რატომ არის მნიშვნელოვანი

Qwen3.5-ის არქიტექტურაზე აგებული თაობა ორიენტირებულია კოდინგზე, პროფესიულ სამუშაოზე, კვლევასა და გრძელვადიან აგენტურ ამოცანებზე. 1M კონტექსტის მქონე ჰოსტინგული ვერსია Qwen Cloud-ზე მალე გამოვა. პრაქტიკული დასკვნა: frontier-თან ახლოს მდგომი აგენტური პროცესები ახლა საკუთარ სერვერზე გაშვებულ 27B მოდელზე შეიძლება — მონაცემების დახურულ API-ში გაგზავნის გარეშე.

📖 წყარო