Alibaba-ს Qwen-მა Qwen3.8-27B გამოაქვეყნა: ღია წონები, ვიზია, 262K კონტექსტი
Qwen-ის გუნდმა Hugging Face-ზე FP8 ფორმატში გამოაქვეყნა Qwen3.8-27B — კომპაქტური მოდელი native ვიზიით, 262 144 ტოკენიანი კონტექსტითა და რეგულირებადი აზროვნებით. გამოშვება Hacker News-ის ტოპში ავიდა.
რა მოხდა
Alibaba-ს Qwen-ის გუნდმა Hugging Face-ზე გამოაქვეყნა Qwen3.8-27B FP8 ფორმატში — კომპაქტური და განლაგებისთვის მოსახერხებელი მოდელი, რომელსაც კომპანია ღია მოდელების ოჯახის ყველაზე ძლიერ თაობად მიიჩნევს. 14 აგვისტოს გამოშვება Hacker News-ის ტოპში ავიდა და დღეში 1 400-ზე მეტი ქულა დააგროვა.
რა არის შიგნით
Qwen3.8-27B native ვიზუალურ-ენობრივი მოდელია: ესმის სურათები და ვიდეოები, native მხარდაჭერა აქვს 262 144 ტოკენიანი კონტექსტისთვის (გაფართოებადი ერთ მილიონ ტოკენამდე) და გთავაზობთ აზროვნების მოქნილ კონტროლს. FP8 ვერსია წვრილმარცვლოვან კვანტიზაციას იყენებს და, Qwen-ის მტკიცებით, თითქმის იდენტურ შედეგს იძლევა — Transformers-ის, vLLM-ისა და SGLang-ის მხარდაჭერით.
რატომ არის მნიშვნელოვანი
Qwen3.5-ის არქიტექტურაზე აგებული თაობა ორიენტირებულია კოდინგზე, პროფესიულ სამუშაოზე, კვლევასა და გრძელვადიან აგენტურ ამოცანებზე. 1M კონტექსტის მქონე ჰოსტინგული ვერსია Qwen Cloud-ზე მალე გამოვა. პრაქტიკული დასკვნა: frontier-თან ახლოს მდგომი აგენტური პროცესები ახლა საკუთარ სერვერზე გაშვებულ 27B მოდელზე შეიძლება — მონაცემების დახურულ API-ში გაგზავნის გარეშე.