უკან დაბრუნება
Aleph Alpha-მ სუვერენული გერმანული AI მოდელი Kolibri გამოუშვა
SiTech AI Team2 წთ. საკითხავი

Aleph Alpha-მ სუვერენული გერმანული AI მოდელი Kolibri გამოუშვა

გერმანულმა AI კომპანია Aleph Alpha-მ ღია წონების მოდელი Kolibri წარადგინა: იგი მხოლოდ გერმანულ და ინგლისურ ენებზეა გაწვრთნილი და გერმანიისა და ფინეთის ინფრასტრუქტურაზე მუშაობს. წონები Apache 2.0 ლიცენზიით გამოქვეყნდა.

გერმანულმა AI კომპანია Aleph Alpha-მ 2026 წლის 3 ოქტომბერს ღია წონების მოდელი Kolibri გამოუშვა. წონები Apache 2.0 ლიცენზიით Hugging Face-ზე გამოქვეყნდა, მოდელი კი მხოლოდ გერმანულ და ინგლისურ ენებზე მუშაობს. კომპანია Kolibri-ს სუვერენულ მოდელს უწოდებს: ორგანიზაციას მისი საკუთარ სერვერებზე გაშვება შეუძლია, მონაცემები შენობიდან არ გადის, მოდელს კი ვერავინ შეცვლის ან გამორთავს.

რა არის Kolibri

Kolibri ექსპერტთა ნარევის (MoE) არქიტექტურაზეა აგებული და სულ 78,1 მილიარდი პარამეტრი აქვს, თუმცა ყოველი ტოკენის დამუშავებისას მათგან მხოლოდ დაახლოებით 3,5 მილიარდი აქტიურდება. 50 ფენიდან თითოეულში 384 ექსპერტი და ერთი საერთო ექსპერტია, როუტერი კი თითო ტოკენს 384-დან მხოლოდ 6-თან აგზავნის. მოდელი 768 NVIDIA B200 GPU-ზე, დაახლოებით 24 ტრილიონ ტოკენზე გაწვრთნეს, რომელთა 20%-ზე მეტი გერმანულია.

კონტექსტის ფანჯარა 262 144 ტოკენს მოიცავს, ტესტებში კი მოდელი 1 048 576 ტოკენამდე აღწევს. ცოდნის ზღვარი 2026 წლის 18 ივნისია. წონები FP8 ფორმატში დაახლოებით 78 გბ-ს იკავებს, ამიტომ საჭიროა ორი 80-გბიანი NVIDIA A100 ან H100, ან ერთი H200, B200 ან B300.

ტოკენაიზერს 128 000 ტოკენის ლექსიკონი და Aleph Alpha-ს ახალი ალგორითმი UniBPE აქვს. ფედერალური საკონსტიტუციო სასამართლოს სახელწოდება GPT-5-ის ტოკენაიზერთან 6 ტოკენად იშლება, Kolibri-სთან კი 2-ად. გერმანულ ტექსტზე მოდელი 11,2%-ით ნაკლებ ტოკენს ხარჯავს.

რატომ ითვლება სუვერენულად

Aleph Alpha-ს თქმით, მოდელი გერმანულმა გუნდებმა შექმნა და გერმანიისა და ფინეთის ინფრასტრუქტურაზე, ევროპული და გერმანული კანონმდებლობის დაცვით, უცხოური კონტროლის გარეშე გაწვრთნა. კომპანიამ ხელი ევროკავშირის GPAI Code of Practice-საც მოაწერა.

სუვერენულობა იმას არ ნიშნავს, რომ მოდელში ევროპის გარედან არაფერი მოხვდა: ინგლისური ვებტექსტი Google-ის Gemma 4-ით გადაამუშავეს, გერმანული Mistral-NeMo-ს საშუალებით, ხარისხის ფილტრებისთვის კი Qwen3-32B-ის მონიშნული მონაცემები გამოიყენეს. მონაცემები პოლიტიკური მიკერძოებისგანაც გაფილტრეს.

ძლიერი და სუსტი მხარეები

კომპანიის საკუთარი შეფასებით, Kolibri იმავე ზომის ღია მოდელებს ორივე ენაზე უსწრებს: საერთო ქულა ინგლისურად 75,5-ია, გერმანულად 70,8, მათემატიკაში კი (AIME 2025) გერმანულად 87,5 და ინგლისურად 96,9. გერმანულ შეკითხვებზე მოდელი ინგლისურზე გადართვის გარეშე, გერმანულადვე აზროვნებს. თავშეკავებაზეც გაწვრთნეს: როცა კონტექსტში მოცემული მტკიცებულება პასუხს არ ადასტურებს, ის ამას აღიარებს. ტესტში, სადაც პასუხი უცნობი იყო, ასე 44%-ში მოიქცა, GPT-OSS 120B-მა კი მხოლოდ 23,7%-ში.

სუსტი მხარეებიც საჯაროა: ტესტში, სადაც პასუხი მეხსიერებიდან უნდა იცოდეს, შედარებულ 12 მოდელს შორის ბოლო ადგილზეა, ხელსაწყოების მრავალნაბიჯიან გამოძახებასა და კოდის წერის ამოცანებში კონკურენტებს ჩამორჩება. 78 გბ წონა მხოლოდ მონაცემთა ცენტრის GPU-ებზე ეტევა, vLLM-ის მხარდაჭერა ახალია და სერვისად მოდელს ჯერ არავინ სთავაზობს.

Kolibri საუკეთესო არჩევანია მაშინ, როცა მნიშვნელოვანია გერმანული ტექსტიც და საკუთარი აპარატურაც: საჯარო უწყებისთვის, ბანკისთვის ან მწარმოებლისთვის, რომელსაც დოკუმენტები შიდა ინფრასტრუქტურაზე უნდა დარჩეს და დარწმუნებულ შეცდომას „არ ვიცი“ ერჩივნოს. კანონებისა და ხელშეკრულებების მსგავს გრძელ დოკუმენტებზე მუშაობისას სწორედ ეს ძლიერი მხარეები ვლინდება.

SSiTech

SiTech — AI-გაძლიერებული ვებ დეველოპმენტი

ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.