უკან დაბრუნება
Kimi K3 — 2,8 ტრილიონი პარამეტრით და 25-ცენტიანი პელიკანით
SiTech AI Team2 წთ. საკითხავი

Kimi K3 — 2,8 ტრილიონი პარამეტრით და 25-ცენტიანი პელიკანით

Moonshot AI-მ წარადგინა Kimi K3 — 2,8 ტრილიონი პარამეტრის მოდელი, რომელსაც პირველ „ღია 3T კლასის“ სისტემად მოიხსენიებს; ღია წონების გამოშვება 27 ივლისამდეა დაპირებული.

ჩინურმა AI-ლაბორატორიამ Moonshot AI-მ ხუთშაბათს წარადგინა Kimi K3, რომელსაც „დღემდე ყველაზე შესაძლებლიან მოდელად, 2,8 ტრილიონი პარამეტრით“ აღწერს. მოდელი კომპანიის ვებგვერდსა და API-ში უკვე ხელმისაწვდომია, ღია წონების ვერსია კი „2026 წლის 27 ივლისამდეა“ დაპირებული.

პოზიციონირება და ფასი

Moonshot K3-ს პირველ „ღია 3T კლასის მოდელს“ უწოდებს — 2,8 ტრილიონს სამ ტრილიონამდე ამრგვალებს და ამ იარლიყს DeepSeek-ის 1.6T v4 Pro-ს ართმევს. თავად კომპანიის გამოქვეყნებული ბენჩმარკებით, K3 უმეტეს შედარებაში Claude Opus 4.8 max-სა და GPT-5.5 high-ს უსწრებს, თუმცა Claude Fable 5-სა და GPT-5.6 Sol-ს ჩამორჩება. დამოუკიდებელი შემფასებლის, Artificial Analysis-ის კერძო გრძელვადიანი ცოდნის სამუშაო ტესტში მოდელმა 1547 Elo მიაღწია — 732 პუნქტით მეტი Kimi K2.6-ზე და მხოლოდ Claude Fable 5-ის შემდეგ — თითო ამოცანის 0,94 დოლარის ფასად, მაშინ როცა GPT-5.6 Sol 1,04 დოლარი, Opus 4.8 კი 1,80 დოლარი ღირს. მის Intelligence Index-ზე ტოკენების ხარჯი K2.6-თან შედარებით 21 პროცენტით შემცირდა. მოდელი ასევე ლიდერობს Arena.ai-ის Frontend Code არენაზე, Claude Fable 5-ის წინ.

ყველაზე შესამჩნევი ცვლილება ფასია: 3 დოლარი მილიონი შემავალი და 15 დოლარი მილიონი გამომავალი ტოკენისთვის — Anthropic-ის Claude Sonnet სერიის დონეზე და ჩინური ლაბორატორიის ყველაზე ძვირი მოდელი დღემდე, მკვეთრად ძვირი Kimi K2.6-ის 0,95/4 დოლართან შედარებით.

როგორ უმკლავდება ველოსიპედზე მჯდომ პელიკანს

საიმონ უილისონმა, რომელიც „ველოსიპედზე მჯდომი პელიკანის“ SVG-პრომპტს ახალ მოდელებზე 21 თვეა ატარებს, K3-ით OpenRouter-ის მეშვეობით სურათი დააგენერირა. გაშვებამ 95 შემავალი და 16 658 გამომავალი ტოკენი მოიხმარა, მათგან 13 241 მსჯელობის ტოკენი — ჯამში 25 ცენტი. მომზადებული სურათის შეყვანისას მოდელმა ის ზუსტად აღწერა, რაც დაახლოებით 0,6 ცენტი დაჯდა. პრომპტმა ასევე აჩვენა, რომ K3-ს ამჟამად მსჯელობის მხოლოდ ერთი დონე — „max“ — აქვს, ხოლო ცალკე „hi“ 86 ტოკენად ითვლება, რაც დაახლოებით 85 ტოკენიან ფარულ სისტემურ პრომპტზე მიუთითებს; მოდელმა მისი გამჟღავნებაზე უარი თქვა.

რას გვიჩვენებს ეს ტესტი დღეს

უილისონი ცხადად ამბობს, რომ პელიკანი ცუდი ბენჩმარკია და მოდელების რანჟირებისთვის არ უნდა გამოიყენებოდეს: ის არაფერს ამბობს აგენტურ ხელსაწყოების გამოძახებაზე ან გრძელ საუბრებში საიმედოობაზე, ხოლო მისი ადრინდელი კორელაცია მოდელების ხარისხთან დაირღვა — GPT-5.6-ისა და Claude Fable 5-ის პელიკანებს GLM-5.2 ჯობს. მისი ღირებულება უფრო ვიწროა: ის აიძულებს მკვლევარს მოდელი რეალურად გაუშვას, აძლევს ხარჯისა და მსჯელობის მოცულობის უხეშ შეფასებას, ადასტურებს ვალიდური SVG-ის გამოტანასა და სივრცით აღქმას და საშუალებას იძლევა ერთი ოჯახის მოდელები ერთმანეთს შევადაროთ — სადაც K3-ის ფრინველი Kimi 2.5-ისაზე შესამჩნევად უკეთესია.

SSiTech

SiTech — AI-გაძლიერებული ვებ დეველოპმენტი

ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.