Geri qayıt
Kimi K3: 2,8 trilyon parametr və 25 sentlik pelikan
SiTech AI Team2 წთ. საკითხავი

Kimi K3: 2,8 trilyon parametr və 25 sentlik pelikan

Moonshot AI 2,8 trilyon parametrli Kimi K3-ü təqdim edib; şirkət onu ilk “açıq 3T sinfi” model adlandırır, açıq çəkiləri 27 iyula qədər vəd edir və pelikan testi 25 sentə başa gəlir.

Çin süni intellekt laboratoriyası Moonshot AI cümə axşamı Kimi K3-ü elan edib və modeli “indiyədək ən bacarıqlı modeli, 2,8 trilyon parametrlə” kimi təsvir edib. Model şirkətin veb-saytı və API-si vasitəsilə əlçatandır, açıq çəkilərlə versiya isə “2026-cı il iyulun 27-dək” vəd olunub.

Mövqe və qiymət

Moonshot K3-ü ilk “açıq 3T sinfi model” adlandırır: 2,8 trilyonu üç trilyona yuvarlaqlaşdırır və bu adı DeepSeek 1.6T v4 Pro-dan alır. Şirkətin özünün yaydığı benchmarklara görə K3 müqayisələrin çoxunda Claude Opus 4.8 max və GPT-5.5 high-ı üstələyir, lakin Claude Fable 5 və GPT-5.6 Sol-dan geri qalır. Müstəqil qiymətləndirici Artificial Analysis özünün uzunmüddətli bilik işi testində 1547 Elo ölçüb — Kimi K2.6-dan 732 bal yuxarı və yalnız Claude Fable 5-dən sonra — hər tapşırıq üçün 0,94 dollara; GPT-5.6 Sol üçün bu rəqəm 1,04, Opus 4.8 üçün isə 1,80 dollardır. Intelligence Index üzrə token sərfi K2.6 ilə müqayisədə 21% azalıb. Model həmçinin Arena.ai-nin Frontend Code arenasında Claude Fable 5-dən öndə liderdir.

Ən nəzərəçarpan dəyişiklik qiymətdir: milyon giriş tokeni üçün 3 dollar, milyon çıxış tokeni üçün 15 dollar — Anthropic-in Claude Sonnet seriyası səviyyəsində və Çin laboratoriyasının indiyədək ən bahalı modeli; Kimi K2.6-nın 0,95/4 dollarına nisbətən kəskin artım.

Velosipedli pelikanı necə çəkir

“Velosiped üstündə pelikan” SVG sorğusunu 21 aydır yeni modellərdə sınaqdan keçirən Simon Willison K3 ilə OpenRouter vasitəsilə belə bir şəkil yaradıb. İşə salma 95 giriş və 16 658 çıxış tokeni sərf edib; onların 13 241-i düşünmə tokeni olub və ümumi məsrəf 25 sent təşkil edib. Yaradılmış şəkil giriş kimi verildikdə model onu təxminən 0,6 sentə dəqiq təsvir edib. Sorğu həmçinin göstərib ki, K3 hazırda yalnız bir düşünmə səviyyəsi təklif edir — “max” — və təkcə “hi” yazmaq 86 token kimi hesablanır; bu, modelin açıqlamaqdan imtina etdiyi təxminən 85 tokenlik gizli sistem sorğusuna işarə edir.

Test bu gün nə öyrədir

Willison açıq şəkildə deyir ki, pelikan pis benchmarkdır və modelləri sıralamaq üçün istifadə edilməməlidir: o, agent alətlərinin çağırılması və ya uzun söhbətlərdə etibarlılıq barədə heç nə demir, model keyfiyyəti ilə əvvəlki korrelyasiyası isə pozulub — GPT-5.6 və Claude Fable 5-in pelikanları GLM-5.2-dən geri qalır. Onun dəyəri daha dardır: insanı modeli həqiqətən işə salmağa məcbur edir, məsrəf və düşünmə yükü üçün təxmini qiymət verir, etibarlı SVG çıxışını və əsas məkan qavrayışını təsdiqləyir, həmçinin eyni model ailəsi daxilində müqayisəyə imkan verir — burada K3-ün quşu Kimi 2.5-inkindən nəzərəçarpan dərəcədə yaxşıdır.

SSiTech

SiTech — AI ilə gücləndirilmiş veb hazırlanması

Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.