Geri qayıt
Inception-ın diffuziya modeli Mercury 2.5 saniyədə 770 token hasil edir
SiTech AI Team2 წთ. საკითხავი

Inception-ın diffuziya modeli Mercury 2.5 saniyədə 770 token hasil edir

Artificial Analysis-in ölçmələrinə görə, Inception-ın diffuziya əsaslı Mercury 2.5 modeli saniyədə 770,4 token hasil edir; kontekst pəncərəsi 260 min tokendir, giriş qiyməti isə milyon token üçün 0,25 dollardır.

Inception şirkəti 8 sentyabr 2026-cı ildə Mercury 2.5-i buraxdı — şirkətin istehsalatda ən sürətli düşünmə modeli adlandırdığı qapalı diffuziya əsaslı böyük dil modeli (dLLM). Mətni token-token yazan avtoreqressiv modellərdən fərqli olaraq Mercury 2.5 cavabı paralel qurur və mərhələlərlə dəqiqləşdirir.

Saniyədə 770 token

Artificial Analysis-in ölçmələrinə görə, Inception API-si vasitəsilə model saniyədə 770,4 çıxış tokeni hasil edir — eyni qiymət seqmentindəki düşünmə modellərinin medianı olan 110,3 tokendən qat-qat yuxarı. Inception özü istehsalatda 1100 tokendən çox sürət iddia edir. İlk cavab tokeninə qədər vaxt 2,91 saniyədir — seqment medianından (2,22 saniyə) bir qədər çox.

Model yalnız mətn qəbul edir və yalnız mətn hasil edir — şəkilləri emal etmir. Model qapalıdır və çəkiləri ictimaiyyətə açıq deyil. Kontekst pəncərəsi 260 min tokendir (təxminən 390 A4 səhifəsi); Mercury 2-də bu 128 min idi.

Nəticələr və qiymət

Artificial Analysis Intelligence Index-də (v4.3.2) Mercury 2.5 12 bal toplayır — kateqoriya medianına uyğun. İndeksdə model 35 milyon çıxış tokeni sərf edib — 84 milyonluq medianın yarısından az; analitik şirkət bunu "kifayət qədər yığcam" adlandırır. Bir tapşırığın qiymətləndirilməsi orta hesabla 0,06 dollara başa gəlir.

Qiymətlər Inception API-si üzrə: milyon giriş tokeni üçün 0,25 dollar, milyon çıxış tokeni üçün 0,75 dollar; keş endirimi 90%, qarışıq tarif milyon token üçün 0,14 dollardır. Buraxılış zamanı OpenRouter-də 80% endirim var — 0,04 və 0,15 dollar.

Niyə vacibdir

Diffuziya generasiyası aşağı gecikmə tələb edən ssenarilərə yönəlib: axtarış, səsli köməkçilər, kodlaşdırma agentləri — burada sürət və xərc imkanlardan az vacib deyil. Inception-a görə Mercury 2.5 əvvəlki nəsildən 10 bal daha ağıllıdır və qənaətcil frontier modelləri — GPT-5.6 Luna, Gemini 3.5 Flash-Lite, Claude Haiku 4.5 ilə müqayisə olunur. Model tənzimlənən düşünmə, daxili alət dəstəyi, JSON rejimi və paralel alət çağırışları qazanıb; Inception API-si, OpenRouter və Baseten vasitəsilə əlçatandır. Şirkət indiyədək ən böyük modelini öyrətməyə başladığını və onu yaxın aylarda buraxacağını bildirir.

SSiTech

SiTech — AI ilə gücləndirilmiş veb hazırlanması

Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.