Geri qayıt
Saymaq üçün çox ucuz tokenlər: AI çıxarışının qiyməti niyə düşür
SiTech AI Team2 წთ. საკითხავი

Saymaq üçün çox ucuz tokenlər: AI çıxarışının qiyməti niyə düşür

jyn.dev saytında dərc olunan esse maşın intellektinin qiymətinin ildə bir neçə tərtib azaldığını və qıt resursun token sayı deyil, keyfiyyət və əlçatanlıq olacağını iddia edir.

jyn.dev saytında dərc olunan esse maşın öyrənməsi intellektinin qiymətinin ildə bir neçə tərtib azaldığını və tendensiyanın zəifləmə əlaməti göstərmədiyini iddia edir; məhdudlaşdırıcı amil isə token sayı deyil, keyfiyyət və əlçatanlıq olacaq.

Sübutlar

Məqalənin istinad etdiyi Epoch AI məlumatlarına görə GPU-ların enerji səmərəliliyi eksponensial artır: loqarifmik qrafikdə tendensiya xəttinin mailliyi təqribən 1,3-dür, yəni səmərəlilik təxminən iki ildə bir dəfə ikiqat artır — Moore qanunundan bəri görülməmiş temp.

Epoch AI məlumatlarına görə GPU enerji səmərəliliyinin artımı

Frontier modellərdə token qiyməti ardıcıl düşmür, lakin bir tapşırığı yerinə yetirməyin dəyəri düşür. Artificial Analysis-in izlədiyi pareto əyrisində 2026-cı ildə intellekt oxu 2025-ci ilə bənzəyir, dəyər oxu isə 2025 ərzində iki tərtib ucuzlaşıb.

2026 pareto əyrisində tapşırıq başına dəyər

Çıxarış mühərrikləri ildə 10–50% yaxşılaşır: vLLM 0.11.1 (dekabr 2025) 0.5.4-lə (sentyabr 2024) müqayisədə token başına təxminən 40% az cul sərf edir, NVIDIA isə MLPerf 2.0-dan 2.1-ə qədər 50%-ə qədər səmərəlilik artımı bildirir. Memarlıqlar da dəyişir — Mixture-of-Experts lazımsız ekspert qatlarını söndürür və model eyni keyfiyyətdə 7 dəfə kiçik ola bilir (6B-dən 0,8B parametrə).

"Saymaq üçün çox ucuz" haradan gəlir

TypeSafe AI-ın Jev-i mətn çıxarmır: əvvəlcədən seçilmiş variantlar arasından seçim edir və ehtimal qaytarır. Şirkətin qiymət səhifəsi adi LLM-ləri milyon giriş tokeni üçün 0,20–10 dollar, çıxış tokenini isə təxminən beş dəfə baha göstərir; System One + Jev isə milyon giriş tokeni üçün 0,042 dollar, yəni milyard token üçün 42 dollardır, çıxış tokenləri pulsuzdur. Bu, beş kitab oxumaq üçün təxminən üç sent deməkdir.

Alətlər bundan artıq istifadə edir: jgrep ehtimalı təxminən 200 millisaniyədə və sentin mində biri qədər qaytarır, açıq çəkili Laya isə yerdə işləyir.

Nəyi dəyişir

Məqalə modelin bir addımını yerli alətlərlə də müqayisə edir: GPT-5.6 Luna milyon token üçün təxminən 30 sentdir, yəni 10 min token istifadə edən alət çağırışı qərarı sentin üçdə biridir, grep isə təxminən 4,5 tərtib ucuzdur. Müəllif qabarcığın partlamasını gözləmir: ucuz həcm keyfiyyəti ucuz etmir və OpenAI tikməyə davam edir — beş yeni Stargate sahəsi.

Bundan başqa, o, təhlükəsizliyin çətinləşəcəyini, çıxarış üçün optimallaşdırılmış GPU icarəsinin artacağını və proqram təminatında çətin olanın alqoritm deyil, məhsul tələbləri, test və interfeys dizaynı olacağını gözləyir. İstifadəçilər də dördüncü yol qazanır: LLM-ə bunu qurmağı tapşırmaq.

SSiTech

SiTech — AI ilə gücləndirilmiş veb hazırlanması

Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.