
OpenAI-nin Jalapeño çipi inferens testlərində Nvidia Blackwell-ı üstələyir
SemiAnalysis testləri göstərir ki, OpenAI-nin öz dizaynı olan Jalapeño inferens çipi vatt başına göstəricidə Nvidia Blackwell-ı üstələyir — spekulyativ dekodlaşdırma olmadan.
OpenAI öz inferens çipini hazırlayıb və ilk testlər onun Nvidia, AMD və Google avadanlıqları ilə rəqabət apara biləcəyini göstərir. 25 avqustda dərc olunan nəticələr SemiAnalysis-in InferenceX dəstini OpenAI-nin laboratoriyalarında şirkətin mühəndisləri ilə birlikdə işə salmasından əldə edilib.
Jalapeño nədir
Kod adı Jalapeño olan çip Hot Chips konfransında təqdim edilib və Broadcom ilə tərəfdaşlıqda hazırlanır. Dizayn işləri 2024-cü ilin ortalarında başlayıb və ilk işə qəbuldan istehsalat tape-outuna qədər təxminən 16 ay keçib; CoWoS tape-outu 2025-ci ilin noyabrında tamamlanıb. Yayımlanan nəticələr proqramın təxminən doqquzuncu ayında, A0 steppinqi üzərində toplanıb; B0 steppinqi artıq fabrikdədir və vatt başına göstəricini təxminən 25 faiz yaxşılaşdırır.
Vatt başına göstərici
Əsas ölçü bütün infrastruktur xərcləri daxil olmaqla bir meqavata düşən token məhsuldarlığıdır. Bu göstərici üzrə Jalapeño sınaqdan keçirilən demək olar ki, bütün ssenarilərdə Blackwell-ı üstələyir və bunu yalnız tək token proqnozu ilə edir — spekulyativ dekodlaşdırma və prefill-decode ayrılması olmadan — halbuki müqayisə edilən sistemlər ən yaxşı konfiqurasiyalarında çoxlu token proqnozundan istifadə edirdi. Aşağı yüklənmədə çip DeepSeek R1 üzərində istifadəçi başına saniyədə 700-dən çox tokenə çatıb; Kimi K2.5 üzərində 700 token/san istifadəçiyə yaxınlaşıb və 100 token/san istifadəçi səviyyəsində növbəti ən yaxşı çipdən doqquz dəfədən çox sürətli olub. GSM8k qiymətləndirmələri Nvidia çipləri ilə eyni səviyyədə olub.
Ümumi təyinatlı çip və 2.048 sürətləndirici
Bu cür çiplərin yalnız sahibinin modellərinə uyğunlaşdırıldığı fikrinin əksinə olaraq SemiAnalysis Jalapeño-nu ümumi təyinatlı inferens sürətləndiricisi kimi təsvir edir: o, bir neçə açıq modeli və InferenceX dəstini işə salıb, OpenAI hətta Codex göstərişləri ilə köçürülmüş Doom-u çip üzərində nümayiş etdirib. Çip TSMC-nin N3P prosesində hazırlanan reticle ölçülü hesablama kristalı, N3E üzərində G/Ç çipleti, x86 host prosessoru ilə PCIe Gen 5 bağlantıları və hər paketə təxminən 15,4TB/s keçirmə qabiliyyəti olan HBM4 yaddaşdan istifadə edir. Bir rəfdə 102,4Tb/s Tomahawk 6 kommutatorları ilə birləşən 128 çip var, 16 belə rəf — 2.048 sürətləndirici — bir miqyaslama sahəsi yaradır.
Qeydlər və növbəti addımlar
Nəşr məhdudiyyətləri də qeyd edir: bütün rəqəmləri OpenAI təqdim edib, yerində yoxlanılan işə salmalar 8k1k yükünü əhatə edib və AgentX nəticələri hələ yoxdur. Müəlliflər hesab edir ki, Jalapeño ilə Blackwell-ın müqayisəsi tam ədalətli deyil, çünki Jalapeño Rubin ilə eyni nəsil olan HBM4-dən istifadə edir. Token maya dəyərinə görə Jalapeño və Vera Rubin təxminən bərabərdir, lakin Jalapeño-nun göstəriciləri spekulyativ dekodlaşdırma olmadan əldə edilib; bu üsul adətən token maya dəyərini bir neçə dəfə azaldır. İstehsalın 2027 ərzində mərhələli artması, məhsulun böyük hissəsinin gələn ilin sonuna düşməsi və növbəti hədəfin 100 MVt gücündə yerləşdirmə olması gözlənilir.
SiTech — AI ilə gücləndirilmiş veb hazırlanması
Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.