
OpenAI'nin Jalapeño çipi Nvidia Blackwell'ı çıkarım testlerinde geçti
SemiAnalysis testleri, OpenAI'nin kendi tasarladığı Jalapeño çıkarım çipinin watt başına performansta Nvidia Blackwell'ı geçtiğini gösteriyor — tek token tahminiyle.
OpenAI kendi çıkarım çipini geliştirdi ve ilk testler bu çipin Nvidia, AMD ve Google donanımlarıyla rekabet edebileceğini gösteriyor. 25 Ağustos'ta yayımlanan sonuçlar, SemiAnalysis'in InferenceX test paketini OpenAI'nin laboratuvarlarında şirket mühendisleriyle birlikte çalıştırmasıyla elde edildi.
Jalapeño nedir
Kod adı Jalapeño olan çip, Hot Chips konferansında duyuruldu ve Broadcom ortaklığıyla geliştiriliyor. Tasarım çalışmaları 2024'ün ortasında başladı; ilk işe alımlardan üretim tape-out'una kadar yaklaşık 16 ay geçti ve CoWoS tape-out'u Kasım 2025'te tamamlandı. Yayımlanan sonuçlar, programın yaklaşık dokuzuncu ayında, A0 adımı üzerinde toplandı; B0 adımı şimdiden fabrikada ve watt başına performansı yaklaşık yüzde 25 artırıyor.
Watt başına performans
Öne çıkan ölçüt, tüm altyapı maliyetleri dahil bir megavat başına token verimi. Bu ölçütte Jalapeño, test edilen neredeyse tüm senaryolarda Blackwell'ı geçiyor ve bunu yalnızca tek token tahminiyle yapıyor — spekülatif kod çözme ve prefill-decode ayrıştırması olmadan — karşılaştırılan sistemler ise en iyi yapılandırmalarında çoklu token tahmini kullanıyordu. Düşük eşzamanlılıkta çip, DeepSeek R1 üzerinde kullanıcı başına saniyede 700'ün üzerinde token'a ulaştı; Kimi K2.5 üzerinde 700 token/sn/kullanıcıya yaklaştı ve 100 token/sn/kullanıcı seviyesinde bir sonraki en iyi çipten dokuz kattan fazla hızlıydı. GSM8k değerlendirmeleri Nvidia çipleriyle aynı seviyede çıktı.
Genel amaçlı çip ve 2.048 hızlandırıcılı alan
Bu tür çiplerin yalnızca sahibinin modellerine göre ayarlandığı görüşünün aksine SemiAnalysis, Jalapeño'yu genel amaçlı bir çıkarım hızlandırıcısı olarak tanımlıyor: çip birkaç açık modeli ve InferenceX paketini çalıştırdı, OpenAI hatta Codex istemleriyle taşınan Doom'u üzerinde gösterdi. Çip, TSMC'nin N3P sürecinde üretilen retikül boyutunda bir hesaplama kalıbı, N3E üzerinde bir G/Ç yonga seti, x86 ana işlemciye PCIe Gen 5 bağlantıları ve paket başına yaklaşık 15,4TB/s bant genişliğine sahip HBM4 belleği kullanıyor. Bir raf, 102,4Tb/s Tomahawk 6 anahtarları üzerinden bağlanan 128 çip barındırıyor; bu raflardan 16'sı — 2.048 hızlandırıcı — tek bir ölçekleme alanı oluşturuyor.
Çekinceler ve sonraki adımlar
Yayın, sınırlamaları da belirtiyor: tüm sayılar OpenAI tarafından sağlandı, yerinde doğrulanan çalıştırmalar 8k1k iş yükünü kapsadı ve AgentX sonuçları henüz yok. Yazarlar ayrıca Jalapeño ile Blackwell karşılaştırmasının tamamen adil olmadığını savunuyor; çünkü Jalapeño, Rubin ile aynı nesil olan HBM4'ü kullanıyor. Token maliyetinde Jalapeño ile Vera Rubin kabaca başa baş, ancak Jalapeño'nun verileri spekülatif kod çözme olmadan elde edildi; bu yöntem token maliyetini genellikle birkaç kat azaltıyor. Üretimin 2027 boyunca kademeli olarak artması, çıktının çoğunun gelecek yılın sonunda gelmesi ve sonraki hedefin 100MW'lık kurulum olması bekleniyor.
SiTech — AI destekli web geliştirme
Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.