
شريحة Jalapeño من OpenAI تتفوّق على Nvidia Blackwell في اختبارات الاستدلال
اختبارات SemiAnalysis تظهر أن شريحة Jalapeño للاستدلال، التي صمّمتها OpenAI بنفسها، تتفوّق على Nvidia Blackwell في الأداء لكل واط من دون فك ترميز تخميني أو توقّع رموز متعددة.
طوّرت OpenAI شريحة استدلال خاصة بها، وتشير الاختبارات الأولى إلى أنها قادرة على منافسة عتاد Nvidia وAMD وGoogle. نُشرت النتائج في 25 أغسطس واعتمدت على تشغيل SemiAnalysis حزمة InferenceX داخل مختبرات OpenAI إلى جانب مهندسي الشركة.
ما هي Jalapeño
أُعلن عن الشريحة، التي تحمل الاسم الرمزي Jalapeño، في مؤتمر Hot Chips، وهي تُطوَّر بالشراكة مع Broadcom. بدأ العمل على التصميم في منتصف 2024، واستغرق الطريق من التوظيف الأولي إلى تصنيع العيّنة الأولى نحو 16 شهرًا، مع إنجاز تصنيع CoWoS في نوفمبر 2025. جُمعت النتائج المنشورة على عيّنة A0 في الشهر التاسع تقريبًا من البرنامج، بينما عيّنة B0 موجودة بالفعل في المصنع وتحسّن الأداء لكل واط بنحو 25 في المئة.
الأداء لكل واط
المؤشر الرئيسي هو معدّل إنتاج الرموز لكل ميغاواط مع احتساب كل تكاليف البنية التحتية. وبهذا المؤشر تتفوّق Jalapeño على Blackwell في كل السيناريوهات المختبرة تقريبًا، وهي تفعل ذلك بتوقّع رمز واحد فقط — من دون فك ترميز تخميني ومن دون فصل مرحلتي prefill وdecode — في حين عملت الأنظمة المقارنة بأفضل تهيئاتها وبتوقّع رموز متعددة. في الأحمال المنخفضة تجاوزت الشريحة 700 رمز في الثانية لكل مستخدم على DeepSeek R1، وعلى Kimi K2.5 اقتربت من 700 رمز/ثانية للمستخدم وكانت أسرع بأكثر من تسعة أضعاف من أفضل شريحة تالية عند 100 رمز/ثانية للمستخدم. وجاءت نتائج GSM8k على مستوى شرائح Nvidia.
شريحة عامة الغرض ونطاق من 2048 مسرّعًا
خلافًا للانطباع بأن مثل هذه الشرائح مُهيّأة لخدمة نماذج مالكها فقط، تصف SemiAnalysis شريحة Jalapeño بأنها مسرّع استدلال عام الغرض: فقد شغّلت عدة نماذج مفتوحة وحزمة InferenceX، بل عرضت OpenAI لعبة Doom تعمل عليها بعد نقلها بأوامر Codex. تستخدم الشريحة قالبًا حسابيًا بحجم الرتيكل مُصنّعًا بتقنية N3P من TSMC، وشريحة إدخال/إخراج بتقنية N3E، ووصلات PCIe Gen 5 إلى معالج x86 مضيف، وذاكرة HBM4 بسعة نطاق تقارب 15.4 تيرابايت/ثانية لكل عبوة. ويضم الرف الواحد 128 شريحة متصلة بمبدّلات Tomahawk 6 بسعة 102.4 تيرابت/ثانية، وتشكّل 16 رفًا — أي 2048 مسرّعًا — نطاق توسّع واحدًا.
تحفظات والخطوات التالية
يذكر التقرير أيضًا حدودًا واضحة: قدّمت OpenAI جميع الأرقام، والتشغيلات التي جرى التحقق منها ميدانيًا غطّت حملًا من نوع 8k1k، ولا توجد بعد نتائج لـ AgentX. ويرى الكاتبان أن مقارنة Jalapeño بـ Blackwell ليست عادلة تمامًا، لأن شريحة OpenAI تستخدم HBM4، أي الجيل نفسه الذي تستخدمه Rubin. وفي كلفة الرمز تتقارب Jalapeño وVera Rubin إلى حدّ كبير، لكن أرقام Jalapeño تحققت من دون فك ترميز تخميني، وهو ما يخفض عادة كلفة الرمز عدة أضعاف. ومن المقرر أن يتصاعد الإنتاج تدريجيًا خلال 2027، مع توقّع الجزء الأكبر من المخرجات في نهاية العام المقبل، والهدف التالي هو نشر بقدرة 100 ميغاواط.
SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي
نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.