უკან დაბრუნება
OpenAI-ის ჩიპი Jalapeño ბენჩმარკებში Nvidia-ს Blackwell-ს აჯობებს
SiTech AI Team2 წთ. საკითხავი

OpenAI-ის ჩიპი Jalapeño ბენჩმარკებში Nvidia-ს Blackwell-ს აჯობებს

SemiAnalysis-ის ტესტებით, OpenAI-ის საკუთარი ინფერენსის ჩიპი Jalapeño წარმადობით ვატზე Nvidia-ს Blackwell-ს აღემატება — ჯერ ერთი ტოკენის პროგნოზირებით, სპეკულაციური დეკოდირების გარეშე.

OpenAI-მ საკუთარი ინფერენსის ჩიპი შექმნა და პირველი ბენჩმარკები აჩვენებს, რომ ის Nvidia-ს, AMD-ისა და Google-ის აპარატურას კონკურენციას უწევს. 25 აგვისტოს გამოქვეყნებული შედეგები SemiAnalysis-მა InferenceX სუიტით მიიღო — OpenAI-ის ლაბორატორიაში, კომპანიის ინჟინრებთან ერთად.

რა არის Jalapeño

ჩიპი კოდური სახელით Jalapeño Hot Chips-ის კონფერენციაზე გამოცხადდა და Broadcom-თან პარტნიორობით მუშავდება. SemiAnalysis-ის ცნობით, დიზაინზე მუშაობა 2024 წლის შუაში დაიწყო, ხოლო საწყისი დაქირავებიდან წარმოების ტეიპაუტამდე დაახლოებით 16 თვე გავიდა — CoWoS ტეიპაუტი 2025 წლის ნოემბერში დასრულდა. გამოქვეყნებული შედეგები A0 სტეპინგზეა მიღებული, პროგრამის დაახლოებით მეცხრე თვეს; B0 სტეპინგი უკვე ქარხანაშია და ვატზე წარმადობას დაახლოებით 25 პროცენტით აუმჯობესებს.

წარმადობა ვატზე

მთავარი მაჩვენებელია ტოკენების გამტარუნარიანობა ერთ მეგავატზე, კომუნალური ხარჯების ჩათვლით. ამ მაჩვენებლით Jalapeño თითქმის ყველა შემთხვევაში აჯობებს Blackwell-ს და ამას მხოლოდ ერთი ტოკენის პროგნოზირებით აღწევს — სპეკულაციური დეკოდირებისა და prefill-decode განცალკევების გარეშე — მაშინ, როცა შესადარებელი სისტემები მრავალტოკენიანი პროგნოზირებით საუკეთესო კონფიგურაციებში მუშაობდნენ. დაბალი დატვირთვისას ჩიპმა DeepSeek R1-ზე ერთ მომხმარებელზე 700-ზე მეტ ტოკენს წამში მიაღწია, Kimi K2.5-ზე კი თითქმის 700 ტოკენს/წმ-ს და 100 ტოკენს/წმ-ზე შემდეგ საუკეთესო ჩიპს ცხრაჯერ აღემატებოდა. GSM8k-ის შეფასებები Nvidia-ს ჩიპების დონეზე იყო.

განზოგადებული ჩიპი და 2048 ამაჩქარებლის მასშტაბირება

იმ წარმოდგენის საპირისპიროდ, რომ ასეთი ჩიპები მხოლოდ მფლობელის მოდელებზეა მორგებული, SemiAnalysis Jalapeño-ს განზოგადებულ ინფერენსის ამაჩქარებლად აღწერს: მან რამდენიმე ღია მოდელი და InferenceX სუიტიც გაუშვა, OpenAI კი ჩიპზე Doom-ის გაშვებაც აჩვენა — თამაში Codex-ის პრომპტებით იყო პორტირებული. ჩიპი იყენებს reticle-ის ზომის გამოთვლით კრისტალს TSMC-ის N3P პროცესზე, N3E-ზე დამზადებულ I/O ჩიპლეტს, PCIe Gen 5-ს x86 ჰოსტ-პროცესორთან და HBM4 მეხსიერებას დაახლოებით 15.4 ტბ/წმ გამტარუნარიანობით თითო პაკეტზე. ერთ თარო 128 ჩიპს მოიცავს, რომლებიც 102.4 ტბ/წმ Tomahawk 6 კომუტატორებით არიან დაკავშირებული, 16 ასეთი თარო — 2048 ამაჩქარებელი — კი ერთ მასშტაბირების დომენს ქმნის.

შეზღუდვები და შემდეგი ნაბიჯები

გამოცემა ზღუდვებსაც აღნიშნავს: ყველა რიცხვი OpenAI-მ მოგვაწოდა, ადგილზე გადამოწმებული გაშვებები 8k1k დატვირთვას მოიცავდა და AgentX-ის შედეგები ჯერ არ არსებობს. ავტორების აზრით, Jalapeño-ს Blackwell-ს შედარება მთლად სამართლიანი არ არის, რადგან Jalapeño HBM4-ს იყენებს — იმავე თაობას, რასაც Rubin. ტოკენის ღირებულებით Jalapeño და Vera Rubin დაახლოებით თანასწორია, თუმცა Jalapeño-ს მაჩვენებლები სპეკულაციური დეკოდირების გარეშეა მიღებული, რაც ჩვეულებრივ ტოკენის ღირებულებას რამდენიმეჯერ ამცირებს. წარმოება 2027 წლის განმავლობაში ეტაპობრივად გაიზრდება, გამოშვების ძირითადი ნაწილი მომავალი წლის ბოლოსთვისაა მოსალოდნელი, შემდეგი მიზანი კი 100 მეგავატიანი განლაგებაა.

SSiTech

SiTech — AI-გაძლიერებული ვებ დეველოპმენტი

ვქმნით სწრაფ, თანამედროვე ვებსაიტებს და AI-ს ვაერთიანებთ ქართული ბიზნესებისთვის. გაქვთ პროექტი ან კითხვა? სიამოვნებით დაგეხმარებით.