Geri qayıt
SiTech Team⏱️ 5 წთ. საკითხავი

NVIDIA Vera Rubin GPU Arxitekturası — 336 Milyard Tranzistor, Blackwell ilə Müqayisədə 10x Daha Çox Agent Ötürmə Qabiliyyəti

NVIDIA Vera Rubin GPU Arxitekturası — 336 Milyard Tranzistor, Blackwell ilə Müqayisədə 10x Daha Çox Agent Ötürmə Qabiliyyəti

NVIDIA Vera Rubin platformasını təqdim etdi — 336 milyard tranzistor, HBM4 yaddaş və üçüncü nəsil Transformer Engine ilə agent AI iş yükləri üçün Blackwell-ə nisbətən enerji vahidi başına 10 dəfəyə qədər daha çox agent ötürmə qabiliyyəti təmin edir.

Agent AI-nın Yeni Dövrü — NVIDIA Vera Rubin

Bir neçə il əvvəl süni intellekt dünyası əsasən modellərin təlimi və sadə söhbət interfeyslərinə xidmət edirdi. Bu gün isə mənzərə kökündən dəyişdi — AI fabrikləri fasiləsiz işləyir və miqyasda intellekt istehsal edir. Bu fabriklər indi düşünən, planlaşdıran, alətlərdən istifadə edən, aralıq nəticələri yoxlayan və geniş kontekstlərdə mürəkkəb çoxmərhələli tapşırıqları yerinə yetirən agent iş axınlarına xidmət edir.

Agent iş yükləri tək bir sual və cavabla müəyyən edilmir — bunlar çoxsaylı düşünmə mərhələləri boyunca davamlı inferensdir. Onlar hər addımda aşağı gecikmə, yüksək dekod ötürmə qabiliyyəti, səmərəli uzun-kontekst diqqəti, böyük KV keş tutumu və modelləri sıx bağlı GPU domenlərində miqyaslama qabiliyyəti tələb edir. Məhz bu çətinliklərə NVIDIA-nın yeni Vera Rubin platforması cavab verir.

Rubin GPU — 336 Milyard Tranzistorlu Hesablama Sıxlığı

Platformanın mərkəzində, NVIDIA Blackwell-dən enerji vahidi başına 10 dəfəyə qədər daha çox agent ötürmə qabiliyyəti təmin etmək üçün hazırlanmış NVIDIA Rubin GPU yerləşir. Bu sadəcə bir rəqəm deyil — bu, AI fabriklərinə eyni enerji büdcəsi daxilində daha çox faydalı token istehsal etməyə imkan verəcək fundamental nəsil sıçrayışıdır.

Rubin GPU 336 milyard tranzistordan ibarətdir, 224 axın çoxprosessoru (SM) və 896 Tensor Core ehtiva edir. Çip, yüksəksürətli NV-HBI (NVIDIA High-Bandwidth Interface) kristallararası əlaqəsi vasitəsilə tək paketdə birləşdirilmiş retikül-məhdud hesablama kristallarından istehsal olunmuşdur. Bu yanaşma yüksək sıxlıq və səmərəlilik təmin edir.

Üçüncü Nəsil Transformer Engine — 50 Petaflops NVFP4

Rubin-in əsas yeniliklərindən biri üçüncü nəsil Transformer Engine-dir. Bu mühərrik müxtəlif ədədi formatlar arasında dəqiqliyi uyğunlaşdıraraq Rubin GPU-ya dəqiqliyi qoruyarkən 50 petaflops-a qədər NVFP4 inferens performansı çatdırmağa imkan verir.

Təkmilləşdirilmiş Tensor Core-lar genişləndirilmiş dəqiqlik çevikliyinə malikdir və Tensor Core-un saat başına ötürmə qabiliyyəti K ölçüsündə məlumat emalının ikiqat artırılması sayəsində iki dəfə artırılmışdır. Bu optimallaşdırma həm ötürmə qabiliyyəti ilə məhdud nüvələrə, həm də yaddaş və gecikmə ilə məhdud nüvələrə kömək edir.

HBM4 Yaddaş — 22 TB/s Bant Genişliyində 288 GB

Rubin, xüsusi HBM nəzarətçiləri və 12-Hi yığınları tərəfindən idarə olunan 288 GB-a qədər HBM4 yaddaşı inteqrasiya edərək 22 TB/s-ə qədər pik bant genişliyi təmin edir — Blackwell və Blackwell Ultra-dan 2.8 dəfə çox.

HBM4, HBM3e ilə müqayisədə interfeys genişliyini ikiqat artırır. Yeni yaddaş nəzarətçisi, yaddaş ekosistemi ilə dərin birgə mühəndislik və daha sıx hesablama-yaddaş inteqrasiyası ilə birlikdə, bu sistem misli görünməmiş bant genişliyi təmin edir.

Yüksək tutumlu, yüksək bant genişlikli HBM4, çox trilyon parametrli modelləri yerləşdirmək, KV keş boşaltması olmadan kontekst uzunluğunu genişləndirmək və yüksək konkurrent, uzun müddətli inferens iş yüklərini dəstəkləmək üçün kritik əhəmiyyət daşıyır.

NVLink 6 və NVLink-C2C — Ultra Sürətli Bağlantılar

Rubin arxitekturasında rabitə infrastrukturu hesablama gücü qədər vacibdir. NVIDIA NVLink 6, hamıdan-hamıya GPU-GPU rabitəsi üçün NVLink Switch-ə 3,600 GB/s miqyaslama bant genişliyi təmin edir. NVLink-C2C, koherent CPU-GPU rabitəsi üçün 1,800 GB/s təmin edir, x16 PCIe Gen 6 isə 256 GB/s-ə qədər host bağlantısı təmin edir.

Rubin, cihaz tərəfindən başladılan NVLink rabitəsi üçün sayılmış yazmalar (counted writes) təqdim edir və GPU-lar arası məlumat ötürülməsi üçün sinxronizasyonu asanlaşdırır. Bu, qəbul edən GPU-nun ötürmənin tamamlanmasını daha səmərəli izləməsinə imkan verir.

Agent AI Üçün Optimallaşdırılmış Arxitektura

Rubin GPU xüsusi olaraq agent AI-nın icra nümunələri üçün hazırlanmışdır — düşünmə, planlaşdırma, alət istifadəsi və uzun kontekst emalı. Bu, təkcə pik hesablama performansını deyil, həm də səmərəli məlumat hərəkətini, uzun kontekst diqqət emalını və asılı nüvələr arasında hamar keçidləri tələb edir.

Rubin, aktivasiya seyrəkliyi ilə adaptiv sıxlaşdırmanın birləşməsini və təkmilləşdirilmiş softmax ötürmə qabiliyyətini istifadə edərək diqqəti sürətləndirir. Diqqət xətti, aralıq diqqət balları yaratmaq üçün sıx QK^T hesablaması ilə başlayır. Rubin daha sonra bu aralıq məlumatları Tensor Yaddaşından strukturlaşdırılmış 2:4 seyrək sıxılmış formaya yükləyərək yazma xərclərini və saxlama tələblərini azaldır.

Bundan əlavə, Rubin asılı nüvələr arasında daha incə dənəli koordinasiya təmin edərək istehlakçı nüvəsinə, lazımi giriş məlumatları əlçatan olan kimi daha tez işə başlamağa imkan verir.

Vera CPU — Maksimum Performans Üçün Olympus Nüvələri

Vera Rubin platforması həmçinin, maksimum tək-axın performansı üçün hazırlanmış Olympus nüvələri üzərində qurulmuş Vera CPU-nu ehtiva edir. Bu CPU, NVLink-C2C vasitəsilə GPU ilə sıx koordinasiya təmin edir; bu, CPU və GPU-nun daim məlumat mübadiləsi apardığı agent iş axınları üçün xüsusilə vacibdir.

Vera Rubin NVL72 — Raf Miqyaslı AI Superkompüteri

Vera Rubin NVL72, Rubin GPU-nu raf miqyaslı icra domeninə genişləndirir. Üçüncü nəsil MGX raf arxitekturası kablosuz hesablama və şəbəkə lövhələrini, 45°C maye soyutmanı, dinamik raf miqyaslı enerji idarəetməsini və Intelligent Power Smoothing-i birləşdirir.

DSX MaxLPS ilə Vera Rubin NVL72, orta enerji istehlakını təxminən 10% və 50 ms pik gücü təxminən 20% azalda bilər. Bu, operatorlara eyni enerji büdcəsi daxilində 40% daha çox GPU quraşdırmağa imkan verir. Spectrum-6 şəbəkəsi giqamiqyaslı AI fabrikləri üçün bağlantı təmin edir.

TEE-I/O ilə Məxfi Hesablama

Böyük miqyaslı agent AI yerləşdirmələri üçün məlumat təhlükəsizliyi vacibdir. NVIDIA, AI fabriki daxilində məlumatları istirahətdə, ötürülmə zamanı və istifadə zamanı qorumaq üçün nəzərdə tutulmuş TEE-I/O ilə Məxfi Hesablama təqdim edir.

Bristol Myers Squibb — Həyat Elmlərinin Ən Qabaqcıl AI Fabriki

Rubin platformasının real potensialını nümayiş etdirmək üçün Bristol Myers Squibb, Rubin üzərində həyat elmlərinin ən qabaqcıl AI fabrikini qurur. Bu addım vurğulayır ki, Vera Rubin sadəcə yeni bir GPU nəsli deyil — bütün sənayelərin AI qəbulunda növbəti səviyyəyə keçməsinə imkan verəcək bir platformadır.

Nəticə

NVIDIA Vera Rubin GPU arxitekturası AI infrastrukturunun təkamülündə əlamətdar bir anı təmsil edir. 336 milyard tranzistor, HBM4 yaddaş, üçüncü nəsil Transformer Engine və Blackwell-ə nisbətən 10 dəfə agent ötürmə qabiliyyəti ilə o, təkcə bugünkü AI iş yüklərinin tələblərini qarşılamır, həm də gələcəyin agent sistemlərinin təməlini qoyur. CoreWeave, Google Cloud, Microsoft Azure və Mistral daxil olmaqla 300 qlobal tərəfdaş və böyük bulud provayderlərinin dəstəyi ilə Vera Rubin artıq dünya üzrə yerləşdirilir. Vera Rubin ilə NVIDIA, AI fabriklərinin fasiləsiz, daha səmərəli, daha təhlükəsiz və həmişəkindən daha böyük miqyasda işlədiyi vizyonunu davam etdirir.

📖 Mənbə