
M5 Ultra Mac Studio icmalı: yerli AI agentləri üçün sıçrayış
MacStories dörd gün ərzində 256 GB-lıq M5 Ultra Mac Studio-nu M3 Ultra və RTX 5090-lı PC ilə müqayisə edib. İcmala görə sorğuların emalı orta hesabla 150% artıb və bu, yerli agentləri praktik edir.
MacStories M5 Ultra Mac Studio-nun icmalını dərc edib — bu, Apple-ın masaüstü Mac xəttinin hazırkı ən yüksək modelidir. Müəllif Federiko Vitiççi 256 GB yaddaşlı versiyanı dörd gün ərzində əvvəlki M3 Ultra (512 GB) və içində RTX 5090 olan oyun kompüteri ilə müqayisə edib. Nəticə: bu, yerli süni intellekt köməkçilərini eksperimentdən praktikaya keçirən ilk Mac-dır.
Dəyişməyən korpusda yeni memarlıq
M5 Ultra xarici görünüşcə əvəz etdiyi M3 Ultra ilə eynidir, lakin çip yenidir: Apple UltraFusion vasitəsilə iki qoşa kristallı M5 Max çipini dörd kristallı quruluşda birləşdirir — bu, şirkət üçün ilkdır. GPU-da hər biri Neural Accelerator ilə birləşdirilmiş 80 nüvə var və bu, süni intellekt üçün pik hesablama gücünü M3 Ultra ilə müqayisədə 4,5 dəfəyə qədər artırır. MLX əsaslı yerli modellərin dayandığı vahid yaddaş yenə 256 və 512 GB variantlarında təklif olunur, ötürmə qabiliyyəti isə 819 GB/s-dən 1,2 TB/s-ə, yəni 50% artıb. 512 GB-lıq modelin oktyabrın sonunda çıxacağı gözlənilir.
Ölçülən qazanclar
macOS 27-də oMLX 0.7.0.dev2 və Qwen3.8-Flash-Next ilə aparılan dörd günlük testlərdə sorğunun emalı orta hesabla 150% artıb — bu, müəllifin əvvəlki qurulumundan təxminən 2,5 dəfə sürətlidir: 16 min tokenlik sorğu saniyədə 2 887 token sürəti ilə oxunub, M3 Ultra-da isə bu göstərici 1 143 olub. Eyni müqayisədə generasiya sürəti təxminən 70% yüksək idi və qrafiklər kontekst 4K-dan 256K-ya böyüdükcə sürətin saniyədə 91 tokendan 75-ə düşdüyünü göstərir. Soyuq keşlə 256K-lıq sorğuda M3 Ultra ilk görünən token üçün təxminən 245 saniyə gözləyib, M5 Ultra isə 102 saniyə. Eyni anda üç sorğuda (hər biri ~6,5 min token) yeni Mac cəmi saniyədə 81,5 token hasil edib — tək sorğuya nisbətən 23% çox; M3 Ultra isə yalnız 4% qazanıb.
RTX 5090 hələ də öndədir, amma sərhədləri var
NVIDIA kartı model yaddaşına sığdığı müddətcə daha sürətlidir: 6 000 tokenlik sorğuda saniyədə təxminən 3 000 token oxuyub, M5 Ultra isə təxminən 1 700-də qalıb; 1,79 TB/s ilə 1,2 TB/s arasındakı fərq generasiyada 25% üstünlük verir. Kartın həddi 32 GB VRAM-dir: 8 bitlik diqqət keşi ilə uzun kontekstləri 64K, 128K və 256K-da saniyədə 49,6, 40,4 və 30 tokenla tamamlayıb; lakin PCIe vasitəsilə sistem yaddaşını borc almağa məcbur olduqda bu sürətlər 4,6, 2,9 və 1,5-ə düşüb. Müəllif həmçinin qeyd edir ki, kompüter daha böyük, səsli və istidir, Mac Studio-nun ventilyatoru isə adi yerli model işində eşidilmir.
Yerli agentlər müəllif üçün niyə vacibdir
Vitiççinin marağı praktikdir. Yay aylarında iOS və iPadOS 27 icmalı üçün araşdırma sistemi 310 sənədli layihə üzərində 99 gün fasiləsiz işləyən agentlərə əsaslanırdı və ümumi xərci 0 dollar idi; onun sözlərinə görə, bu iş yükü bulud API-ləri ilə davamlı olmazdı. Yerli modeli iOS-dakı Open Minis tətbiqində standart seçim edib. 256 GB versiya üçün 5 bitlik kvantizasiyanı ən yaxşı balans hesab edir.
SiTech — AI ilə gücləndirilmiş veb hazırlanması
Sürətli və müasir saytlar qurur, AI-ı real biznes proseslərinə gətiririk. Layihəniz və ya sualınız var? Kömək etməyə hazırıq.