Վերադառնալ
M5 Ultra Mac Studio-ի ակնարկը՝ թռիչք տեղային AI գործակալների համար
SiTech AI Team3 წთ. საკითხავი

M5 Ultra Mac Studio-ի ակնարկը՝ թռիչք տեղային AI գործակալների համար

MacStories-ը չորս օր փորձարկել է 256 ԳԲ-անոց M5 Ultra Mac Studio-ն M3 Ultra-ի և RTX 5090-ով համակարգչի հետ։ Ակնարկի համաձայն՝ հրահանգի մշակումը միջինում աճել է 150%-ով, ինչը տեղային գործակալներին գործնական է դարձնում։

MacStories-ը հրապարակել է M5 Ultra Mac Studio-ի ակնարկը՝ Apple-ի սեղանադիր Mac-երի այսօրվա ամենաբարձր մոդելի մասին։ Հեղինակ Ֆեդերիկո Վիտիչին չորս օր փորձարկել է 256 ԳԲ հիշողությամբ տարբերակը՝ համեմատելով նախորդ M3 Ultra-ի (512 ԳԲ) և RTX 5090-ով իր խաղային համակարգչի հետ։ Եզրակացությունը՝ սա առաջին Mac-ն է, որը տեղային AI օգնականները փորձարարականից դարձնում է գործնական։

Նոր ճարտարապետություն անփոփոխ պատյանում

Արտաքինից M5 Ultra նույնական է փոխարինվող M3 Ultra-ին, սակայն չիպը նոր է. Apple-ը UltraFusion-ի միջոցով միավորում է երկու կրկնակի բյուրեղով M5 Max չիպեր՝ քառաբյուրեղ կառուցվածքում, ինչն ընկերության համար առաջինն է։ GPU-ն ունի 80 միջուկ, որոնցից յուրաքանչյուրը զուգորդված է Neural Accelerator-ի հետ, ինչը AI-ի համար ապահովում է մինչև 4,5 անգամ ավելի բարձր գագաթնակետային հաշվարկային հզորություն՝ M3 Ultra-ի համեմատ։ MLX-ի վրա հենվող տեղային մոդելների համար կարևոր միասնական հիշողությունը դեռ հասանելի է 256 և 512 ԳԲ տարբերակներով, իսկ թողունակությունը 819 ԳԲ/վ-ից աճել է մինչև 1,2 ՏԲ/վ՝ 50%-ով ավելի։ 512 ԳԲ-անոց մոդելը սպասվում է հոկտեմբերի վերջին։

Չափված արդյունքները

macOS 27-ում oMLX 0.7.0.dev2-ի և Qwen3.8-Flash-Next մոդելի հետ չորս օրվա թեստերում հրահանգի մշակումը միջինում աճել է 150%-ով՝ մոտ 2,5 անգամ ավելի, քան հեղինակի նախորդ կարգավորումը. 16 հազար թոքենանոց հրահանգը կարդացվել է վայրկյանում 2887 թոքեն արագությամբ՝ M3 Ultra-ի 1143-ի դիմաց։ Նույն համեմատության մեջ գեներացիայի արագությունը մոտ 70%-ով բարձր էր, իսկ գրաֆիկները ցույց են տալիս 91-ից 75 թոքեն վայրկյանում՝ կոնտեքստի 4K-ից 256K աճի ընթացքում։ Սառը քեշով 256K հրահանգի դեպքում M3 Ultra-ն առաջին տեսանելի թոքենին սպասել է մոտ 245 վայրկյան, M5 Ultra-ն՝ 102։ Միաժամանակ երեք հարցումների դեպքում (յուրաքանչյուրը՝ ~6,5 հազար թոքեն) նոր Mac-ը տվել է վայրկյանում 81,5 թոքեն ընդհանուր արագություն՝ 23%-ով ավելի, քան մեկ հարցումով, մինչդեռ M3 Ultra-ն ավելացրել է ընդամենը 4%։

RTX 5090-ը դեռ առաջ է՝ իր սահմաններով

NVIDIA-ի քարտը մնում է ավելի արագ, քանի դեռ մոդելը տեղավորվում է նրա հիշողության մեջ. 6000 թոքենանոց հրահանգում այն կարդացել է վայրկյանում մոտ 3000 թոքեն՝ M5 Ultra-ի մոտ 1700-ի դիմաց, իսկ գեներացիայում ունեցել է 25% առավելություն՝ 1,79 ՏԲ/վ ընդդեմ 1,2 ՏԲ/վ թողունակության։ Նրա սահմանը 32 ԳԲ VRAM-ն է. 8-բիթանոց ուշադրության քեշով այն ավարտել է երկար կոնտեքստերը 49,6, 40,4 և 30 թոքեն վայրկյանում 64K, 128K և 256K դեպքերում, սակայն հենց ստիպված է եղել PCIe-ով վերցնել համակարգի հիշողությունը, այդ ցուցանիշները ընկել են 4,6, 2,9 և 1,5-ի։ Հեղինակը նշում է նաև, որ համակարգիչը շատ ավելի մեծ է, աղմկոտ ու տաք, իսկ Mac Studio-ի հովհարիչը սովորական աշխատանքում չի լսվում։

Ինչու են տեղային գործակալները կարևոր հեղինակի համար

Վիտիչիի հետաքրքրությունը գործնական է. ամառային iOS և iPadOS 27 ակնարկի հետազոտական համակարգը հիմնված էր գործակալների վրա, որոնք 99 օր շուրջօրյա աշխատել են 310 փաստաթղթից բաղկացած նախագծի վրա՝ 0 դոլար ընդհանուր ծախսով. ըստ նրա, այդ ծանրաբեռնվածությունը ամպային API-ների միջոցով անհնարին կլիներ։ Տեղային մոդելը նա դարձրել է լռելյայն iOS-ի Open Minis հավելվածում։ 256 ԳԲ տարբերակի համար լավագույն հավասարակշռությունը նա համարում է 5-բիթանոց քվանտացումը։

SSiTech

SiTech — AI-ով հզորացված վեբ մշակում

Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։