Վերադառնալ
Inception-ի դիֆուզիոն Mercury 2.5-ը վայրկյանում 770 թոքեն է արտադրում
SiTech AI Team2 წთ. საკითხავი

Inception-ի դիֆուզիոն Mercury 2.5-ը վայրկյանում 770 թոքեն է արտադրում

Artificial Analysis-ի չափումներով՝ Inception-ի դիֆուզիոն Mercury 2.5 մոդելը վայրկյանում արտադրում է 770,4 թոքեն, ունի 260 հազար թոքենի կոնտեքստ և արժե 0,25 դոլար միլիոն մուտքային թոքենի դիմաց։

Inception-ը 2026 թվականի սեպտեմբերի 8-ին թողարկեց Mercury 2.5-ը՝ փակ դիֆուզիոն խոշոր լեզվական մոդել (dLLM), որը ընկերությունն անվանում է արտադրության մեջ ամենաարագ reasoning մոդելը։ Ի տարբերություն ավտոռեգրեսիվ մոդելների, որոնք տեքստը գրում են թոքեն առ թոքեն, Mercury 2.5-ը պատասխանը կառուցում է զուգահեռ և ճշգրտում է փուլերով։

Վայրկյանում 770 թոքեն

Artificial Analysis-ի չափումներով՝ Inception-ի API-ի միջոցով մոդելը վայրկյանում արտադրում է 770,4 ելքային թոքեն՝ շատ ավելի, քան նույն գնային կատեգորիայի reasoning մոդելների մեդիանը (110,3)։ Ինքը Inception-ը հայտարարում է արտադրության մեջ 1100 թոքենից ավելի արագության մասին։ Առաջին պատասխան-թոքենի սպասման ժամանակը 2,91 վայրկյան է՝ մի փոքր ավելի կատեգորիայի մեդիանից (2,22 վայրկյան)։

Մոդելը ընդունում և արտադրում է միայն տեքստ՝ պատկերներ չի մշակում։ Այն փակ է, կշիռները հանրությանը հասանելի չեն։ Կոնտեքստի պատուհանը 260 հազար թոքեն է (մոտ 390 A4 էջ)՝ Mercury 2-ի 128 հազարի փոխարեն։

Գնահատականներ և գին

Artificial Analysis-ի Intelligence Index-ում (v4.3.2) Mercury 2.5-ը հավաքում է 12 միավոր՝ կատեգորիայի մեդիանի մակարդակով։ Ինդեքսում մոդելը ծախսել է 35 միլիոն ելքային թոքեն՝ մեդիանի (84 միլիոն) կեսից պակաս, ինչը վերլուծական ընկերությունը «բավականին լակոնիկ» է անվանում։ Մեկ առաջադրանքի գնահատումը միջինում արժե 0,06 դոլար։

Գները Inception-ի API-ով՝ 0,25 դոլար միլիոն մուտքային թոքենի համար, 0,75 դոլար միլիոն ելքային թոքենի համար, քեշի 90% զեղչով և 0,14 դոլար խառը սակագնով միլիոն թոքենի դիմաց։ Թողարկման պահին OpenRouter-ում գործում է 80% զեղչ՝ 0,04 և 0,15 դոլար։

Ինչու է սա կարևոր

Դիֆուզիոն գեներացիան ուղղված է ցածր ուշացման սցենարներին՝ որոնում, ձայնային օգնականներ, կոդինգ-ագենտներ, որտեղ արագությունն ու գինը ոչ պակաս կարևոր են, քան կարողությունները։ Inception-ի խոսքով՝ Mercury 2.5-ը նախորդ սերնդից 10 միավորով խելացի է և համեմատելի է տնտեսող frontier մոդելների հետ՝ GPT-5.6 Luna, Gemini 3.5 Flash-Lite, Claude Haiku 4.5։ Մոդելն ստացել է կարգավորելի reasoning, գործիքների ներկառուցված աջակցություն, JSON ռեժիմ և զուգահեռ գործիք-կանչեր, հասանելի է Inception-ի API-ով, OpenRouter-ով և Baseten-ով։ Ընկերությունը հայտնում է, որ սկսել է մարզել իր ամենամեծ մոդելը և նախատեսում է թողարկել այն առաջիկա ամիսներին։

SSiTech

SiTech — AI-ով հզորացված վեբ մշակում

Ստեղծում ենք արագ ու ժամանակակից կայքեր և AI-ը ներդնում իրական բիզնես գործընթացներում։ Ունե՞ք նախագիծ կամ հարց։ Ուրախ կլինենք օգնել։