
Inception'ın difüzyon modeli Mercury 2.5 saniyede 770 token üretiyor
Artificial Analysis ölçümlerine göre Inception'ın difüzyon tabanlı Mercury 2.5 modeli saniyede 770,4 token üretiyor; bağlam penceresi 260 bin token, girdi fiyatı milyon token başına 0,25 dolar.
Inception, 8 Eylül 2026'da Mercury 2.5'i yayımladı — şirketin üretimdeki en hızlı akıl yürütme modeli olarak tanımladığı, kapalı kaynaklı difüzyon tabanlı büyük dil modeli (dLLM). Metni token token yazan otoregresif modellerin aksine Mercury 2.5 yanıtı paralel olarak oluşturup birkaç aşamada düzeltiyor.
Saniyede 770 token
Artificial Analysis'ın ölçümüne göre model, Inception API'si üzerinden saniyede 770,4 çıktı tokenı üretiyor — aynı fiyat aralığındaki akıl yürütme modellerinin medyanı olan 110,3 tokenın çok üzerinde. Inception ise üretimde 1.100 tokenın üzerinde hız iddia ediyor. İlk yanıt tokenına kadar geçen süre 2,91 saniye; kategorinin medyanı 2,22 saniye.
Model yalnızca metin alıp yalnızca metin üretiyor; görüntüleri işleyemiyor. Model kapalı kaynaklı ve ağırlıkları kamuya açık değil. Bağlam penceresi 260 bin token (yaklaşık 390 A4 sayfası); Mercury 2'de bu 128 bindi.
Sonuçlar ve fiyat
Artificial Analysis Intelligence Index'te (v4.3.2) Mercury 2.5, 12 puan alıyor — kategorisinin medyanına denk. Endekste model 35 milyon çıktı tokenı harcadı; bu, 84 milyonluk medyanın yarısından az ve analiz şirketi bunu "oldukça öz" olarak niteliyor. Tek bir görevin değerlendirme maliyeti ortalama 0,06 dolar.
Fiyatlar Inception API'sinde milyon girdi tokenı başına 0,25 dolar, milyon çıktı tokenı başına 0,75 dolar; önbellek indirimi %90, harmanlanmış tarife milyon token başına 0,14 dolar. Lansmanda OpenRouter'da %80 indirim var: 0,04 ve 0,15 dolar.
Neden önemli
Difüzyon üretimi düşük gecikmeli iş yüklerini hedefliyor: arama, sesli asistanlar ve kodlama ajanları; burada hız ve maliyet, yetenek kadar belirleyici. Inception'a göre Mercury 2.5, Mercury 2'ye kıyasla 10 puan daha akıllı ve GPT-5.6 Luna, Gemini 3.5 Flash-Lite, Claude Haiku 4.5 gibi ekonomik sınır modelleriyle kıyaslanabilir. Model ayarlanabilir akıl yürütme, yerleşik araç kullanımı, JSON modu ve paralel araç çağrıları ekliyor; Inception API'si, OpenRouter ve Baseten üzerinden sunuluyor. Şirket, şimdiye kadarki en büyük modelini eğitmeye başladığını ve birkaç ay içinde yayımlamayı planladığını söylüyor.
SiTech — AI destekli web geliştirme
Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.