
Desert Ant Labs tek SDK ile 18 cihaz üstü YZ modelini yayınladı
Avrupalı laboratuvar ses, görü ve metin için on iki kararlı, altı beta model sundu; modeller cihazda milisaniyeler içinde çalışıyor ve ayda 100.000 etkin cihaza kadar ücretsiz.
Avrupalı yapay zekâ laboratuvarı Desert Ant Labs, 8 Eylül 2026'da ses, görü ve metin için cihaz üzerinde çalışan on sekiz özel modeli, Swift, Kotlin ve JavaScript için tek bir SDK'yı ve yerel çıkarımı ücretsiz kılan bir fiyatlandırma modelini duyurdu.
Her göreve bir model
Modellerin on ikisi kararlı, altısı beta. Her biri milisaniyeler içinde yanıt veriyor ve çalıştırması hiçbir şeye mal olmuyor; bu da onu her karede ya da tuş vuruşunda kullanılabilir ve beş yıllık bir telefona bile sığar hale getiriyor. Voz, bir iPhone'da on dakikalık sesi iki saniyede yazıya döküyor — Whisper'dan 4,7 kat hızlı — her kelimenin başlangıç ve bitiş zamanıyla. Clear, beş dakikalık bir dizüstü kaydını bir saniyede stüdyo kalitesine çeviren 9MB'lık bir model. Redact, adları, adresleri ve kart numaralarını 27 dilde gerçek zamanlı maskeliyor, böylece sunucuya hiç ulaşmıyorlar. Tongue üç kelimeden 84 dili 2MB'lık modelle tanıyor: 293MB'lık bir dedektörün 0,887'sine karşı 0,933 skor. Redact ise kişisel verilerin %88,8'ini yakalarken 2,3GB'lık GLiNER-PII %91,1'de kalıyor.
Neden cihaz üstü
Laboratuvar yerel çıkarımı Avrupa'nın egemen varsayılanı olarak sunuyor: veri müşterinin elinden çıkmıyor, özellik başkasının bulutuna bağlı değil ve hiç yüklenmemiş olan talep edilemiyor. Ekonomi, bedeli çoktan ödenmiş hesaplama gücüne dayanıyor: sektör bu yıl veri merkezlerine yaklaşık 450 milyar dolar harcayacak; oysa dünyada giderek güçlenen çiplerle bir milyardan fazla telefon, tablet ve dizüstü satılıyor — insanların elindeki hesaplama gücü, yeryüzündeki tüm YZ veri merkezlerinden fazla. Desert Ant ayrıca üç ajan sistemini inceleyen NVIDIA araştırmacılarının, büyük modele yapılan çağrıların %40-70'inin küçük ve uzmanlaşmış bir modele kaydırılabileceği tahminini aktarıyor. Her model ayda 100.000 etkin cihaza kadar ücretsiz.
Bir video uygulamasından kendi modellerine
Ekip beş yılını Detail adlı video uygulamasında geçirdi, ancak altyapı faturaları büyüdükçe Auto Edit klip oluşturma ve podcast ses iyileştirme gibi özellikler için bulut API'lerine dönmek zorunda kaldı. Modelleri kendileri eğitti: Clear, Dolby'nin yerini aldı; Voz cihaz üstü transkripsiyonu beş kat hızlandırdı. On dakikalık videoyu beş saniyede bir düzine klibe çeviren 284MB'lık Clips, Claude Sonnet'in yerini 10 kat hız ve aynı kalitede 470 kat daha az enerjiyle aldı. iOS 27 ile çıkacak Detail 6, tüm bulut API'lerini tamamen cihazda çalışan kendi modelleriyle değiştirecek.
Önce "küçük beyinler"
Desert Ant ilk yüz modeli beyincik olarak tanımlıyor — sürekli çalışan işleri üstlenen küçük beyin — ve ardından hangi modelin yanıt vereceğine karar verecek bir korteks katmanı geliyor: önce küçük yerel model, iş gerektirdiğinde daha büyüğü, bulut ise yalnızca iş cihazdan çıkmak zorunda kaldığında. Modeller seçilmiş bir varsayılan ve onu değiştirme kollarıyla geliyor; çalışma ortamı modelle birlikte optimize ediliyor: Clear ve Voz iPhone Neural Engine üzerinde, Clear'ın aynı ağırlıkları tarayıcıda WebAssembly ile çalışıyor. SDK GitHub'da; dokümantasyon, Mac CLI ve Hugging Face'te tarayıcı demolarıyla birlikte.
SiTech — AI destekli web geliştirme
Hızlı ve modern web siteleri kuruyor, AI'yı gerçek iş akışlarına taşıyoruz. Projeniz veya sorunuz mu var? Yardımcı olmaktan mutluluk duyarız.