
Desert Ant Labs تطلق 18 نموذج ذكاء اصطناعي محلياً عبر SDK واحد
قدّمت المختبرات الأوروبية اثني عشر نموذجاً مستقراً وستة في المرحلة التجريبية للصوت والرؤية والنص، تعمل على الجهاز في أجزاء من الثانية ومجانية حتى 100 ألف جهاز نشط شهرياً.
أطلقت المختبرات الأوروبية Desert Ant Labs في الثامن من سبتمبر 2026 ثمانية عشر نموذجاً متخصصاً يعمل على الجهاز للصوت والرؤية والنص، إلى جانب SDK واحد لـ Swift وKotlin وJavaScript ونموذج تسعير يجعل الاستدلال المحلي مجانياً.
نموذج واحد لكل مهمة
اثنا عشر نموذجاً مستقر وستة في المرحلة التجريبية. يستجيب كل منها في أجزاء من الثانية ولا يكلف شيئاً للتشغيل، ما يجعله صالحاً للاستخدام في كل إطار أو ضغطة مفتاح وصغيراً بما يكفي لهاتف عمره خمس سنوات، وفق الشركة. ينسخ Voz عشر دقائق من الصوت في ثانيتين على آيفون — أسرع 4.7 مرة من Whisper — مع وقت بداية ونهاية لكل كلمة. أما Clear فهو نموذج بحجم 9 ميغابايت يحوّل تسجيلاً لخمس دقائق إلى صوت بجودة الاستوديو في ثانية واحدة. ويحجب Redact الأسماء والعناوين وأرقام البطاقات في الوقت الفعلي بـ27 لغة كي لا تصل إلى أي خادم. ويتعرف Tongue على 84 لغة من ثلاث كلمات بنموذج بحجم 2 ميغابايت مسجلاً 0.933 مقابل 0.887 لكاشف بحجم 293 ميغابايت، بينما يلتقط Redact 88.8% من البيانات الشخصية مقابل 91.1% لـGLiNER-PII بحجم 2.3 غيغابايت.
لماذا على الجهاز
يقدّم المختبر الاستدلال المحلي كخيار سيادي افتراضي في أوروبا: البيانات لا تترك يد العميل، والميزة لا تعتمد على سحابة طرف آخر، وما لم يُرفع قط لا يمكن مصادرته. ويقوم الاقتصاد على قدرة حوسبة دُفعت تكلفتها سلفاً: سينفق القطاع نحو 450 مليار دولار على مراكز البيانات هذا العام، بينما يُشحن عالمياً أكثر من مليار هاتف وحاسوب لوحي ومحمول بشرائح متزايدة القدرة — أي أن الحوسبة في أيدي الناس أكثر منها في كل مراكز بيانات الذكاء الاصطناعي على الأرض. وتستشهد Desert Ant أيضاً بباحثي NVIDIA الذين حللوا ثلاثة أنظمة وكلاء وقدّروا أن 40% إلى 70% من نداءاتهم لنموذج كبير يمكن أن تذهب إلى نموذج صغير متخصص. وكل نموذج مجاني حتى 100 ألف جهاز نشط شهرياً.
من تطبيق فيديو إلى نماذجه الخاصة
أمضى الفريق خمس سنوات في تطوير تطبيق الفيديو Detail، لكنه عاد إلى واجهات السحابة لإنشاء المقاطع في Auto Edit وتحسين صوت البودكاست مع تضخم فواتير البنية التحتية. ودرّبوا النماذج بأنفسهم: حلّ Clear محل Dolby، وسرّع Voz النسخ على الجهاز خمس مرات. أما Clips، وهو نموذج بحجم 284 ميغابايت يحوّل فيديو من عشر دقائق إلى عشرات المقاطع في خمس ثوان، فقد حلّ محل Claude Sonnet بسرعة أكبر 10 مرات وبطاقة أقل 470 مرة وبالجودة نفسها، بحسب الشركة. وسيستبدل Detail 6، المتوقع مع iOS 27، كل واجهات السحابة بنماذجه الخاصة العاملة بالكامل على الجهاز.
أولاً "أدمغة صغيرة"
تصف Desert Ant المئة نموذج الأولى بالمخيخ — الدماغ الصغير الذي يتولى العمل المستمر — ثم تأتي طبقة القشرة التي تقرر أي نموذج يجيب: نموذج محلي صغير أولاً، وأكبر عند الحاجة، والسحابة فقط عندما يجب أن يخرج العمل من الجهاز. وتأتي النماذج بإعداد افتراضي مختار وأدوات لتغييره، ويُحسَّن وقت التشغيل مع النموذج: يعمل Clear وVoz على محرك Neural Engine في آيفون، وتعمل الأوزان نفسها لـ Clear في المتصفح عبر WebAssembly. ويتوفر SDK على GitHub مع التوثيق وأداة سطر أوامر لماك وعروض في المتصفح على Hugging Face.
SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي
نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.