
Qwen 3.8 27B على نقاط النهاية العامة لدى Cerebras: نحو 1850 رمزًا في الثانية
أضافت Cerebras إلى كتالوجها نموذج Alibaba الكثيف متعدد الوسائط Qwen 3.8 27B: نافذة سياق 64K/128K، و0.99 دولار لكل مليون رمز إدخال، ونحو 1850 رمزًا في الثانية على نقاط النهاية العامة.
أدرجت Cerebras الآن Qwen 3.8 27B بين النماذج التي تخدمها عبر نقاط النهاية العامة للاستدلال. ويقف نموذج Alibaba ذو الـ27 مليار معامل إلى جانب gpt-oss-120b من OpenAI في كتالوج النماذج الخاص بالشركة، حيث تُقدَّر سرعته بنحو 1850 رمزًا في الثانية.
ما يذكره الكتالوج
معرّف النموذج هو qwen-3.8-27b. وتصفه Cerebras بأنه نموذج Alibaba الكثيف (dense) متعدد الوسائط بحجم 27 مليار معامل، مخصص للبرمجة الوكيلية واستخدام الأدوات والبحث وسير العمل الطويل: يقبل النصوص والصور ويدعم استدلالًا قابلًا للضبط. نافذة السياق 64 ألف رمز (65,536) في الطبقة التجريبية المجانية و128 ألف رمز (131,072) في الطبقات المدفوعة، بأقصى إخراج 32 ألف (32,768) و40 ألف (40,960) رمز على التوالي. الأسعار: 0.99 دولار لكل مليون رمز إدخال و1.49 دولار لكل مليون رمز إخراج. وللمقارنة، يذكر الكتالوج نفسه gpt-oss-120b بـ120 مليار معامل وسياق 65k/131k ونحو 3000 رمز في الثانية.
حدود المعدل والقدرات
في الطبقة المجانية تبلغ الحدود 5 طلبات في الدقيقة، و30 ألف رمز إدخال في الدقيقة، و90 ألف رمز إجمالًا في الدقيقة، ومليون رمز يوميًا، وما يصل إلى صورتين لكل طلب. وتتيح طبقة Developer نحو 300 طلب في الدقيقة، و150 ألف رمز إدخال و450 ألف رمز إجمالًا في الدقيقة، وما يصل إلى 10 صور لكل طلب، دون سقف يومي معلن. تشمل الميزات المدعومة إدخال الصور والاستدلال والبث وضوابط أخذ العينات والمخرجات المهيكلة واستدعاء الأدوات والاستدعاء المتوازي للأدوات وتخزين التعليمات مؤقتًا. وتتوفر نقطتا نهاية: Chat Completions وCompletions.
قيود تستحق المعرفة
الاستدلال مُفعَّل افتراضيًا عند مستوى "high" ويمكن إيقافه بضبط reasoning_effort على none. ويعمل إدخال الصور فقط عبر Chat Completions وبصيغة PNG أو JPEG مُرمّزة بـbase64؛ أما روابط الصور الخارجية وضبط مستوى التفاصيل وتوليد الصور والفيديو والصوت فغير مدعومة. وتعيد نقطة النهاية Completions نصًا فقط ولا تدعم الصور ولا ضوابط الاستدلال ولا الرسائل المهيكلة ولا الأدوات.
نماذج غير مشذّبة وضغط الحجم
يوضح التوثيق أن جميع النماذج على نقاط النهاية العامة هي النسخ الأصلية غير المشذّبة. وتُطبّق تكميم الأوزان بشكل انتقائي ولأغراض التخزين فقط، في نطاقات 16 و8 و4 بتات؛ وتُحفظ الطبقات الحساسة بدقة كاملة مع فك التكميم أثناء التشغيل، بينما تبقى التنشيطات وآلية الانتباه وذاكرة KV غير مكمَّمة بالكامل. أما النماذج المشذّبة بطريقة REAP التي تبحثها الشركة فتُنشر على Hugging Face ولا تُقدَّم عبر واجهة البرمجة. وتؤكد Cerebras أنها لن تغيّر بنية أي نموذج قائم دون إشعار، وأن أي تشذيب مستقبلي سيُعرض كنقاط نهاية منفصلة بأسماء واضحة.
SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي
نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.