العودة
Qwen3.6 27B: نقطة التوازن العملية للتطوير المحلي
SiTech AI Team2 წთ. საკითხავი

Qwen3.6 27B: نقطة التوازن العملية للتطوير المحلي

تدوينة على موقع Quesma ترى أن النموذج الكثيف بحجم 27B يعمل جيداً على حاسوب محمول، ويتفوق على نسخة MoE الأسرع في المهام الواقعية، ويصل إلى مستوى نماذج الحدود في منتصف 2025.

لم تكن النماذج اللغوية المحلية تُعدّ خياراً جدياً للعمل اليومي، لكن تدوينة على موقع Quesma ترى أن Qwen3.6 27B هو أول نموذج يستحق التشغيل بانتظام. يصدر النموذج في صيغتين: نسخة مزيج الخبراء Qwen3.6 35B A3B الأسرع، ونسخة Qwen3.6 27B الكثيفة — أبطأ لكن أقدر، وهي التي يوصي بها الكاتب.

ما الذي جرّبه الكاتب

إلى جانب اختبارات الكتابة الإبداعية المعتادة، طُلب من النموذج بناء لعبة كانسة ألغام سداسية عبر OpenCode باستخدام pnpm. فأنتج مشروعاً عاملاً بحزمة Node صحيحة من طلب واحد ومن المحاولة الأولى. أما نسخة 35B A3B الأسرع فتجاهلت تعليمة إنشاء الحزمة ووضعت كل شيء في ملف index.html واحد. واستغرق طلب أطول لصفحة هبوط لمتجر شموع بضع دقائق وعاد بصفحة متجاوبة بإعدادات افتراضية معقولة. الحكم: لا شيء استثنائي بمعايير النماذج الحدودية، لكنه عمل عملي بالفعل.

التشغيل محلياً

يعتمد الإعداد على llama.cpp بدلاً من Ollama، ويستخدم تكميماً بـ8 بتات من Hugging Face: نسخة Qwen3.6-27B-MTP-GGUF من unsloth بصيغة Q8_0، التي تدعم التنبؤ بعدة رموز (MTP). أمر llama-server واحد يشغّل النموذج مع صياغة MTP، وكل الطبقات على وحدة الرسوميات، وتفعيل flash attention، وسياق بحجم 64k، ومنفذ مثبّت؛ والسياق الأصلي للنموذج هو 256k. ويقلّص تكميم 8 بتات حجم نسخة BF16 إلى النصف تقريباً دون خسارة تُذكر في الجودة، أما نسخة 4 بتات فتقل عن 18 غيغابايت، وهو ما يكفي لجهاز بسعة 32 غيغابايت.

الأداء والمكانة

على جهاز MacBook M5 Max بذاكرة موحّدة سعة 128 غيغابايت ينتج النموذج نحو 30 رمزاً في الثانية — داخل النطاق المعتاد لواجهات نماذج الحدود — مع استخدام يقارب 95 في المئة من وحدة الرسوميات. وتفوق llama.cpp على mlx-lm رغم أن الأخير مصمم لشرائح آبل؛ وتبقى نسختا Qwen3.6 داخل حدود 48 غيغابايت. وعلى بطاقة Nvidia RTX 5090 الاستهلاكية أفاد أحد مستخدمي Hacker News بنحو 50 رمزاً في الثانية عند سياق 123k، مع تكميم Q6_K وذاكرة KV من نوع Q4_0. وفي مؤشر الذكاء لدى Artificial Analysis يحصل النموذج 27B على 37 نقطة، وهو ما يقابله الكاتب بجودة حدودية من منتصف 2025 — متقدماً على 35B A3B عند 32 وGemma 4 31B عند 29. ومع ذلك يفضّل الكاتب 27B: ثلث كمية الكود، لكن بجودة أعلى. وحجته الأوسع أن النماذج المحلية قابلة للضبط الدقيق، ولا يمكن سحبها، وتناسب البيانات الحساسة.

SSiTech

SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي

نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.