
Kimi K3: 2.8 تريليون معامل وبجعة بـ25 سنتًا
أعلنت Moonshot AI عن Kimi K3، وهو نموذج بـ2.8 تريليون معامل تصفه بأنه أول نظام «من فئة 3T» مفتوح، مع وعد بإتاحة الأوزان المفتوحة قبل 27 يوليو، واختبار بجعة كلّف 25 سنتًا.
أعلنت مختبرات Moonshot AI الصينية يوم الخميس عن نموذج Kimi K3، واصفة إياه بأنه «أقدر نموذج لها حتى الآن، بـ2.8 تريليون معامل». والنموذج متاح عبر موقع الشركة وواجهتها البرمجية، مع وعد بإصدار بأوزان مفتوحة «قبل 27 يوليو 2026».
الموقع والسعر
تسمّي Moonshot نموذج K3 أول «نموذج من فئة 3T مفتوح»، إذ تقرّب 2.8 تريليون إلى ثلاثة تريليونات وتنتزع اللقب من DeepSeek 1.6T v4 Pro. وبحسب الاختبارات المعيارية التي تنشرها الشركة نفسها، يتقدّم K3 على Claude Opus 4.8 max وGPT-5.5 high في معظم المقارنات، لكنه يتخلّف عن Claude Fable 5 وGPT-5.6 Sol. وقد قاست الجهة المستقلة Artificial Analysis نتيجة 1547 Elo في اختبارها الخاص لعمل المعرفة الطويل المدى — أي 732 نقطة فوق Kimi K2.6 وخلف Claude Fable 5 فقط — بتكلفة 0.94 دولار للمهمة، مقابل 1.04 دولار لـGPT-5.6 Sol و1.80 دولار لـOpus 4.8. وانخفض استهلاك الرموز في مؤشر Intelligence Index بنسبة 21% مقارنة بـK2.6. كما يتصدّر النموذج ساحة Frontend Code من Arena.ai، متقدّمًا على Claude Fable 5.
التغيير الأبرز هو السعر: 3 دولارات لكل مليون رمز إدخال و15 دولارًا لكل مليون رمز إخراج، أي بمستوى سلسلة Claude Sonnet من Anthropic، وهو أغلى نموذج حتى الآن من مختبر صيني — ارتفاع حاد عن Kimi K2.6 بسعر 0.95 و4 دولارات.
كيف يتعامل مع بجعة على دراجة
أنشأ سايمون ويليسون، الذي يجرّب أمر SVG «بجعة تركب دراجة» على النماذج الجديدة منذ 21 شهرًا، صورة كهذه بواسطة K3 عبر OpenRouter. استهلك التشغيل 95 رمز إدخال و16,658 رمز إخراج، منها 13,241 رمز تفكير، بتكلفة إجمالية بلغت 25 سنتًا. وعند إدخال الصورة الناتجة، وصفها النموذج بدقة مقابل نحو 0.6 سنت. وأظهر الأمر أيضًا أن K3 يوفّر حاليًا مستوى تفكير واحدًا فقط هو «max»، وأن كتابة «hi» وحدها تُحتسب بـ86 رمزًا، ما يشير إلى أمر نظام خفي بطول نحو 85 رمزًا رفض النموذج الكشف عنه.
ما الذي يعلّمه هذا الاختبار اليوم
يقول ويليسون صراحة إن البجعة اختبار معياري سيئ ولا ينبغي استخدامه لترتيب النماذج: فهو لا يقول شيئًا عن استدعاء أدوات الوكيل أو الموثوقية في المحادثات الطويلة، وقد انهار ارتباطه السابق بجودة النماذج — فبجعتا GPT-5.6 وClaude Fable 5 أدنى من بجعة GLM-5.2. وقيمته أضيق: فهو يدفع المختبر إلى تشغيل النموذج فعليًا، ويعطي تقديرًا تقريبيًا للتكلفة وحجم التفكير، ويؤكد إخراج SVG صالحًا وإدراكًا مكانيًا أساسيًا، ويتيح المقارنة داخل عائلة النموذج الواحدة — حيث يتفوّق طائر K3 بوضوح على طائر Kimi 2.5.
SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي
نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.