العودة
رموز أرخص من أن تُحاسَب: كيف تنخفض تكلفة استدلال الذكاء الاصطناعي
SiTech AI Team2 წთ. საკითხავი

رموز أرخص من أن تُحاسَب: كيف تنخفض تكلفة استدلال الذكاء الاصطناعي

يطرح مقال على موقع jyn.dev أن تكلفة الذكاء الآلي تنخفض بمراتب عدة كل عام، وأن المورد النادر لن يكون عدد الرموز بل جودة النماذج وسهولة الوصول إليها، مع أثر مباشر على أسعار واجهات البرمجة.

يطرح مقال منشور على موقع jyn.dev أن سعر الذكاء الناتج عن تعلّم الآلة ينخفض بمراتب عدة في السنة دون إشارة إلى تباطؤ، وأن القيد الحقيقي سيكون الجودة وسهولة الوصول لا عدد الرموز.

الأدلة

تُظهر بيانات Epoch AI التي يستشهد بها المقال أن كفاءة الطاقة في وحدات GPU ترتفع أُسّياً: على مخطط لوغاريتمي يبلغ ميل خط الاتجاه نحو 1.3، أي أن الكفاءة تتضاعف كل سنتين تقريباً — وتيرة لم تُشاهد منذ قانون مور.

كفاءة الطاقة في وحدات GPU عبر الزمن بحسب Epoch AI

سعر الرمز في نماذج frontier لا ينخفض باطراد، لكن كلفة إنجاز المهمة تنخفض. وعلى منحنى pareto الذي ترصده Artificial Analysis تبدو محور الذكاء في 2026 قريباً من 2025، بينما أصبح محور الكلفة أرخص بمرتبتين خلال 2025.

كلفة المهمة على منحنى pareto لعام 2026

تتحسن محركات الاستدلال بنسبة 10–50% سنوياً: يستهلك vLLM 0.11.1 (ديسمبر 2025) نحو 40% أقل من الجول لكل رمز مقارنة بـ 0.5.4 (سبتمبر 2024)، وتعلن NVIDIA عن تحسن في الكفاءة يصل إلى 50% من MLPerf 2.0 إلى 2.1. وتتغير المعماريات أيضاً — يعطّل Mixture-of-Experts طبقات الخبراء غير الضرورية، فيمكن أن يصغر النموذج سبع مرات (من 6B إلى 0.8B معامل) بالجودة نفسها.

من أين يأتي «أرخص من أن يُحاسَب»

نموذج Jev من TypeSafe AI لا يُنتج نصاً: إنه يختار بين خيارات محددة مسبقاً ويعيد احتمالاً — مثل الحكم على ما إذا كان أمر shell يخالف تعليمات النظام. وتقارن صفحة الأسعار بين نماذج LLM الحالية بسعر 0.20 إلى 10 دولارات لكل مليون رمز إدخال، مع إخراج يزيد نحو خمس مرات، وبين System One + Jev بسعر 0.042 دولار لكل مليون رمز إدخال، أي 42 دولاراً لكل مليار رمز، مع إخراج مجاني. وهذا يعني نحو ثلاثة سنتات لقراءة خمسة كتب.

وتستفيد الأدوات من ذلك بالفعل: يعيد jgrep احتمالاً في نحو 200 مللي ثانية وبكلفة تقارب جزءاً من ألف من السنت، ويعمل نموذج Laya المفتوح الأوزان محلياً.

ما الذي يتغير

يقارن المقال أيضاً دورة واحدة من النموذج بالأدوات المحلية: يكلف GPT-5.6 Luna نحو 30 سنتاً لكل مليون رمز، أي أن قرار استدعاء أداة يستهلك عشرة آلاف رمز يكلف ثلث سنت، بينما يخرج grep أرخص بنحو 4.5 مراتب. والكاتب لا يتوقع انفجار الفقاعة: الحجم الرخيص لا يجعل الجودة رخيصة، وتواصل OpenAI البناء — خمسة مواقع Stargate جديدة.

ويتوقع أن تزداد صعوبة الأمن السيبراني، وأن ينمو تأجير وحدات GPU المحسّنة للاستدلال، وأن يصبح الجزء الصعب في البرمجيات هو متطلبات المنتج والاختبار وتصميم الواجهات لا الخوارزميات. ويكتسب المستخدمون خياراً رابعاً: أن يطلبوا من نموذج LLM بناءه.

SSiTech

SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي

نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.