العودة
SiTech
Jev — شكل جديد لنماذج اللغة: System One أو Decision Models
SiTech AI Team3 წთ. საკითხავი

Jev — شكل جديد لنماذج اللغة: System One أو Decision Models

يستبدل Jev من TypeSafe AI المخرجات النصية بأرقام: احتمالات وفئات ودرجات ثقة لمهام التصنيف، بسعر 0.042 دولار لكل مليون رمز في المدخلات، والمخرجات مجانية، وهو أرخص حتى من GPT-5 Nano.

كشفت شركة TypeSafe AI الأسبوع الماضي عن Jev، أول مثال على فئة جديدة من النماذج تسميها الشركة "نماذج System One". ويرى سايمون ويليسون أن التسمية الأدق هي "نماذج القرار" (decision models)، ويتفق معه في ذلك المصممة ماغي أبليتون.

يحتفظ Jev بالمدخلات النصية للنموذج اللغوي الكبير المعتاد، لكنه يغيّر المخرجات كليًا: فبدلًا من النص يعيد أرقامًا عشرية مرتبطة بفئات وأسئلة نعم/لا وتقييمات، مع درجات ثقة مصاحبة. وتصفه TypeSafe بأنه "استدعاء دالة لذكاء متقدم: حالة غير منظمة تدخل، وقرارات احتمالية مصنّفة تخرج".

كيف يعمل Jev

يتطلب استخدام الواجهة البرمجية تكوين كائن "حالة" (state): نص أو مصفوفة نصوص أو مجموعة من أزواج الاسم والقيمة تصف مقالًا أو عميلًا أو أي سجل آخر. يُرسل هذا الكائن مع سؤال واحد أو أكثر، ويُستلم رد منفصل لكل سؤال.

يقبل النموذج ثلاثة أنواع من الأسئلة. أسئلة نعم/لا، التي يسميها Jev أسئلة "Noul"، تعيد رقمًا بين 0 و1 يعبّر عن ثقة النموذج في صحة العبارة؛ وأكد الرئيس التنفيذي للشركة على Hacker News أن الاسم مشتق من توزيع برنولي. أسئلة الاختيار تعيد درجة ثقة وتوزيعًا احتماليًا على الخيارات المقدمة. وأسئلة التقييم تأخذ مستويات رقمية موصوفة وتضع المستند في نقطة على هذا المدى.

تُعالج الأسئلة بالتوازي، لذا فإن إضافة أسئلة كثيرة إلى مستند واحد تستغرق وقتًا مشابهًا لسؤال واحد. التسعير مختلف أيضًا: الدفع على المدخلات فقط — 0.042 دولار لكل مليون رمز، والمخرجات مجانية، وهو أرخص حتى من GPT-5 Nano من OpenAI (0.05 دولار لكل مليون).

الصناديق السوداء والتحيز

يشير ويليسون إلى أن شكل المنتج يثير لديه انزعاجًا: فهو يدفع تعلم الآلة خطوة أخرى نحو أنظمة "الصندوق الأسود" المعتمة. يمكن على الأقل مطالبة نموذج لغوي عادي بتبرير قراره، أما Jev فلا يعيد سوى رقم، ولا شيء يوضح إشارات المحتوى التي دفعت المستند إلى فئة معينة. لذلك يصبح التحيز مسألة بالغة الأهمية — ويأمل ألا يستخدم أحد النموذج لترتيب المتقدمين للوظائف. وفي تجربة واحدة، أدى تقييم جميع مدن خليج سان فرانسيسكو بسؤال "هل هي مدينة جيدة؟" إلى تصدّر كوبرتينو وقوع إيست بالو ألتو في آخر القائمة.

ولأن النموذج رخيص، يرى الكاتب أن التقييمات والتجارب المنظمة تصبح أهم مما هي عليه في مشاريع النماذج اللغوية العادية: فمئات أو آلاف الطلبات التجريبية تكلف بضعة سنتات فقط.

تجارب المجتمع

خلال أيام ظهرت استخدامات غير مألوفة: jevchat من كايل بينا يحوّل Jev إلى روبوت محادثة سيئ يسأل عن الرمز التالي؛ وjev-leftpad من فاتح قادر أكين ينفذ دالة left-pad عبر سؤال اختيار عن عدد المسافات المطلوبة؛ وjev-2048 من آندي غايتون يلعب لعبة 2048.

ظهرت أيضًا إعادة إنشاء بأوزان مفتوحة، منها Kev المبني على Qwen 3.5 بنماذج بحجم 0.8B و4B و9B. وقد نشأ بالفعل معيار JevBench لمقارنة "نماذج القرار من فئة Jev" — نشاط لافت لإصدار عمره أقل من أسبوع.

SSiTech

SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي

نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.