
دالة Python واحدة كغلاف على نمط Jev لنماذج LLM ونماذج الرؤية
في تدوينة من سبتمبر 2026 يعرض الكاتب دالة Python واحدة تحوّل عدة مزوّدي LLM، ومنها نماذج الرؤية، إلى واجهة استدعاء موحّدة، وتعيد أجوبة باحتمالات محسوبة لأسئلة تُكتب بنص عادي.
في تدوينة نُشرت في سبتمبر 2026 يصف الكاتب دالة Python واحدة تحوّل عدة مزوّدي LLM، ومنها نماذج الرؤية، إلى واجهة استدعاء موحّدة. ويقول إن الفكرة نشأت من التعرّف على Jev والمشاريع القابلة للاستضافة الذاتية حوله، مثل OpenJev و-SemIf، وهو ما عرّفه بحيلة قراءة احتمالات الرموز.
ما معنى «على نمط Jev»
صيغة الطلب الموثّقة في Jev تحمل مستند JSON يتضمن حالة نصية ومجموعة أسئلة. ويحافظ الغلاف الذي كتبه الكاتب على هذه البنية، لكنه يضيف حقل attachments الخاص بالصور، وهو ما لا تغطيه الصيغة الموثّقة. أي أن «على نمط Jev» تعني هنا بنية الطلب والرد، لا المشروع نفسه.
كيف يعمل الغلاف
يُعاد صياغة كل سؤال كطلب اختيار من متعدد بخيارات مرقّمة بالحروف من A إلى T، ثم يُرسل عبر طلب HTTP عادي. ويُجبر النموذج على توليد رمز واحد فقط، وفي المقابل يعيد الـAPI الحروف مع لوغاريتمات احتمالاتها. وتُحوّل هذه الأرقام إلى احتمالات يُستخرج منها الجواب: في سؤال choice يفوز الخيار الأعلى احتمالاً، ونوع noul (نعم/لا) يعيد احتمال true، ونوع score يحسب المستوى المتوقع بين المعايير. ويقبل كل سؤال من 2 إلى 20 خياراً؛ وإذا أسقط المزوّد خياراً غير مهمل، تُعيد الدالة خطأً بدل التخمين.
المزوّدون والصور والسرعة
يخاطب المثال افتراضياً خادم llama.cpp المحلي، وعند وجود مفتاح يخاطب OpenAI؛ ويُرسل مفتاح الـAPI إلى api.openai.com فقط. يحتاج llama.cpp إلى Chat Completions للوغاريتمات الاحتمالية، بينما تحتاج OpenAI إلى Responses لإظهار بدائل كافية، ويتولى السكربت معالجة هذا الفرق. وتُرسل الصور كروابط base64، لذا يمكن طرح الأسئلة نفسها على إطار من كاميرا الويب. وفي العرض التوضيحي يقرأ الكاتب الإطارات عبر OpenCV، وهو يُستخدم للوصول إلى الكاميرا فقط، ويطبع جدول الأجوبة. وعلى RTX 3090 مع Gemma 4 12B نحصل على نحو إطار واحد في الثانية بثلاثة أسئلة لكل إطار؛ وعبر API الخاص بـgpt-6-luna نحو 0.2 إطار في الثانية.
تحفّظات الكاتب
يقول الكاتب صراحة إن نماذج الرؤية الحاسوبية المتخصصة أكثر كفاءة بكثير، وإن قيمة مقاربته في المرونة: يُضاف شرط جديد بوصفه بنص عادي. ويشير كذلك إلى أن معالجة المدخلات تستهلك وقتاً على أي حال، وأن بادئة الحالة المشتركة تُخزَّن مؤقتاً إذا دعم الخادم ذلك، وأن أرقام السرعة مأخوذة من إعداد غير محسَّن يستخدم اتصالاً منفصلاً لكل سؤال وإطار.
SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي
نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.