
OpenAI تحسّن التخزين المؤقت للمطالبات في GPT-6
أعلنت OpenAI تفاصيل نظام محسّن للتخزين المؤقت للمطالبات في عائلة نماذج GPT-6، إذ يرفع معدل إصابة الذاكرة المؤقتة افتراضياً ويمنح المطورين خصومات تصل إلى 90% على رموز الإدخال المخزّنة، مع أدوات تشخيص جديدة.
نشرت OpenAI تفاصيل نظام محسّن للتخزين المؤقت للمطالبات خاص بعائلة نماذج GPT-6. وتقول الشركة إن النظام يرفع افتراضياً معدل إصابة الذاكرة المؤقتة، ويمنح المطورين خصومات تصل إلى 90 في المئة على رموز الإدخال المخزّنة. وصدر التحديث في 22 سبتمبر 2026.
يُعدّ التخزين المؤقت بالغ الأهمية للوكلاء الذين يعملون ساعات على مهام معقّدة، من إعادة هيكلة قواعد الشيفرة إلى إعداد أوراق بحثية. فهذه التطبيقات ترسل سلاسل طويلة من طلبات الواجهة البرمجية تحمل التعليمات نفسها وتعريفات الأدوات والسياق السابق، لذا فإن إعادة استخدام الحسابات تقلّل زمن الاستجابة والتكلفة معاً.
معدل إصابة أعلى افتراضياً
بحسب OpenAI، تحصل البادئات المشتركة المؤهلة مع GPT-6 على خصم عندما يُعاد استخدامها خلال نافذة مدتها 30 دقيقة. ويعمل النظام تلقائياً، لكن الشركة أضافت أيضاً أدوات تمكّن الفرق من قياس ما يُعاد استخدامه فعلاً.
تعرض لوحة Prompt Caching Dashboard الجديدة مقدار ما يصل إلى التطبيق من ذاكرته المؤقتة، وتتابع معدل الإصابة مع الوقت، وتقارن الرموز المخزّنة بغير المخزّنة. وعند حدوث إخفاق غير متوقع، تقارن أداة التشخيص الطلب باستجابة حديثة وتحدّد السبب — تغيّر النموذج أو مجموعة الأدوات أو الإعدادات أو الإدخال — وتقدّر عدد الرموز المتأثرة. في مثال OpenAI، خلّف إخفاق بسبب tools_changed نحو 5,629 رمزاً قابلاً لإعادة الاستخدام دون استخدام.

أدوات تحكم للمطورين
تتيح نقاط التوقف الصريحة في الذاكرة المؤقتة اختيار البادئات التي يُعاد استخدامها، وقد حدّثت OpenAI دليلها في هذا الشأن. وفي نماذج GPT-6 يمكن الآن تغيير جهد الاستدلال بين الاستجابات بإضافة configuration_update، مع إبقاء إعداد الطلب دون تغيير، فلا يتعطّل التخزين المؤقت.
وتنصح OpenAI أيضاً بإبقاء تعريفات الأدوات والمخططات والترتيب ثابتة: اعرض الأدوات اللازمة فقط عبر allowed_tools أو اضبط tool_choice على none بدلاً من حذف التعريفات. وتُضاف التعليمات الجديدة كرسائل مطوّرين قرب نهاية السياق، ويمكن تسخين السياق المعروف مسبقاً.
ما يذكره العملاء
قال مدير المنتجات في GitHub Copilot، ماريو رودريغيز، إن العمل على التخزين المؤقت ساعد في خفض نسبة رموز المطالبات التي تحتاج إلى معالجة جديدة بأكثر من 50 في المئة عبر مليارات الطلبات. وأفاد المدير التقني في Strawberry Browser، آريان حنيفي، بانخفاض التكاليف 20 في المئة، وبأن نقاط التوقف الصريحة جعلت تفريع المحادثات للمهام الخلفية مجدياً اقتصادياً. وانتقل Manus من نحو 85 في المئة إلى أكثر من 90 في المئة بثبات خلال أقل من أسبوع، بينما ارتفع Wordsmith من 83 إلى 91 في المئة، مع خفض كتابات الذاكرة المؤقتة بنحو الثلثين وتكاليف الاستدلال 36 في المئة.
SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي
نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.