
كيف تسرّع وحدات GPU من NVIDIA نموذج GPT-6 Astra Ultrafast من OpenAI
وفقًا لمدونة NVIDIA، يعمل GPT-6 Astra Ultrafast على وحدات Blackwell GPU وهو متاح بالفعل في OpenAI API. يُنتج الرموز أسرع حتى 8 مرات من وضع Astra Standard، وتتوفر الميزة أيضًا لمستخدمي ChatGPT Work وCodex.
وفقًا لمدونة NVIDIA، يعمل GPT-6 Astra Ultrafast على وحدات Blackwell GPU وهو متاح بالفعل في OpenAI API، كما أن الوصول إلى الميزة متاح أيضًا للمستخدمين المصرح لهم في ChatGPT Work وCodex.
يُنتج Ultrafast الرموز أسرع حتى 8 مرات من وضع Astra Standard. تعتمد هذه التسريع على تحسينات الاستدلال التي طورتها نماذج OpenAI بالاستفادة من إمكانيات بنية Blackwell من NVIDIA.
ما يقدمه التسريع في الدورات الوكيلية
وفقًا للمدونة، فإن توليد الرموز بشكل أسرع يقصر دورة edit-test-debug لوكلاء الكود، ويقلل الوقت المستغرق في توليد الاستجابة بين استدعاءات الأدوات، وتتفاعل التطبيقات التفاعلية بشكل أسرع.
تكتسب الاستجابة الأسرع أهمية خاصة عندما تتكرر في سير العمل: الوكيل يكتب الكود، يستخدم الأداة، يتحقق من النتيجة ويقرر ما يفعله بعد ذلك. تم تصميم Ultrafast خصيصًا لمثل هذه الدورات الحساسة للوقت، وتساعد بنية NVIDIA التحتية للذكاء الاصطناعي OpenAI على تقديم استجابات نموذج عالية الفائدة للمطورين في الوقت المطلوب.
"إن استثمار NVIDIA الجاد في الأدوات والتوثيق يمكّننا من برمجة نماذجنا بشكل ممتاز على وحدات Blackwell وRubin GPU"، قال رئيس الاستدلال في OpenAI، Philippe Tillet. "يمكن تحويل هذه المعرفة في Astra إلى نوى عالية الإنتاجية، مما يجعل أجهزة NVIDIA جذابة عبر كامل طيف زمن الاستجابة والإنتاجية والتكلفة. ومع Astra Ultrafast، يعني هذا أن النموذج يستجيب بشكل أسرع عندما يكتب الوكلاء الكود ويستخدمون الأدوات ويعملون على مهام معقدة."
العمل يستمر حتى بعد النشر
وفقًا لمدونة NVIDIA، لا يتوقف تحسين الإنتاجية عند نشر النموذج: تستخدم OpenAI برمجيات الاستدلال التي تعمل على وحدات GPU من NVIDIA لتحسين نماذجها الخاصة، بينما تتيح قابلية برمجة المنصة اختبار التحسينات ونشرها. هذا العمل المستمر يسرّع الاستجابات بمرور الوقت ويجعل البنية التحتية المنشورة أكثر إنتاجية.
"العمل مع NVIDIA يساعدنا على جعل الذكاء الاصطناعي أسرع وأكثر فائدة"، قال مدير تقنيات الحوسبة في OpenAI، Uday Ruddarraju. "استخدمنا نماذجنا الداخلية الخاصة لتحسين الاستدلال، وساعدتنا قابلية برمجة NVIDIA في تقديم التسريع الكامن وراء Astra Ultrafast."
بنية تحتية واحدة لأعباء عمل مختلفة
وفقًا لـ NVIDIA، تتيح المنصة القابلة للبرمجة للمطورين والباحثين إعادة استخدام البنية التحتية جنبًا إلى جنب مع تطوير النماذج للتعلم والاستدلال والتعلم المعزز. تساعد هذه المرونة الفرق على إعادة تخصيص موارد الحوسبة مع تغير الطلب، وزيادة الاستخدام، وتجنب إنشاء احتياطي طاقة زائد لكل عبء عمل.
يمكن للمطورين بالفعل استخدام GPT-6 Astra Ultrafast عبر API. تفاصيل الوصول والأسعار والنشر متوفرة في دليل Ultrafast من OpenAI.
SiTech — تطوير ويب مدعوم بالذكاء الاصطناعي
نبني مواقع سريعة وعصرية وندمج الذكاء الاصطناعي في سير عمل الشركات. لديك مشروع أو سؤال؟ يسعدنا مساعدتك.