AiGpu

Infrastructure·

وحدات معالجة الرسوميات بلاكويل من إنفيديا تدفع GPT-6 Astra Ultrafast من OpenAI لتسريع الاستدلال

يعمل نموذج GPT-6 Astra Ultrafast الجديد من OpenAI على وحدات معالجة الرسوميات بلاكويل من إنفيديا، مقدماً تسريعاً يصل إلى 8 أضعاف في توليد الرموز. يقلل هذا التحسين من دورات البرمجة، ويقلل زمن الاستجابة بين استدعاءات الأدوات، ويجعل وكلاء الذكاء الاصطناعي التفاعليين أكثر استجابة.

وحدات معالجة الرسوميات بلاكويل من إنفيديا تدفع GPT-6 Astra Ultrafast من OpenAI لتسريع الاستدلال

أطلقت OpenAI نموذج GPT-6 Astra Ultrafast، وهو إصدار من أحدث نماذجها اللغوية الكبيرة يعمل على وحدات معالجة الرسوميات بلاكويل من إنفيديا. من خلال الاستفادة من أنوية التنسور المتقدمة والذاكرة ذات النطاق الترددي العالي في المعمارية، تحقق الخدمة سرعة تصل إلى ثمانية أضعاف في توليد الرموز مقارنة بوضع Astra القياسي.

بالنسبة للمطورين، يعني هذا التسريع دورات تحرير‑اختبار‑تصحيح أضيق، وتقليل أوقات الانتظار بين استدعاءات الأدوات، وتجربة أكثر سلاسة في التطبيقات التفاعلية مثل وكلاء البرمجة والمساعدين في الوقت الفعلي.

لماذا يهم ذلك البنية التحتية لوحدات معالجة الرسوميات والذكاء الاصطناعي

أشار فيليب تيلي، قائد الاستدلال في OpenAI، إلى أن الاستثمار العميق من إنفيديا في الأدوات والتوثيق يمكّن النماذج من كتابة أنوية عالية الأداء لوحدات بلاكويل وروبين القادمة. تتيح هذه القابلية للبرمجة لـ Astra تحويل معرفتها إلى أنوية محسّنة، مما يدفع حدود الكمون، والإنتاجية، والتكلفة.

بالإضافة إلى المكاسب الأولية في السرعة، تستخدم OpenAI نماذجها الخاصة لتحسين مكدس الاستدلال على أجهزة إنفيديا بشكل مستمر. تتيح مرونة المنصة استخدام نفس موارد الحوسبة للتدريب والاستدلال والتعلم المعزز، مما يحسن الاستخدام ويمنع الإفراط في التخصيص مع تغير الطلب.

  • aigpu
  • ai gpu
  • ai gpu cloud
  • aigpu dubai
  • nvidia
  • openai
  • inference

بقلم AiGpu Editorial · إعادة صياغة تحريرية استناداً إلى تقارير عامة (NVIDIA Blog)

→ كل المقالات