وضع Ultrafast يسرع GPT-6 Astra حتى 8 مرات عبر واجهة OpenAI API
أصبح وضع Ultrafast متاحاً لنموذج GPT-6 Astra عبر واجهة API لجميع المستخدمين، مع حدود استخدام أولية منخفضة. يعمل الوضع بتحديد النموذج GPT-6-astra ثم اختيار الخدمة ultrafast، مع توصية باستخدام WebSockets لتقليل تكلفة إنشاء الاتصالات في التطبيقات الحساسة للزمن.
يؤكد المزود أن الوضع يقدم سرعة قد تصل إلى ثمانية أضعاف الخدمة القياسية، مع اختلاف النتيجة حسب طول المدخلات والمخرجات والحمل. أوضح NVIDIA أيضاً أن التنفيذ يعتمد على وحدات Blackwell و Vera Rubin ضمن طبقة الاستدلال، لذا فهذه زيادة خدمة مدفوعة وليست نسخة جديدة من النموذج نفسه. المستجد الآن هو طبقة تشغيل أسرع للتطبيقات والوكلاء.
القيود قبل الاعتماد عليه تتطلب Ultrafast تكلفة أعلى من الطبقة القياسية، كما تدعم الخدمة إقامة البيانات داخل الولايات المتحدة أو المعالجة العالمية فقط، ولا تعمل مع نقاط النهاية الإقليمية الأخرى. ينبغي اختبار التكلفة والكمون الفعليين على حمل التطبيق بدلاً من الاعتماد على رقم السرعة الأقصى وحده.
السرعة مهمة عندما تتكرر دورة الوكيل، حيث يعتبر Ultrafast مفيداً خصوصاً للوكلاء الذين يجرون سلسلة طويلة من الاستدعاءات؛ بضع مئات من المللي ثانية في كل خطوة تتحول إلى فارق واضح. أما الدردشة البسيطة، فقد لا تبرر الزيادة في التكلفة.



إرسال التعليق