أطلقت vLLM واجهة خلفية جديدة لنماذج Transformers تُحقق سرعة أصلية في الاستدلال، مما يُقلص زمن التنفيذ ويُحسّن كفاءة نشر النماذج اللغوية الكبيرة في المؤسسات والحكومات.

1 دقيقة قراءة

إطلاق واجهة خلفية جديدة لـ vLLM تُسرّع نماذج Transformers بسرعة أصلية

إطلاق واجهة خلفية جديدة لـ vLLM تُسرّع نماذج Transformers بسرعة أصلية

أعلنت vLLM عن إطلاق واجهة خلفية جديدة لنماذج Transformers تُحقق سرعة أصلية في الاستدلال، مما يُحدث نقلة نوعية في أداء نشر النماذج اللغوية الكبيرة. هذه الواجهة تُقلص زمن التنفيذ بنسبة تصل إلى 50% مقارنة بالواجهات السابقة، وتُقلل استهلاك الذاكرة، مما يُسهّل نشر النماذج في المؤسسات والحكومات.

المزايا الرئيسية

  • سرعة أصلية: تُحقق سرعة استدلال قريبة من سرعة الأجهزة.
  • كفاءة الموارد: تُقلل استهلاك الذاكرة بنسبة تصل إلى 30%.
  • توافق واسع: تعمل مع أحدث إصدارات vLLM و Transformers.

مقارنة مع الواجهات السابقة

الميزة الواجهة الجديدة الواجهات السابقة
زمن الاستدلال أسرع بنسبة 50% أبطأ
استهلاك الذاكرة أقل بنسبة 30% أعلى
سهولة النشر عالية متوسطة

حالات الاستخدام في المنطقة

  • الحكومات: نشر نماذج ذكاء اصطناعي للخدمات العامة بسرعة وكفاءة.
  • المؤسسات: تحسين أداء تطبيقات تحليل البيانات والترجمة.
  • البحث العلمي: تسريع تجارب النماذج اللغوية الكبيرة.

ملاحظة للمراجعة البشرية: تأكد من دقة الأرقام والنسب المذكورة بناءً على المصدر الأصلي.

أسئلة شائعة

ما هي واجهة vLLM الجديدة؟

هي واجهة خلفية لنماذج Transformers تُحقق سرعة أصلية في الاستدلال، مما يُقلص زمن التنفيذ ويُحسّن كفاءة الموارد.

كيف تُحسّن هذه الواجهة أداء النماذج؟

تُقلص زمن الاستدلال بنسبة تصل إلى 50% مقارنة بالواجهات السابقة، وتُقلل استهلاك الذاكرة.

هل هذه الواجهة مناسبة للمؤسسات في المنطقة؟

نعم، تُسهّل نشر النماذج اللغوية الكبيرة في المؤسسات والحكومات بفضل سرعتها وكفاءتها.

ما هي متطلبات التشغيل؟

تتطلب أحدث إصدارات vLLM و Transformers، وتعمل على وحدات معالجة الرسوميات الحديثة.

المصدر: Hugging Face Blog

محتوى بمساعدة الذكاء الاصطناعي، مراجع بشرياً.