Kernel Forge: أداة مفتوحة المصدر لتحسين نوى CUDA باستخدام LLM
ما هي Kernel Forge؟
Kernel Forge هي أداة مفتوحة المصدر طورها باحثون لتوليد وتحسين نوى CUDA (وحدات الحوسبة الأساسية في GPU) باستخدام وكلاء يعتمدون على نماذج اللغة الكبيرة (LLM). تهدف الأداة إلى أتمتة عملية تحسين النوى التي كانت تتطلب سابقًا خبراء متخصصين في كتابة كود GPU منخفض المستوى.
الأداء والنتائج
اختبرت الأداة على أربعة نماذج PyTorch تشمل الرؤية والانتشار واللغة، باستخدام NVIDIA DGX Spark مع GPU GB10. بعد 50 تكرار تحسين فقط لكل نواة، حققت النتائج التالية:
- ResNet-50: تسريع 1.52x على adaptive_avgpool2d.
- Stable Diffusion 3.5 Medium: تسريع 1.70x على group_norm.
- Gemma 4 E2B: تسريع 2.83x على softmax.
- Qwen 3.5 35B-A3B: تسريع 1.54x على softmax.
الميزات الرئيسية
- قبول أي نموذج PyTorch: دون تعديل.
- بحث شجرة مونت كارلو (MCTS): لاستكشاف مسارات تحسين متعددة بدلاً من سلسلة خطية واحدة.
- واجهة مستخدم رسومية: لمراقبة التقدم وفحص النوى المرشحة وتصحيح الأخطاء.
- دعم أعباء عمل متنوعة: الرؤية، الانتشار، ونماذج اللغة.
التأثير على الشرق الأوسط
بالنسبة للمؤسسات والحكومات في الشرق الأوسط، يمكن أن تقلل Kernel Forge تكاليف البنية التحتية للحوسبة بشكل كبير، خاصة مع الاعتماد المتزايد على نماذج الذكاء الاصطناعي في التطبيقات الحيوية مثل الرعاية الصحية والخدمات المالية. الأداة تقلل الحاجة إلى خبراء نادرين في تحسين GPU، مما يسرع دورة التطوير ويخفض التكاليف.
لمراجعة بشرية: تأكد من دقة الأرقام والتواريخ، وأن المقارنات مع الأدوات الأخرى محدثة.
أسئلة شائعة
ما هي Kernel Forge؟
Kernel Forge هي أداة مفتوحة المصدر تستخدم وكلاء LLM لتوليد وتحسين نوى CUDA تلقائيًا، مما يحسن أداء نماذج الذكاء الاصطناعي على وحدات معالجة الرسوميات.
كيف تقارن Kernel Forge بالأدوات الأخرى؟
تتميز Kernel Forge بقدرتها على العمل مع أي نموذج PyTorch دون تعديل، واستخدام بحث شجرة مونت كارلو (MCTS) لاستكشاف مسارات تحسين متعددة، وتوفير واجهة مستخدم رسومية.
هل يجب على فرق MENA اعتماد Kernel Forge الآن؟
نعم، لأنها تقلل تكاليف البنية التحتية للحوسبة بشكل كبير، وتسرع نشر النماذج، وتقلل الاعتماد على الخبراء النادرين في كتابة كود GPU.
المصدر: arXiv cs.AI
محتوى بمساعدة الذكاء الاصطناعي، مراجع بشرياً.