إصدار Hugging Face Transformers v5.13.0: إضافة نماذج Kimi K2.5 و MiMo-V2-Flash و Nemotron 3.5 ASR وتحسينات التصدير
ملخص الإصدار
أصدرت Hugging Face الإصدار v5.13.0 من مكتبة Transformers، وهو تحديث رئيسي يضيف نماذج جديدة مهمة ويحسن قدرات التصدير والانتباه والتوليد. هذا الإصدار مناسب بشكل خاص للفرق العربية التي تعمل على التعرف على الكلام والنماذج الوكيلة متعددة الوسائط.
النماذج الجديدة
Kimi K2.5 (Moonshot AI)
- نموذج وكيل متعدد الوسائط مفتوح المصدر.
- يركز على البرمجة طويلة المدى والتصميم القائم على الكود والتنفيذ الذاتي.
- يدعم التحويل من الأوامر البسيطة والمدخلات البصرية إلى واجهات إنتاجية.
MiMo-V2-Flash (Xiaomi)
- نموذج خبير مختلط (MoE) مع 27 تريليون رمز تدريب.
- نافذة سياق 256K مع تقليل تخزين KV-cache.
- مناسب للتفكير المعقد والمهام الوكيلية.
Nemotron 3.5 ASR (NVIDIA)
- نموذج تعرف على الكلام متعدد اللغات بحجم 600M معلمة.
- يدعم التدفق المنخفض الكمون (80ms إلى 1120ms) والتجميع عالي الإنتاجية.
- بنية FastConformer-RNNT مع تخزين مؤقت للسياق.
نماذج أخرى
- Qwen3 ASR: تعرف على الكلام من Alibaba مع كشف تلقائي للغة.
- VideoPrism: مشفر فيديو عام من Google DeepMind.
- RADIO: نماذج رؤية أساسية من NVIDIA.
- MiniCPM3: نموذج لغة كثيف من OpenBMB.
- ZAYA1: نموذج خبير مختلط من Zyphra.
تحسينات التصدير
تم تقديم نظام تصدير موحد (HfExporter) يدعم:
- PyTorch (DynamoExporter)
- ONNX (OnnxExporter)
- ExecuTorch (ExecutorchExporter)
يدعم التصدير التلقائي للنماذج التوليدية مع تقسيم prefill/decode.
تحسينات الانتباه والتوليد
- إصلاح أخطاء الانتباه في Gemma 3/4 وBlip2 وXcodec2.
- تحسين التوليد التخميني للنماذج الهجينة.
- دعم Flash Attention مع StaticCache.
الأمان
- إصلاح ثغرة path traversal في tokenizer_config.json.
توصيات للفرق العربية
- استخدام Nemotron 3.5 ASR للتعرف على الكلام باللغة العربية.
- استخدام Kimi K2.5 للتطبيقات الوكيلة متعددة الوسائط.
- الاستفادة من تحسينات التصدير لنشر النماذج على ONNX.
هذا الخبر يتطلب مراجعة بشرية للتأكد من دقة المعلومات.
أسئلة شائعة
ما هو Kimi K2.5؟
Kimi K2.5 هو نموذج وكيل متعدد الوسائط مفتوح المصدر من Moonshot AI، يركز على البرمجة طويلة المدى والتصميم القائم على الكود والتنفيذ الذاتي.
ما هو MiMo-V2-Flash؟
MiMo-V2-Flash هو نموذج خبير مختلط (MoE) من Xiaomi، مصمم للتفكير المعقد والمهام الوكيلية مع نافذة سياق 256K.
ما الجديد في Nemotron 3.5 ASR؟
Nemotron 3.5 ASR هو نموذج تعرف على الكلام متعدد اللغات من NVIDIA، يدعم التدفق المنخفض الكمون والتجميع عالي الإنتاجية.
هل يجب على الفرق العربية تبني هذا الإصدار؟
نعم، خاصة للفرق التي تعمل على التعرف على الكلام باللغة العربية (Nemotron 3.5 ASR) أو تحتاج إلى نماذج وكيلة متعددة الوسائط (Kimi K2.5).
المصدر: Hugging Face Transformers Releases
محتوى بمساعدة الذكاء الاصطناعي، مراجع بشرياً.