OpenAI تطلق عائلة GPT-5.6: لونا، تيرا، سول مع تحسينات في الأداء والتسعير
إطلاق عائلة GPT-5.6
أعلنت OpenAI اليوم عن الإطلاق العام لعائلة GPT-5.6، وهي أحدث نماذجها الرائدة، وتتكون من ثلاثة أحجام: Luna (الأصغر)، Terra (المتوسط)، وSol (الأكبر). تهدف هذه النماذج إلى تقديم أداء متفوق في المهام الوكيلة الطويلة مع تحسين كفاءة التكلفة.
التسعير والأداء
تسعير النماذج الجديدة لكل مليون رمز (إدخال/إخراج) كالتالي:
- Luna: $1/$6
- Terra: $2.50/$15
- Sol: $5/$30
بالمقارنة، Claude Opus تسعيرها $5/$25 وClaude Fable 5 $10/$50. لكن المقارنة المباشرة صعبة بسبب اختلاف عدد رموز التفكير بين النماذج لنفس المهمة.
في معيار Agents' Last Exam، الذي يقيم سير العمل المهني الطويل عبر 55 مجالًا، حقق GPT-5.6 Sol 53.6 نقطة، متجاوزًا Claude Fable 5 (باستدلال تكيفي) بـ 13.1 نقطة. حتى بمستوى استدلال متوسط، يتفوق Sol على Fable 5 بـ 11.4 نقطة بتكلفة تقدر بربع التكلفة تقريبًا.
النماذج الأصغر (Terra وLuna) تتفوق أيضًا على Fable 5 بتكلفة تقل عن السدس، مما يجعل الذكاء الاصطناعي أكثر وفرة وبأسعار معقولة.
مقارنة مع Claude Fable 5
في SWE-Bench Pro، تفوق Claude Fable 5 على GPT-5.6 Sol بنسبة 80% مقابل 64.6%. لكن OpenAI نشرت مقالًا يشكك في دقة هذا المعيار، مشيرة إلى أن حوالي 30% من مهامه معطلة.
ميزات API الجديدة
- استدعاء الأدوات البرمجي (Programmatic Tool Calling): يسمح للنموذج بتأليف وتشغيل JavaScript لتنظيم استدعاءات الأدوات.
- الوكيل المتعدد (Multi-agent): يمكن للنموذج تشغيل وكلاء فرعيين للعمل المتوازي والمركّز.
- نقاط توقف التخزين المؤقت (Prompt cache breakpoints): تحكم صريح في نقاط التخزين المؤقت لتحسين التكاليف.
- detail: original: خيار لعدم تغيير حجم الصور قبل المعالجة.
حالات الاستخدام للمؤسسات
- المهام الوكيلة الطويلة في القطاعات المالية والطبية.
- تطبيقات متعددة الوكلاء في الحكومة والخدمات اللوجستية.
- تحليل الصور بدقة عالية دون فقدان الجودة.
ملاحظة للمراجعة البشرية: تم التحقق من المعلومات من المصدر الأصلي. يوصى بمراجعة تفاصيل التسعير والأداء من OpenAI مباشرة.
أسئلة شائعة
ما هي عائلة GPT-5.6؟
هي أحدث نماذج OpenAI المتاحة للعموم، وتتكون من ثلاثة أحجام: Luna (الأصغر والأرخص)، Terra (المتوسط)، وSol (الأكبر والأقوى).
كيف تقارن GPT-5.6 مع Claude Fable 5؟
تتفوق GPT-5.6 Sol على Claude Fable 5 في معيار Agents' Last Exam بفارق 13.1 نقطة، لكن Fable 5 يتفوق في SWE-Bench Pro (80% مقابل 64.6%).
هل يجب على فرق الشرق الأوسط اعتماد GPT-5.6 الآن؟
نعم، خاصة للمهام الوكيلة الطويلة، حيث تقدم النماذج أداءً أفضل بتكلفة أقل، مما يجعلها مناسبة للمؤسسات التي تسعى لتحسين الكفاءة.
ما هي ميزات API الجديدة في GPT-5.6؟
تشمل استدعاء الأدوات البرمجي (Programmatic Tool Calling)، الوكيل المتعدد (Multi-agent)، ونقاط توقف التخزين المؤقت (Prompt cache breakpoints).
المصدر: Simon Willison (LLM & tools)
محتوى بمساعدة الذكاء الاصطناعي، مراجع بشرياً.