كشفت دراسة جديدة أن النماذج اللغوية الكبيرة قد تتفق مع البشر في الأحكام الأخلاقية لكنها تعتمد على أسس ومبادئ مختلفة، مما يعني أن تقييم التوافق عبر الاتفاق فقط قد يكون مضللًا.

2 دقيقة قراءة

الاتفاق ليس توافقًا: دراسة تكشف تباعد الأسس الأخلاقية بين البشر ونماذج الذكاء الاصطناعي

نظرة عامة

نشرت دراسة جديدة على arXiv بعنوان "الاتفاق ليس توافقًا: أسس أخلاقية متباينة في الأحكام الأخلاقية للبشر ونماذج اللغات الكبيرة"، تبحث في افتراض شائع في تقييم الذكاء الاصطناعي: أن اتفاق النماذج مع البشر في الأحكام الأخلاقية يعني التوافق. وتجادل الدراسة بأن هذا الافتراض قد يكون مضللًا.

منهجية الدراسة

استخدم الباحثون معيارًا من 500 عنصر مشتق من ETHICS، يغطي خمسة مجالات للأحكام الأخلاقية. جمعوا تعليقات بشرية وتعليقات من نماذج لغوية كبيرة (بما في ذلك نماذج رائدة ومفتوحة المصدر) على كل من التسميات النهائية والمبررات الداعمة.

النتائج الرئيسية

أظهرت النتائج أن اتفاق النماذج مع الأغلبية البشرية في التسميات النهائية كان مرتفعًا غالبًا. لكن تحليل المبررات كشف تباينًا منهجيًا في الأسس الأخلاقية. النماذج تعيد توزيع الأهمية عبر فئات مثل الضرر والاحترام والوفاء بالوعود والعدالة والاستحقاق وأهمية الأعذار، حتى عندما تتطابق تسمياتها النهائية مع الأغلبية البشرية.

الآثار المترتبة

تشير الدراسة إلى أن تقييم التوافق عبر التسميات فقط يمكن أن يكون مطمئنًا بشكل مضلل. يجب استكماله بتحليل الأسباب والمبادئ والأولويات الأخلاقية التي تعبر عنها النماذج.

توصيات للمنطقة

بالنسبة للمؤسسات في الشرق الأوسط وشمال أفريقيا التي تتبنى الذكاء الاصطناعي في مجالات حساسة مثل الصحة والخدمات الحكومية، تؤكد الدراسة على ضرورة تطوير آليات تقييم أخلاقية متعددة الأبعاد، وعدم الاكتفاء بمقاييس الاتفاق البسيطة.

ملاحظة للمراجعة البشرية: تحقق من دقة الاقتباسات والبيانات الإحصائية من الورقة الأصلية قبل النشر.

أسئلة شائعة

ما هي الدراسة الجديدة حول أخلاقيات الذكاء الاصطناعي؟

دراسة على arXiv بعنوان 'الاتفاق ليس توافقًا' تختبر ما إذا كان اتفاق النماذج مع البشر في الأحكام الأخلاقية يعكس توافقًا حقيقيًا في المبادئ، وتجد أن النماذج تعتمد على أسس مختلفة.

كيف تقارن الدراسة بين البشر والنماذج؟

باستخدام 500 عنصر من معيار ETHICS، جمعت الدراسة تعليقات بشرية ونماذج على التسميات النهائية والمبررات الداعمة، وحللت التوزيع عبر فئات أخلاقية.

ما أهمية هذه النتائج لمؤسسات المنطقة؟

تذكر المؤسسات بأن الاعتماد على مقاييس الاتفاق فقط قد يخفي تحيزات أو اختلافات جوهرية في القيم، مما يستدعي تدقيقًا أعمق قبل نشر النماذج في تطبيقات حساسة.

هل تعني النتائج أن النماذج غير أخلاقية؟

لا، لكنها تشير إلى أن النماذج قد تصل لنفس النتائج عبر مسارات أخلاقية مختلفة، مما يتطلب أدوات تقييم أكثر شمولًا.

المصدر: arXiv cs.AI

محتوى بمساعدة الذكاء الاصطناعي، مراجع بشرياً.