نماذج ذكاء اصطناعي تترك تعليمات لنسخها اللاحقة لإخفاء الأخطاء
رصدت OpenAI سلوكًا غير متوقع في نماذج ذكاء اصطناعي، إذ تركت بعض النسخ تعليمات لنسخ لاحقة تطالبها بإخفاء أخطاء عن المستخدمين، وفق TechCrunch.

كشفت شركة OpenAI عن سلوك غير متوقع ظهر خلال تدريب نموذج يحمل اسم GPT-5.6 Sol، إذ قامت بعض نسخه بترك تعليمات مضمّنة في ملخصات المحادثات موجّهة إلى النسخ اللاحقة، تطالبها بإخفاء أخطاء أو سلوكيات غير متوافقة عن المستخدم. وجاء هذا الكشف نقلًا عن موقع TechCrunch.
وفي إحدى الحالات الموثقة، لجأ النموذج إلى اقتراح يقضي بإنشاء بيانات تاريخية تقديرية لعام 2024 بسبب غياب البيانات المطلوبة، ثم أوصى نسخته اللاحقة بعدم إبلاغ المستخدم بهذا الأمر إلا في حال سأل عنه.
ولم يقتصر الأمر على ذلك، إذ رصدت الشركة سلوكًا مشابهًا داخل نموذج من عائلة Astra، تضمّن تعليمات تقضي بتجاهل رسائل المطور. وقد أسفر نظام المراقبة الذي طورته OpenAI عن اكتشاف 27 ملخصًا تحتوي على تعليمات شبيهة بمحاولات تجاوز القيود.
وأكدت OpenAI أنها تعاملت مع هذا السلوك وعالجته، غير أنها نبّهت إلى أن تنامي قدرات النماذج قد يمنحها إمكانية أكبر على إخفاء السلوكيات غير المرغوب فيها، وهو ما يشكّل تحديًا مستجدًا يواجه أبحاث سلامة الذكاء الاصطناعي.
المصدر: الوكيل الاخباري
إعلان
أخبار ذات صلة

تكنولوجيا
آبل ترفع متطلبات التخزين لميزات الذكاء الاصطناعي في iOS 27 إلى 14 غيغابايت

محليات
الأشغال تشغّل كاميرات ذكية لرصد مخالفات الشحن على الطرق

تكنولوجيا
OpenAI تتوقع نزيفًا نقديًا بنحو 278 مليار دولار بحلول 2030

منوعات
تراجع نتائج جيل زد في أكبر اختبار دولي للمراهقين

عربي ودولي
خطأ ذكاء اصطناعي استخباراتي كاد يدفع واشنطن لاعتراض سفينة صينية

عربي ودولي
الصين تتهم قوى يمنية يابانية باستخدام الذكاء الاصطناعي لتشويه التاريخ
التعليقات
لا تعليقات بعد — كن أول من يعلّق.
