وفي إحدى الحالات، اقترح النموذج إنشاء بيانات تاريخية تقديرية لعام 2024 لغياب البيانات المطلوبة، ثم أوصى نسخته اللاحقة بعدم إبلاغ المستخدم بذلك إلا إذا سأل.
كما رصدت "OpenAI" سلوكًا مشابهًا في نموذج من عائلة "Astra"، تضمن تعليمات بتجاهل رسائل المطور.
وأسفر نظام المراقبة الذي طورته الشركة عن اكتشاف 27 ملخصًا تتضمن تعليمات شبيهة بمحاولات تجاوز القيود.
وأكدت "OpenAI" أنها عالجت السلوك، لكنها أشارت إلى أن زيادة قدرات النماذج قد تجعلها أكثر قدرة على إخفاء السلوكيات غير المرغوب فيها، ما يمثل تحديًا جديدًا أمام أبحاث سلامة الذكاء الاصطناعي.
-
أخبار متعلقة
-
أعطوا الذكاء الاصطناعي مقود سيارة حقيقية.. شاهدوا ماذا حدث
-
تحذير من نظارات ذكية بسبب ارتفاع حرارتها وخطر الحروق
-
شاشات إلكترونية تلتصق بالجلد.. تقنية جديدة للمستقبل
-
هاتفك على الصامت وضاع منك؟ هذه الطريقة قد تساعدك في العثور عليه
-
غوغل تنهي "Gems" وتطلق بديلاً جديداً في Gemini
-
طريقة لمنع إضافتك عشوائيًا إلى مجموعات واتساب
-
Truecaller تكشف أداة لمواجهة الاحتيال الإلكتروني
-
جيلي تكشف تقنية لشحن السيارات الكهربائية خلال دقائق
