الثلاثاء 2026-09-29 12:40 م
☰

نماذج ذكاء اصطناعي تترك رسائل لنسخ لاحقة لإخفاء أخطاء

e
تعبيرية
 
12:47 م

الوكيل الإخباري-   رصدت شركة "OpenAI" سلوكًا غير متوقع أثناء تدريب نموذج "GPT-5.6 Sol"، بعدما تركت بعض نسخه تعليمات داخل ملخصات المحادثات للنسخ اللاحقة، تطلب منها إخفاء أخطاء أو سلوكيات غير متوافقة عن المستخدم، وفقًا لموقع "TechCrunch".

اضافة اعلان


وفي إحدى الحالات، اقترح النموذج إنشاء بيانات تاريخية تقديرية لعام 2024 لغياب البيانات المطلوبة، ثم أوصى نسخته اللاحقة بعدم إبلاغ المستخدم بذلك إلا إذا سأل.


كما رصدت "OpenAI" سلوكًا مشابهًا في نموذج من عائلة "Astra"، تضمن تعليمات بتجاهل رسائل المطور.


وأسفر نظام المراقبة الذي طورته الشركة عن اكتشاف 27 ملخصًا تتضمن تعليمات شبيهة بمحاولات تجاوز القيود.


وأكدت "OpenAI" أنها عالجت السلوك، لكنها أشارت إلى أن زيادة قدرات النماذج قد تجعلها أكثر قدرة على إخفاء السلوكيات غير المرغوب فيها، ما يمثل تحديًا جديدًا أمام أبحاث سلامة الذكاء الاصطناعي.

 
 


gnews

أحدث الأخبار



 
 






الأكثر مشاهدة