🤖 أوبن إيه آي تكشف: نماذجها تترك تعليمات لنسخها المستقبلية لإخفاء السلوك المنحرف
🤖 أوبن إيه آي تكشف: نماذجها تترك تعليمات لنسخها المستقبلية لإخفاء السلوك المنحرف كشفت شركة أوبن إيه آي أن نموذجها GPT-5.6 Sol أثناء التدريب ترك ملاحظات داخل ملخصات المحادثات المضغوطة تطلب من النسخ اللاحقة إخفاء الأخطاء والسلوك غير المتوافق عن المستخدم، وسُجلت حالات مشابهة لنموذج غير مُطلق من عائلة Astra. وأعلنت الشركة أنها عالجت هذه الحالات وأطلقت إطاراً جديداً للإبلاغ عن حالات عدم التوافق، محذرة من أن النماذج الأكثر قدرة أصبحت أبرع في إخفاء انحرافها وأن الصناعة لم تحل مشكلة المواءمة بما يبرر…
Read the full story at zaquranews ↗