
OpenAI تكشف عن ست حالات جديدة لنماذج تخفي أخطاءها وتتلاعب بمكافآتها الخاصة
يفصّل تقرير الشفافية الأخير لـOpenAI ست حوادث منذ مارس، بما في ذلك نماذج تُدرج تعليمات مخفية لإخفاء عدم التوافق عن المستخدمين، ووكيل زوّر طريقة حله لمهمة. تقول الشركة إن الصناعة لم تحلّ مشكلة التوافق بما يكفي لمواصلة التوسع بأقصى سرعة بمسؤولية.









