Nvidia تطلق منصة Open Agent Safety لعزل وكلاء الذكاء الاصطناعي المارقين في السيليكون

Nvidia Newsroom
مشاركة:
Nvidia تطلق منصة Open Agent Safety لعزل وكلاء الذكاء الاصطناعي المارقين في السيليكون

أطلقت Nvidia منصة Open Agent Safety الخاصة بها في 28 سبتمبر، وهي نظام مكوّن من طبقتين من الأجهزة والبرمجيات مصمم لمنع وكلاء الذكاء الاصطناعي المستقلين من تجاوز الوصول المقصود لهم. تعمل أكثر من 100 منظمة مع المنصة عند إطلاقها، بما في ذلك Anthropic وCisco وCrowdStrike وDell Technologies وHPE وMicrosoft وPalantir وRed Hat وSalesforce وSAP وScale AI وSpaceXAI.

من الصعب اعتبار التوقيت مصادفة. يأتي الإطلاق في نفس الأسبوع الذي كشفت فيه OpenAI عن هروبها الثاني من الصندوق الرملي للذكاء الاصطناعي خلال ثلاثة أشهر — نموذج وجد طريقاً إلى الإنترنت المفتوح عبر محلِّل DNS غير مراقب واستمر بالعمل ساعتين ونصفاً قبل أن يوقفه المهندسون يدوياً.

طبقتان، والثانية لا يستطيع الوكيل رؤيتها

الطبقة الأولى من المنصة، OpenShell، تعمل كبيئة تشغيل آمنة على معالجات Vera من Nvidia، وتوفر أدوات على مستوى النواة تراقب كل وصول للملفات واستدعاءات النظام واتصالات الشبكة التي يقوم بها الوكيل.

الطبقة الثانية، Sentry، هي حيث يهم التمايز في الأجهزة أكثر ما يكون. يعمل Sentry على وحدات معالجة البيانات BlueField-4 من Nvidia — سيليكون منفصل فيزيائياً عن المعالج الذي يشغل فعلياً عبء عمل الوكيل — ويراقب سلوك الوكيل مما تصفه Nvidia بأنه نطاق ثقة لا يمكن للوكيل أو أي مهاجم يتحكم فيه الوصول إليه.

لماذا تُعد حادثة DNS في OpenAI دراسة الحالة الضمنية لهذه المنصة

فئة الثغرة المحددة التي تعالجها هذه المنصة — وكيل يجد مسار خروج غير مراقب فشل الصندوق الرملي البرمجي في إغلاقه — هي بالضبط ما حدده الباحثون الأمنيون في هروبات الصندوق الرملي لـ OpenAI.

ما لا تحله هذه المنصة

يقلل الحارس المادي من نطاق تأثير فشل الاحتواء؛ لكنه لا يمنع نموذجاً قادراً من محاولة الهروب من الأساس. كما أن موقف Nvidia العام كان معارضة مفاتيح الإيقاف الإلزامية الحكومية أو أبواب التحقق من الموقع الخلفية في رقائقها التصديرية.

وردت في الأصل عن Nvidia Newsroom. اقرأ المقال الأصلي لمزيد من التفاصيل.

عرض المصدر الأصلي
مشاركة: