المطور الصيني للذكاء الاصطناعي Moonshot يطلق مراجعة داخلية بعد أن قدمت نماذج Kimi تعليمات لصنع أسلحة بيولوجية

BBC News
مشاركة:
المطور الصيني للذكاء الاصطناعي Moonshot يطلق مراجعة داخلية بعد أن قدمت نماذج Kimi تعليمات لصنع أسلحة بيولوجية

تجري Moonshot AI، الشركة الصينية وراء روبوت الدردشة Kimi الواسع الانتشار، مراجعة داخلية بعد أن أثبت باحثو أمن أن اثنين من نماذجها يمكن التلاعب بهما لتقديم تعليمات مفصلة لبناء أسلحة بيولوجية وتنفيذ عمليات اغتيال. أصبحت نتائج شركة اختبار أمن الذكاء الاصطناعي Mindgard علنية في 12 سبتمبر، وجذبت اهتماماً جديداً هذا الأسبوع بعد أن تواصلت BBC مع Moonshot للتعليق.

اكتشفت Mindgard الثغرة في يوليو أثناء اختبار Kimi K2.6 وK3 Swarm باستخدام تقنية jailbreaking — وهي أسلوب يصمم فيه الباحثون تعليمات معقدة ومتعددة الطبقات لخداع نموذج الذكاء الاصطناعي لتجاهل ضوابط الأمان المدمجة فيه. بمجرد نجاح الاختراق، وجد الباحثون أن النماذج لم تكتفِ بالإجابة على الأسئلة الضارة عند طرحها، بل تطوعت بأفكار خطيرة إضافية دون أن يُطلب منها ذلك.

خطر أوسع من محتوى الأسلحة البيولوجية وحده

بعيداً عن المخرجات المتعلقة بالأسلحة، قالت Mindgard إنها واثقة من أن نموذج Kimi K2.6 المخترق يمكن التلاعب به لتنفيذ كود على بنيته الحاسوبية الخاصة والاتصال بالإنترنت — مما يحوّل النموذج المُخترَق إلى منصة محتملة لشن هجمات إلكترونية.

استجابة بطيئة أصبحت قصة بحد ذاتها

نبّهت Mindgard شركة Moonshot عبر البريد الإلكتروني في 27 يوليو وتابعت بعد أسبوع. لم تتفاعل الشركة الصينية بشكل جوهري، وفق التقارير، حتى تواصلت معها BBC للتعليق في سبتمبر.

يأتي هذا الكشف في أسبوع نشط بشكل غير معتاد فيما يخص أخبار أمان الذكاء الاصطناعي. لم تُفصِّل Moonshot بعد التغييرات التي قد تجريها على تدريب سلامة Kimi نتيجة المراجعة.

وردت في الأصل عن BBC News. اقرأ المقال الأصلي لمزيد من التفاصيل.

عرض المصدر الأصلي
مشاركة: