Anthropic و OpenAI توافق کردند ارزیابان مستقل ایمنی را در آزمایشگاههایشان مستقر کنند

Dario Amodei مدیرعامل Anthropic مدلی جدید برای نظارت بر AI پیشنهاد داده است: ارزیابان مستقل شخص ثالث که به صورت دائمی در آزمایشگاههای AI پیشرو مستقر میشوند، با همان سطح دسترسی کارمندان، کارت شناسایی شرکت، و حق انتشار یافتههایشان. Sam Altman مدیرعامل OpenAI نیز تعهد داده که OpenAI همین رویکرد را اتخاذ خواهد کرد.
جزئیات پیشنهاد
بر اساس چارچوب Amodei، هر شرکت AI پیشرو باید به یک تیم دائمی از ارزیابان مستقل — مانند سازمان METR — همان دسترسیای را بدهد که معمولاً به کارمندان ارشد تعلق میگیرد: بررسی Pipelineهای آموزشی، شیوههای ایمنی، و فرآیندهای Alignment مدل پیش از استقرار. این طرح صراحتاً برای جایگزینی ممیزیهای دورهای با نظارت مستمر طراحی شده است.
Amodei مقررات بانکی را به عنوان سابقه ذکر کرد: برخی نهادهای نظارتی مالی ناظرانی را مستقیماً در درون شرکتها مستقر میکنند. این پیشنهاد همان مدل را برای توسعه AI تطبیق میدهد.
چارچوب سهبخشی حکمرانی
پیشنهاد ارزیابان بخشی از چارچوب گستردهتری است که Amodei در مقاله ۱۲ سپتامبر خود تشریح کرد: استانداردهای ایمنی مشترک میان شرکتهای AI پیشرو کشورهای دموکراتیک، و هماهنگی بینالمللی — از جمله توافقهای رسمی با چین — برای جلوگیری از رقابت به سوی کف در سطح ایمنی. Altman توافق OpenAI را تأیید کرد و گفت: «با Dario موافقم که باید آهنگ توسعه را تنظیم کنیم.»
مشکل استقلال
پژوهشگران و فعالان ایمنی AI از دسترسی بیسابقهای که Amodei توصیف کرده استقبال میکنند. اما ارزیابان در این طرح دسترسی گسترده دارند بدون اینکه اختیار رسمی داشته باشند: هیچ حق وتویی بر جلسات آموزشی یا انتشار مدلها ندارند. CNBC این ارزیابان را «ناظران بیطرف» نامید در حالی که اشاره کرد بدون سازوکار اجرایی قانونی، همه چیز به انتخاب شرکتها بستگی دارد. منتقدان از خطر «نمایش ممیزی» صحبت میکنند: استفاده از ظاهر نظارت مستقل برای رضایت منتقدان در حالی که کنترل کامل حفظ میشود.
حرکت موازی در کنگره
پیشنهاد دوحزبیای در مجلس نمایندگان آمریکا در حال بررسی است که ارزیابان مستقر در شرکتهای AI پیشرو را اجباری میکند و پایگاه قانونی و الزامات گزارشدهی رسمی را برای آنها تعریف میکند.
چرا این موضوع اهمیت دارد
Amodei این ماه به صراحت استدلال کرده که AI ممکن است ظرف شش تا دوازده ماه از توانایی ما در درک و کنترلش پیشی بگیرد. مدل ارزیابان مستقر بیشترین دسترسیای است که تاکنون به هیچ سازمان خارجی در آزمایشگاههای AI پیشرو داده شده. اینکه آیا واقعاً به پاسخگویی میانجامد یا به نمایش ممیزی تبدیل میشود، به آنچه ارزیابان مجاز به دیدن، گفتن و اقدام بر اساس آن هستند بستگی دارد.
در ابتدا توسط TechCrunch گزارش شده است. برای جزئیات بیشتر مقالهٔ اصلی را بخوانید.
مشاهدهٔ منبع اصلی