Anthropic و OpenAI توافق کردند ارزیابان مستقل ایمنی را در آزمایشگاه‌هایشان مستقر کنند

TechCrunch
اشتراک‌گذاری:
Anthropic و OpenAI توافق کردند ارزیابان مستقل ایمنی را در آزمایشگاه‌هایشان مستقر کنند

Dario Amodei مدیرعامل Anthropic مدلی جدید برای نظارت بر AI پیشنهاد داده است: ارزیابان مستقل شخص ثالث که به صورت دائمی در آزمایشگاه‌های AI پیشرو مستقر می‌شوند، با همان سطح دسترسی کارمندان، کارت شناسایی شرکت، و حق انتشار یافته‌هایشان. Sam Altman مدیرعامل OpenAI نیز تعهد داده که OpenAI همین رویکرد را اتخاذ خواهد کرد.

جزئیات پیشنهاد

بر اساس چارچوب Amodei، هر شرکت AI پیشرو باید به یک تیم دائمی از ارزیابان مستقل — مانند سازمان METR — همان دسترسی‌ای را بدهد که معمولاً به کارمندان ارشد تعلق می‌گیرد: بررسی Pipeline‌های آموزشی، شیوه‌های ایمنی، و فرآیندهای Alignment مدل پیش از استقرار. این طرح صراحتاً برای جایگزینی ممیزی‌های دوره‌ای با نظارت مستمر طراحی شده است.

Amodei مقررات بانکی را به عنوان سابقه ذکر کرد: برخی نهادهای نظارتی مالی ناظرانی را مستقیماً در درون شرکت‌ها مستقر می‌کنند. این پیشنهاد همان مدل را برای توسعه AI تطبیق می‌دهد.

چارچوب سه‌بخشی حکمرانی

پیشنهاد ارزیابان بخشی از چارچوب گسترده‌تری است که Amodei در مقاله ۱۲ سپتامبر خود تشریح کرد: استانداردهای ایمنی مشترک میان شرکت‌های AI پیشرو کشورهای دموکراتیک، و هماهنگی بین‌المللی — از جمله توافق‌های رسمی با چین — برای جلوگیری از رقابت به سوی کف در سطح ایمنی. Altman توافق OpenAI را تأیید کرد و گفت: «با Dario موافقم که باید آهنگ توسعه را تنظیم کنیم.»

مشکل استقلال

پژوهشگران و فعالان ایمنی AI از دسترسی بی‌سابقه‌ای که Amodei توصیف کرده استقبال می‌کنند. اما ارزیابان در این طرح دسترسی گسترده دارند بدون اینکه اختیار رسمی داشته باشند: هیچ حق وتویی بر جلسات آموزشی یا انتشار مدل‌ها ندارند. CNBC این ارزیابان را «ناظران بی‌طرف» نامید در حالی که اشاره کرد بدون سازوکار اجرایی قانونی، همه چیز به انتخاب شرکت‌ها بستگی دارد. منتقدان از خطر «نمایش ممیزی» صحبت می‌کنند: استفاده از ظاهر نظارت مستقل برای رضایت منتقدان در حالی که کنترل کامل حفظ می‌شود.

حرکت موازی در کنگره

پیشنهاد دوحزبی‌ای در مجلس نمایندگان آمریکا در حال بررسی است که ارزیابان مستقر در شرکت‌های AI پیشرو را اجباری می‌کند و پایگاه قانونی و الزامات گزارش‌دهی رسمی را برای آن‌ها تعریف می‌کند.

چرا این موضوع اهمیت دارد

Amodei این ماه به صراحت استدلال کرده که AI ممکن است ظرف شش تا دوازده ماه از توانایی ما در درک و کنترلش پیشی بگیرد. مدل ارزیابان مستقر بیشترین دسترسی‌ای است که تاکنون به هیچ سازمان خارجی در آزمایشگاه‌های AI پیشرو داده شده. اینکه آیا واقعاً به پاسخگویی می‌انجامد یا به نمایش ممیزی تبدیل می‌شود، به آنچه ارزیابان مجاز به دیدن، گفتن و اقدام بر اساس آن هستند بستگی دارد.

در ابتدا توسط TechCrunch گزارش شده است. برای جزئیات بیشتر مقالهٔ اصلی را بخوانید.

مشاهدهٔ منبع اصلی
اشتراک‌گذاری: