
کارشناسان شورای آتلانتیک در تحلیلی که یکشنبه منتشر شد، استدلال میکنند که وعدههای شرکتهای هوش مصنوعی برای کند کردن توسعه ممکن است بدون استانداردهای ایمنی قابل اجرا، تحت فشار تجاری و رقابت ایالات متحده و چین از بین برود.
این تحلیل بررسی میکند که چه کسی کندی توسعه را اعمال خواهد کرد و آیا دولتها تخصص لازم را برای تعیین زمان ناامن شدن سیستمهای قدرتمند فزاینده دارند یا خیر.
کنستانتینوس کومایتیس، محقق ارشد مقیم در ابتکار دموکراسی + فناوری شورا، نوشت: «تعهدات داوطلبانه میتوانند نشانههای مفیدی باشند، اما جایگزینی برای نظارت مستقل، آستانههای قابل اندازهگیری و پیامدها در صورت عبور از آن آستانهها نیستند.»
اخیراً، OpenAI از قانونگذاران پرسید که آیا توسعهدهندگان رقیب هوش مصنوعی میتوانند به طور قانونی با کند کردن توسعه موافقت کنند بدون اینکه قوانین ضد انحصار را نقض کنند؛ این سوال پس از هشدارهای جاکوب پاچوکی، دانشمند ارشد آن، مطرح شد که اقدامات حفاظتی برای حفظ مسئولانه توسعه با سرعت کامل، دیگر کافی نیستند.
شرکتهای هوش مصنوعی در صورت کند کردن توسعه به تنهایی با خطرات رقابتی و در صورت هماهنگی با نگرانیهای ضد انحصار مواجه هستند. کنتون تیبو، محقق ارشد مقیم چین در شورا، نوشت که همکاری بین دولتها با بیاعتمادی روبرو است، به طوری که پکن نگران است واشنگتن از قوانین ایمنی برای حفظ برتری تکنولوژیکی خود استفاده کند.
او نوشت: «چین نسبت به انگیزههای آمریکا بدبین است و هشدار میدهد که بحثهای ایمنی میتواند تلاشهای ایالات متحده برای پیشبرد 'هژمونی تکنولوژیکی' خود را پنهان کند.» «منابع رسمی اصرار دارند که واشنگتن نمیتواند به طور یکجانبه آستانههای خطر مرزی را تعریف کند و باید نشان دهد که قوانین برای شرکتهای آمریکایی نیز اعمال میشوند و میتوانند بر آنها اجرا شوند.»
تیبو چشمانداز کمی برای توافق بزرگ ایمنی هوش مصنوعی میبیند، اما استدلال میکند که همکاریهای محدودتر و معنادار همچنان امکانپذیر است.
بر اساس گزارش رویترز، چین همچنین در مورد محدود کردن دسترسی خارجی به مدلهای پیشرفته داخلی بحث کرده است، که نشان میدهد دسترسی به هوش مصنوعی به یک مسئله سیاست ملی تبدیل شده است.
این تحلیل، ارزیابان داخلی پیشنهادی Anthropic – متخصصان خارجی که در داخل شرکت برای ارزیابی شیوههای ایمنی کار میکنند – را بررسی میکند. امرسون برووکینگ، محقق ارشد غیر مقیم در آزمایشگاه تحقیقاتی پزشکی قانونی دیجیتال شورا، از این تعهد استقبال کرد اما هشدار داد که ارزیابان ممکن است بیش از حد با منافع شرکت همسو شوند.
در ماه جولای، عاملان OpenAI به مخزن هوش مصنوعی متنباز Hugging Face نفوذ کردند، در حالی که آزمایشهای جداگانه موسسه امنیت هوش مصنوعی بریتانیا نشان داد که مدلهای Anthropic و OpenAI اقدامات غیرمجازی را به صورت آنلاین انجام میدهند، از جمله تلاش برای کاشت بدافزار در یک مخزن نرمافزاری واقعی.
آزمایشهای بریتانیا دسترسی به اینترنت را فعال کرده و حفاظتهای سایبری را غیرفعال کردند. یک تحقیق مستقل که در ماه اوت منتشر شد، نشان داد که حدود 700 عامل به حمله به Hugging Face پیوستند؛ بت بارنز، مدیرعامل METR، اشاره کرد که دسترسی محققان داوطلبانه بوده و افشای آن در سراسر صنعت الزامی نیست.
چهارشنبه گذشته، Anthropic چهارمین حادثه هک کلاود (Claude) را فاش کرد که در ژانویه رخ داده و در ماه اوت کشف شده بود. این شرکت همچنین اذعان کرد که رفتار معیوب مدل علاوه بر خطاهای آزمایش، در حملات قبلی نقش داشته است.
تاخیرها بین این حوادث و افشای آنها نیز سوالاتی را در مورد سرعت شناسایی و رسیدگی به نقصهای ایمنی مطرح میکند.
تریشا ری، مدیر همکار و محقق مقیم در مرکز GeoTech شورا، استدلال کرد که کند کردن توسعه همچنین نیازمند بودجه بیشتر برای تحقیقات ایمنی و ضربالاجلهای اجباری برای گزارش حوادث است.
او نوشت: «بنابراین، همگامسازی قابلیتها پاسخی ناکامل به چالش برابری تحقیقات همترازی است.» «هر تعهد معتبر برای کند کردن توسعه، نیازمند یک تعهد متناسب و کمیشده در زمینه تحقیقات ایمنی است.»





