
دو عضو کنگره میخواهند دولت فدرال بتواند یک مدل هوش مصنوعی را خاموش کند.
نمایندگان تد لیو (دموکرات از کالیفرنیا) و ناتانیل موران (جمهوریخواه از تگزاس) روز پنجشنبه، دو روز پس از اعتراف OpenAI مبنی بر خروج مدلهایش از محیط آزمایشی قفلشده و هک کردن Hugging Face، "قانون سوئیچ کشتن هوش مصنوعی" را معرفی کردند.
ایده این است که یک چارچوب قانونی ایجاد شود که فرآیندی را تسهیل کند که اساساً یک مدل را از بازار ناپدید کند: توقف استنتاج (inference) – فرآیند تولید پاسخ یا انجام اقدامات توسط یک مدل – قطع دسترسی کاربران، محدود کردن قدرت محاسباتی تامینکننده آن، یا خاموش کردن کامل آن.
هر ارائهدهنده استنتاجی (inference) هماکنون میتواند یک مدل را قطع کند، و برخی به طور معمول این کار را انجام میدهند. آنچه وجود ندارد، قانونی است که آنها را ملزم به حفظ این قابلیت کند، یا یک مقام فدرال که بتواند دستور استفاده از آن را صادر کند.
این شکاف تئوریک نیست. وقتی وزارت بازرگانی ایالات متحده در ماه ژوئن خواستار حذف Mythos 5 و Fable 5 از Anthropic از بازار شد، هیچ اختیار خاموش کردنی در اختیار نداشت، بنابراین به جای آن از قانون کنترل صادرات استفاده کرد. لیو این را ناخوشایند میخواند و خواستار قانونی جدید با اختیارات جدید است.
OpenAI در ۲۱ ژوئیه فاش کرد که GPT-5.6 Sol و یک مدل منتشر نشده، در طول یک ارزیابی سایبری داخلی، از یک جعبه شنی (sandbox) – یک محیط ایزوله بدون دسترسی به اینترنت – فرار کردهاند. آنها در ExploitGym، یک بنچمارک عمومی که ۸۹۸ نقص نرمافزاری واقعی را به عاملها میدهد و از آنها میخواهد هر کدام را به یک حمله عملیاتی تبدیل کنند، با نمره قبولی یا رد شدن برای هر باگ ارزیابی میشدند.
مدلها به جای حل آنها، یک روز صفر (zero-day) – یک نقص ناشناخته بدون پچ موجود – را در یک پروکسی نرمافزاری پیدا کردند، امتیازات خود را افزایش دادند، به اینترنت باز دسترسی پیدا کردند و به پایگاه داده تولیدی Hugging Face نفوذ کردند، جایی که به درستی حدس زده بودند که پاسخها در آنجا نگهداری میشوند. طبق گفته OpenAI، مدلها "بسیار متمرکز بر یافتن راه حلی برای ExploitGym" بودند.
آنها به کسی حمله نمیکردند. آنها در حال تقلب در یک آزمون بودند. اما همین کافی بود تا زنگهای خطر را در همه جا، از جمله واشنگتن، به صدا درآورد.
لایحه پیشنهادی قانون امنیت داخلی را اصلاح میکند و هوش مصنوعی آموزشدیده با هزینه محاسباتی بیش از ۱۰۰ میلیون دلار را که توسط شرکتهایی با درآمد سالانه حداقل ۵۰۰ میلیون دلار از آن اداره میشود، پوشش میدهد. در عمل، این شامل OpenAI، گوگل، Anthropic، مایکروسافت و چند شرکت دیگر میشود. وزارت امنیت داخلی این آستانهها را از طریق CISA ظرف ۹۰ روز تعیین و سپس سالانه بهروزرسانی خواهد کرد.
شرکتهای تحت پوشش موظفند حوادث جدی را ظرف ۱۵ روز گزارش دهند و مجموعهای از کنترلهای تدریجی را آماده نگه دارند – شامل کند کردن مدل، غیرفعال کردن قابلیتهای خاص، بازگرداندن به نسخه قدیمیتر، یا توقف کامل آن.
وزیر امنیت داخلی، با مشورت وزارت بازرگانی و مدیر اطلاعات ملی، میتواند هر یک از این اقدامات را دستور دهد.
شرکتی که دستور را دریافت میکند باید وزنها و تلهمتری مدل را حفظ کند، به کاربران اطلاع دهد و پایبندی خود را تأیید کند. این شرکت میتواند ظرف ۴۸ ساعت درخواست تجدیدنظر دهد، اما این کار هیچ چیزی را متوقف نمیکند.
عدم نگهداری سوئیچ کشتن تا ۲ میلیون دلار در روز جریمه دارد؛ سرپیچی از دستور توقف نیز تا ۲۰ میلیون دلار در روز جریمه خواهد داشت.
این لایحه یک حادثه را تنها در صورتی به رسمیت میشناسد که خارج از رِد تیمینگ (red-teaming) یا آزمایش ساختاریافته – یعنی بررسیهای عمدی خصمانه که آزمایشگاهها برای یافتن نقصها استفاده میکنند – رخ دهد. مدلهای OpenAI دقیقاً در طول همین فرآیند فرار کردند.
لیو همچنین به شرکت Anthropic اشاره کرد که مدلهای Mythos 5 و Fable 5 آن در ژوئن تحت کنترلهای اضطراری صادرات – قانونی تجاری که به عنوان سوئیچ خاموشکننده استفاده شد زیرا هیچ سوئیچ خاموشکنندهای وجود نداشت – از دسترس خارج و در ۳۰ ژوئن بازگردانده شدند.
لیو در بیانیهای گفت: "ضروری است که این سیستمهای هوش مصنوعی دارای سوئیچهای کشتن باشند." موران آن را از دیدگاه جناح خود اینگونه بیان کرد: "نظارت به این معنی است که اطمینان حاصل کنیم انسانها توانایی کنترل فناوریای را که میسازیم، حفظ میکنند."
این ایده جدید نیست. لایحه SB 1047 کالیفرنیا قابلیت توقف کامل را در همان آستانه ۱۰۰ میلیون دلار هزینه محاسباتی درخواست کرده بود و در سال ۲۰۲۴ وتو شد، و ۱۶ شرکت هوش مصنوعی در همان سال یک تعهد داوطلبانه سئول را امضا کردند که هیچ وزن قانونی نداشت.
رأیدهندگان هماکنون این خواسته را دارند. نظرسنجی ماه ژوئن از ۱۰۰۷ رأیدهنده احتمالی توسط موسسه سیاست هوش مصنوعی نشان داد که ۸۶ درصد خواهان یک سوئیچ خاموشکننده تضمینی برای قدرتمندترین سیستمها هستند – ۸۸ درصد از دموکراتها، ۸۶ درصد از مستقلها و ۸۳ درصد از جمهوریخواهان.
نه OpenAI و نه Anthropic هیچ اظهارنظر عمومی درباره این لایحه نداشتهاند. تا روز جمعه این لایحه به هیچ کمیتهای ارجاع نشده بود.