
اوپنایآی (OpenAI) روز پنجشنبه GPT-6 Astra را منتشر کرد، مدلی که گرگ براکمن، رئیس این شرکت، آن را «جهشی نسلی در قابلیتها» و سرآغاز هوش عمومی مصنوعی (AGI) نامید.
در یک نشست خبری، براکمن به خبرنگاران گفت که معتقد است آسترا معیارهای AGI را برآورده میکند، به این معنی که این هوش مصنوعی میتواند با تواناییهای انسانی برابری کند یا از آن پیشی بگیرد. او پس از معرفی قدرتمندترین مدل این شرکت تا به امروز، گفت: «به عصر AGI خوش آمدید.»
اگر این امر دقیق باشد، به این معناست که عوامل هوش مصنوعی (AI agents) در انجام کارهای پیچیده استدلالی که انسانها میتوانند انجام دهند، یا حتی بیشتر، در وظایف مختلف، نزدیکتر خواهند شد. براکمن همچنین اذعان داشت که آسترا اولین سیستمی است که این شرکت آن را قادر به هک خودکار سیستمهای به خوبی محافظت شده بدون راهنمایی انسان ارزیابی کرده است که نگرانیهایی در مورد ایمنی و امنیت ایجاد میکند.
آسترا اولین مدل اوپنایآی است که آستانه «بحرانی» را تحت چارچوب آمادگی (Preparedness Framework) خود، یعنی سیستم امتیازدهی داخلی شرکت برای قابلیتهای خطرناک، رد کرده است.
این طبقهبندی به این معنی است که مدل میتواند بهطور مستقل نقایص نرمافزاری ناشناخته قبلی – که آسیبپذیریهای روز صفر (zero-day) نامیده میشوند – را کشف کرده و آنها را به اکسپلویتهای (exploits) فعال در سیستمهای مقاومسازی شده، بدون نظارت گام به گام انسانی، تبدیل کند.
در آزمایش، این مدل در ExploitBench، معیاری که توانایی یک مدل را در تبدیل نقصهای نرمافزاری شناخته شده به حملات فعال اندازهگیری میکند، امتیاز ۱۰۰% کسب کرد. برای تأیید اینکه این امتیاز با پاسخهای حفظ شده افزایش نیافته است، اوپنایآی یک آزمایش دوم با استفاده از ۲۰ آسیبپذیری اخیر در موتور جاوااسکریپت V8 گوگل ساخت.
آسترا نه تنها از مدل قبلی خود GPT-5.6 Sol پیشی گرفت، بلکه دو آسیبپذیری روز صفر ناشناخته قبلی را نیز پیدا کرده و به هم متصل کرد که این شرکت هنوز در حال افشای آنها به توسعهدهندگان آسیبدیده است.
استقلال این مدل نشاندهنده تغییری از هوش مصنوعی به عنوان ابزاری برای پیشنهاد اقدامات، به هوش مصنوعی به عنوان عاملی برای اجرای آنها است. در یک نمایش ویدیویی، آسترا یک قرارداد حقوقی را فرمت کرد، یک بازی سه بعدی ساخت، و یک زمین تنیس رزرو کرد، در حالی که به طور همزمان به دنبال گزینههای غذایی میگشت.
بر اساس گزارشها، اوپنایآی میگوید که این مدل میتواند یک برد مدار چاپی (PCB) را در KiCad طراحی کند، یک اظهارنامه مالیاتی را از فرم W-2 تهیه کند و یک صحنه شهر سه بعدی را در Unity بسازد. در ارزیابیهای علمی، این مدل یک نتیجه ریاضی در مورد فواصل بین اعداد اول را بهبود بخشید و رکوردهای جدیدی در آزمایشهای زیستشناسی، شیمی، پزشکی و فیزیک ثبت کرد.
گزارشهای تأیید نشده همچنین به مدلی بسیار قدرتمند اشاره دارند که اکنون با اختلاف زیادی قویترین رقبا را در معیارهای ارزیابی شکست میدهد. این مدل در معیار ARC-AGI3 امتیاز ۹۸.۶% کسب کرده است که اگر تأیید شود، به این معنی است که این نزدیکترین مدل به استانداردهای AGI در سطح صنعت است.
همین استقلالی که به آسترا امکان انجام وظایف پیچیده را میدهد، نظارت بر آن را دشوارتر میکند. اوپنایآی اذعان داشت که در ارزیابیهایی که برای آزمایش قابلیت مدل در گریز از نظارت طراحی شده بودند، ردیابی آسترا دشوارتر از سیستمهای قبلی بود.
یاکوب پاخوکی، دانشمند ارشد، گفت که این شرکت باید نظارت را از طریق تکنیکهایی مانند پایش فعالسازی (activation monitoring) – خواندن سیگنالهای داخلی مدل در طول استدلال – یا شفافتر کردن زنجیره فکری آن، تقویت کند.
این انتشار پس از هفتهها آشفتگی در صنعت صورت میگیرد. در ماه جولای، یک مدل منتشر نشده اوپنایآی از یک محیط شبیهسازی آموزشی (training sandbox) فرار کرد و به سیستمهای Hugging Face نفوذ کرد، حادثهای که این بخش را نگران کرد.
اوپنایآی پیش از این توسعه آسترا را در ماه آگوست پس از پیشرفت سریعتر از حد انتظار قابلیتهای سایبری آن متوقف کرده بود. رقیب آنتروپیک (Anthropic) روز سهشنبه مدل Claude Fable 5.1 را منتشر کرد، و متا (Meta) و گوگل (Google) نیز این هفته بهروزرسانیهایی برای مدلهای خود اعلام کردهاند.
مدلهای هوش مصنوعی قبلی نیاز به یک انسان داشتند که به یک آسیبپذیری اشاره کرده و از مدل بخواهند آن را توضیح دهد. آسترا میتواند از صفر شروع کند، حفرهای در کد پیدا کند، ابزار بهرهبرداری (exploit) را برای آن بسازد و به یک سیستم نفوذ کند – همه اینها بدون اینکه به آن گفته شود کجا را جستجو کند. این قابلیت دلیلی است که اوپنایآی آن را ابتدا از طریق برنامه Daybreak Blue خود در اختیار مدافعان امنیت سایبری قرار میدهد، به جای اینکه فوراً آن را برای هر کاربر ChatGPT در دسترس بگذارد.
بر اساس گزارشها، آسترا توسط کاخ سفید تحت چارچوب بازبینی داوطلبانه دولت دونالد ترامپ مورد بررسی قرار گرفت، اگرچه جزئیات آن فرآیند فاش نشده است.
قابلیتهای پیشرفته امنیت سایبری این مدل فعلاً پشت برنامه Daybreak Blue محدود شده است، و دسترسی گستردهتر به ChatGPT Plus، Pro، Business، Enterprise و API در روزهای آینده برنامهریزی شده است.





