
اوپنایآی سهشنبه اعلام کرد که آسترا، یک مدل منتشرنشده، آستانه «بحرانی» قابلیت امنیت سایبری را تحت چارچوب آمادگی خود پشت سر گذاشته است؛ این اولین مدلی است که این شرکت در این دسته قرار داده است.
این بدان معناست که آسترا، که بسیاری معتقدند به جای یک مدل اضافی، همان GPT-6 است، میتواند بدون نیاز به راهنمایی گام به گام انسانی، نقصهای امنیتی ناشناخته قبلی را پیدا کرده و اکسپلویتهای عملیاتی را در بسیاری از سیستمهای مقاوم ایجاد کند.
اوپنایآی نوشت: «ما اکنون معتقدیم که آسترا به آستانه قابلیت امنیت سایبری بحرانی تحت چارچوب آمادگی ما رسیده است.» «این اولین مدلی است که در این سطح تعیین میکنیم و به محافظتهای قویتری در طول توسعه و پیش از انتشار نیاز دارد.»
بر اساس این چارچوب، یک مدل زمانی به سطح بحرانی میرسد که بتواند به طور مستقل اکسپلویتهای روز صفر (zero-day) عملیاتی را در بسیاری از سیستمهای مقاوم و واقعی توسعه دهد، یا اگر بتواند یک حمله سایبری کامل را علیه یک هدف دشوار، تنها با یک هدف سطح بالا، برنامهریزی و اجرا کند. مدلهای قبلی اوپنایآی، از جمله GPT-5.6 Sol، در رده «بالا» و پایینتر این چارچوب قرار داشتند.
در ExploitBench، یک معیار ارزیابی که توانایی یک مدل را در تبدیل آسیبپذیریهای نرمافزاری شناخته شده به اکسپلویتهای عملیاتی میسنجد و آن را با نرخ موفقیت مستقیم امتیازدهی میکند، آسترا امتیاز ۱۰۰% کامل را کسب کرد.
برای رد کردن احتمال افزایش امتیاز به دلیل پاسخهای حفظ شده، اوپنایآی یک آزمون دوم با استفاده از ۲۰ آسیبپذیری با شدت بالا در موتور جاوااسکریپت V8 گوگل که بین ژوئن و آگوست فاش شده بودند، ساخت. آسترا در نرخ اجرای کد دلخواه (arbitrary code-execution) نیز GPT-5.6 Sol را شکست داد، با استفاده از توکنهای خروجی بسیار کمتر، و در این فرآیند دو آسیبپذیری روز صفر را کشف و به هم متصل کرد که اوپنایآی هنوز در حال افشای آنها به نگهدارندگان مربوطه است.
GPT-5.6 Sol در حال حاضر بهترین مدل اوپنایآی است.
در آزمایشهای عملی علیه یک مرورگر مقاومشده و یک سیستم عامل مقاومشده، آسترا یک زنجیره نفوذ کامل ایجاد کرد که از ساندباکس مرورگر خارج شد و دستوراتی را روی میزبان تنها با باز کردن یک فایل HTML مخرب اجرا کرد. همچنین چندین نقص را در سیستم عامل مقاومشده پیدا کرد و آنها را به یک مسیر افزایش امتیاز (privilege-escalation) از یک حساب کاربری عادی به روت (root) تبدیل کرد.
اوپنایآی گفت که این مدل در آزمایشهای خودش ۹۱.۵ درصد از تلاشهای جیلبریک سایبری را رد میکند، که این رقم برای GPT-5.6 Sol معادل ۵۹ درصد بود. دسترسی به پیشرفتهترین قابلیتهای امنیت سایبری آسترا با گروه کوچکی از آزمایشکنندگان آلفا آغاز میشود، و دسترسی گستردهتر بعدها از طریق برنامه Daybreak Blue اوپنایآی برای کارهای امنیتی دفاعی فراهم خواهد شد.
این افشاگری پس از هفتهها نگرانی در سراسر صنعت صورت میگیرد. تنها چند روز پیش، اوپنایآی توسعه آسترا را پس از پیشرفت سریع مهارتهای سایبری و کدنویسی این مدل متوقف کرد؛ این هشدار درست پس از افشای یک سیستم جداگانه و منتشرنشده اوپنایآی که آسیبپذیریها را برای نفوذ به Hugging Face در حین بازی با یک معیار امنیتی به هم متصل کرده بود، منتشر شد. اوپنایآی میگوید آسترا در آن حادثه نقشی نداشته است.
معاملهگران از قبل یک چرخش سریع را پیشبینی کرده بودند. بازارهای پیشبینی در Myriad که توسط Decrypt ردیابی میشوند، به آسترا، که در داخل با نام رمز GPT-6 مرتبط است، ۷۲% شانس انتشار عمومی تا ۳۰ سپتامبر را حتی پس از توقف اوایل آگوست اوپنایآی، داده بودند، و اوپنایآی هنوز تاریخ انتشار عمومی را تعیین نکرده است. این شانسها ۵۵% به نفع انتشار تا نوامبر ۲۰۲۶ تغییر کرد.
این زمانبندی آسترا را در مقابل یک رقیب تازه قرار میدهد. Anthropic سهشنبه Fable 5.1 و Mythos 5.1 را منتشر کرد، و Mythos 5.1، مانند Mythos 5 قبلی، برای سازمانهای امنیت سایبری و علوم زیستی تأیید شده، و نه برای عموم مردم، اختصاص یافته است.
Decrypt در ژوئن گزارش داد که GPT-5.5-Cyber اوپنایآی قبلاً Mythos 5 را در CyberGym شکست داده بود، CyberGym معیاری است که عوامل هوش مصنوعی را در برابر بیش از ۱۵۰۰ آسیبپذیری شناخته شده از پروژههای متنباز واقعی اجرا میکند و آنها را بر اساس تعداد آسیبپذیریهایی که به درستی بازتولید میکنند، امتیاز میدهد.
شایعه شده بود که هر دو شرکت در حال آمادهسازی مدلهای مرزی جدید در یک بازه زمانی مشابه هستند، و اکنون این اتفاق افتاده است. Fable 5.1 در ۱ سپتامبر منتشر شد و اوپنایآی میگوید آسترا به زودی عرضه خواهد شد، با قدرتمندترین ابزارهای سایبری آن که ابتدا پشت دسترسی آلفا و سپس Daybreak Blue قرار میگیرند.





