
یک هفته پیش، GPT-6 آسترا در حال بازسازی خیابانهای منهتن به صورت خیابان به خیابان در یک موتور بازی بود و کاربران را با قابلیتهای خود شگفتزده میکرد. این هفته، همان گروه از کاربران در حال انتشار اسکرینشاتهایی هستند و از OpenAI میپرسند که چه بلایی سر مدلشان آمده است.
«آسترا امروز برای من به طرز چشمگیری احمقتر به نظر میرسد،» این توسعهدهنده محبوب با نام مستعار synthwavedd در X نوشت. «مسئله زمان بود تا «لوبوتومی پس از عرضه» رخ دهد. شرمآور است.»
این یک ترجیعبند آشناست؛ کاربران هوش مصنوعی عادت کردهاند که رباتهای چت و عاملهای مورد علاقه خود را ناگهان «تضعیفشده» ببینند. بیشتر اوقات توضیحهای معقولی برای کاهش محسوس عملکرد این مدلها وجود دارد. اما وقتی تعداد کافی از افراد همزمان یک چیز را میگویند، ارزش بررسی دارد که چه اتفاقی در حال رخ دادن است. و رسانههای اجتماعی در حال حاضر پر از نمونههایی هستند که کاربران به سرعت از GPT-6 آسترا ناامید میشوند.
توسعهدهنده پرانژال پالیوال، که پیشتر این مدل را ستایش کرده بود، به عقب برگشت و کدی را که آسترا برای او نوشته بود، واقعاً خواند. او آنچه را که پیدا کرد، دوست نداشت.
او پست کرد: «ما AGI نداریم. ما پسرفت کردهایم.»
لعنت به این زندگی، بالاخره نگاهی به کدی انداختم که آسترا نوشته بود.
حرفهایم را پس میگیرم.ما AGI نداریم.
ما پسرفت کردهایم.چگونه میتواند همزمان اینقدر باهوش و اینقدر احمق باشد!
— پرانژال پالیوال (@betterclever) ۱۱ سپتامبر ۲۰۲۶
AGI، مخفف هوش عمومی مصنوعی، اصطلاح صنعت برای ماشینی است که اساساً میتواند هر کاری را که یک انسان از نظر شناختی انجام میدهد، انجام دهد. رئیس خود OpenAI در زمان عرضه آسترا از این کلمه استفاده کرد. یک هفته بعد، یکی از کاربران او از آن برای توصیف نقطه مقابل استفاده میکند.
شکایتها شکل مشابهی دارند. توسعهدهنده پانکاج کومار علائم را فهرست کرد: پاسخهای سریعتر، کیفیت بدتر، و این گمان که OpenAI «ارزش آبمیوه (جوهر)» را کاهش داده است. سابا، بنیانگذار، مستقیماً از OpenAI پرسید که چرا اکنون باید آن را «سادهسازی کند» تا وظایف انجام شود.
«ارزش آبمیوه (جوهر)» یک اصطلاح رسمی نیست. هیچ کس آن را تعریف نکرده است. اما این یک اصطلاح اختصاری است که همه در اینجا میفهمند: میزان تلاش محاسباتی که مدل قبل از پاسخ دادن صرف فکر کردن میکند، و این گمان که OpenAI پس از اینکه دموهای عرضه کار خود را انجام دادند، بیسر و صدا آن را کاهش داده است.
برخی افراد آن را به درستی آزمایش کردند. سالیو و محقق امدی اسماعیل سوجال هر دو یک پرامپت یکسان را روی نسخه آسترای روز عرضه و نسخه امروزی اجرا کردند، و هر دو نتایج بدتری از نسخه فعلی دریافت کردند.
خروجی GPT-6 آسترای امروز بدتر به نظر میرسد.
GPT-6 آسترا در زمان عرضه در مقابل GPT-6 آسترای امروز.- تیبو گفت که آنها قدرت محاسباتی دارند
- همان پرامپت، همان تنظیمات.
- ایوان من دقیقا همان پرامپت را روی GPT-6 آسترا در زمان عرضه و دوباره امروز اجرا کردم.
- تفاوت بزرگتر از آن چیزی است که انتظار داشتم…— امدی اسماعیل شوجال 🕷️ (@0x0SojalSec) ۱۱ سپتامبر ۲۰۲۶
دیگران صرفاً در حال بازگشت هستند. داکس راد، که ابزار کدنویسی Opencode را میسازد، گفت تیمش به سلف آسترا، GPT-5.6 Sol، بازگشته است، زیرا هزینهها دو برابر شده اما معایبش ارزشش را نداشت. مصطفی شاهینلی، کاربر ChatGPT، صریحتر گفت: آسترا اکنون باعث میشود او احساس کند که Claude Opus 4.6 «پس از ۱ هفته از عرضه» است، کنایهای به واکنشهای منفی پس از عرضه مدل Anthropic.
البته همه فکر نمیکنند که OpenAI عمداً جدیدترین مدل خود را تضعیف کرده است. کاربر ناشناس Antikythera مفصلترین رد ادعا را منتشر کرد و استدلال کرد که جدول زمانی برعکس عمل میکند.
Antikythera نوشت: «این مدل به همان اندازه که در زمان عرضه احمق بود، الان هم هست.» «مدل خوب است، اما مشکلات زیادی دارد. تنبل است. مثل یک معتاد به لیست گلولهای مینویسد... مردم در هفته عرضه بیش از حد هیجانزده بودند، حالا وقت داشتند آن را آزمایش کنند و اشتباهاتش را ببینند.»
به عبارت دیگر: چیزی تغییر نکرده است. شما فقط به اندازه کافی از خیرگی خارج شدید تا متوجه شوید که این مدل همیشه کمی معتاد به لیست گلولهای بوده است.
تئو، بنیانگذار T3Chat، ایدهای تا حدودی مشابه دارد: آسترا در واقع نامنظمتر از Claude Fable است، بنابراین میتواند گاهی اوقات کدهای فوقالعاده یا کاملاً احمقانه تولید کند. آنچه به نظر میرسد در حال وقوع است، موجی از کاربران است که اکنون که دوره ماه عسل به پایان رسیده، نتایج احمقانه را بیشتر پست میکنند.
GPT-6 آسترا کارهای باورنکردنی انجام داده که هرگز فکر نمیکردم یک مدل بتواند انجام دهد. همچنین برخی از احمقانهترین کارهایی را انجام داده که تاکنون از یک مدل دیدهام.
به طور کلی، Fable 5.1 فقط کاری را انجام میدهد که از آن میخواهم. pic.twitter.com/X2UwI7tDnD
— تئو - t3.gg (@theo) ۸ سپتامبر ۲۰۲۶
این هم چیز جدیدی نیست. آخرین مدل شاخص OpenAI، GPT-5.6 Sol، در ماه ژوئیه همین چرخه را طی کرد، زمانی که کاربران گزارش دادند حالت استدلال برتر آن یک شبه سطحی شده است. تیبو سوتیا، مدیر اجرایی OpenAI، عمداً تضعیف آن را انکار کرد، در حالی که تأیید کرد این شرکت در حال آزمایش با «تلاش استدلالی» بوده است، که تنظیماتی است که کنترل میکند یک مدل قبل از پاسخ دادن چند مرحله «فکر» میکند.
یک پاسخ، این شوخی رایج را خلاصه کرد: آزمایشگاههای بسته یک مدل را منتشر میکنند، و چند روز بعد به «نوعی بیماری» مبتلا میشود و ناگهان «احمقتر میشود.» دیگری نظریه بدبینانه را در یک جمله ارائه داد: «احتمالاً کوانتیزه میشوند تا شرکتها اینقدر پول نسوزانند.»
هرچند این بار از همان اول احمق بودند. من دقیقا یک کار به آسترا دادم که به طرز فجیعی شکست خورد، بعد 5.6 SOL روی xHigh کار را درست کرد...
— فیزیکدان 🏖️ 💻 (@heisenberg_btc) ۱۱ سپتامبر ۲۰۲۶
کوانتیزه کردن یک مدل به معنای کاهش دقت محاسبات داخلی آن برای کاهش هزینهها است، که اغلب با کاهشی در دقت همراه است. OpenAI هرگز تأیید نکرده است که عمداً چنین کاری را روی یک مدل منتشر شده انجام داده باشد.
OpenAI هنوز بیانیهای به سبک Sol درباره آسترا صادر نکرده است. این مدل همچنان اولین مدل این شرکت است که از آنچه آن را آستانه بحرانی خطر امنیت سایبری مینامد، عبور کرده است، به این معنی که میتواند آسیبپذیریهای نرمافزاری ناشناخته را بدون راهنمایی انسان پیدا کرده و به هم متصل کند، قابلیتی که تحت برنامه Daybreak OpenAI به مدافعان تأیید شده محدود شده است.
احمقتر باشد یا نه، همچنان ۱۰ دلار به ازای هر میلیون توکن ورودی و ۵۰ دلار به ازای هر میلیون توکن خروجی هزینه دارد که ۲.۵ برابر هزینهای است که Sol در زمان عرضه دریافت میکرد.





