
ایلان ماسک هدفگذاری اوایل اوت را برای Grok 4.6 تعیین کرده و برنامههایی را برای مدل بزرگتر Grok 4.7 فاش کرده است، زیرا SpaceXAI رقابت خود را با OpenAI، Anthropic و Moonshot AI چین افزایش میدهد.
ماسک جدول زمانی را در پستی در ۲۸ ژوئیه در پلتفرم X فاش کرد و گفت Grok 4.6 "حدود ۷ اوت" منتشر خواهد شد. او آن را مدلی با ۱.۵ تریلیون پارامتر و تنظیم دقیق تحت نظارت قویتر و یادگیری تقویتی توصیف کرد.
تنظیم دقیق تحت نظارت، یک مدل را بر روی نمونههای انتخاب شده آموزش میدهد تا کیفیت پاسخهای آن را بهبود بخشد. یادگیری تقویتی از بازخورد و سیگنالهای پاداش برای اصلاح نحوه انجام وظایف و پیروی از دستورالعملها توسط مدل استفاده میکند.
ماسک همچنین گفت که Grok 4.7 "چند هفته بعد" به عنوان مدلی با ۲.۱ تریلیون پارامتر عرضه خواهد شد. با این حال، او تاریخ دقیق عرضه یا جزئیات قیمتگذاری و در دسترس بودن برای هیچ یک از این نسخهها را اعلام نکرد.
ماسک در مورد Grok 4.7 گفت: "این از هر نظر بهتر از ۴.۶ خواهد بود، به جز اینکه کمی کندتر سرویسدهی میکند، هرچند با بهرهوری توکن (token efficiency) حتی بهتر."
هر دو تاریخ همچنان اهداف هستند و نه قرارهای انتشار تایید شده. برنامههای توسعه مدل ممکن است در طول آموزش، آزمایش و استقرار تغییر کنند.
SpaceXAI Grok 4.5 را در اوایل ژوئیه به عنوان مدلی طراحی شده برای کدنویسی، وظایف مبتنی بر عامل و کارهای دانش معرفی کرد. این شرکت در حال حاضر ۲ دلار برای هر میلیون توکن ورودی و ۶ دلار برای هر میلیون توکن خروجی دریافت میکند.
ماسک دو مدل بعدی را در پاسخ به ارزیابی گیلرمو راوش، مدیر عامل ورسل، اعلام کرد که Grok 4.5 را به عنوان بهترین مدل امنیت سایبری از نظر قیمت در آخرین آزمایشهای ورسل توصیف کرده بود.
بر اساس پست راوش، Grok 4.5 ده برابر ارزانتر از GPT-5.6 Sol از OpenAI، ۵.۷ برابر ارزانتر از Opus 5 از Anthropic و ۲.۲ برابر ارزانتر از Kimi K3 از Moonshot بود، در حالی که عملکردی نزدیک به Kimi ارائه میداد.
راوش همچنان Sol را به عنوان مدل پیشرو مرزی، جلوتر از Opus 5 رتبهبندی کرد. یافتههای او نشاندهنده روشهای آزمایش ورسل است و یک رتبهبندی جهانی در تمام بارهای کاری هوش مصنوعی را تعیین نمیکند.
SpaceXAI نگفته است که آیا Grok 4.6 و Grok 4.7 قیمتگذاری Grok 4.5 را حفظ خواهند کرد یا خیر. سرعت سرویسدهی، استفاده از توکن و هزینههای API تعیین خواهد کرد که آیا مدلهای جدیدتر همان مزیت قیمت-عملکرد را حفظ میکنند یا خیر.
ارتقاهای برنامهریزی شده Grok در حالی ارائه میشوند که توسعهدهندگان چینی در حال کاهش فاصله با شرکتهای پیشرو هوش مصنوعی آمریکا هستند. Moonshot AI وزنهای کامل Kimi K3 را در ۲۷ ژوئیه منتشر کرد و به توسعهدهندگان اجازه داد مدل را دانلود، اصلاح و بر روی زیرساخت خود اجرا کنند.
Kimi K3 دارای ۲.۸ تریلیون پارامتر، قابلیتهای بصری بومی و یک پنجره متنی (context window) یک میلیون توکنی است. مقیاس و ساختار وزن-باز آن فشار را بر شرکتهای آمریکایی که عمدتاً پیشرفتهترین مدلهای خود را از طریق پلتفرمهای بسته و APIهای پولی توزیع میکنند، افزایش داده است.
SpaceXAI، OpenAI و Anthropic نیز در زمینههای کدنویسی، امنیت سایبری، استدلال و هزینه مورد نیاز برای تکمیل هر وظیفه با یکدیگر رقابت میکنند. معماری بزرگتر Grok 4.7 ممکن است قابلیتهای آن را بهبود بخشد، اما ماسک اذعان داشت که سرعت سرویسدهی آن کندتر از Grok 4.6 خواهد بود.
تعداد پارامترها به تنهایی کیفیت مدل را تعیین نمیکند. دادههای آموزشی، معماری، روشهای پسآموزش، سیستمهای استنتاج و کارایی توکن همگی میتوانند بر عملکرد تأثیر بگذارند.
OpenAI و Anthropic قبلاً موافقت کردهاند که دسترسی زودهنگام به مدلهای مرزی منتشر نشده را برای آزمایشهای ایمنی به مقامات آمریکایی ارائه دهند. این توافقنامهها مبنای یک چارچوب بررسی داوطلبانه فدرال گستردهتر را تشکیل داد که اکنون سایر توسعهدهندگان اصلی از جمله SpaceXAI، Google DeepMind و Microsoft را نیز پوشش میدهد.
رئیس جمهور دونالد ترامپ این چارچوب را از طریق یک فرمان اجرایی در ماه ژوئن رسمی کرد. شرکتهای شرکتکننده میتوانند مدلهای تحت پوشش را تا ۳۰ روز قبل از انتشار به شرکای مورد اعتماد، در اختیار دولت فدرال قرار دهند. این فرمان تصریح میکند که این بررسیها یک سیستم مجوزدهی اجباری یا پیشتایید ایجاد نمیکنند.
با این حال، صنعت در مورد نحوه برخورد واشنگتن با مدلهای وزن-باز (open-weight) دچار اختلاف نظر است. انویدیا، مایکروسافت، متا، OpenAI، پالانتیر و سایر سازمانها در نامهای سرگشاده در ۲۴ ژوئیه به سیاستگذاران آمریکایی در مورد محدودیتهای گسترده هشدار دادند. آنها استدلال کردند که مدلهای باز از رقابت حمایت میکنند، هزینههای استقرار را کاهش میدهند و به توسعهدهندگان اجازه میدهند سیستمهای هوش مصنوعی را بر روی زیرساخت خود اجرا و اصلاح کنند.
این بحثها پس از انتشار Kimi K3 با ۲.۸ تریلیون پارامتر توسط Moonshot AI شدت یافته است. مقامات دولت ترامپ، Moonshot را به استفاده از خروجیهای مدل Fable از Anthropic برای آموزش Kimi K3 از طریق تقطیر در مقیاس بزرگ متهم کردهاند. مایکل کراتسیوس، مشاور فناوری کاخ سفید، این عمل ادعایی را تلاشی برای دستیابی به فناوری اختصاصی آمریکا توصیف کرد، در حالی که اسکات بسنت، وزیر خزانهداری، گفت که دولت در حال بررسی تحریمها و قرار دادن Moonshot در لیست سیاه تجاری است.
Moonshot علناً این اتهامات را نپذیرفته است. با این حال، این اختلاف، Kimi K3 را در مرکز یک مبارزه سیاسی گستردهتر قرار داده است که آیا واشنگتن باید خطرات خاص امنیتی و مالکیت فکری را هدف قرار دهد یا دسترسی به مدلهای وزن-باز چینی را به طور کلی محدود کند. Grok 4.6 و Grok 4.7 در حالی وارد این بازار خواهند شد که توسعهدهندگان آمریکایی برای بهبود عملکرد و در عین حال برآورده کردن انتظارات ایمنی فدرال تحت فشار هستند.