ایلان ماسک در یک پاسخ کوتاه در ایکس (توییتر سابق) از مدل بعدی Grok خبر داد: Grok 4.8، مدلی با ۲.۵ تریلیون پارامتر که با استک نرم‌افزاری جدید شرکت — نوشته‌شده به زبان C++ — آموزش دیده و طبق گفته‌ی او، پیش‌آموزش (pre-training) آن همین هفته تمام می‌شود و وارد فاز یادگیری تقویتی (RL) خواهد شد.

دقیقاً چه چیزی گفته شد؟

ادعای ماسک در پاسخ به یک کاربر مطرح شد که پرسیده بود جز Grok 4.7 چه چیز دیگری از xAI (که حالا با نام SpaceXAI فعالیت می‌کند) در راه است. ماسک در پاسخ نوشت Grok 4.8 یک مدل ۲.۵ تریلیونی است که با استک نرم‌افزاری جدید C++ آموزش دیده، این هفته آموزشش تمام می‌شود و RL شروع می‌شود.

نکته‌ای که باید دقیق خوانده شود: منظور از «تمام‌شدن آموزش»، پایان فاز اولیه‌ی پیش‌آموزش است، نه آماده‌بودن مدل برای انتشار. دقیقاً همان فاز RL که حالا Grok 4.8 قرار است واردش شود، جایی است که Grok 4.7 هفته‌هاست در آن گیر کرده.

حدود ده ساعت بعد، ماسک جزئیات بیشتری اضافه کرد: به گفته‌ی او Grok 4.7 تقریباً هم‌تراز با Opus 5.0 (و نه ۵.۱) است، Grok 4.8 «بهبود محسوسی» خواهد بود، Grok 4.9 احتمالاً در کلاس Astra/Fable قرار می‌گیرد و درباره‌ی Grok 5 هم گفت شاید از هر چیز دیگری بهتر باشد.

عدد ۲.۵ تریلیون چقدر معنا دارد

برای مقایسه، Grok 4.6 با ۱.۵ تریلیون پارامتر منتشر شد و رقم حدود ۲.۱ تریلیون مدت‌ها به Grok 4.7 نسبت داده می‌شد. بنابراین ۲.۵ تریلیون حدود دو سوم بزرگ‌تر از ۴.۶ و نزدیک به ۱۹ درصد بالاتر از ۴.۷ است.

اما این عدد هرگز روی هیچ برگه‌ی مشخصات رسمی xAI ظاهر نشده و باید آن را یک ادعای شخصی مدیرعامل دانست، نه اسپک تأییدشده. سابقه‌ی خود ماسک هم در نسبت‌دادن ارقام به نام‌ها ثابت نبوده؛ پیش‌تر یک مدل ۲ تریلیونی به Grok 4.6 نسبت داده شده بود، اما بعداً برچسب ۴.۶ به مدل ۱.۵ تریلیونی رسید و مدل بزرگ‌تر با نام ۴.۷ و رقم ۲.۱ تریلیون معرفی شد.

استک C++؛ شرط‌بندی روی کد دست‌نویس

بخش جالب‌تر ماجرا برای توسعه‌دهنده‌ها، استک نرم‌افزاری جدید است. ماسک اعلام کرده نرم‌افزار پیش‌آموزش شرکت حالا یک استک داخلی نوشته‌شده با C و C++ است که تیم نرم‌افزار Starlink آن را نوشته و — به تأکید خودش — توسط هوش مصنوعی نوشته نشده، چون به گفته‌ی او هوش مصنوعی هنوز برای نرم‌افزار با کارایی بسیار بالا به‌اندازه‌ی کافی خوب نیست.

او همچنین گفته این استک از اسمبلی و فراخوانی مستقیم شتاب‌دهنده‌های سخت‌افزاری در مالتی‌پروسسورهای استریمینگ انویدیا استفاده می‌کند تا نرم‌افزار بتواند دقیق‌تر سخت‌افزار GPU را هدف بگیرد. در مقابل، ماسک اعتراف کرده استک یادگیری تقویتی همچنان مجموعه‌ای از سیستم‌های شخص‌ثالث قدیمی است و قرار است «در زمان مناسب» اصلاح شود.

این وعده سابقه هم دارد: ماسک اواخر ژوئن گفته بود ظرف حدود سه ماه نرم‌افزار آموزش و استنتاج Grok را به C/C++ بازنویسی می‌کند، لایه‌های میانی زیادی را حذف می‌کند و آن را مخصوص GB300 انویدیا بهینه می‌کند.

چرا باید محتاط بود
Grok 4.7 هنوز منتشر نشده، صفحه‌ی مدل در مستندات توسعه‌دهنده‌ی xAI ندارد و انتشارش به‌خاطر مشکلات RL عقب افتاده است. خود ماسک گفته بود این مدل حدود ۱۲ سپتامبر عرضه می‌شود، اما نزدیک موعد اعلام کرد مدل روی مسائل سخت زودتر از موعد تسلیم می‌شود و بررسی دقیقی روی صحت پاسخ‌هایش ندارد.

Grok 4.8 هم در حال حاضر نه مدل آی‌دی دارد، نه قیمت، نه پنجره‌ی زمینه (context window) و نه کارت بنچمارک. عملاً هیچ اعلامیه‌ی رسمی‌ای از سوی شرکت منتشر نشده و تمام چیزی که وجود دارد، چند پست در ایکس است.

سوالات متداول

آیا Grok 4.8 منتشر شده است؟ خیر. طبق گفته‌ی ماسک تازه پیش‌آموزشش تمام می‌شود و وارد فاز یادگیری تقویتی می‌شود. تاریخ انتشاری اعلام نشده است.
Grok 4.8 چند پارامتر دارد؟ ماسک عدد ۲.۵ تریلیون را اعلام کرده، اما این رقم روی هیچ مستند رسمی xAI منتشر نشده است.

استک C++ چه فرقی ایجاد می‌کند؟ هدف اعلام‌شده، حذف لایه‌های میانی و بهینه‌سازی مستقیم برای سخت‌افزار انویدیاست تا سرعت آموزش بالاتر برود. تأثیر واقعی آن هنوز با داده‌ی مستقلی سنجیده نشده.

وضعیت Grok 4.7 چیست؟ همچنان منتشر نشده و به‌دلیل مشکلات مرحله‌ی یادگیری تقویتی تأخیر خورده است.

جمع‌بندی
Grok 4.8 در این مرحله بیشتر یک ادعای مدیرعامل است تا یک محصول. عدد ۲.۵ تریلیون و استک C++ جدید از نظر فنی قابل توجه‌اند، اما تا زمانی که مدل منتشر نشود و بنچمارک مستقلی از آن در دسترس نباشد، هر قضاوتی درباره‌ی عملکرد واقعی‌اش زودهنگام است — به‌خصوص وقتی نسخه‌ی قبلی هنوز روی همان فاز RL گیر کرده است.


منابع: KuCoin News