شرکت xAI روز دوشنبه نسخه جدید مدل زبانی خود، Grok 4.7، را معرفی کرد. این مدل، که پس از حداقل پنج تأخیر در عرضه قرار گرفته، با برتری قابل توجه نسبت به نسخه قبلی یعنی Grok 4.6 ارائه شده است.
مدل جدید به گفته xAI، در حل مسائل پیچیده زمان بیشتری صرف میکند و با بررسی مجدد پاسخهای خود، دقت آن را افزایش میدهد، علاوه بر آن ایمنی و ساختارهای محافظتی قویتری را هم در بر دارد.
جزئیات فنی و مقایسه با رقبا
Grok 4.7 شامل ۲.۱ تریلیون پارامتر است که نسبت به Grok 4.6، ۴۰ درصد بیشتر است. هزینههای استفاده از این مدل، ۲ دلار به ازای هر میلیون توکن ورودی و ۶ دلار به ازای هر میلیون توکن خروجی است. این پارامترها نشاندهنده توانایی بیشتر در یادگیری الگوها و پردازش اطلاعات است.
مدل جدید همچنین آموزشهای مکملی را برای تحلیل دادههای شرکت SpaceX شامل Telemetry ماهوارهای، سوابق تولید و لاگهای خطای فنی دریافت کرده است. این دادهها این امکان را میدهد که مدل در فهم و تحلیل سیستمهای فیزیکی و سختافزاری بهتر عمل کند.
با وجود این، نتایج بنچمارکها نشان میدهد که Grok 4.7 همچنان در رتبههای دوم قرار دارد. در آزمون GDPval، این مدل امتیاز ۱۶۹۵ را کسب کرده است، در حالی که Claude Fable 5.1 امتیاز ۱۷۳۵ را دارد. در آزمون AA-Briefcase، که وظایف متنوع اداری و تحقیقاتی را ارزیابی میکند، Grok 4.7 امتیاز ۱۶۵۷ را گرفت و در مقابل Fable 5.1 که ۱۶۷۸ کسب کرده بود، قرار گرفت.
جایگاه و آینده محصولات xAI
نتایج این مسابقهها نشان میدهد که اگرچه Grok 4.7 در مقایسه با رقبا هنوز فاصله دارد، اما برای استفاده در برنامههایی مانند پاسخدهی به سوالات کاربران، دستیار صوتی خودرو و سایر امکانات موجود، کاملاً کاربردی است. این مدلها بر اساس برآوردهای xAI، در کنار هزینه پایینتر، تواناییهای لازم برای کاربردهای عمومی را دارند.
در روزهای قبل از عرضه، ایلان ماسک سطح انتظارات را پایین نگه داشته و گفته بود Grok 4.7 باید در همان سطح Claude Opus 5.0 عمل کند، نه نسخه جدیدتر Opus 5.1، و هنوز نیازمند بهبود عملکرد چندرسانهای است.
او همچنین برنامههای آتی برای مدلهای جدیدتر، مانند Grok 4.8، Grok 4.9 و Grok 5 را اعلام کرده است. تاریخ عرضه این محصولات هنوز مشخص نشده و تنها به قول “منتظر بمانیم” اکتفا شده است.




