أطلقت xAI نموذج Grok 4.6 في 12 أغسطس، ووصفتْه بأنه تحسينٌ بعديّ للتدريب على Grok 4.5 وليس نموذجًا أساسيًا جديدًا. وكلاهما يقوم على الأساس نفسه من فئة 1.5 تريليون معلمة ضمن "V9".

ما الذي تغيّر فعليًا

العمل هنا يتمثل في الضبط الدقيق الخاضع للإشراف والتعلّم المعزز داخل بيئات وكيلية — أي استخدام الأدوات على مدى طويل، لا مجرد التوسع الخام. وتذكر xAI أنها حققت 61 في Artificial Analysis Intelligence Index مقابل 56 لـ Grok 4.5، وهو ما يعادل GPT-5.6 Sol على ذلك المؤشر. ويظل السياق عند 500K tokens، والمدخلات نصوصًا وصورًا، ويقع حد المعرفة عند 1 فبراير 2026. كما أُتيح للمستخدمين مستوى جديد من جهد الاستدلال باسم xhigh.

أين لا يتصدر

في البرمجة، تبدو الصورة أقل إبهارًا. يسجل Grok 4.6 نسبة 69.9% على CursorBench v3.2، و65.9% على DeepSWE v1.1، و61.3% على FrontierCode v1.1، و26% على Terminal-Bench v3.0. وتقع نتيجة DeepSWE دون GPT-5.6 بنحو ملحوظ، عند حوالى 73% — أي إن التعادل في مؤشر مركب واحد لا يعني تفوقًا في هندسة البرمجيات.

التسعير والتوافر

دون Prompt يتجاوز 200K tokens، تبلغ كلفة النموذج $2 لكل مليون token إدخال، و$0.50 للمخزن المؤقت، و$6 للإخراج؛ وفوق ذلك تصبح $4 / $1 / $12. أما النسخة "fast" فتضاعف هذه الأسعار. والنموذج هو الافتراضي في Grok Build، ومتاح لكل خطط Cursor، وشُحن مع مضاعفة الاستخدام المشمول خلال الأسبوع الأول. ولا تتوافر أوزان مفتوحة.

رقم يجدر حذفه

تداولت التغطيات رقم "1753 ELO" المرتبط بـ Grok 4.6. لكن هذا الرقم هو نتيجة GDPVal-AA v2 الخاصة بالنموذج، وليس Arena ELO، والرقمان غير قابلين للمقارنة. كما أن الادعاء ببدء الإطلاق في 7 أغسطس لا يستند إلى أي دعم في مواد xAI نفسها.

النمط الذي ينسجم معه

إن تحقيق مكسب من خمس نقاط في المؤشر من دون أي جولة pretraining جديدة هو الشكل الحالي للمنافسة في النماذج المتقدمة: الجزء المكلف انتهى، والعوائد تأتي مما يحدث بعد ذلك. كما أن هذا يجعل أرقام الإصدارات دليلًا ضعيفًا على مقدار الحوسبة الفاصل بين نموذجين.