عمل كل مطوّر إلى جانب نوعين من الزملاء.
الأولى بارعة ودقيقة، وتلقي محاضرة مدتها ربع ساعة كلما سألتها سؤالًا. أما الثاني فيميل نحو لوحة مفاتيحك، ويكتب أربعين سطرًا، ويشغّل الاختبارات، ثم يقول: «جرّب هذا».
في تشكيلتي OpenAI وAnthropic تحصد الزميلة الدقيقة والباهظة معظم الألقاب. أما Grok 4.7 فهو السريع، الرخيص بما يكفي لتسأله مئة مرة في اليوم.
صدر Grok 4.7 في 21 سبتمبر 2026، ويحتل المركز الخامس في ترتيب البرمجة لدينا. ودوره أن يكون شريك البرمجة الأفضل قيمة بين نماذج الصف الأول.
التحسينات التي تهمّ المبرمجين
كان Grok 4.6 منافسًا مثيرًا للاهتمام. أما Grok 4.7 فخطوة واضحة إلى الأمام في كل اختبار برمجة نشرته xAI:
- DeepSWE v1.1، أي مهام هندسية معقدة في قواعد شيفرة حقيقية: من 65.2% إلى 71.0% (بجهد مرتفع). وفي جدول xAI، هذا يتقدم قليلًا على 70.0% لـ Claude Fable 5.1.
- CursorBench 4.0، أي مهام برمجة أطول داخل محرر Cursor: من 40.4% إلى 46.3%.
- Terminal-Bench 4.0، أي عمل على سطر الأوامر يمتد ساعات: من 20.3% إلى 37.6%، أي الضعف تقريبًا.
تعزو xAI هذه المكاسب إلى نموذج أساسي أكبر، وتدريب أطول بكثير على مهام تستغرق ساعات، وعمل مركّز على التحقق من إجاباته والتعامل مع السياق الطويل. وعمليًا، يعني ذلك تعديلات أقل تُترك نصف منجزة، وأخطاء أقل تُقال بثقة.
حسابات البرمجة داخل المحرر
حين تبرمج في Cursor أو محرر مشابه، لا يُستدعى الذكاء الاصطناعي مرة في اليوم، بل باستمرار. يقرأ ملفاتك، ويقترح تعديلات، ويشرح خطأً، ويعيد كتابة دالة، ثم يعمل من جديد.
بسعر دولارين لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، يملك Grok 4.7 أدنى سعر إخراج بين أفضل نماذج البرمجة. للمقارنة: يكلّف GPT-6 Sol 10 دولارات، وClaude Opus 5.5 20 دولارًا، وGPT-6 Astra 50 دولارًا. إن كنت تعمل في المحرر طوال اليوم، فهذا فرق حقيقي في المال.
وهناك أيضًا نسخة سريعة تُخرج النص بضعف السرعة مقابل ضعف السعر، وهي مفيدة حين تنتظر كل إجابة.
أين ما زال يقصّر
التشغيلات الطويلة دون إشراف. Terminal-Bench 4.0 هو الاختبار الأقدر على التنبؤ بما إذا كان يمكنك ترك وكيل وحده في الطرفية لساعات. نسبة Grok 4.7 البالغة 37.6% تحسّن كبير، لكن GPT-6 Astra وClaude Opus 5.5 يسجلان كلاهما 59.6% في الاختبارات المستقلة، ويسجّل Fable 5.1 نسبة 57.9% في جدول xAI نفسه. وفي العمل المستقل طوال الليل، تضلّ هذه النماذج طريقها أقل بكثير.
أفضل نتائج المحرر. في CursorBench 4.0 يأتي Grok خلف Claude Fable 5.1 (51.8%) وخلف 57.8% التي تعلنها Anthropic لـ Claude Opus 5.5.
أحدث المنافسين. تقارن xAI نموذج Grok 4.7 بـ GPT-5.6 Sol وFable 5.1. وقد صدر GPT-6 Sol في اليوم التالي بسعر مماثل، ولم نرَ بعد مقارنة مباشرة مستقلة. وكل أرقام Grok هنا من xAI نفسها.
الحكم
للتشغيلات الطويلة للوكلاء دون إشراف، اختر GPT-6 Astra. وللعمل المعماري العميق على قاعدة شيفرة كبيرة، اختر Claude Opus 5.5.
أما الساعات التي تقضيها كل يوم في محررك، تصلح الأخطاء وتكتب الاختبارات وتعيد هيكلة المكوّنات، فإن Grok 4.7 شريك قوي وسريع ورخيص جدًا. جرّبه على شيفرتك في مواجهة GPT-6 Sol؛ فالأرجح أن يصبح أحدهما أداتك اليومية.