الترتيب #6 البرمجة — ذكاء اصطناعي يكتب شيفرة جاهزة للإنتاج
xAI

Grok 4.7

Grok 4.7 هو أرخص نموذج برمجة جادّ بالقرب من قمة الترتيب. مقابل دولارين للإدخال و6 دولارات للإخراج لكل مليون رمز، يسجّل 71.0% في DeepSWE و46.3% في CursorBench 4.0، ويعمل مباشرة داخل Cursor وGrok Build. إنه شريك برمجة قوي للعمل اليومي، لكنه ليس بعد الوكيل الذي تتركه وحده في الطرفية لساعات.

تم التحديث 27 سبتمبر 2026 DeepSWE 71.0%CursorBench 46.3%Cursor & Grok Build
الأفضل لـ

Grok 4.7 هو أرخص نموذج برمجة جادّ بالقرب من قمة الترتيب. مقابل دولارين للإدخال و6 دولارات للإخراج لكل مليون رمز، يسجّل 71.0% في DeepSWE و46.3% في CursorBench 4.0، ويعمل مباشرة داخل Cursor وGrok Build. إنه شريك برمجة قوي للعمل اليومي، لكنه ليس بعد الوكيل الذي تتركه وحده في الطرفية لساعات.

لماذا تفوز

في جدول إطلاق xAI: ارتفع CursorBench 4.0 من 40.4% إلى 46.3%، وDeepSWE v1.1 من 65.2% إلى 71.0% (بجهد مرتفع)، وتضاعف Terminal-Bench 4.0 تقريبًا من 20.3% إلى 37.6%. بقي السعر عند 2/6 دولارات، مع نسخة سريعة بضعف السرعة مقابل ضعف السعر. متاح في Cursor، وGrok Build (للتجربة مجانًا)، وعبر Grok API، وفي أدوات برمجة من أطراف ثالثة.

انتبه إلى

في العمل الطويل والمستقل على الطرفية ما زال متأخرًا كثيرًا عن المتصدرين: 37.6% في Terminal-Bench 4.0 مقابل 57.9% لـ Claude Fable 5.1، و59.6% لـ GPT-6 Astra وClaude Opus 5.5 في الاختبارات المستقلة. وفي CursorBench يأتي خلف Fable 5.1 (51.8%). وكل أرقام Grok من xAI نفسها.

01

ما هو في الواقع

عمل كل مطوّر إلى جانب نوعين من الزملاء.

الأولى بارعة ودقيقة، وتلقي محاضرة مدتها ربع ساعة كلما سألتها سؤالًا. أما الثاني فيميل نحو لوحة مفاتيحك، ويكتب أربعين سطرًا، ويشغّل الاختبارات، ثم يقول: «جرّب هذا».

في تشكيلتي OpenAI وAnthropic تحصد الزميلة الدقيقة والباهظة معظم الألقاب. أما Grok 4.7 فهو السريع، الرخيص بما يكفي لتسأله مئة مرة في اليوم.

صدر Grok 4.7 في 21 سبتمبر 2026، ويحتل المركز الخامس في ترتيب البرمجة لدينا. ودوره أن يكون شريك البرمجة الأفضل قيمة بين نماذج الصف الأول.

التحسينات التي تهمّ المبرمجين

كان Grok 4.6 منافسًا مثيرًا للاهتمام. أما Grok 4.7 فخطوة واضحة إلى الأمام في كل اختبار برمجة نشرته xAI:

  • DeepSWE v1.1، أي مهام هندسية معقدة في قواعد شيفرة حقيقية: من 65.2% إلى 71.0% (بجهد مرتفع). وفي جدول xAI، هذا يتقدم قليلًا على 70.0% لـ Claude Fable 5.1.
  • CursorBench 4.0، أي مهام برمجة أطول داخل محرر Cursor: من 40.4% إلى 46.3%.
  • Terminal-Bench 4.0، أي عمل على سطر الأوامر يمتد ساعات: من 20.3% إلى 37.6%، أي الضعف تقريبًا.

تعزو xAI هذه المكاسب إلى نموذج أساسي أكبر، وتدريب أطول بكثير على مهام تستغرق ساعات، وعمل مركّز على التحقق من إجاباته والتعامل مع السياق الطويل. وعمليًا، يعني ذلك تعديلات أقل تُترك نصف منجزة، وأخطاء أقل تُقال بثقة.

حسابات البرمجة داخل المحرر

حين تبرمج في Cursor أو محرر مشابه، لا يُستدعى الذكاء الاصطناعي مرة في اليوم، بل باستمرار. يقرأ ملفاتك، ويقترح تعديلات، ويشرح خطأً، ويعيد كتابة دالة، ثم يعمل من جديد.

بسعر دولارين لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، يملك Grok 4.7 أدنى سعر إخراج بين أفضل نماذج البرمجة. للمقارنة: يكلّف GPT-6 Sol 10 دولارات، وClaude Opus 5.5 20 دولارًا، وGPT-6 Astra 50 دولارًا. إن كنت تعمل في المحرر طوال اليوم، فهذا فرق حقيقي في المال.

وهناك أيضًا نسخة سريعة تُخرج النص بضعف السرعة مقابل ضعف السعر، وهي مفيدة حين تنتظر كل إجابة.

أين ما زال يقصّر

التشغيلات الطويلة دون إشراف. Terminal-Bench 4.0 هو الاختبار الأقدر على التنبؤ بما إذا كان يمكنك ترك وكيل وحده في الطرفية لساعات. نسبة Grok 4.7 البالغة 37.6% تحسّن كبير، لكن GPT-6 Astra وClaude Opus 5.5 يسجلان كلاهما 59.6% في الاختبارات المستقلة، ويسجّل Fable 5.1 نسبة 57.9% في جدول xAI نفسه. وفي العمل المستقل طوال الليل، تضلّ هذه النماذج طريقها أقل بكثير.

أفضل نتائج المحرر. في CursorBench 4.0 يأتي Grok خلف Claude Fable 5.1 (51.8%) وخلف 57.8% التي تعلنها Anthropic لـ Claude Opus 5.5.

أحدث المنافسين. تقارن xAI نموذج Grok 4.7 بـ GPT-5.6 Sol وFable 5.1. وقد صدر GPT-6 Sol في اليوم التالي بسعر مماثل، ولم نرَ بعد مقارنة مباشرة مستقلة. وكل أرقام Grok هنا من xAI نفسها.

الحكم

للتشغيلات الطويلة للوكلاء دون إشراف، اختر GPT-6 Astra. وللعمل المعماري العميق على قاعدة شيفرة كبيرة، اختر Claude Opus 5.5.

أما الساعات التي تقضيها كل يوم في محررك، تصلح الأخطاء وتكتب الاختبارات وتعيد هيكلة المكوّنات، فإن Grok 4.7 شريك قوي وسريع ورخيص جدًا. جرّبه على شيفرتك في مواجهة GPT-6 Sol؛ فالأرجح أن يصبح أحدهما أداتك اليومية.

02

نقاط القوة والقيود بصراحة

نقاط القوة الرئيسية

  • أدنى سعر قرب القمة: دولاران لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج. وهو في الإخراج أرخص من GPT-6 Sol (10 دولارات) وClaude Opus 5.5 (20 دولارًا) وGPT-6 Astra (50 دولارًا). وفي محرر يستدعي النموذج باستمرار، يتراكم هذا الفرق.
  • إصلاح أخطاء متين في مشاريع حقيقية: في DeepSWE v1.1، الذي يختبر مهام هندسية معقدة في قواعد شيفرة حقيقية، سجّل Grok 4.7 نسبة 71.0% بجهد مرتفع، صعودًا من 65.2% في Grok 4.6. وبحسب أرقام xAI، فهذا يضعه متقدمًا قليلًا على Claude Fable 5.1 (70.0%).
  • أفضل في العمل داخل المحرر: يقيس CursorBench 4.0 مهام برمجة أطول داخل محرر Cursor. تحسّن Grok 4.7 من 40.4% إلى 46.3%، وتصفه xAI في هذا الاختبار بأنه «في طليعة نسبة السعر إلى الأداء».
  • يبقى مركّزًا مدة أطول: درّبته xAI على مهام تستغرق ساعات طويلة، وحسّنت طريقة تحققه من عمله وتعامله مع السياق الطويل. وهذه بالضبط المهارات التي تمنع الوكيل من التشتت في منتصف تعديل ما.
  • متاح حيث يعمل المطورون: مدمج في Cursor وGrok Build منذ اليوم الأول، ومتاح عبر Grok API وأدوات برمجة أخرى وموجّهات النماذج. وتضاعف النسخة السريعة سرعة الإخراج في العمل التفاعلي.

قيود صادقة

  • ليس جاهزًا بعد لجلسات طرفية طويلة دون إشراف: ارتفع Terminal-Bench 4.0، الذي يقيس العمل على سطر الأوامر لساعات، إلى 37.6%. إنها قفزة كبيرة، لكنها ما زالت بعيدة جدًا عن نحو 58–60% لدى Fable 5.1 وGPT-6 Astra وClaude Opus 5.5.
  • خلف المتصدرين في مهام المحرر: نسبته 46.3% في CursorBench 4.0 أقل من Fable 5.1 (51.8%) ومن 57.8% التي تعلنها Anthropic لـ Claude Opus 5.5.
  • قورن بمنافسي الشهر الماضي: يضع جدول xAI نموذج Grok 4.7 في مواجهة GPT-5.6 Sol وFable 5.1، لا GPT-6 Sol الذي صدر في اليوم التالي بسعر مماثل.
  • أرقام الشركة فقط: كل أرقام Grok هنا مصدرها xAI. وسنحدّث المقال عند صدور نتائج مستقلة.
03

لمحة عن المعايير

DeepSWE v1.1 — 71.0% (جهد مرتفع)

مهام هندسية معقدة في قواعد شيفرة حقيقية. صعود من 65.2% في Grok 4.6. ويُظهر جدول xAI نموذج Claude Fable 5.1 عند 70.0% وGPT-5.6 Sol (بأقصى جهد) عند 72.7%.

CursorBench 4.0 — 46.3%

مهام برمجة أطول في محرر Cursor. صعود من 40.4%؛ وفي الجدول نفسه يسجّل Claude Fable 5.1 نسبة 51.8% وGPT-5.6 Sol نسبة 41.7%.

Terminal-Bench 4.0 — 37.6%

عمل على سطر الأوامر يمتد ساعات. قرابة ضعف 20.3% لـ Grok 4.6، لكنه بعيد جدًا عن 57.9% لـ Claude Fable 5.1 في جدول xAI. (يضع تشغيل Anthropic الخاص Fable 5.1 عند 55.8%، وتضع الاختبارات المستقلة GPT-6 Astra وClaude Opus 5.5 عند 59.6%.)

السعر — 2/6 دولارات لكل مليون رمز

دون تغيير عن Grok 4.6. وتعمل النسخة السريعة بضعف سرعة الإخراج مقابل ضعف السعر.

04

الحكم

Grok 4.7 هو نموذج البرمجة الخامس لدينا، وأفضل خيار إن كانت تكلفة كل ضغطة مفتاح هي أهم ما يعنيك. في العمل اليومي داخل المحرر – إصلاح الأخطاء، وكتابة الاختبارات، وإعادة هيكلة الشيفرة – هو شريك برمجة كفء حقًا، بأدنى سعر إخراج بين نماذج الصف الأول. أما في جلسات الطرفية الطويلة دون إشراف، فما زال متأخرًا كثيرًا عن GPT-6 Astra وClaude Opus 5.5. وقبل أن تحسم أمرك، جرّبه على شيفرتك في مواجهة أقرب منافسيه سعرًا، GPT-6 Sol.

05

الأسئلة الشائعة