الترتيب #7 المنظومة اليومية — مساعدات الذكاء الاصطناعي الرائدة
xAI

Grok 4.7

يحافظ Grok 4.7 على السعر المنخفض نفسه لـ Grok 4.6 – دولاران للإدخال و6 دولارات للإخراج لكل مليون رمز – لكنه نموذج أقوى وأكثر تأنيًا بشكل ملموس. درّبته xAI على مهام أطول وأصعب، وعلّمته أن يراجع عمله بنفسه. إنه أوفر طريق للحصول على مساعدة قريبة من المستوى الأعلى في العمل المكتبي، والمسودات القانونية، والرياضيات الهندسية.

تم التحديث 27 سبتمبر 2026 Value Frontier$2/$6 PricingSelf-Verification
الأفضل لـ

يحافظ Grok 4.7 على السعر المنخفض نفسه لـ Grok 4.6 – دولاران للإدخال و6 دولارات للإخراج لكل مليون رمز – لكنه نموذج أقوى وأكثر تأنيًا بشكل ملموس. درّبته xAI على مهام أطول وأصعب، وعلّمته أن يراجع عمله بنفسه. إنه أوفر طريق للحصول على مساعدة قريبة من المستوى الأعلى في العمل المكتبي، والمسودات القانونية، والرياضيات الهندسية.

لماذا تفوز

السعر نفسه لـ Grok 4.6 عند 2/6 دولارات، مع نسخة سريعة بضعف السرعة مقابل ضعف السعر. في جدول إطلاق xAI، يحقق Grok 4.7 أعلى درجة في Harvey Legal Agent Benchmark (19.6% مقابل 6.7% لـ Claude Fable 5.1) وفي EEBench للهندسة الكهربائية (64.0%). وفي AA Briefcase، وهو اختبار لعمل مكتبي يمتد ساعات، يقترب من Fable 5.1 (1,657 مقابل 1,678). وتصفه xAI بأنه أقوى نماذجها حتى الآن في رفض الطلبات الضارة ومقاومة محاولات كسر الحماية (jailbreak).

انتبه إلى

يقارنه جدول إطلاقه بـ GPT-5.6 Sol وClaude Fable 5.1، لا بالنموذجين الأحدث Claude Opus 5.5 وGPT-6 Sol، لذا لم تتحدد بعد مكانته أمام أفضل نماذج اليوم. ويتأخر بوضوح في العمل الطويل على الطرفية (37.6% في Terminal-Bench 4.0 مقابل 57.9% لـ Fable 5.1) وفي الاستدلال السريري. وكل الأرقام من xAI نفسها.

01

ما هو في الواقع

تخيّل شركة طيران منخفضة التكلفة تُبقي أسعار تذاكرها كما هي، لكنها تستبدل بهدوء طائراتها بطائرات أكبر وأفضل.

هذا تقريبًا ما فعلته xAI مع Grok 4.7، الذي صدر في 21 سبتمبر 2026. لم يتغير السعر: دولاران لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، تمامًا كما في Grok 4.6. ما تغيّر هو النموذج نفسه.

ما الجديد تحت الغطاء

تصف xAI ثلاثة تغييرات، بعبارات بسيطة:

  1. نموذج أساسي أكبر. تقول xAI إن الإصدار 4.7 مبني على أساس أكبر من 4.6. لم يذكر إعلانها عدد المعاملات، لذا تعامل مع أي رقم محدد تقرؤه في مكان آخر على أنه غير مؤكد.
  2. تدريب أطول وأصعب. دُرّب النموذج بالتعلم المعزز على مهام يستغرق إنجازها ساعات طويلة، وهو بالضبط نوع العمل الذي كانت النماذج السابقة تفقد فيه الخيط في منتصف الطريق.
  3. مراجعة عمله بنفسه. درّبته xAI تحديدًا على التحقق من إجاباته والتعامل مع المستندات الطويلة بموثوقية أكبر.

والنتيجة نموذج يثبت أفضل على المهمة الطويلة، ويكتشف أخطاءه قبل أن تكتشفها أنت.

أين فاجأنا

أكثر الأرقام إثارة للاهتمام في جدول إطلاق xAI ليست أرقام البرمجة، بل أرقام مجالات لا تتوقع فيها أن يتصدر نموذج اقتصادي.

  • العمل القانوني. في Harvey Legal Agent Benchmark، وهو اختبار لمدى إتقان وكيل ذكاء اصطناعي لمهام قانونية حقيقية، سجّل Grok 4.7 نسبة 19.6%، متقدمًا على Claude Fable 5.1 (6.7%) وGPT-5.6 Sol (2.5%). الاختبار صعب إلى حد قاسٍ، والجميع يسجلون فيه درجات منخفضة، لكن Grok جاء في صدارة تلك المقارنة.
  • الرياضيات الهندسية. في EEBench، الذي يقيس حل مسائل الهندسة الكهربائية، سجّل 64.0%، متقدمًا على 56.4% لـ Fable 5.1.
  • العمل المكتبي. في AA Briefcase، وهو اختبار لمهام مكتبية تمتد ساعات مثل إعداد المستندات والعروض التقديمية، سجّل 1,657، خلف 1,678 لـ Fable 5.1 بقليل، وأعلى بكثير من 1,546 لـ Grok 4.6.

ببساطة: في العمل المكتبي والمهني الحقيقي، صار Grok 4.7 ينافس في الدوري نفسه مع نماذج تكلّف أضعاف سعره.

أكثر أمانًا من سمعته

يشتهر Grok بأنه روبوت المحادثة الأقل قيودًا. لكن هذه السمعة لم تعد تنطبق على الإصدار 4.7. تقول xAI إنها بنت نظام أمان جديدًا كليًا، وتصفه بأنه أقوى نماذجها حتى الآن في رفض الطلبات الخطرة ومقاومة محاولات كسر الحماية. وتؤكد أيضًا أنه نادرًا ما يحجب العمل المشروع، مثل أبحاث الأمن الدفاعي.

ما زال Grok يميل إلى الإجابة المباشرة بدل تغليف ردوده بالتحذيرات. لكن هذه مسألة أسلوب، لا غياب للأمان.

العيب بصراحة

لم يواجه أحدث المنافسين بعد. يقارن جدول xAI نموذج Grok 4.7 بـ GPT-5.6 Sol وClaude Fable 5.1. وبعد يوم من إطلاقه أصدرت Anthropic نموذج Claude Opus 5.5، وأصدرت OpenAI نموذج GPT-6 Sol، وكلاهما منافس قوي بسعر جيد. وإلى أن تضعها الاختبارات المستقلة جنبًا إلى جنب، تبقى مكانة Grok الدقيقة غير واضحة.

العمل الطويل على الطرفية ما زال نقطة ضعف. في Terminal-Bench 4.0، الذي يقيس العمل على سطر الأوامر لساعات، سجّل Grok 4.7 نسبة 37.6%. هذا ضعف Grok 4.6 تقريبًا، لكنه بعيد جدًا عن 57.9% لـ Fable 5.1.

الطب ليس نقطة قوته. في HealthBench Professional، وهو اختبار للاستدلال السريري، سجّل 56.7%، أي أقل من GPT-5.6 Sol وFable 5.1.

كل هذه أرقام xAI. تفوّقه في القانون والهندسة مثير للاهتمام، لكننا نود أن نراه مؤكدًا باختبارات مستقلة.

لمن يناسب

إن كنت تستخدم الذكاء الاصطناعي طوال اليوم في المستندات والتحليلات والأسئلة التقنية، وكانت الفاتورة الشهرية تهمّك، فإن Grok 4.7 يستحق تجربة جادة. فهو يمنحك معظم جودة أفضل النماذج بجزء يسير من التكلفة.

إن احتجت إلى أدق حكم متاح، فاختر Claude Opus 5.5. وإن أردت وكيلًا يشغّل البرامج على حاسوبك، فاختر GPT-6 Astra. ولكل ما بين ذلك، يبقى Grok 4.7 أفضل قيمة قرب القمة.

02

نقاط القوة والقيود بصراحة

نقاط القوة الرئيسية

  • عمل قريب من القمة بسعر زهيد: دولاران لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج. هذا أقل من ثلث سعر الإخراج لدى Claude Opus 5.5 ونحو ثُمن سعر GPT-6 Astra. وللفرق التي تستخدم الذكاء الاصطناعي طوال اليوم، يظهر الفرق في الفاتورة الشهرية.
  • قوي على نحو مفاجئ في العمل القانوني: في Harvey Legal Agent Benchmark سجّل Grok 4.7 نسبة 19.6% في جدول xAI، متقدمًا على Claude Fable 5.1 (6.7%) وGPT-5.6 Sol (2.5%). إنه اختبار صعب ما زالت كل النماذج تسجّل فيه درجات منخفضة، لكن Grok تصدّر المقارنة.
  • جيد في الرياضيات الهندسية: في EEBench، وهو اختبار لمسائل الهندسة الكهربائية، سجّل 64.0%، متقدمًا على Fable 5.1 (56.4%) وأعلى بكثير من Grok 4.6 (53.0%).
  • يراجع عمله بنفسه: درّبت xAI نموذج Grok 4.7 على مهام أطول وأصعب، وحسّنت تحديدًا طريقة تحققه من إجاباته وتعامله مع المستندات الطويلة. وفي AA Briefcase، وهو اختبار لعمل مكتبي يمتد ساعات، قفز من 1,546 إلى 1,657، قريبًا من 1,678 لـ Fable 5.1.
  • أكثر أمانًا دون وعظ: أعادت xAI بناء نظام الأمان. وتصف Grok 4.7 بأنه أقوى نماذجها حتى الآن في رفض الطلبات الخطرة ومقاومة محاولات كسر الحماية، مع أنه نادرًا ما يحجب العمل المشروع مثل أبحاث الأمن الدفاعي.

قيود صادقة

  • لم يُقارن بأحدث المنافسين: يضع جدول xAI نموذج Grok 4.7 في مواجهة GPT-5.6 Sol وClaude Fable 5.1. أما Claude Opus 5.5 وGPT-6 Sol فقد صدرا بعده بيوم، لذا ما زالت المقارنات المباشرة المستقلة غائبة.
  • أضعف في جلسات الطرفية الطويلة: في Terminal-Bench 4.0، الذي يقيس العمل على سطر الأوامر لساعات، سجّل 37.6%، وهي قفزة كبيرة عن 20.3% لـ Grok 4.6، لكنها بعيدة جدًا عن 57.9% لـ Fable 5.1.
  • متأخر في الطب: في HealthBench Professional، وهو اختبار للاستدلال السريري، سجّل 56.7%، أي أقل من GPT-5.6 Sol (60.5%) وFable 5.1 (62.1%).
  • أرقام الشركة فقط: كل رقم هنا مصدره إعلان xAI. تعامل مع تفوّقه في القانون والهندسة بوصفه واعدًا إلى أن تؤكده اختبارات مستقلة.
03

لمحة عن المعايير

Harvey Legal Agent Benchmark — 19.6%

عمل قانوني تنفّذه وكلاء. جدول xAI: Grok 4.7 19.6%، وGrok 4.6 15.8%، وClaude Fable 5.1 6.7%، وGPT-5.6 Sol 2.5%. اختبار صعب جدًا، والدرجات المطلقة المنخفضة فيه أمر طبيعي.

EEBench — 64.0%

حل مسائل الهندسة الكهربائية. في الجدول نفسه سجّل Grok 4.6 نسبة 53.0%، وClaude Fable 5.1 نسبة 56.4%، وGPT-5.6 Sol نسبة 39.4%.

AA Briefcase v1.1 — 1,657

مهام مكتبية تمتد ساعات، مثل المستندات والعروض التقديمية. ارتفاع من 1,546 في Grok 4.6، وخلف Claude Fable 5.1 بقليل عند 1,678.

Terminal-Bench 4.0 — 37.6%

عمل على الطرفية يمتد ساعات. تحسن كبير عن Grok 4.6 (20.3%)، ومساوٍ لـ GPT-5.6 Sol (37.3%)، لكنه بعيد جدًا عن Claude Fable 5.1 (57.9%) في جدول xAI. (يضع تشغيل Anthropic الخاص Fable 5.1 عند 55.8%، وتضع الاختبارات المستقلة GPT-6 Astra وClaude Opus 5.5 عند 59.6%.)

السعر — 2/6 دولارات لكل مليون رمز

دون تغيير عن Grok 4.6. وتقدّم النسخة السريعة ضعف سرعة الإخراج مقابل ضعف السعر.

04

الحكم

يحتفظ Grok 4.7 بالمركز الخامس لدينا في فئة المنظومة اليومية بوصفه أفضل قيمة قرب القمة. ليس أذكى مساعد يمكنك شراؤه، فما زال Claude Opus 5.5 وGPT-6 Astra في المقدمة في الحكم المتأني وتشغيل البرامج. لكن Grok 4.7 يقترب على نحو مفاجئ في العمل المكتبي، ويتصدر جدول إطلاقه في الاختبارات القانونية والهندسية، ويكلّف جزءًا يسيرًا من السعر. إن كنت تستخدم الذكاء الاصطناعي طوال اليوم وتراقب الفاتورة، فهو يستحق تجربة جادة.

05

الأسئلة الشائعة