تخيّل شركة طيران منخفضة التكلفة تُبقي أسعار تذاكرها كما هي، لكنها تستبدل بهدوء طائراتها بطائرات أكبر وأفضل.
هذا تقريبًا ما فعلته xAI مع Grok 4.7، الذي صدر في 21 سبتمبر 2026. لم يتغير السعر: دولاران لكل مليون رمز إدخال و6 دولارات لكل مليون رمز إخراج، تمامًا كما في Grok 4.6. ما تغيّر هو النموذج نفسه.
ما الجديد تحت الغطاء
تصف xAI ثلاثة تغييرات، بعبارات بسيطة:
- نموذج أساسي أكبر. تقول xAI إن الإصدار 4.7 مبني على أساس أكبر من 4.6. لم يذكر إعلانها عدد المعاملات، لذا تعامل مع أي رقم محدد تقرؤه في مكان آخر على أنه غير مؤكد.
- تدريب أطول وأصعب. دُرّب النموذج بالتعلم المعزز على مهام يستغرق إنجازها ساعات طويلة، وهو بالضبط نوع العمل الذي كانت النماذج السابقة تفقد فيه الخيط في منتصف الطريق.
- مراجعة عمله بنفسه. درّبته xAI تحديدًا على التحقق من إجاباته والتعامل مع المستندات الطويلة بموثوقية أكبر.
والنتيجة نموذج يثبت أفضل على المهمة الطويلة، ويكتشف أخطاءه قبل أن تكتشفها أنت.
أين فاجأنا
أكثر الأرقام إثارة للاهتمام في جدول إطلاق xAI ليست أرقام البرمجة، بل أرقام مجالات لا تتوقع فيها أن يتصدر نموذج اقتصادي.
- العمل القانوني. في Harvey Legal Agent Benchmark، وهو اختبار لمدى إتقان وكيل ذكاء اصطناعي لمهام قانونية حقيقية، سجّل Grok 4.7 نسبة 19.6%، متقدمًا على Claude Fable 5.1 (6.7%) وGPT-5.6 Sol (2.5%). الاختبار صعب إلى حد قاسٍ، والجميع يسجلون فيه درجات منخفضة، لكن Grok جاء في صدارة تلك المقارنة.
- الرياضيات الهندسية. في EEBench، الذي يقيس حل مسائل الهندسة الكهربائية، سجّل 64.0%، متقدمًا على 56.4% لـ Fable 5.1.
- العمل المكتبي. في AA Briefcase، وهو اختبار لمهام مكتبية تمتد ساعات مثل إعداد المستندات والعروض التقديمية، سجّل 1,657، خلف 1,678 لـ Fable 5.1 بقليل، وأعلى بكثير من 1,546 لـ Grok 4.6.
ببساطة: في العمل المكتبي والمهني الحقيقي، صار Grok 4.7 ينافس في الدوري نفسه مع نماذج تكلّف أضعاف سعره.
أكثر أمانًا من سمعته
يشتهر Grok بأنه روبوت المحادثة الأقل قيودًا. لكن هذه السمعة لم تعد تنطبق على الإصدار 4.7. تقول xAI إنها بنت نظام أمان جديدًا كليًا، وتصفه بأنه أقوى نماذجها حتى الآن في رفض الطلبات الخطرة ومقاومة محاولات كسر الحماية. وتؤكد أيضًا أنه نادرًا ما يحجب العمل المشروع، مثل أبحاث الأمن الدفاعي.
ما زال Grok يميل إلى الإجابة المباشرة بدل تغليف ردوده بالتحذيرات. لكن هذه مسألة أسلوب، لا غياب للأمان.
العيب بصراحة
لم يواجه أحدث المنافسين بعد. يقارن جدول xAI نموذج Grok 4.7 بـ GPT-5.6 Sol وClaude Fable 5.1. وبعد يوم من إطلاقه أصدرت Anthropic نموذج Claude Opus 5.5، وأصدرت OpenAI نموذج GPT-6 Sol، وكلاهما منافس قوي بسعر جيد. وإلى أن تضعها الاختبارات المستقلة جنبًا إلى جنب، تبقى مكانة Grok الدقيقة غير واضحة.
العمل الطويل على الطرفية ما زال نقطة ضعف. في Terminal-Bench 4.0، الذي يقيس العمل على سطر الأوامر لساعات، سجّل Grok 4.7 نسبة 37.6%. هذا ضعف Grok 4.6 تقريبًا، لكنه بعيد جدًا عن 57.9% لـ Fable 5.1.
الطب ليس نقطة قوته. في HealthBench Professional، وهو اختبار للاستدلال السريري، سجّل 56.7%، أي أقل من GPT-5.6 Sol وFable 5.1.
كل هذه أرقام xAI. تفوّقه في القانون والهندسة مثير للاهتمام، لكننا نود أن نراه مؤكدًا باختبارات مستقلة.
لمن يناسب
إن كنت تستخدم الذكاء الاصطناعي طوال اليوم في المستندات والتحليلات والأسئلة التقنية، وكانت الفاتورة الشهرية تهمّك، فإن Grok 4.7 يستحق تجربة جادة. فهو يمنحك معظم جودة أفضل النماذج بجزء يسير من التكلفة.
إن احتجت إلى أدق حكم متاح، فاختر Claude Opus 5.5. وإن أردت وكيلًا يشغّل البرامج على حاسوبك، فاختر GPT-6 Astra. ولكل ما بين ذلك، يبقى Grok 4.7 أفضل قيمة قرب القمة.