دليل مرتب

المنظومة اليومية — مساعدات الذكاء الاصطناعي الرائدة

هذه هي السكاكين السويسرية للذكاء الاصطناعي — الأدوات التي يفتحها ملايين الأشخاص قبل أن يفتحوا بريدهم الإلكتروني. تكتب، وتُحلل، وتُخطط، وأحياناً تهلوس بثقة مبهرة. إليك ما يجيده كل منها فعلاً، وأين يتعثر، ولماذا اختيارك يهمّ أقل مما تظن (وأكثر مما يريدك المطوّرون أن تصدّق).

القرار أولاً

ترتيبنا

ابدأ بالفائز، ثم قارن المفاضلات التي قد تغيّر الإجابة بالنسبة لك.

#1 النظام البيئي اليومي

Claude — Opus 5

Anthropic

القائد الجديد للذكاء اليومي: ينقل Opus 5 حكماً قريباً من Fable إلى نموذج يستطيع الأفراد والشركات تشغيله فعلياً على نطاق واسع. يتصدر اختبارات الذكاء المستقلة المبكرة، ويقود مقارنات Anthropic للعمل المعرفي واستخدام الحاسوب، ويكلف نصف Fable 5، ويتوفر على نطاق واسع عبر Claude والمنصات السحابية وواجهة API.

لماذا تفوز

بلغ عند الإطلاق 1861 Elo في GDPval-AA v2، و30.2% في ARC-AGI-3، و70.6% في OSWorld 2.0، و64.7% في Humanity's Last Exam بمساعدة الأدوات. ويمنح Artificial Analysis v4.1.1 الآن جهد max نحو 63 والمركز #1 إجمالاً. كما يوفر Opus سياق 1M وإخراج 128K وتسعير $5/$25.

العيب

ما يزال Fable 5 يفوز ببعض التقييمات التخصصية، ويبقى GPT-5.6 منظومة المستهلك الأوسع، ولا يملك Opus 5 توليد صور أصلياً. جهد max بطيء ومسهب، وتتغير قيم Elo الحية، وما تزال حدود الاستخدام في خطط Claude المجانية والمدفوعة مهمة.

9.9 تقييم التحرير
اقرأ المراجعة
الأفضل لـ

القائد الجديد للذكاء اليومي: ينقل Opus 5 حكماً قريباً من Fable إلى نموذج يستطيع الأفراد والشركات تشغيله فعلياً على نطاق واسع. يتصدر اختبارات الذكاء المستقلة المبكرة، ويقود مقارنات Anthropic للعمل المعرفي واستخدام الحاسوب، ويكلف نصف Fable 5، ويتوفر على نطاق واسع عبر Claude والمنصات السحابية وواجهة API.

لماذا تفوز

بلغ عند الإطلاق 1861 Elo في GDPval-AA v2، و30.2% في ARC-AGI-3، و70.6% في OSWorld 2.0، و64.7% في Humanity's Last Exam بمساعدة الأدوات. ويمنح Artificial Analysis v4.1.1 الآن جهد max نحو 63 والمركز #1 إجمالاً. كما يوفر Opus سياق 1M وإخراج 128K وتسعير $5/$25.

انتبه إلى

ما يزال Fable 5 يفوز ببعض التقييمات التخصصية، ويبقى GPT-5.6 منظومة المستهلك الأوسع، ولا يملك Opus 5 توليد صور أصلياً. جهد max بطيء ومسهب، وتتغير قيم Elo الحية، وما تزال حدود الاستخدام في خطط Claude المجانية والمدفوعة مهمة.

#2

GPT-6 Astra

OpenAI

GPT-6 Astra هو الرائد الجديد من OpenAI للجزء من العمل الذي يحدث خارج مربع المحادثة. يقود المتصفح، وينقر عبر تطبيقات سطح المكتب، ويُنفّذ مسارات العمل المهنية متعددة الخطوات حتى النهاية، ويتحقق من حقائقه بنفسه أفضل بنحو الضعف مقارنةً بـ GPT-5.6 Sol — داخل منظومة ChatGPT وCodex وAPI نفسها التي تعرفها.

9.8 تقييم التحرير
اقرأ المراجعة
#3

نفس أوزان نموذج Mythos 5.1 الحصري، ولكن مع طبقة الأمان التي يحصل عليها معظم المستخدمين بالفعل. إنه النموذج الذي تنصحك شركة Anthropic باستخدامه عندما يفشل Opus 5 بالجهد العالي في تقييماتك الخاصة — البرمجة طويلة الأمد، والبحث لعدة ساعات، والمستندات التي يجب أن تظل متماسكة.

9.8 تقييم التحرير
اقرأ المراجعة
#4

Gemini 3.1 Pro

Google DeepMind

Gemini 3.1 Pro هو متخصص Google في التفكير العميق: نموذج رائد تقادم لكنه ما زال ممتازاً في العلوم والمنطق الجديد والوثائق الطويلة والبحث متعدد الوسائط. عائلة Flash أسرع وأرخص، غير أن 3.1 Pro يظل مفيداً عندما تكون جودة التحليل أهم من سرعة الوصول.

9.7 تقييم التحرير
اقرأ المراجعة
#5

Grok 4.6

xAI

يحوّل Grok 4.6 قصة السعر لدى xAI إلى قصة منافسة في القمة: 61 نقطة لدى Artificial Analysis، وأداء قوي في العمل الوكيلي طويل المدى، مع بقاء سعر الواجهة $2/$6.

9.5 تقييم التحرير
اقرأ المراجعة
#6

Qwen3.8-Max

Alibaba / Qwen Team

يتوفر Qwen3.8 الآن في شكلين مهمين: منتج Qwen3.8-Max المستضاف مع الرؤية، والأدوات المدمجة، وسياق افتراضي بـ 1 مليون رمز، وأول نموذج قابل للتنزيل من فئة Max لـ Qwen. النموذج المفتوح عبارة عن نموذج نصي يحتوي على 2.4 تريليون معلمة إجمالية و 95 مليار معلمة نشطة مع سياق أصلي يبلغ 262 ألفًا يمتد إلى ما يقرب من مليون رمز.

9.0 تقييم التحرير
اقرأ المراجعة
أسئلة وإجابات

الأسئلة الشائعة