الترتيب #1 المنظومة اليومية — مساعدات الذكاء الاصطناعي الرائدة
Anthropic

Claude Opus 5.5

Claude Opus 5.5 هو النموذج الذي نسلّمه مهمة معقدة وعالية المخاطر ونحن مطمئنون إلى أنه سيعود بالإجابة الصحيحة. تقول Anthropic إنه يؤدي في معظم الأعمال بمستوى نموذجها الأعلى Fable 5.1، لكنه يكلّف أقل من نصف سعره لكل رمز. وصار يكتب اليوم كزميل هادئ متمرّس، لا كخرّيج جديد متوتر.

تم التحديث 27 سبتمبر 2026 AA Index 58 #1Knowledge Work SOTAAdaptive Thinking
الأفضل لـ

Claude Opus 5.5 هو النموذج الذي نسلّمه مهمة معقدة وعالية المخاطر ونحن مطمئنون إلى أنه سيعود بالإجابة الصحيحة. تقول Anthropic إنه يؤدي في معظم الأعمال بمستوى نموذجها الأعلى Fable 5.1، لكنه يكلّف أقل من نصف سعره لكل رمز. وصار يكتب اليوم كزميل هادئ متمرّس، لا كخرّيج جديد متوتر.

لماذا تفوز

أعلى درجة على مؤشر Artificial Analysis Intelligence Index المستقل عند الإطلاق (58 بأقصى جهد). يتصدر GDPval-AA v2.1، وهو اختبار لعمل مهني حقيقي، بـ 1846 نقطة Elo متقدمًا على Fable 5.1 (1735). انخفض سعر الرموز 20% إلى 4/20 دولارًا، وانخفضت قراءة الذاكرة المؤقتة 60% إلى 0.20 دولار، ما يجعل أعباء العمل المعتادة أرخص بنحو 40% من Opus 5 وفق Anthropic. الكتابة أسرع بأكثر من 30%، ورُفعت حدود الاستخدام لكل خمس ساعات في الخطط المدفوعة.

انتبه إلى

عند أقصى جهد يفكّر بصوت عالٍ كثيرًا: قاست Artificial Analysis نحو 119,000 رمز إخراج لكل مهمة مقابل نحو 27,000 لـ GPT-6 Astra، لذا لا يُثمر السعر المنخفض إلا إذا بقيت الأعمال الروتينية على مستوى الجهد الافتراضي. لا يولّد الصور، ولم يعد ممكنًا إيقاف التفكير تمامًا، ومعظم طلبات الأمن السيبراني تُحال بهدوء إلى النموذج الأقدم Opus 4.8.

01

ما هو في الواقع

معظم مساعدي الذكاء الاصطناعي يتصرفون كمتدرّب سريع جدًا: يجيبون فورًا وبثقة. أعطِهم عقد إيجار من أربعين صفحة، فيعيدون إليك ملخصًا أنيقًا يتجاوز تمامًا البند المهم في الصفحة 37.

أما Claude Opus 5.5 فيشبه الزميلة الخبيرة التي تقرأ المستند كله أولًا، ثم تخبرك في جملتين أين المشكلة وأين تجدها.

أطلقت Anthropic نموذج Opus 5.5 في 22 سبتمبر 2026 بوصفه أول نماذج عائلة Claude 5.5. ويحتل المركز الأول لدينا في فئة المنظومة اليومية لسبب بسيط: إنه أفضل نموذج نستطيع قياسه في التفكير المتأني، ولم يعد سعره سعر سلعة فاخرة.

ماذا تقول الاختبارات المستقلة

يقوم معظم الحكم هنا على رقمين، وكلاهما من Artificial Analysis، لا من الحملات التسويقية لـ Anthropic.

الأول هو Artificial Analysis Intelligence Index، وهو درجة تجمع عشرة اختبارات صعبة في التفكير المنطقي والعلوم والبرمجة والمعرفة. بأقصى جهد، سجّل Opus 5.5 درجة 58 في سبتمبر 2026. كانت تلك صدارة الترتيب عند الإطلاق، متقدمًا على GPT-6 Astra وعلى نموذج Anthropic الأعلى نفسه، Claude Fable 5.1. (يُعاد ضبط مقياس المؤشر من حين لآخر، لذا لا تكون للدرجة قيمة إلا بمقارنتها بنماذج قيست في الفترة نفسها.)

الثاني هو GDPval-AA v2.1، وهو أقرب إلى الحياة الواقعية. فبدل أسئلة الاختبارات، تُنتج النماذج مخرجات عمل حقيقية – نموذجًا في جدول بيانات، أو مذكرة قانونية، أو ملخصًا للإدارة – من 44 مهنة، ثم تُقارن النتائج وجهًا لوجه كما يُصنَّف لاعبو الشطرنج. سجّل Opus 5.5 1846 Elo، مقابل 1735 لـ Fable 5.1، و1708 لـ Opus 5، و1542 لـ GPT-6 Astra.

وتشير اختبارات Anthropic الداخلية إلى الاتجاه نفسه. في أحدها كتبت ثلاثة نماذج تقريرًا عن النتائج الفصلية لشركة ما، مستعينة بنسخة من الإنترنت يصعب فيها العثور على بيان الأرباح، وكان أي رقم أو اقتباس مختلَق يعني الرسوب. نجح Opus 5.5 في 16 مرة من أصل 18، بينما لم ينجح Fable 5.1 ولا Opus 5 ولو مرة واحدة. هذا بالضبط ما نريده من المساعد: ألا يكون ذكيًا فحسب، بل حذرًا فيما يدّعيه.

حكاية السعر كما هي

ربما قرأت أن Opus 5.5 «أرخص بنسبة 40%». هذا صحيح، لكن من المفيد أن تفهم مصدر هذا الرقم.

  • انخفض سعر الرموز 20%: 4 دولارات لكل مليون رمز إدخال و20 دولارًا لكل مليون رمز إخراج، بدل 5 و25.
  • انخفضت قراءة الذاكرة المؤقتة 60%: إلى 0.20 دولار لكل مليون. حين تطرح سؤالًا تلو الآخر عن المستند الطويل نفسه، يعيد النموذج قراءته من ذاكرة مؤقتة، وهذه القراءة المتكررة هي الجزء الأكبر من فاتورة الوكلاء وأدوات البرمجة.
  • يستهلك رموزًا أقل عند الجهد الافتراضي: وتقول Anthropic إن هذا ما يجعل أعباء العمل المعتادة أقل بنحو 40% من Opus 5.

للمقارنة، يبلغ السعر المعلن لـ Fable 5.1 10/50 دولارًا. يمنحك Opus 5.5 معظم قدرات Fable مقابل 40% من سعره لكل رمز. بل تقول Anthropic إن الفارق بين النموذجين في استخدامها اليومي «أضيق مما توحي به هذه الدرجات».

صار يكتب كإنسان

كان من أكثر الشكاوى شيوعًا حول Opus 5 أن إجاباته صعبة المتابعة: طويلة، ومليئة بالمصطلحات، والفكرة المهمة مدفونة في الفقرة الرابعة. تقول Anthropic إنها عملت على هذا تحديدًا. يبدأ Opus 5.5 بالإجابة، ويختار كلمات أبسط، ويلتزم بقواعد الأسلوب التي تعطيه إياها.

قد يبدو هذا تجميليًا، لكنه ليس كذلك. الإجابة التي تقرؤها في ثلاثين ثانية إجابة تستطيع التحقق منها. أما الإجابة العبقرية التي تحتاج إلى فكّ رموزها، فستمرّ عليها سريعًا وتثق بها ثقة عمياء.

العيب بصراحة

أقصى جهد شَرِه. في أعلى مستوياته يستكشف Opus 5.5 طرقًا كثيرة قبل أن يجيب. قاست Artificial Analysis نحو 119,000 رمز إخراج لكل مهمة بأقصى جهد، مقابل نحو 27,000 لـ GPT-6 Astra. عند هذه الكميات لا يضمن سعر الرمز الأقل فاتورة أقل لكل إجابة. والقاعدة العملية بسيطة: أبقِه على الجهد الافتراضي (المتوسط) في العمل اليومي، حيث تقول Anthropic إنه يتفوق في GDPval على Astra بأقصى جهد مقابل نحو خُمس التكلفة. ولا ترفع المستوى إلا حين تكون المشكلة صعبة فعلًا.

لا يصنع الصور. يقرأ Claude الرسوم البيانية ولقطات الشاشة وملفات PDF الممسوحة ضوئيًا جيدًا جدًا، لكنه لا يولّد صورًا ولا صوتًا ولا فيديو. إن أردت تطبيقًا واحدًا لكل شيء، فما زال ChatGPT أشمل.

بعض الأبواب محروسة. يبلغ Opus 5.5 في الأمن السيبراني وعلم الأحياء درجة من القوة جعلت Anthropic تطبّق عليه ضوابط إضافية. معظم مهام الأمن يتولاها في الخلفية النموذج الأقدم Opus 4.8، وبعض أبحاث الأحياء تتطلب الانضمام إلى برنامج التحقق لدى Anthropic. معظم الناس لن يلاحظوا ذلك أبدًا؛ أما فرق الأمن فستلاحظه.

لمن يناسب

إن كان يومك يتضمن… استخدم لماذا
عقودًا وأبحاثًا وتقارير ونماذج مالية Claude Opus 5.5 أفضل عمل مهني جرى قياسه؛ وإجابات يمكن التحقق منها
«شغّل هذا البرنامج على حاسوبي وأنجز المهمة» GPT-6 Astra وكيل أقوى وأوفر لاستخدام الحاسوب
تطبيقًا واحدًا للمحادثة والصور والصوت ChatGPT أوسع مجموعة ميزات للمستخدم العادي
كميات هائلة من الطلبات البسيطة GPT-6 Luna جزء من السنت لكل مهمة

الحكم للاستخدام اليومي

للرسائل السريعة والأسئلة العابرة يكفي أي مساعد حديث تقريبًا. لكن حين تكون المستندات مبعثرة، والسؤال ملتبسًا، والخطأ مكلفًا، فإن Claude Opus 5.5 هو المساعد الذي نثق به أكثر من غيره – ولأول مرة لا تأتي هذه الثقة بسعر السلع الفاخرة.

02

نقاط القوة والقيود بصراحة

نقاط القوة الرئيسية

  • أقوى نموذج شامل جرى قياسه: منحته Artificial Analysis في سبتمبر 2026 درجة 58 على Intelligence Index بأقصى جهد، أي صدارة الترتيب عند الإطلاق، متقدمًا على GPT-6 Astra وClaude Fable 5.1.
  • عمل مكتبي حقيقي، لا أسئلة امتحان فقط: في GDPval-AA v2.1، الذي يقيّم مخرجات عمل مكتملة من 44 مهنة، يسجّل 1846 Elo مقابل 1735 لـ Fable 5.1 و1708 لـ Opus 5. وفي اختبار أجرته Anthropic كان يجب فيه ردّ كل رقم إلى مصدره، نجح 16 من أصل 18 تقريرًا بحثيًا كتبها؛ بينما لم ينجح Fable 5.1 ولا Opus 5 ولو مرة واحدة.
  • نتائج بمستوى Fable بسعر أقل: 4 دولارات للإدخال و20 دولارًا للإخراج لكل مليون رمز، أي 40% مما يتقاضاه Fable 5.1 (10/50 دولارًا). وانخفضت قراءة الذاكرة المؤقتة – أي إعادة قراءة المستند الطويل نفسه أو الشيفرة نفسها، وهي الجزء الأكبر من فاتورة الوكلاء – بنسبة 60% إلى 0.20 دولار.
  • أسهل في القراءة: أعادت Anthropic بناء أسلوب كتابة النموذج. فهو يبدأ بالخلاصة، ويتجنب المصطلحات المعقدة، ويلتزم بقواعد الأسلوب التي تحددها. أشاد بذلك المختبرون الأوائل في Ramp وDeloitte، وللأمر أهميته: التقرير الذي يمكن تصفّحه بسرعة هو تقرير يمكن التحقق منه.
  • أسرع وأكثر سخاءً: تظهر الإجابات أسرع بأكثر من 30% مقارنة بـ Opus 5، ورفعت Anthropic حدود الخمس ساعات في خطط Pro وMax وTeam وEnterprise القائمة على المقاعد.

قيود صادقة

  • أقصى جهد مكلف: في أعلى مستوياته يستكشف Opus 5.5 مسارات تفكير كثيرة. قاست Artificial Analysis نحو 119,000 رمز إخراج لكل مهمة بأقصى جهد، مقابل نحو 27,000 لـ GPT-6 Astra، فالرمز الأرخص لا يعني تلقائيًا إجابة أرخص. وتُظهر أرقام Anthropic نفسها أن التوفير الحقيقي في مستوى الجهد الافتراضي (المتوسط).
  • لا صور ولا استوديو صوت: يقرأ Claude الصور والرسوم البيانية جيدًا، لكنه لا يولّد صورًا ولا صوتًا ولا فيديو. إن أردت اشتراكًا واحدًا يرسم أيضًا، فما زال ChatGPT المنصة الاستهلاكية الأشمل.
  • الضوابط الأمنية تحوّل بعض الأعمال: لأن Opus 5.5 قوي جدًا في الأمن السيبراني وعلم الأحياء، تُحال معظم مهام الأمن إلى Opus 4.8، وتتطلب بعض أعمال الأحياء الانضمام إلى برنامج التحقق لدى Anthropic. على المتخصصين في الأمن توقّع بعض العوائق إلى حين اعتمادهم.
  • التفكير يعمل دائمًا: يمكنك خفض مستوى الجهد، لكن لم يعد بالإمكان إيقاف التفكير كليًا، ما يضيف قليلًا من الانتظار حتى على الطلبات البسيطة.
03

لمحة عن المعايير

Artificial Analysis Intelligence Index — 58 (الأول عند الإطلاق)

درجة مركّبة مستقلة بأقصى جهد، قيست في سبتمبر 2026، وهي الأعلى في الترتيب عند الإطلاق. تعيد Artificial Analysis معايرة المؤشر من حين لآخر، لذا قارنها فقط بنماذج قيست في الفترة نفسها.

GDPval-AA v2.1 — 1846 Elo

مخرجات مهنية حقيقية من 44 مهنة تقيّمها Artificial Analysis. في جدول إطلاق Anthropic يسجّل Fable 5.1 1735، وOpus 5 1708، وGPT-6 Astra 1542.

Humanity's Last Exam — 67.7% مع الأدوات

رقم Anthropic عند الإطلاق مع تفعيل الأدوات. في الجدول نفسه يسجّل Fable 5.1 نسبة 65.6% وGPT-6 Astra نسبة 57.2%. أسئلة صعبة متعددة التخصصات كتبها خبراء.

OSWorld 2.0 — 81.8% (درجات جزئية)

رقم Anthropic لتشغيل سطح مكتب حقيقي: النقر والكتابة والتنقل بين التطبيقات. يُحتسب بدرجات جزئية، لذا لا يُقارن مباشرة بأرقام OpenAI للمهام المنجزة كاملة.

السعر — 4/20 دولارًا لكل مليون رمز، و0.20 دولار لقراءة الذاكرة المؤقتة

أقل بـ 20% من Opus 5 في الرموز وبـ 60% في قراءة الذاكرة المؤقتة. تقدّر Anthropic أن التكلفة في أعباء العمل المعتادة أقل بنحو 40% لأن النموذج يستهلك رموزًا أقل أيضًا عند الجهد الافتراضي. أما الوضع السريع فيكلّف 8/40 دولارًا.

04

الحكم

يحتل Claude Opus 5.5 المركز الأول لدينا في فئة المنظومة اليومية لأنه يجمع ثلاثة أمور: أفضل درجة ذكاء مستقلة عند الإطلاق، وأفضل نتيجة في العمل المهني الحقيقي، وسعرًا يجعل حكمًا بمستوى Fable عمليًا أخيرًا للعمل اليومي. ليس تطبيقًا يفعل كل شيء: ما زال ChatGPT يرسم الصور، وما زال GPT-6 Astra يشغّل البرامج بكفاءة أعلى. لكن حين تكون المهمة قراءة شيء طويل ومبعثر، والتفكير فيه بعناية، وتقديم إجابة يمكنك التحقق منها، فإن Opus 5.5 هو أول ما نلجأ إليه. أبقِه على الجهد الافتراضي، واحتفظ بأقصى جهد للمشكلات التي تستحقه.

05

الأسئلة الشائعة