معظم مساعدي الذكاء الاصطناعي يتصرفون كمتدرّب سريع جدًا: يجيبون فورًا وبثقة. أعطِهم عقد إيجار من أربعين صفحة، فيعيدون إليك ملخصًا أنيقًا يتجاوز تمامًا البند المهم في الصفحة 37.
أما Claude Opus 5.5 فيشبه الزميلة الخبيرة التي تقرأ المستند كله أولًا، ثم تخبرك في جملتين أين المشكلة وأين تجدها.
أطلقت Anthropic نموذج Opus 5.5 في 22 سبتمبر 2026 بوصفه أول نماذج عائلة Claude 5.5. ويحتل المركز الأول لدينا في فئة المنظومة اليومية لسبب بسيط: إنه أفضل نموذج نستطيع قياسه في التفكير المتأني، ولم يعد سعره سعر سلعة فاخرة.
ماذا تقول الاختبارات المستقلة
يقوم معظم الحكم هنا على رقمين، وكلاهما من Artificial Analysis، لا من الحملات التسويقية لـ Anthropic.
الأول هو Artificial Analysis Intelligence Index، وهو درجة تجمع عشرة اختبارات صعبة في التفكير المنطقي والعلوم والبرمجة والمعرفة. بأقصى جهد، سجّل Opus 5.5 درجة 58 في سبتمبر 2026. كانت تلك صدارة الترتيب عند الإطلاق، متقدمًا على GPT-6 Astra وعلى نموذج Anthropic الأعلى نفسه، Claude Fable 5.1. (يُعاد ضبط مقياس المؤشر من حين لآخر، لذا لا تكون للدرجة قيمة إلا بمقارنتها بنماذج قيست في الفترة نفسها.)
الثاني هو GDPval-AA v2.1، وهو أقرب إلى الحياة الواقعية. فبدل أسئلة الاختبارات، تُنتج النماذج مخرجات عمل حقيقية – نموذجًا في جدول بيانات، أو مذكرة قانونية، أو ملخصًا للإدارة – من 44 مهنة، ثم تُقارن النتائج وجهًا لوجه كما يُصنَّف لاعبو الشطرنج. سجّل Opus 5.5 1846 Elo، مقابل 1735 لـ Fable 5.1، و1708 لـ Opus 5، و1542 لـ GPT-6 Astra.
وتشير اختبارات Anthropic الداخلية إلى الاتجاه نفسه. في أحدها كتبت ثلاثة نماذج تقريرًا عن النتائج الفصلية لشركة ما، مستعينة بنسخة من الإنترنت يصعب فيها العثور على بيان الأرباح، وكان أي رقم أو اقتباس مختلَق يعني الرسوب. نجح Opus 5.5 في 16 مرة من أصل 18، بينما لم ينجح Fable 5.1 ولا Opus 5 ولو مرة واحدة. هذا بالضبط ما نريده من المساعد: ألا يكون ذكيًا فحسب، بل حذرًا فيما يدّعيه.
حكاية السعر كما هي
ربما قرأت أن Opus 5.5 «أرخص بنسبة 40%». هذا صحيح، لكن من المفيد أن تفهم مصدر هذا الرقم.
- انخفض سعر الرموز 20%: 4 دولارات لكل مليون رمز إدخال و20 دولارًا لكل مليون رمز إخراج، بدل 5 و25.
- انخفضت قراءة الذاكرة المؤقتة 60%: إلى 0.20 دولار لكل مليون. حين تطرح سؤالًا تلو الآخر عن المستند الطويل نفسه، يعيد النموذج قراءته من ذاكرة مؤقتة، وهذه القراءة المتكررة هي الجزء الأكبر من فاتورة الوكلاء وأدوات البرمجة.
- يستهلك رموزًا أقل عند الجهد الافتراضي: وتقول Anthropic إن هذا ما يجعل أعباء العمل المعتادة أقل بنحو 40% من Opus 5.
للمقارنة، يبلغ السعر المعلن لـ Fable 5.1 10/50 دولارًا. يمنحك Opus 5.5 معظم قدرات Fable مقابل 40% من سعره لكل رمز. بل تقول Anthropic إن الفارق بين النموذجين في استخدامها اليومي «أضيق مما توحي به هذه الدرجات».
صار يكتب كإنسان
كان من أكثر الشكاوى شيوعًا حول Opus 5 أن إجاباته صعبة المتابعة: طويلة، ومليئة بالمصطلحات، والفكرة المهمة مدفونة في الفقرة الرابعة. تقول Anthropic إنها عملت على هذا تحديدًا. يبدأ Opus 5.5 بالإجابة، ويختار كلمات أبسط، ويلتزم بقواعد الأسلوب التي تعطيه إياها.
قد يبدو هذا تجميليًا، لكنه ليس كذلك. الإجابة التي تقرؤها في ثلاثين ثانية إجابة تستطيع التحقق منها. أما الإجابة العبقرية التي تحتاج إلى فكّ رموزها، فستمرّ عليها سريعًا وتثق بها ثقة عمياء.
العيب بصراحة
أقصى جهد شَرِه. في أعلى مستوياته يستكشف Opus 5.5 طرقًا كثيرة قبل أن يجيب. قاست Artificial Analysis نحو 119,000 رمز إخراج لكل مهمة بأقصى جهد، مقابل نحو 27,000 لـ GPT-6 Astra. عند هذه الكميات لا يضمن سعر الرمز الأقل فاتورة أقل لكل إجابة. والقاعدة العملية بسيطة: أبقِه على الجهد الافتراضي (المتوسط) في العمل اليومي، حيث تقول Anthropic إنه يتفوق في GDPval على Astra بأقصى جهد مقابل نحو خُمس التكلفة. ولا ترفع المستوى إلا حين تكون المشكلة صعبة فعلًا.
لا يصنع الصور. يقرأ Claude الرسوم البيانية ولقطات الشاشة وملفات PDF الممسوحة ضوئيًا جيدًا جدًا، لكنه لا يولّد صورًا ولا صوتًا ولا فيديو. إن أردت تطبيقًا واحدًا لكل شيء، فما زال ChatGPT أشمل.
بعض الأبواب محروسة. يبلغ Opus 5.5 في الأمن السيبراني وعلم الأحياء درجة من القوة جعلت Anthropic تطبّق عليه ضوابط إضافية. معظم مهام الأمن يتولاها في الخلفية النموذج الأقدم Opus 4.8، وبعض أبحاث الأحياء تتطلب الانضمام إلى برنامج التحقق لدى Anthropic. معظم الناس لن يلاحظوا ذلك أبدًا؛ أما فرق الأمن فستلاحظه.
لمن يناسب
| إن كان يومك يتضمن… | استخدم | لماذا |
|---|---|---|
| عقودًا وأبحاثًا وتقارير ونماذج مالية | Claude Opus 5.5 | أفضل عمل مهني جرى قياسه؛ وإجابات يمكن التحقق منها |
| «شغّل هذا البرنامج على حاسوبي وأنجز المهمة» | GPT-6 Astra | وكيل أقوى وأوفر لاستخدام الحاسوب |
| تطبيقًا واحدًا للمحادثة والصور والصوت | ChatGPT | أوسع مجموعة ميزات للمستخدم العادي |
| كميات هائلة من الطلبات البسيطة | GPT-6 Luna | جزء من السنت لكل مهمة |
الحكم للاستخدام اليومي
للرسائل السريعة والأسئلة العابرة يكفي أي مساعد حديث تقريبًا. لكن حين تكون المستندات مبعثرة، والسؤال ملتبسًا، والخطأ مكلفًا، فإن Claude Opus 5.5 هو المساعد الذي نثق به أكثر من غيره – ولأول مرة لا تأتي هذه الثقة بسعر السلع الفاخرة.