الترتيب #4 المنظومة اليومية — مساعدات الذكاء الاصطناعي الرائدة
Anthropic

Claude Sonnet 5.5

Claude Sonnet 5.5 هو المساعد المناسب لأسبوع العمل العادي: تلخيص المستندات، وبناء جداول البيانات والعروض التقديمية، وصياغة التقارير. في الاختبارات المستقلة للعمل المكتبي يقترب من Opus 5.5 إلى حدود نقطة أو نقطتين، ومتاح ضمن الخطة المجانية لـ Claude، ورموزه في الواجهة البرمجية بنصف السعر. لكن Opus يعرف حقائق أكثر ويتعامل مع المشكلات المعقدة فعلًا بشكل أفضل.

تم التحديث 29 سبتمبر 2026 Knowledge WorkFreemium1M Context
الأفضل لـ

Claude Sonnet 5.5 هو المساعد المناسب لأسبوع العمل العادي: تلخيص المستندات، وبناء جداول البيانات والعروض التقديمية، وصياغة التقارير. في الاختبارات المستقلة للعمل المكتبي يقترب من Opus 5.5 إلى حدود نقطة أو نقطتين، ومتاح ضمن الخطة المجانية لـ Claude، ورموزه في الواجهة البرمجية بنصف السعر. لكن Opus يعرف حقائق أكثر ويتعامل مع المشكلات المعقدة فعلًا بشكل أفضل.

لماذا تفوز

يسجّل 56 نقطة في مؤشر الذكاء المستقل من Artificial Analysis عند مستوى max، خلف Opus 5.5 (58) بنقطتين. وقاست Artificial Analysis أيضًا 1844 Elo في GDPval-AA v2.1 (مقابل 1846 لـ Opus 5.5) و1811 في AA-Briefcase (مقابل 1822 لـ Opus 5.5). وحين لا يعرف الإجابة، يختلقها أقل مما يفعل Opus 5.5. سعر رموز الواجهة البرمجية $2/$10، ويصل الإخراج أسرع من Sonnet 5 بأكثر من 30%.

انتبه إلى

يعرف حقائق أقل من Opus 5.5 (54% مقابل 66% من الإجابات الصحيحة في اختبار المعرفة لدى Artificial Analysis)، لذا تحقّق من التفاصيل غير الشائعة. وعند مستوى max ينتج نصًا أكثر من أي نموذج قاسته Artificial Analysis، ما يجعل max مكلفًا وبطيئًا. ولا يولّد صورًا أو صوتًا أو فيديو، وتُحال طلبات الأمن الأعلى خطورة إلى Sonnet 5 الأقدم.

01

ما هو في الواقع

تخيّل مكتبًا فيه شخصان متمرّسان. الأولى هي الشريكة التي تستدعيها إلى الاجتماع حين تكون القضية غير مألوفة والرهان كبيرًا. والثاني هو الزميل الذي ينجز كومة الأسبوع، أربعين رسالة وثلاثة جداول بيانات وعرضًا تقديميًا ليوم الخميس، بسرعة وإتقان.

معظمنا يحتاج إلى الشخص الثاني أكثر بكثير من الأول. Claude Sonnet 5.5 هو ذلك الزميل.

أطلقته Anthropic في 28 سبتمبر 2026، بعد أسبوع من Claude Opus 5.5، بوصفه النموذج الثاني في عائلة Claude 5.5. وهو مصمم ليكون الرفيق اليومي لـ Opus. وبعبارة Anthropic، صُنع Opus للعمل المعقد الذي يتطلب حكمًا دقيقًا، بينما يكون Sonnet 5.5 في أقوى حالاته مع المهام اليومية محددة النطاق، وإصلاح الأخطاء، وإعداد المستندات والعروض وجداول البيانات المتقنة.

إلى أي حد يقترب من Opus؟

أكثر مما قد تتوقع، على الأقل في الاختبارات المستقلة.

تجري Artificial Analysis اختبارين يدوران حول العمل المهني المكتمل لا حول أسئلة المسابقات. في GDPval-AA v2.1 تنتج النماذج مخرجات حقيقية، مثل نموذج مالي أو مذكرة قانونية أو إحاطة، وتُقارن النتائج وجهًا لوجه كما في مباريات الشطرنج. سجّل Sonnet 5.5 1844 Elo، وحصل Opus 5.5 على 1846، وهو فارق أصغر من أن يُعتدّ به. وفي اختبار AA-Briefcase الأحدث، الذي يقيس العمل المعرفي الأطول متعدد الخطوات، سجّل 1811 مقابل 1822 لـ Opus.

وأوسع مقياس مستقل هو مؤشر الذكاء من Artificial Analysis، وهو نتيجة مركّبة من تقييمات صعبة. عند مستوى max سجّل Sonnet 5.5 56 نقطة، ولم يتقدم عليه سوى Opus 5.5 بـ 58.

هذه قفزة كبيرة لنموذج من فئة Sonnet. فسلفه Sonnet 5 سجّل 1449 في GDPval-AA. وعمليًا يعني ذلك أن العمل المكتبي الذي كان يحتاج إلى النموذج الرائد يمكن أن يذهب الآن إلى النموذج الأرخص والأسرع.

أين يبقى Opus متقدمًا

هناك مجالان يكون فيهما الفارق حقيقيًا.

الحقائق. يطرح اختبار AA-Omniscience من Artificial Analysis آلاف الأسئلة عن الحقائق. أجاب Sonnet 5.5 إجابة صحيحة عن 54% منها، وOpus 5.5 عن 66%. فالنموذج الأصغر يختزن معرفة أقل ببساطة. لكن هناك جانبًا مشرقًا: حين لم يعرف Sonnet 5.5 الإجابة، اختلق واحدة في 47% من الحالات، مقابل 59% لـ Opus 5.5. إنه يعرف أقل، لكنه أكثر استعدادًا للاعتراف بذلك. ومع هذا، إن احتجت إلى تاريخ غير شائع أو اسم أو إحصاء، فاطلب منه البحث في الويب أو ذكر مصدر.

الحكم. هنا تتحدث Anthropic بصراحة غير معتادة. ففي عدة اختبارات يؤدي Sonnet 5.5 عند مستوى max أداءً مماثلًا لـ Opus 5.5. لكن في اختبارات Anthropic نفسها واختبارات المختبرين الخارجيين يبقى Opus 5.5 أقوى بوضوح في العمل المعقد المفتوح الذي يتطلب حكمًا متواصلًا. وإن لم يكن للسؤال إطار واضح، كقرار استراتيجي أو عقد ببنود غير مألوفة، فهو لا يزال من اختصاص Opus.

فيمَ يتفوق

تبرز Anthropic المستندات والتلخيصات وجداول البيانات والعروض التقديمية، وتقول إن لدى النموذج حسًّا مرهفًا بالتصميم: إذ يستطيع اتباع قالب الشرائح بدقة تجعل التعديل اللاحق قليلًا جدًا. وقد تحسّنت قراءته للرسوم البيانية تحسنًا كبيرًا. ففي اختبار Chartography من Anthropic، الذي يطلب قراءة القيم من الرسوم البيانية دون أدوات، سجّل 61.6% مقابل 15.6% لـ Sonnet 5.

وهو سريع أيضًا. تقول Anthropic إن الإخراج يصل أسرع من Sonnet 5 بأكثر من 30%، وقد لاحظ المختبرون الأوائل ذلك: تقول Zendesk إن تذاكر الدعم عولجت أسرع بنسبة 20%، وقاست Box سرعة تبلغ 2.4 ضعف الإصدار السابق.

ويستطيع كذلك تشغيل الحاسوب. ففي OSWorld 2.1، حيث ينقر النموذج ويكتب ليشق طريقه عبر تطبيقات سطح مكتب حقيقية، تعلن Anthropic عن 80.1% بنظام الدرجات الجزئية، قريبًا من 81.8% لـ Opus 5.5.

اترك المؤشر في المنتصف

لدى Sonnet 5.5 خمسة مستويات جهد: low وmedium وhigh وxhigh وmax. وتستخدم تطبيقات Claude مستوى medium افتراضيًا. هذا ما قاسته Artificial Analysis عند كل مستوى:

مستوى الجهد مؤشر الذكاء تكلفة المهمة
Low 36 $0.41
Medium 41 $0.59
High 47 $1.08
Xhigh 52 $2.74
Max 56 $7.60

الدرجة الأخيرة هي المكلفة. فعند max كتب Sonnet 5.5 نحو 193,000 رمز إخراج لكل مهمة، وهو أعلى رقم قاسته Artificial Analysis على الإطلاق، وأكثر بنحو 60% من Opus 5.5 عند max. بالنسبة إلى معظم مستخدمي تطبيق Claude يعني هذا ببساطة انتظارًا أطول. أما للمطورين الذين يدفعون لكل رمز، فيعني أن Sonnet المدفوع إلى أقصاه لم يعد الخيار الرخيص. وإن احتاجت مهمة إلى هذا القدر من التفكير، فهي تستحق Opus عادةً.

العيب بصراحة

لا صور. يقرأ Claude لقطات الشاشة والرسوم البيانية وملفات PDF الممسوحة ضوئيًا جيدًا، لكنه لا يولّد صورًا أو صوتًا أو فيديو. وإن أردت تطبيقًا واحدًا يرسم ويتحدث أيضًا، فإن ChatGPT وGemini أشمل.

سعر الرمز ليس سعر المهمة. تكلف الرموز ما كانت تكلفه في Sonnet 5: دولاران لكل مليون رمز إدخال و10 دولارات لكل مليون رمز إخراج. وتقول Anthropic إن المهام المعتادة تكلف أقل بما يصل إلى 30% لأن النموذج ينجز العمل بخطوات أقل. هذا صحيح عند الإعدادات العادية؛ أما عند max، فكما يُظهر الجدول، ترتفع الفاتورة بسرعة.

بعض الطلبات محروسة. Sonnet 5.5 هو أول نموذج Sonnet يُطرح بضوابط الأمن السيبراني الأشد التي تطبقها Anthropic على أقوى نماذجها. وتُحال طلبات الأمن الأعلى خطورة إلى Sonnet 5 بشكل ظاهر للمستخدم. ولن يصادف ذلك أحد تقريبًا.

لمن يناسب

إن كان يومك يتضمن… استخدم لماذا
رسائل وتلخيصات وجداول بيانات وعروضًا تقديمية Claude Sonnet 5.5 عمل مكتبي قريب من مستوى Opus، وسريع، ومتاح في الخطة المجانية
قرارات عالية المخاطر وحقائق غير شائعة وبحثًا معقدًا Claude Opus 5.5 معرفة أكثر وحكم أقوى بوضوح
«شغّل هذا البرنامج على حاسوبي وأنجز المهمة» GPT-6 Astra وكيل أقوى وأوفر لاستخدام الحاسوب
تطبيقًا واحدًا للدردشة والصور والصوت ChatGPT أو Gemini صندوق أدوات إبداعي أوسع

الحكم للاستخدام اليومي

لن يحل Claude Sonnet 5.5 محل Opus في أصعب الأسئلة، ولا تدّعي Anthropic ذلك. لكن أصعب الأسئلة لا تشغل إلا جزءًا صغيرًا من معظم الأسابيع. وفي كل ما عداها، هو سريع وقادر ومتاح ضمن الخطة المجانية لـ Claude، وبسعر لا يستدعي التفكير فيه. اتركه على الإعداد الافتراضي، وتحقّق من الحقائق غير الشائعة، واستدعِ Opus حين يرتفع الرهان.

02

نقاط القوة والقيود بصراحة

نقاط القوة الرئيسية

  • قريب من النموذج الرائد في العمل الحقيقي: تجري Artificial Analysis اختبارين قائمين على مخرجات مهنية مكتملة. حصل Sonnet 5.5 على 1844 Elo في GDPval-AA v2.1 مقابل 1846 لـ Opus 5.5، وعلى 1811 في اختبار AA-Briefcase طويل المدى مقابل 1822. في العمل المكتبي اليومي يكاد الاثنان يتساويان.
  • الثاني في أوسع مؤشر مستقل: عند مستوى max يسجّل 56 نقطة في مؤشر الذكاء من Artificial Analysis، ولا يتقدم عليه سوى Opus 5.5 بـ 58. وحتى عند مستوى High المناسب للاستخدام اليومي يصل إلى 47 نقطة بنحو دولار واحد للمهمة.
  • يقول «لا أعرف» أكثر: في اختبار المعرفة AA-Omniscience اختلق Sonnet 5.5 إجابة في 47% من الأسئلة التي لم يستطع الإجابة عنها بشكل صحيح، مقابل 59% لـ Opus 5.5، فهو أكثر استعدادًا للاعتراف بعدم اليقين.
  • مصنوع للمستندات والعروض وجداول البيانات: تقول Anthropic إنه في أقوى حالاته مع المهام اليومية محددة النطاق والمستندات المتقنة، ولديه حس مرهف بالتصميم. كما يقرأ الرسوم البيانية أفضل بكثير من Sonnet 5: 61.6% في اختبار Chartography من Anthropic مقابل 15.6%.
  • سريع ومتاح على نطاق واسع وأرخص للمطورين: يصل الإخراج أسرع من Sonnet 5 بأكثر من 30%. ويمكن لأي شخص استخدامه في تطبيقات Claude على الويب والهاتف، بما في ذلك الخطة المجانية، ويدفع المطورون $2/$10 لكل مليون رمز، أي نصف سعر Opus 5.5، عبر واجهة Anthropic البرمجية وAWS وGoogle Cloud وMicrosoft Azure.

قيود صادقة

  • معرفة مخزّنة أقل: في AA-Omniscience أجاب إجابة صحيحة عن 54% من أسئلة المعرفة، مقابل 66% لـ Opus 5.5. في الأسماء أو التواريخ أو الأرقام غير الشائعة، اطلب منه البحث في الويب أو ذكر مصدر.
  • مستوى max لا يستحق: قاست Artificial Analysis نحو 193,000 رمز إخراج لكل مهمة عند max، وهو أعلى رقم سجّلته، وتتضاعف تكلفة المهمة ثلاث مرات تقريبًا بين xhigh وmax. مكان العمل اليومي هو الإعدادات الافتراضية.
  • يبقى Opus الفائز في الحالات الصعبة: تقول Anthropic إن Opus 5.5 يبقى أقوى بوضوح في العمل المعقد المفتوح الذي يتطلب حكمًا متواصلًا، مثل العقد الملتبس أو السؤال الاستراتيجي الذي لا إطار واضحًا له.
  • لا صور ولا استوديو صوت: يقرأ Claude الصور والرسوم البيانية، لكنه لا يولّد صورًا أو صوتًا أو فيديو. ويبقى ChatGPT وGemini صندوقَي أدوات أشمل.
  • تُحال بعض طلبات الأمن: يأتي Sonnet 5.5 بضوابط Anthropic الأشد في الأمن السيبراني، وتُحال مهام الأمن الأعلى خطورة إلى Sonnet 5 بشكل ظاهر للمستخدم. معظم الناس لن يلاحظوا ذلك أبدًا.
03

لمحة عن المعايير

مؤشر الذكاء من Artificial Analysis — 56 (مستوى max)

نتيجة مركّبة مستقلة من تقييمات صعبة، قيست في سبتمبر 2026. عند الإطلاق لم يتقدم عليه سوى Opus 5.5 (58). بحسب مستوى الجهد: low 36، وmedium 41، وhigh 47، وxhigh 52، وmax 56.

GDPval-AA v2.1 — 1844 Elo

مخرجات مهنية حقيقية من مهن كثيرة، تجريها Artificial Analysis. يحصل Opus 5.5 على 1846 وSonnet 5 على 1449.

AA-Briefcase v1.1 — 1811 Elo

الاختبار الأحدث لدى Artificial Analysis للعمل المعرفي الطويل متعدد الخطوات. يحصل Opus 5.5 على 1822 وSonnet 5 على 1359.

AA-Omniscience — دقة 54% ومعدل هلوسة 47%

اختبار معرفة مستقل. يجيب Opus 5.5 عن أسئلة أكثر بشكل صحيح (66%)، لكنه يختلق أكثر حين يخطئ (59%). معدل الهلوسة الأقل أفضل.

OSWorld 2.1 — 80.1% (بدرجات جزئية)

رقم Anthropic لتشغيل سطح مكتب حقيقي. يسجّل Opus 5.5 نسبة 81.8% وSonnet 5 نسبة 57.0% بنظام الدرجات الجزئية نفسه.

السعر — $2 / $10 لكل مليون رمز

دون تغيير عن Sonnet 5، ونصف سعر Opus 5.5. قاست Artificial Analysis تكلفة المهمة من $0.41 عند low إلى $7.60 عند max.

04

الحكم

Claude Sonnet 5.5 هو المساعد الذي يستطيع معظم الناس استخدامه يوميًا دون التفكير في التكلفة: قريب من Opus 5.5 في الاختبارات المستقلة للعمل المكتبي، ومتاح ضمن الخطة المجانية لـ Claude، وبنصف سعر الواجهة البرمجية. يأتي بعد Opus 5.5 لأنه يعرف حقائق أقل بشكل ملحوظ، ولأنه باعتراف Anthropic نفسها أضعف في المسائل المفتوحة التي تتطلب حكمًا؛ ويأتي بعد GPT-6 Astra وFable 5.1 لأنهما يتصدران في تشغيل الحاسوب والبحث الطويل. للتلخيصات وجداول البيانات والعروض والتقارير، هو الخيار الافتراضي المعقول.

05

الأسئلة الشائعة