الترتيب #5 المنظومة اليومية — مساعدات الذكاء الاصطناعي الرائدة
OpenAI

GPT-6.1 Sol

إن نموذج GPT-6.1 Sol هو نموذج العمل اليومي من OpenAI: النموذج الذي توكل إليه تقاريرك وملفات PDF والمهام المتعددة الخطوات في ChatGPT Work. في الاختبارات المستقلة، جاء في مرتبة متأخرة بنقطة واحدة فقط عن نموذج GPT-6 Astra، النموذج الرائد لشركة OpenAI، لكنه يكلف أقل من ربع التكلفة للمهمة العادية. يقرأ المستندات الطويلة بشكل جيد ويرتكب أخطاء واقعية أقل من النموذج الذي يحل محله. ووفقًا لـ OpenAI، يمكنه أيضًا تشغيل تطبيقات سطح المكتب بكفاءة تقارب Astra.

تم التحديث 30 سبتمبر 2026 Near-Astra ValueChatGPT WorkDocument Work
الأفضل لـ

إن نموذج GPT-6.1 Sol هو نموذج العمل اليومي من OpenAI: النموذج الذي توكل إليه تقاريرك وملفات PDF والمهام المتعددة الخطوات في ChatGPT Work. في الاختبارات المستقلة، جاء في مرتبة متأخرة بنقطة واحدة فقط عن نموذج GPT-6 Astra، النموذج الرائد لشركة OpenAI، لكنه يكلف أقل من ربع التكلفة للمهمة العادية. يقرأ المستندات الطويلة بشكل جيد ويرتكب أخطاء واقعية أقل من النموذج الذي يحل محله. ووفقًا لـ OpenAI، يمكنه أيضًا تشغيل تطبيقات سطح المكتب بكفاءة تقارب Astra.

لماذا تفوز

في 29 سبتمبر 2026، منحه تقييم Artificial Analysis 52 نقطة على مؤشر الذكاء الخاص به، أي أقل بنقطة واحدة من GPT-6 Astra (53)، بتكلفة 0.72 دولار للمهمة مقابل 3.26 دولار. وتشير OpenAI إلى أنه يتفوق على Claude Opus 5.5 في اختبار GDP.pdf (أسئلة حول ملفات PDF مهنية معقدة) بأقل من نصف التكلفة، ويقترب بفارق 2.1 نقطة من Astra في اختبار OSWorld 2.0 (تشغيل أنظمة سطح المكتب) بحوالي سبع التكلفة.

انتبه إلى

لم يتوفر بعد في محادثات ChatGPT العادية. ستحتاج إلى خطة مدفوعة واستخدام ChatGPT Work أو Codex. في اختبار المعرفة الخاص بـ Artificial Analysis، لا يزال النموذج يختلق الإجابات في 54% من الحالات عندما لا يعرف الإجابة. كما يسجل Claude Opus 5.5 و Sonnet 5.5 درجات أعلى على نفس المؤشر المستقل، والنموذج يقرأ الصور لكنه لا يصنعها بنفسه.

01

ما هو في الواقع

تخيل شركة محاماة جيدة. الشريك الأول بارع ويُصدر فواتيره بناءً على ذلك. لن تطلب منه أبداً مراجعة مائتي صفحة من عقود الموردين بحثاً عن بند فسخ العقد. ستُسلم هذه المهمة إلى محامٍ مساعد موثوق، شخصٌ يقاربه في الفطنة وأرخص منه بكثير.

نموذج GPT-6.1 Sol هو ذلك المحامي المساعد. إنه ليس النموذج الأكثر قوة لدى OpenAI، لكنه يقترب منه كثيراً، وهو النموذج الذي يمكنك تحمل تكلفة استخدامه لمعظم أعمالك الأسبوعية.

ما هو وأين تجده

أطلقت OpenAI نموذج GPT-6.1 Sol في 29 سبتمبر 2026 ضمن حدث DevDay، وذلك بعد أسبوع واحد من إصدار GPT-6 Sol. وتصفه OpenAI بأنه يوفر ذكاءً يقارب مستوى Astra للبرمجة واستخدام الحاسوب والأعمال المهنية، وبخُمس سعر نموذجها الرائد GPT-6 Astra.

مكان استخدامه هو ما يهم معظم المستخدمين. داخل تطبيق ChatGPT، يتواجد GPT-6.1 Sol في ChatGPT Work و Codex، وهي الأقسام المصممة للمهام الطويلة والملفات والوكلاء. إنه متوفر في خطط Plus و Pro و Business و Enterprise و Edu. وهو غير متوفر بعد في الدردشة العادية، ولا يشمله الاشتراك المجاني. يمكن للمطورين استخدامه عبر واجهة برمجة التطبيقات تحت اسم gpt-6.1-sol، وقد تمت إضافته إلى أدوات برمجة مثل Devin من Cognition في يوم الإطلاق.

ما مدى قربه من النموذج الرائد؟

أجرت شركة الاختبارات المستقلة Artificial Analysis تقييماتها يوم الإطلاق. يجمع مؤشر الذكاء الخاص بها بين عشر تقييمات صعبة، تتراوح من العمل المكتبي وأتمتة الأعمال إلى البرمجة العلمية والمعرفة الواقعية. سجل GPT-6.1 Sol 52 نقطة. بينما سجل GPT-6 Astra 53 نقطة، وحصل GPT-6 Sol الصادر الأسبوع الماضي على 48 نقطة. هذا يضع GPT-6.1 Sol في المركز العاشر من بين 222 نموذجاً تم ترتيبهم في الجدول.

الآن لنتأمل السعر. حسبت Artificial Analysis التكلفة بحوالي 0.72 دولار لتنفيذ مهمة من مهام المؤشر الخاص بها باستخدام GPT-6.1 Sol، مقابل 3.26 دولار لنموذج Astra. أي بتكلفة تقل عن الربع مقابل قدرة تقل بنقطة واحدة فقط.

وللإنصاف، لا تزال نماذج Anthropic تتصدر هذا المؤشر. سجل Claude Opus 5.5 ‏58 نقطة وسجل Claude Sonnet 5.5 ‏56 نقطة. ولكن تحقيق هذه الدرجات يكلف أكثر بكثير: 5.98 دولار و 7.60 دولار لكل مهمة على التوالي.

ما يميزه في يوم العمل

تركز اختبارات الإطلاق من OpenAI على نوعية العمل التي تملأ أسبوع العمل المكتبي. تذكر أن هذه الأرقام مقدمة من OpenAI نفسها.

  • قراءة ملفات PDF المعقدة. في اختبار GDP.pdf، يُجيب النموذج على أسئلة حول مستندات حقيقية من مجالات التمويل والقانون والرعاية الصحية وسبعة مجالات أخرى، مليئة بالجداول المكدسة والرسوم البيانية والنصوص الدقيقة. يعرض جدول OpenAI نسبة 32.0% بجهد عالٍ (High Effort) مقابل 0.35 دولار للمهمة. يبلغ أفضل أداء لـ Claude Opus 5.5 نسبة 28.8% مقابل 0.83 دولار، وأفضل أداء لـ GPT-6 Astra نسبة 32.2% مقابل 1.91 دولار. بالتالي، يكاد Sol يطابق النموذج الرائد بخُمس السعر.
  • المهام الروتينية متعددة الخطوات. في AutomationBench، يُكمل الوكيل مهام كاملة عبر 47 أداة أعمال، مثل تحديث نظام CRM وإرسال تذكرة وكتابة رسالة متابعة. على مستوى الجهد المتوسط، يحقق GPT-6.1 Sol 31.7% مقابل 0.19 دولار للمهمة، متفوقاً بـ 2.2 نقطة على Claude Opus 5.5 بنفس الإعداد. لكن يجب قراءة الجدول كاملاً: فعند مستوى الجهد الأقصى، يصل Opus 5.5 إلى 42.5% و Astra إلى 41.4%، بينما يتوقف Sol عند 36.1%. يتفوق Sol من حيث التكلفة في المهام الروتينية؛ في حين لا تزال النماذج الأغلى تُنجز قدراً أكبر من المهام الأكثر صعوبة.
  • استخدام الكمبيوتر. في OSWorld 2.0، يقوم النموذج بالنقر والكتابة عبر تطبيقات سطح المكتب الفعلية. تعلن OpenAI عن 71.4% مقابل 1.27 دولار للمهمة، مقارنة بـ 73.5% لنموذج Astra مقابل 9.44 دولار.

حقائق مخترعة أقل، ولكنها ليست معدومة

اختبرت OpenAI الدقة الواقعية باستخدام أسئلة صعبة عن قصد مستمدة من محادثات حقيقية حيث حدد المستخدمون أخطاءً لنموذج سابق. على مستوى الجهد المنخفض، انخفضت نسبة الإجابات التي تحتوي على أخطاء واقعية من 11.4% إلى 7.7% مقارنة بنموذج GPT-6 Sol، وهو انخفاض بنسبة الثلث تقريباً.

إلا أن اختبار المعرفة المستقل من Artificial Analysis يُقدم صورة أكثر واقعية. عندما لا يعرف GPT-6.1 Sol إجابة معينة، فإنه لا يزال يختلقها في 54% من الحالات. هذا أفضل من 60% الخاصة بـ GPT-6 Sol، ولكنه أسوأ من 47% الخاصة بـ Claude Sonnet 5.5. لا تتغير النصيحة العملية: عند السؤال عن اسم أو تاريخ أو رقم غير معروف، اطلب منه البحث على الويب أو الاستشهاد بمصدر.

كلمة عن نموذج Astra الذي لم يصدر

لم يكن GPT-6.1 Sol النموذج الوحيد الذي خططت OpenAI لإطلاقه في DevDay. ففي اليوم السابق، ألغت الشركة GPT-6.1 Astra بعد أن أظهرت الاختبارات الداخلية أن النموذج لم يلتزم بنطاق وأذونات المهام الموكلة إليه بشكل موثوق. يُعد GPT-6.1 Sol نموذجاً منفصلاً يمتلك تقرير أمان خاص به. ففي إحدى تجارب OpenAI، تم تعطيل أداة بحث الوكيل سراً، وكان يتعين على النموذج الإشارة إلى ذلك بدلاً من التخمين. فشل GPT-6.1 Sol في الكشف عن المشكلة في 2.1% من الحالات، مقارنة بـ 4.9% لـ GPT-6 Sol و 1.5% لـ GPT-6 Astra. يُعتبر هذا تحسناً حقيقياً، وإن لم يكن ضماناً لكل موقف.

القيد الصريح

يتطلب الدفع ويوجد في علامة تبويب منفصلة. بالنسبة لنموذج يستهدف العمل اليومي، يُعد الوصول إليه هو أكبر قيد: فلا توجد خطة مجانية ولا يتوفر في الدردشة العادية، بل يوجد فقط في ChatGPT Work و Codex ضمن الخطط المدفوعة.

يقرأ الصور لكنه لا يرسم. يتلقى GPT-6.1 Sol كلاً من النصوص والصور كمدخلات ويعيد نصوصاً. لا يُولد النموذج الصور أو الصوت أو الفيديو بنفسه.

Claude لا يزال يتقدم في المؤشر العام. إذا كنت تبحث عن أعلى الدرجات المستقلة بغض النظر عن التكلفة، فإن Claude Opus 5.5 و Sonnet 5.5 هما الأفضل. وتتمثل ميزة GPT-6.1 Sol في تقديم أداء متقارب بتكلفة أقل بكثير.

من ينبغي عليه استخدامه

إذا كان يومك يتضمن… اختر السبب
عقود وتقارير وملفات PDF في ChatGPT Work GPT-6.1 Sol تعامل مع المستندات بمستوى يقارب Astra وبجزء بسيط من التكلفة
أبحاث ومهام حاسوبية فائقة الصعوبة GPT-6 Astra أقوى نموذج من OpenAI، يتفوق بنقطة أو نقطتين
أحكام حاسمة وحقائق نادرة Claude Opus 5.5 يتصدر المؤشر المستقل العام
عمل يومي مع خطة مجانية Claude Sonnet 5.5 أو Gemini نماذج قوية بدون اشتراك

الحكم اليومي

لن يبهرك GPT-6.1 Sol بكونه النموذج الأذكى على الإطلاق، بل سيبهرك باقترابه من ذكاء النموذج الرائد لشركة OpenAI وبجزء بسيط من التكلفة. إذا كنت تدفع بالفعل مقابل ChatGPT وتمضي يومك في تبويب Work، فإن جعله الخيار الافتراضي هو أمر بديهي. تحقق دائماً من الحقائق الغامضة، وانتقل إلى Astra فقط عندما تتطلب المهمة بالفعل تلك النقاط الإضافية.

02

نقاط القوة والقيود بصراحة

نقاط القوة الرئيسية

  • أداء يقارب النماذج الرائدة بسعر الفئة المتوسطة: على مؤشر الذكاء الخاص بـ Artificial Analysis، والذي تم قياسه في 29 سبتمبر 2026، سجل GPT-6.1 Sol 52 نقطة مقابل 53 لنموذج GPT-6 Astra. وتكلف المهمة الواحدة حوالي 0.72 دولار مقابل 3.26 دولار لنموذج Astra، ليحتل بذلك المرتبة العاشرة من أصل 222 نموذجاً تم اختباره.
  • يقرأ المستندات الصعبة بمهارة: في اختبار GDP.pdf، والذي يطرح أسئلة حول ملفات PDF حقيقية في مجالات التمويل والقانون والرعاية الصحية وتكون مليئة بالجداول والرسوم البيانية والخطوط الصغيرة، يُظهر جدول OpenAI نسبة 32.0% بجهد عالٍ (High Effort) مقابل 0.35 دولار للمهمة، مقارنة بأفضل نتيجة لنموذج Claude Opus 5.5 والبالغة 28.8% (0.83 دولار) وأفضل نتيجة لـ GPT-6 Astra والبالغة 32.2% (1.91 دولار).
  • جيد في الأعمال المكتبية الروتينية بتكلفة منخفضة: في اختبار AutomationBench، والذي يختبر سير عمل الأعمال عبر 47 أداة في مجالات المبيعات والتمويل والدعم والموارد البشرية، يظهر جدول OpenAI نسبة 31.7% بجهد متوسط مقابل 0.19 دولار للمهمة، متفوقاً بـ 2.2 نقطة على Claude Opus 5.5 بنفس الإعداد (0.65 دولار).
  • يشغل الحاسوب تقريباً بنفس كفاءة Astra: في اختبار OSWorld 2.0، حيث يقوم الوكيل بالنقر والكتابة عبر تطبيقات سطح المكتب الحقيقية، أبلغت OpenAI عن نسبة 71.4% بجهد أقصى مقابل 1.27 دولار للمهمة، مقارنة بـ 73.5% لنموذج GPT-6 Astra مقابل 9.44 دولار.
  • أخطاء أقل بثقة مفرطة: في اختبار دقة الحقائق الأكثر صرامة من OpenAI، انخفضت نسبة الإجابات التي تحتوي على خطأ واقعي من 11.4% إلى 7.7% في مستوى الجهد المنخفض مقارنة بنموذج GPT-6 Sol. وقد قاس Artificial Analysis بشكل مستقل انخفاضاً في معدل الهلوسة لديه من 60% إلى 54%.

قيود صادقة

  • ليس في نافذة الدردشة الرئيسية: في ChatGPT، يعمل GPT-6.1 Sol فقط داخل ChatGPT Work و Codex، وذلك في خطط Plus و Pro و Business و Enterprise و Edu. لا يمكن للمستخدمين المجانيين اختياره وهو غير موجود في المحادثات العادية بعد.
  • لا يزال يخمّن عندما يكون غير متأكد: في اختبار AA-Omniscience الخاص بـ Artificial Analysis، اختلق إجابة في 54% من الحالات عندما لم يكن يعلم، وهو أفضل من نسبة 60% الخاصة بـ GPT-6 Sol لكنه أسوأ من 47% الخاصة بـ Claude Sonnet 5.5. تحقق من الحقائق الغامضة.
  • لا يزال Claude يتصدر المؤشر العام: يتفوق كل من Claude Opus 5.5 (58) و Claude Sonnet 5.5 (56) على GPT-6.1 Sol (52) في مؤشر الذكاء من Artificial Analysis. نموذج Sol أرخص لكل مهمة، ولكنه ليس الأذكى.
  • يتفوق على Opus في مستوى الجهد المتوسط، وليس الأقصى: تفوقُ OpenAI في AutomationBench على Claude Opus 5.5 كان على مستوى الجهد المتوسط. أما في مستوى الجهد الأقصى (Max Effort)، فيظهر جدولهم الخاص Opus 5.5 بنسبة 42.5% و GPT-6 Astra بنسبة 41.4%، وهو أعلى بكثير من 36.1% الخاصة بـ GPT-6.1 Sol. في أصعب مسارات العمل متعددة الخطوات، لا تزال النماذج الأغلى تنجز قسماً أكبر من العمل.
  • يقرأ الصور لكنه لا ينشئها: يقبل النموذج إدخال النصوص والصور، ويُخرج نصوصاً. يتم توليد الصور في ChatGPT عن طريق أداة منفصلة، ولا يعالج النموذج الصوت أو الفيديو.
  • العديد من المقارنات تخص OpenAI: البيانات الخاصة بـ GDP.pdf و AutomationBench و OSWorld واختبار الحقائق مأخوذة من إعلان إطلاق OpenAI. في المقابل، نتائج مؤشر Artificial Analysis مستقلة وتتجه نحو نفس النتائج.
03

لمحة عن المعايير

مؤشر الذكاء Artificial Analysis — 52 (جهد أقصى)

مؤشر مركب مستقل يضم 10 تقييمات، قيست في 29 سبتمبر 2026. أقل بنقطة واحدة عن GPT-6 Astra (53) وبزيادة من 48 لنموذج GPT-6 Sol. يسجل Claude Opus 5.5 ‏58 نقطة بينما يصل Claude Sonnet 5.5 إلى 56 نقطة.

تكلفة المهمة على المؤشر — 0.72 دولار

التكلفة المحسوبة من Artificial Analysis لتنفيذ مهمة واحدة من المؤشر: GPT-6 Astra بـ 3.26 دولار، و Claude Opus 5.5 بـ 5.98 دولار، و Claude Sonnet 5.5 بـ 7.60 دولار، جميعها بمستوى الجهد الأقصى (Max Effort).

GDP.pdf — بنسبة 32.0% (جهد عالٍ، 0.35 دولار للمهمة)

أسئلة حول ملفات PDF مهنية معقدة في مجالات التمويل والقانون والرعاية الصحية وسبعة مجالات أخرى، وفقاً لجدول OpenAI. أفضل نتيجة لـ Claude Opus 5.5 كانت 28.8% (0.83 دولار للمهمة) ولـ GPT-6 Astra كانت 32.2% (1.91 دولار).

OSWorld 2.0 أوفلاين — 71.4% (جهد أقصى)

تشغيل تطبيقات سطح مكتب حقيقية، بنظام النقاط الجزئية، وفقاً لـ OpenAI. يحصل GPT-6 Astra على 73.5% بتكلفة 9.44 دولار للمهمة، بينما يحقق GPT-6 Sol نسبة 64.4% بتكلفة 3.37 دولار؛ في حين يكلف GPT-6.1 Sol مبلغ 1.27 دولار.

معدل الهلوسة في AA-Omniscience — 54%

مستقل. مدى تكرار اختلاق النموذج لإجابة عندما يخطئ في سؤال؛ الأقل هو الأفضل. GPT-6 Sol: 60%. Claude Sonnet 5.5: 47%.

السعر — 2 دولار / 10 دولارات لكل مليون رمز، و0.10 دولار للمخزن مؤقتاً

خُمس سعر واجهة برمجة تطبيقات GPT-6 Astra. يتمتع الإدخال المخزن مؤقتاً بخصم 95%، ومعالجة Batch و Flex بخصم 50%.

04

الحكم

تم تصميم GPT-6.1 Sol لمن يدفعون بالفعل مقابل ChatGPT ويريدون من وكيل Work التعامل مع المستندات وجداول البيانات والمهام المكتبية المتعددة الخطوات دون تحمل تكلفة النموذج الرائد. تضعه الاختبارات المستقلة خلف GPT-6 Astra بنقطة واحدة. يأتي بعد GPT-6 Astra ونماذج Claude لأن Opus 5.5 وSonnet 5.5 يسجلان درجات أعلى على المؤشر المستقل نفسه، ولأن Sonnet متاح في الخطة المجانية لـ Claude، بينما لا يتوفر Sol في الدردشة العادية ولا في أي خطة مجانية. ويتقدم على Gemini 3.1 Pro وGrok 4.7 استناداً إلى النتائج المستقلة الحالية، رغم أن Gemini لا يزال مجانياً. إذا كنت تستخدم ChatGPT Work يومياً، فهو الخيار الافتراضي المعقول.

05

الأسئلة الشائعة