تخيل شركة محاماة جيدة. الشريك الأول بارع ويُصدر فواتيره بناءً على ذلك. لن تطلب منه أبداً مراجعة مائتي صفحة من عقود الموردين بحثاً عن بند فسخ العقد. ستُسلم هذه المهمة إلى محامٍ مساعد موثوق، شخصٌ يقاربه في الفطنة وأرخص منه بكثير.
نموذج GPT-6.1 Sol هو ذلك المحامي المساعد. إنه ليس النموذج الأكثر قوة لدى OpenAI، لكنه يقترب منه كثيراً، وهو النموذج الذي يمكنك تحمل تكلفة استخدامه لمعظم أعمالك الأسبوعية.
ما هو وأين تجده
أطلقت OpenAI نموذج GPT-6.1 Sol في 29 سبتمبر 2026 ضمن حدث DevDay، وذلك بعد أسبوع واحد من إصدار GPT-6 Sol. وتصفه OpenAI بأنه يوفر ذكاءً يقارب مستوى Astra للبرمجة واستخدام الحاسوب والأعمال المهنية، وبخُمس سعر نموذجها الرائد GPT-6 Astra.
مكان استخدامه هو ما يهم معظم المستخدمين. داخل تطبيق ChatGPT، يتواجد GPT-6.1 Sol في ChatGPT Work و Codex، وهي الأقسام المصممة للمهام الطويلة والملفات والوكلاء. إنه متوفر في خطط Plus و Pro و Business و Enterprise و Edu. وهو غير متوفر بعد في الدردشة العادية، ولا يشمله الاشتراك المجاني. يمكن للمطورين استخدامه عبر واجهة برمجة التطبيقات تحت اسم gpt-6.1-sol، وقد تمت إضافته إلى أدوات برمجة مثل Devin من Cognition في يوم الإطلاق.
ما مدى قربه من النموذج الرائد؟
أجرت شركة الاختبارات المستقلة Artificial Analysis تقييماتها يوم الإطلاق. يجمع مؤشر الذكاء الخاص بها بين عشر تقييمات صعبة، تتراوح من العمل المكتبي وأتمتة الأعمال إلى البرمجة العلمية والمعرفة الواقعية. سجل GPT-6.1 Sol 52 نقطة. بينما سجل GPT-6 Astra 53 نقطة، وحصل GPT-6 Sol الصادر الأسبوع الماضي على 48 نقطة. هذا يضع GPT-6.1 Sol في المركز العاشر من بين 222 نموذجاً تم ترتيبهم في الجدول.
الآن لنتأمل السعر. حسبت Artificial Analysis التكلفة بحوالي 0.72 دولار لتنفيذ مهمة من مهام المؤشر الخاص بها باستخدام GPT-6.1 Sol، مقابل 3.26 دولار لنموذج Astra. أي بتكلفة تقل عن الربع مقابل قدرة تقل بنقطة واحدة فقط.
وللإنصاف، لا تزال نماذج Anthropic تتصدر هذا المؤشر. سجل Claude Opus 5.5 58 نقطة وسجل Claude Sonnet 5.5 56 نقطة. ولكن تحقيق هذه الدرجات يكلف أكثر بكثير: 5.98 دولار و 7.60 دولار لكل مهمة على التوالي.
ما يميزه في يوم العمل
تركز اختبارات الإطلاق من OpenAI على نوعية العمل التي تملأ أسبوع العمل المكتبي. تذكر أن هذه الأرقام مقدمة من OpenAI نفسها.
- قراءة ملفات PDF المعقدة. في اختبار GDP.pdf، يُجيب النموذج على أسئلة حول مستندات حقيقية من مجالات التمويل والقانون والرعاية الصحية وسبعة مجالات أخرى، مليئة بالجداول المكدسة والرسوم البيانية والنصوص الدقيقة. يعرض جدول OpenAI نسبة 32.0% بجهد عالٍ (High Effort) مقابل 0.35 دولار للمهمة. يبلغ أفضل أداء لـ Claude Opus 5.5 نسبة 28.8% مقابل 0.83 دولار، وأفضل أداء لـ GPT-6 Astra نسبة 32.2% مقابل 1.91 دولار. بالتالي، يكاد Sol يطابق النموذج الرائد بخُمس السعر.
- المهام الروتينية متعددة الخطوات. في AutomationBench، يُكمل الوكيل مهام كاملة عبر 47 أداة أعمال، مثل تحديث نظام CRM وإرسال تذكرة وكتابة رسالة متابعة. على مستوى الجهد المتوسط، يحقق GPT-6.1 Sol 31.7% مقابل 0.19 دولار للمهمة، متفوقاً بـ 2.2 نقطة على Claude Opus 5.5 بنفس الإعداد. لكن يجب قراءة الجدول كاملاً: فعند مستوى الجهد الأقصى، يصل Opus 5.5 إلى 42.5% و Astra إلى 41.4%، بينما يتوقف Sol عند 36.1%. يتفوق Sol من حيث التكلفة في المهام الروتينية؛ في حين لا تزال النماذج الأغلى تُنجز قدراً أكبر من المهام الأكثر صعوبة.
- استخدام الكمبيوتر. في OSWorld 2.0، يقوم النموذج بالنقر والكتابة عبر تطبيقات سطح المكتب الفعلية. تعلن OpenAI عن 71.4% مقابل 1.27 دولار للمهمة، مقارنة بـ 73.5% لنموذج Astra مقابل 9.44 دولار.
حقائق مخترعة أقل، ولكنها ليست معدومة
اختبرت OpenAI الدقة الواقعية باستخدام أسئلة صعبة عن قصد مستمدة من محادثات حقيقية حيث حدد المستخدمون أخطاءً لنموذج سابق. على مستوى الجهد المنخفض، انخفضت نسبة الإجابات التي تحتوي على أخطاء واقعية من 11.4% إلى 7.7% مقارنة بنموذج GPT-6 Sol، وهو انخفاض بنسبة الثلث تقريباً.
إلا أن اختبار المعرفة المستقل من Artificial Analysis يُقدم صورة أكثر واقعية. عندما لا يعرف GPT-6.1 Sol إجابة معينة، فإنه لا يزال يختلقها في 54% من الحالات. هذا أفضل من 60% الخاصة بـ GPT-6 Sol، ولكنه أسوأ من 47% الخاصة بـ Claude Sonnet 5.5. لا تتغير النصيحة العملية: عند السؤال عن اسم أو تاريخ أو رقم غير معروف، اطلب منه البحث على الويب أو الاستشهاد بمصدر.
كلمة عن نموذج Astra الذي لم يصدر
لم يكن GPT-6.1 Sol النموذج الوحيد الذي خططت OpenAI لإطلاقه في DevDay. ففي اليوم السابق، ألغت الشركة GPT-6.1 Astra بعد أن أظهرت الاختبارات الداخلية أن النموذج لم يلتزم بنطاق وأذونات المهام الموكلة إليه بشكل موثوق. يُعد GPT-6.1 Sol نموذجاً منفصلاً يمتلك تقرير أمان خاص به. ففي إحدى تجارب OpenAI، تم تعطيل أداة بحث الوكيل سراً، وكان يتعين على النموذج الإشارة إلى ذلك بدلاً من التخمين. فشل GPT-6.1 Sol في الكشف عن المشكلة في 2.1% من الحالات، مقارنة بـ 4.9% لـ GPT-6 Sol و 1.5% لـ GPT-6 Astra. يُعتبر هذا تحسناً حقيقياً، وإن لم يكن ضماناً لكل موقف.
القيد الصريح
يتطلب الدفع ويوجد في علامة تبويب منفصلة. بالنسبة لنموذج يستهدف العمل اليومي، يُعد الوصول إليه هو أكبر قيد: فلا توجد خطة مجانية ولا يتوفر في الدردشة العادية، بل يوجد فقط في ChatGPT Work و Codex ضمن الخطط المدفوعة.
يقرأ الصور لكنه لا يرسم. يتلقى GPT-6.1 Sol كلاً من النصوص والصور كمدخلات ويعيد نصوصاً. لا يُولد النموذج الصور أو الصوت أو الفيديو بنفسه.
Claude لا يزال يتقدم في المؤشر العام. إذا كنت تبحث عن أعلى الدرجات المستقلة بغض النظر عن التكلفة، فإن Claude Opus 5.5 و Sonnet 5.5 هما الأفضل. وتتمثل ميزة GPT-6.1 Sol في تقديم أداء متقارب بتكلفة أقل بكثير.
من ينبغي عليه استخدامه
| إذا كان يومك يتضمن… | اختر | السبب |
|---|---|---|
| عقود وتقارير وملفات PDF في ChatGPT Work | GPT-6.1 Sol | تعامل مع المستندات بمستوى يقارب Astra وبجزء بسيط من التكلفة |
| أبحاث ومهام حاسوبية فائقة الصعوبة | GPT-6 Astra | أقوى نموذج من OpenAI، يتفوق بنقطة أو نقطتين |
| أحكام حاسمة وحقائق نادرة | Claude Opus 5.5 | يتصدر المؤشر المستقل العام |
| عمل يومي مع خطة مجانية | Claude Sonnet 5.5 أو Gemini | نماذج قوية بدون اشتراك |
الحكم اليومي
لن يبهرك GPT-6.1 Sol بكونه النموذج الأذكى على الإطلاق، بل سيبهرك باقترابه من ذكاء النموذج الرائد لشركة OpenAI وبجزء بسيط من التكلفة. إذا كنت تدفع بالفعل مقابل ChatGPT وتمضي يومك في تبويب Work، فإن جعله الخيار الافتراضي هو أمر بديهي. تحقق دائماً من الحقائق الغامضة، وانتقل إلى Astra فقط عندما تتطلب المهمة بالفعل تلك النقاط الإضافية.