الترتيب #6 ذكاء اصطناعي محلي / خاص — عقلك، جهازك، قواعدك
Moonshot AI

Kimi K3

نموذج متقدم مفتوح الأوزان يضم 2.8 تريليون معامل، ويثبت أن الذكاء الاصطناعي الخاص يمكن أن يكون هائلاً وممتازاً معاً. كما يثبت أن مجانية التنزيل لا تعني مجانية الجهاز اللازم لتشغيله.

تم التحديث 29 أغسطس 2026 Open WeightsModified MIT2.8T MoE
الأفضل لـ

نموذج متقدم مفتوح الأوزان يضم 2.8 تريليون معامل، ويثبت أن الذكاء الاصطناعي الخاص يمكن أن يكون هائلاً وممتازاً معاً. كما يثبت أن مجانية التنزيل لا تعني مجانية الجهاز اللازم لتشغيله.

لماذا تفوز

يسجّل Kimi K3 نحو 60 على الإصدار الحالي من مؤشر الذكاء لدى Artificial Analysis، متعادلاً مع GLM-5.3 الرئيسي عند قمة النماذج مفتوحة الأوزان. ويضيف فهماً أصلياً متعدد الوسائط، وسياقاً بطول مليون رمز، ونتائج برمجة قوية وفق اختبارات Moonshot.

انتبه إلى

يبلغ حجم نقطة تحقق MXFP4 نحو 1.4 تيرابايت، وقد تتطلب خدمة النموذج في بيئة الإنتاج عشرات المسرّعات، كما أن رخصة MIT المعدّلة ليست مطابقة لرخصة MIT القياسية. وتسبقه الآن في هذا التصنيف المحلي نماذج منافسة أكثر عملية بأحجام تتراوح بين 75 و306 غيغابايت.

01

ما هو في الواقع

يمثّل Kimi K3 ما يحدث حين نمدد عبارة «شغّله بنفسك» حتى تبلغ مقياس مركز بيانات. أوزانه قابلة للتنزيل، ويمكن إبقاء النموذج داخل حدود المؤسسة، وذكاؤه قريب من القمة. لكن حجم نقطة التحقق الرسمية المضغوطة يقارب 1.4 تيرابايت. الخصوصية ممكنة؛ أما البساطة فلا.

تضع Artificial Analysis الآن Kimi K3 عند نحو 60 على الإصدار الحالي من مؤشر الذكاء، متعادلاً مع GLM-5.3 الرئيسي ضمن المجموعة المتصدرة من النماذج مفتوحة الأوزان. كان النص السابق في الموقع يذكر نتيجة تقارب 80 ومركزاً خامساً على مقياس أقدم. تلك اللقطة انتهت صلاحيتها. الرقم الجديد لا يعني أن الذكاء تراجع؛ بل إن أداة القياس تغيّرت.

ولا تزال قصة Moonshot في المهام المتخصصة مثيرة للإعجاب. تفيد الشركة بنتيجة 88.3 على Terminal-Bench 2.1، و67.5 على DeepSWE، و81.2 على FrontierSWE. كما يجعل الفهم الأصلي للصور والفيديو، مع سياق بطول مليون رمز، نموذج K3 أكثر من مجرد محرك نصي. إذ يستطيع نظام خاص فحص المواد البصرية والمستودعات الكبيرة والسجلات الطويلة من دون إرسالها إلى مزود نموذج خارجي.

ثم تأتي الفيزياء بالفاتورة. تنشّط بنية خليط الخبراء نحو 104 مليارات معامل لكل رمز، لكن النظام يظل مضطراً إلى تخزين مجموعة المعاملات الكاملة البالغة 2.8 تريليون وتوجيه العمل بينها. تبدأ التركيبات التجريبية بعدد كبير من المسرّعات ذات الذاكرة العالية، وقد يتطلب الإنتاج الجاد عشرات المسرّعات. كون بعض الاختصاصيين فقط يعالجون كل حالة لا يسمح للمستشفى بهدم بقية العيادات.

كما تغيّر سلّم المنافسة. يقدم GLM-5.3-Flash نقطة تحقق رسمية بصيغة FP8 حجمها 306 غيبيبايت، وحقوقاً وفق رخصة MIT، وقدرة مستقلة أقل قليلاً. وينخفض Qwen3.8-Flash-Next إلى نحو 75 غيغابايت مع تكميم قوي وستة مليارات معامل نشط فقط، وإن كانت رخصته أضيق. أما Qwen3.8-27B فيشغل نحو 18 غيغابايت عند تكميمه إلى أربعة بتات. لا يطابق أي منها جميع نقاط قوة Kimi، لكن امتلاك كل واحد منها أسهل بكثير.

لذلك يبقى Kimi K3 معلماً مهماً من دون أن يظل توصية عملية ضمن المركزين الأول والثاني. اختره عندما تكون مؤسستك تشغّل البنية التحتية المطلوبة بالفعل، وعندما يتفوق ملفه متعدد الوسائط في تقييم مماثل لحالة استخدامك. أما الآخرون، فقد أتاحت لهم ثورة الأوزان المفتوحة أبواباً أصغر إلى المبنى نفسه.

02

نقاط القوة والقيود بصراحة

نقاط القوة الرئيسية

  • قدراته الخام استثنائية بين النماذج مفتوحة الأوزان: تضع اختبارات Artificial Analysis الحالية Kimi K3 عند نحو 60، ضمن أقوى مجموعة من النماذج القابلة للتنزيل وبالقرب من أفضل النماذج المغلقة.
  • تعدد الوسائط وطول السياق ليسا ميزتين ثانويتين: فالفهم الأصلي للصور والفيديو، إلى جانب سياق يبلغ مليون رمز، يناسبان سير العمل الخاص بالمستندات والمستودعات البرمجية والوكلاء طويلي الأمد.
  • تفيد Moonshot بقوة جادة في البرمجة: تضعه نتائج Terminal-Bench 2.1 البالغة 88.3 وDeepSWE البالغة 67.5 وFrontierSWE البالغة 81.2 في نطاق النماذج المتقدمة، وفق إعدادات الاختبار التي أفصحت عنها الشركة.
  • تتيح نقطة التحقق نشراً سيادياً: تستطيع المؤسسات التي تملك البنية التحتية إبقاء تشغيل النموذج وسياقه الحساس داخل حدودها، بدلاً من الاعتماد على نقطة وصول مستضافة قد تتغير.

قيود صادقة

  • حجمه يُقاس بالتيرابايت: تستبعد أوزان MXFP4 التي تقارب 1.4 تيرابايت، وتوصيات الإنتاج التي تشمل مجموعات كبيرة من المسرّعات، جميع الأفراد والفرق الصغيرة تقريباً.
  • المعاملات النشطة لا تلغي متطلبات التخزين: يشارك نحو 104 مليارات معامل في معالجة كل رمز، لكن لا يزال من الضروري تخزين مجموعة الخبراء الكاملة البالغة 2.8 تريليون معامل وتوجيه العمل بينها.
  • معظم نتائج المهام التفصيلية صادرة عن الشركة: تؤكد Artificial Analysis القدرة العامة، لكن نتائج Moonshot الدقيقة في البرمجة وتحسين النوى تظل معتمدة على بيئة اختبارها وتحتاج إلى إعادة إنتاج بإعدادات مماثلة.
  • الرخصة MIT معدّلة وليست MIT قياسية: الاستخدام التجاري متاح على نطاق واسع، لكن ينبغي للمشغّلين قراءة شروط الإسناد وتسمية المنتجات بدلاً من الاكتفاء بوصف مختصر للرخصة.
03

لمحة عن المعايير

مؤشر الذكاء لدى Artificial Analysis — نحو 60

تُظهر الأدلة المركّبة المستقلة الحالية تعادل Kimi K3 مع GLM-5.3 بالقرب من قمة النماذج مفتوحة الأوزان. أما النص السابق في الموقع الذي استخدم مقياساً يقارب 80 نقطة فقد أصبح متقادماً.

Terminal-Bench 2.1 — ‏88.3 (اختبار Moonshot)

أداء قوي لوكيل يعمل في الطرفية، قريب من أنظمة متقدمة أخرى في مقارنة الشركة. ويجب ذكر بيئة الاختبار والإصدار عند الاستشهاد بالنتيجة.

DeepSWE — ‏67.5 (اختبار Moonshot)

دليل لافت على البرمجة الممتدة عبر خطوات كثيرة، لكنه يظل معتمداً على الإعداد ولا ينبغي اعتباره نتيجة مستقلة لتكميم محلي.

حجم نقطة التحقق — نحو 1.4 تيرابايت بصيغة MXFP4

هذا هو الرقم العملي الذي يحدد مرتبته: فحتى الأوزان الرسمية المضغوطة تحتاج إلى تخزين وذاكرة مسرّعات من فئة مراكز البيانات.

04

الحكم

ينتقل Kimi K3 إلى المركز #6 في فئة الذكاء الاصطناعي المحلي / الخاص بتقييم 8.5. لا يزال معلماً بارزاً وأحد أذكى النماذج التي يمكن لمؤسسة امتلاكها، لكن الفئة باتت تضم سلّماً أكثر فائدة: Qwen3.8-27B للامتلاك على جهاز واحد، وGLM-5.3-Flash لمجموعة متعددة الوسائط برخصة MIT، وQwen3.8-Flash-Next للكفاءة على أجهزة ذات ذاكرة كبيرة، وDeepSeek لخدمة النصوص والبرمجة، وGLM-5.3 الرئيسي لمجموعة أصغر تستهدف أقصى قدرة. اختر Kimi عندما يبرر ملفه الخاص في تعدد الوسائط والبرمجة تركيباً بالغ الضخامة، لا لأن مقالاً قديماً ما زال يصفه بأنه في المركز الثاني.

05

الأسئلة الشائعة