الترتيب #2 ذكاء اصطناعي محلي / خاص — عقلك، جهازك، قواعدك
Moonshot AI

Kimi K3

أول نموذج بأوزان مفتوحة يشبه عقلاً مغلقاً من الطراز المتقدم. 2.8 تريليون معامل في بنية خليط الخبراء، ورؤية أصلية، ونافذة سياق كاملة تبلغ مليون رمز، ورخصة تسمح باستخدامه تجارياً — كل ذلك قابل للتنزيل على جهاز تحت سيطرتك. المشكلة تكمن في الجهاز: يحتاج إلى مركز بيانات، وليس مكتباً.

تم التحديث July 28, 2026 Open WeightsModified MIT2.8T MoE
الأفضل لـ

أول نموذج بأوزان مفتوحة يشبه عقلاً مغلقاً من الطراز المتقدم. 2.8 تريليون معامل في بنية خليط الخبراء، ورؤية أصلية، ونافذة سياق كاملة تبلغ مليون رمز، ورخصة تسمح باستخدامه تجارياً — كل ذلك قابل للتنزيل على جهاز تحت سيطرتك. المشكلة تكمن في الجهاز: يحتاج إلى مركز بيانات، وليس مكتباً.

لماذا تفوز

أكبر نموذج بأوزان مفتوحة صدر على الإطلاق. تصنّفه Artificial Analysis في المركز الخامس عالمياً (على بعد ثلاث نقاط من Claude Fable 5). رؤية وفهم فيديو متعدد الأوضاح أصلية لا يقدمها أي نموذج مفتوح آخر في هذه الفئة. نتائج برمجة قوية من المصدر — FrontierSWE 81.2 وTerminal-Bench 88.3 وDeepSWE 67.5. رخصة Modified MIT تسمح بالاستضافة الذاتية التجارية مع الإسناد. دعم نشر من اليوم الأول عبر vLLM وSGLang وDocker وTogether AI وHuggingChat.

انتبه إلى

أوزان MXFP4 تبلغ حوالي 1.4 تيرابايت. التشغيل التجريبي يحتاج ثمانية معالجات رسومات H100 بسعة 80 غيغابايت كحد أدنى؛ والإنتاج يوصي بـ 64 مسرّعاً أو أكثر عبر عقد متعددة. هذا ليس نموذجاً للحاسوب المحمول أو المكتبي أو محطة عمل فردية. معظم أرقام الأداء تأتي من المصنّع — التقييمات المستقلة لا تزال تكتمل بعد إصدار 27 يوليو. الرخصة المعدّلة ليست MIT أو Apache 2.0 صافية، والنموذج يعاني من مشاكل استقرار معروفة تتعلق بسجل التفكير والمبادرة المفرطة.

01

ما هو في الواقع

لسنوات، عاشت مجتمعية الأوزان المفتوحة بقاعدة بسيطة: يمكنك امتلاك الخصوصية أو الذكاء المتقدم، لكن ليس كليهما معاً. كانت أفضل النماذج التي يمكنك تنزيلها وتشغيلها بنفسك دائماً درجة واحدة خلف العمالقة المغلقين. جيدة بما يكفي لكثير من المهام، لكن ليس للأصعب منها.

Kimi K3 هو النموذج الذي يجعل هذه القاعدة تبدو عفا عليها الزمن.

أصدرت Moonshot AI الأوزان الكاملة في 27 يوليو 2026، والأرقام مذهلة. 2.8 تريليون معامل منظمة في بنية خليط الخبراء — 896 خبيراً، يشتبك منها 16 عند كل رمز (104 مليار نشط). مُرمِّز رؤية مدمج يُدعى MoonViT-V2 يمكّن النموذج من قراءة لقطات الشاشة والمخططات والرسوم البيانية والمستندات وحتى إطارات الفيديو بشكل أصلي. تمتد نافذة السياق إلى مليون رمز، أي ما يعادل عشر روايات كاملة تقريباً. وكل ذلك تحت رخصة Modified MIT تسمح بالاستخدام التجاري.

تؤكد الأدلة المستقلة ادعاء القدرة. Artificial Analysis — أقرب ما يكون إلى حكم محايد في مجال الذكاء الاصطناعي — تُصنّف K3 بحوالي 80 من 100 على مؤشر الذكاء، ضائعة في المركز الخامس بين 215 نموذجاً عالمياً. يضعه ذلك على بعد ثلاث نقاط من Claude Fable 5، وهو نموذج مغلق يكلّف مالاً حقيقياً. لم يصل أي نموذج آخر بأوزان مفتوحة إلى هذه المرتبة.

قصة البنية

عدد المعاملات الخام هو العنوان الرئيسي، لكن الهندسة الموجودة تحته تستحق الاهتمام. يبني K3 على فكرتين تسميهما Moonshot Kimi Delta Attention (KDA) وAttention Residuals. KDA آلية انتباه فعّالة تتوسع أفضل من النُهج القياسية؛ وAttention Residuals تسترجع المعلومات بشكل انتقائي عبر عمق النموذج بدلاً من تجميعها بانتظام. معاً، تُعلن Moonshot عن تحسين بنحو 2.5× في كفاءة التوسع مقارنة بـ K2.

ما يعنيه ذلك عملياً: يستخدم النموذج ميزانية معاملاته الضخمة بذكاء أكبر مما يفعله التوسع الساذج. كما أنه يُشحن مع تكميم MXFP4 أصلي — تُخزَّن الأوزان بدقة 4 بت مع تنشيطات 8 بت، ودُمج هذا الضغط أثناء التدريب بدلاً من تطبيقه كإضافة لاحقة. لهذا السبب يمكن للنموذج أن يعمل على «فقط» ثمانية معالجات H100 بدلاً من طلب مركز بيانات كامل بالدقة الكاملة.

لماذا ليس الأول في هذه الفئة

هنا التوتر الصريح. Kimi K3 هو أكثر نموذج بأوزان مفتوحة قدرة على وجه الأرض. وهو أيضاً أقل النماذج عملية في هذه الفئة لمعظم القراء.

تبلغ أوزان MXFP4 حوالي 1.4 تيرابايت. الحد الأدنى للتكوين التجريبي الذي تصفه Moonshot يتطلب ثمانية معالجات رسومات H100 بسعة 80 غيغابايت — 640 غيغابايت من VRAM، أي ما يعادل حوالي 200,000 دولار من الأجهزة بالأسعار الحالية. الإنتاج يريد 64 مسرّعاً أو أكثر عبر عقد متعددة متصلة بوصلات عالية النطاق الترددي. هذه ليست محطة عمل. هذه حاسوب فائق صغير.

قارن ذلك بـ GLM-5.2، صاحب المركز الأول الحالي في هذه الفئة. GLM-5.2 نموذج بـ 744 مليار معامل (حوالي 40 مليار نشط) يتسع في حوالي 241 غيغابايت مع تكميم 2 بت عدواني — في متناول Mac Studio بذاكرة موحدة 256 غيغابايت أو محطة عمل بمعالجي رسومات. يحمل رخصة MIT نظيفة. يمتلك أشهراً من التحقق المجتمعي المستقل، بما في ذلك المركز الأول في لوحة تصنيف البرمجة على Design Arena.

K3 يتفوق في الذكاء الخام والقدرة متعددة الأوضاح والحجم الصرف. GLM-5.2 تتفوق في كل ما يحدد ما إذا كان شخص عادي أو فريق صغير يمكنه استخدامها فعلاً. لفئة تحمل اسم «الذكاء الاصطناعي المحلي / الخاص»، هذا الفرق العملي حاسم — ولهذا يدخل K3 في المركز الثاني، لا الأول.

ما يُجيده K3 فعلاً

بوضع مسألة الأجهزة جانباً، فإن ملف القدرات مثير للإعجاب. في تقييمات Moonshot الذاتية، يحقق K3 FrontierSWE 81.2% (مهام هندسة برمجيات حقيقية على مستودعات كبيرة)، وTerminal-Bench 88.3 (كفاءة كعامل سطر أوامر)، وGPQA Diamond 93.5 (استدلال علمي بمستوى الدراسات العليا). في اختبار تحسين النوى، تُفيد Moonshot بأن K3 تفوّق بشكل كبير على GPT-5.6 Sol وGPT-5.5 وOpus 4.8 — رغم أن هذه أرقام من الشركة تنتظر التأكيد المستقل.

القدرة متعددة الأوضاح الأصلية هي السمة التي تفصل K3 بوضوح عن GLM-5.2 في هذه الفئة. GLM-5.2 للنص والكود فقط. K3 يقرأ الصور ولقطات الشاشة والرسوم البيانية والفيديو. في سير العمل المستضاف ذاتياً الذي يتضمن مدخلات بصرية — تحليل ملف PDF أو تصحيح واجهة من لقطة شاشة أو فحص تصور بياني — يتعامل K3 مع ذلك أصلياً دون إضافة نموذج رؤية منفصل. هذه ميزة معمارية حقيقية للفرق التي تبني خطوط أنابيب متعددة الأوضاح خلف جدار الحماية الخاص بها.

واقعية النشر

إذا كانت مؤسستك تشغّل بالفعل مجموعة معالجات رسومات — مختبر أبحاث أو شركة سحابية أو فريق ذكاء اصطناعي مؤسسي — فإن قصة النشر ناضجة بشكل مفاجئ لإصدار عمره يوم واحد. نشرت vLLM معاينة دعم بمقياس الإنتاج في 22 يوليو، مع تحسينات prefix-caching لـ KDA أعادتها Moonshot إلى مجتمع المصادر المفتوحة. تقدم SGLang وDocker وTogether AI وHuggingChat جميعاً مسارات فورية لتقديم النموذج. الأدوات ليست العائق؛ الأجهزة هي.

للجميع غير ذلك، تقدم واجهة Moonshot البرمجية النموذج نفسه بـ 3 دولارات لكل مليون رمز دخول و15 دولاراً لكل مليون رمز إخراج (مع الدخل المخزّن مؤقتاً بـ 0.30 دولار). هذا سعر معقول لعمل من الطراز المتقدم، لكنه يهزم غرض تصنيف «الذكاء الاصطناعي المحلي»: تغادر البيانات جهازك.

خشونة معروفة

Moonshot صريحة بشكل يستحق الإشادة بشأن قيود K3 في وثائقها الخاصة. النموذج حساس لوضع سجل التفكير — تبديل محرك الاستدلال خلال الجلسة قد يُزعزع المخرجات، وهو أمر يهم الفرق التي تشغّل أُطُراً متعددة للخدمة. كما قد يكون مفرط المبادرة، متخذاً قرارات ذاتية لم يطلبها المستخدم. توصي Moonshot بقيود صريحة في تلميحات النظام أو ملف AGENTS.md لإبقاء النموذج على المسار.

يوجد أيضاً فجوة ملحوظة في تجربة المستخدم مقارنة بالمنتجات المغلقة المصقولة مثل Claude Fable 5 وGPT-5.6 Sol، كما يعترف Moonshot نفسه. الذكاء الخام موجود؛ السلاسة ليست كذلك بعد.

الخلاصة

Kimi K3 هو النموذج الذي يثبت أن حدود الأوزان المفتوحة قد وصلت. عقل قابل للتنزيل ينافس أفضل النماذج المغلقة، ويقرأ الصور والفيديو، ويحمل رخصة تجارية، لم يعد فرضية — إنه ملف على Hugging Face. فيزياء تشغيله (1.4 تيرابايت، ثمانية معالجات H100 كحد أدنى) تعني أن معظم القراء سيُعجبون به من بعيد، أو سيصلون إليه عبر واجهة برمجية بدلاً من خوادمهم. لكن للفرق التي تملك البنية التحتية، وللجميع الذين يتابعون مسار الذكاء الاصطناعي المفتوح، K3 هو السقف الجديد — والسقف تحرك للتو بشكل كبير نحو الأعلى.

02

نقاط القوة والقيود بصراحة

نقاط القوة الرئيسية

  • أكبر عقل يمكنك تنزيله: بـ 2.8 تريليون معامل إجمالي (104 مليار نشط لكل رمز، باختيار 16 من أصل 896 خبيراً)، يُعد Kimi K3 أكبر نموذج بأوزان مفتوحة نُشر على الإطلاق. تُقيّمه Artificial Analysis بحوالي 80 من 100 على مؤشر الذكاء — المركز الخامس بين 215 نموذجاً مصنّفاً، وعلى بعد ثلاث نقاط فقط من Claude Fable 5. لا يُقترب أي نموذج آخر قابل للاستضافة الذاتية من هذا الموقع المستقل.
  • رؤية أصلية، وليس مجرد نص: على عكس GLM-5.2 ومعظم نماذج البرمجة المفتوحة، يأتي K3 بمُرمِّز رؤية مدمج (MoonViT-V2، 401 مليون معامل). يقرأ لقطات الشاشة والمخططات والرسوم البيانية والمستندات وحتى إطارات الفيديو. في سير العمل المستضاف ذاتياً الذي يتضمن مدخلات بصرية — تصحيح أخطاء الواجهات، تحليل المستندات، قراءة الرسوم — يُلغي الحاجة إلى ربط نموذج رؤية منفصل.
  • نتائج برمجة تضاهي الرواد المغلقين: تُفيد تقييمات Moonshot الذاتية بـ FrontierSWE 81.2% وTerminal-Bench 88.3 وDeepSWE 67.5. في مهمة تحسين النوى، تفوّق K3 بشكل كبير على GPT-5.6 Sol وGPT-5.5 وOpus 4.8 وفق مقارنة Moonshot. هذه أرقام رسمية، لكن تصنيف Artificial Analysis يؤكد بشكل مستقل أن K3 يستحق مكاناً في نقاش التقدّم.
  • رخصة تسمح بالاستخدام التجاري: تسمح رخصة Modified MIT للشركات باستضافة K3 ذاتياً وضبطه دقيقاً وتقطيره وتضمينه في منتجات تجارية مع الإسناد. ليست Apache 2.0 أو MIT قياسية نظيفة — بيانات التدريب وخط الأنابيب غير منشورة — لكن للفرق التي تحتاج مساراً تجارياً قابلاً للدفاع عنه، الشروط قابلة للتطبيق حيث لا تقدم多く من البدائل المتقدمة شيئاً.
  • بنية تحتية للنشر متاحة من اليوم الأول: نشرت vLLM معاينة لدعم بمقياس الإنتاج في 22 يوليو، مع تحسينات prefix-caching لـ KDA أُعيدت إلى المجتمع. تقدم SGLang وDocker وTogether AI وHuggingChat جميعاً مسارات فورية. إذا كان فريقك يشغّل بالفعل مجموعة معالجات رسومات، فإن الأدوات اللازمة لتقديم K3 ليست على بُعد أشهر — وصلت مع الأوزان.

قيود صادقة

  • هذا نموذج لمركز بيانات، وليس محلياً: تبلغ أوزان MXFP4 حوالي 1.4 تيرابايت. الحد الأدنى للتكوين التجريبي هو ثمانية معالجات رسومات H100 بسعة 80 غيغابايت (640 غيغابايت VRAM)، وتوصي Moonshot بعقد فائقة بـ 64 مسرّعاً أو أكثر للإنتاج. للمقارنة: GLM-5.2 — صاحب المركز الأول في هذه الفئة — يتسع في حوالي 241 غيغابايت ويعمل على Mac Studio متطور. لا يستطيع معظم قراء دليل الذكاء الاصطناعي المحلي استضافة K3 على أجهزة يملكونها بالفعل.
  • التحقق المستقل لا يزال مبكراً: صدرت الأوزان في 27 يوليو 2026. نشرت Artificial Analysis تصنيفها المركّب، لكن مجموعة الاختبارات المستقلة الكاملة — SWE-Bench وLiveBench وArena Elo عبر مهام متنوعة — لا تزال تكتمل. معظم النتائج التفصيلية في بطاقة النموذج تأتي من المصنّع. تعامل معها كإشارات قوية، لا كأحكام نهائية، حتى يكمل المُقيِّمون المستقلون جولاتهم.
  • الرخصة معدّلة وليست قياسية: تسمح شروط Modified MIT بالاستخدام التجاري مع الإسناد، لكنها ليست MIT أو Apache 2.0 الصافي الخالي من القيود الذي تحمله GLM-5.2 وGemma 4. بيانات التدريب غير منشورة والشروط المعدّلة الدقيقة تستحق قراءة متأنية قبل بناء منتج تجاري فوق هذه الأوزان.
  • مشاكل استقرار معروفة: تحذّر وثائق Moonshot ذاتها من أن K3 حساس لوضع سجل التفكير — تبديل محرك الاستدلال خلال الجلسة قد يُزعزع المخرجات. كما قد يكون النموذج مفرط المبادرة، متخذاً قرارات ذاتية لم يطلبها المستخدم. توصي Moonshot بقيود صريحة في تلميحات النظام أو ملف AGENTS.md. هذا قابل للإدارة لكنه حقيقي، خاصة في خطوط الأنابيب الآلية.
  • لمعظم مشتري الذكاء الاصطناعي المحلي، تبقى GLM-5.2 الخيار الأفضل: K3 أكثر قدرة على الورق، لكن GLM-5.2 يعمل على أجهزة يستطيع فرد جاد أو فريق صغير شراءها فعلاً، ويحمل رخصة MIT نظيفة، ويمتلك أشهراً من التحقق المجتمعي المستقل. K3 يأخذ تاج القدرة؛ GLM-5.2 يحتفظ بتاج العملية. لهذا يدخل K3 في المركز الثاني، لا الأول.
03

لمحة عن المعايير

Artificial Analysis Intelligence Index — ~80 (المركز 5 من 215)

أقوى إشارة مستقلة متاحة. يحتل K3 المركز الخامس عالمياً ويقع على بعد ثلاث نقاط من Claude Fable 5 — أول نموذج بأوزان مفتوحة يصل إلى هذه المرتبة. نتيجة مركّبة؛ تفاصيل كل مهمة لا تزال تُنشر.

FrontierSWE — 81.2% / Terminal-Bench 2.1 — 88.3

اختبارات من المصنّع لهندسة البرمجيات وعامل سطر الأوامر. يقيس FrontierSWE مهام حقيقية على مستودعات كبيرة؛ ويقيس Terminal-Bench كفاءة سطر الأوامر. نتائج قوية، لكن بانتظار التأكيد المستقل بعد استقرار الأوزان.

GPQA Diamond — 93.5

أسئلة علمية بمستوى الدراسات العليا. قرب قمة أي تصنيف عام — مفتوح أو مغلق. يشير إلى أن ذكاء K3 يتجاوز البرمجة إلى الاستدلال العام.

البنية — 2.8T MoE / 104B نشط

896 خبيراً مع اختيار 16 لكل رمز. توفر Kimi Delta Attention وAttention Residuals معاً حوالي 2.5× كفاءة في التوسع مقارنة بـ K2. أوزان MXFP4 أصلية وتنشيطات MXFP8 مع تدريب واعٍ بالتكميم مدمج منذ مرحلة SFT.

04

الحكم

Kimi K3 هو أكثر نموذج بأوزان مفتوحة قدرة يمكن تنزيله — وهذه الجملة أصبحت حقيقة بدلاً من طموح. عقل قابل للاستضافة الذاتية يحتل المركز الخامس عالمياً على Artificial Analysis، ويقرأ الصور والفيديو، ويحتفظ بمليون رمز من السياق، ويحمل رخصة تجارية — إنها خطوة حقيقية كبرى. لكن المعالم لا تلغي قوانين الفيزياء. البصمة البالغة 1.4 تيرابايت والحد الأدنى لثمانية معالجات H100 تضع هذا النموذج خارج متناول الجميع باستثناء الفرق التي تشغّل بالفعل مجموعات معالجات رسومات. تبقى GLM-5.2 في المركز الأول في هذه الفئة لأنها تقدم ذكاء برمجة شبه متقدم على أجهزة يستطيع الفرد شراءها، برخصة MIT نظيفة وأشهر من التحقق المستقل. يحتل K3 المركز الثاني كالنموذج الذي يدفع السقف: الدليل على أن حدود الأوزان المفتوحة قد وصلت، حتى لو كان معظم القراء سيصلون إليه عبر واجهة برمجية بدلاً من خوادمهم. إذا كنت تملك البنية التحتية — أو إذا كانت القدرة الخام هي المتغير الوحيد — فإن K3 هو الملك الجديد للأوزان المفتوحة. إذا كنت تختار نموذجاً لتشغيله محلياً فعلاً، ابدأ بـ GLM-5.2.

05

الأسئلة الشائعة