الترتيب #5 المنظومة اليومية — مساعدات الذكاء الاصطناعي الرائدة
Moonshot AI

Kimi K3

Kimi K3 هو أول إصدار من Kimi يستحق مكانًا بجوار منصات الذكاء اليومية، لا في مخطط النماذج فحسب. يجمع قدرات استدلال متقدمة مع محادثة الويب والهاتف، وتدفقات Agent المستقلة، وDocs وSheets وSlides وDeep Research وKimi Work وKimi Code. النموذج يقدم بالفعل أداءً لافتًا، مع بقاء حدود عملية في بعض تدفقات Agent.

تم التحديث 28 يوليو 2026 AgenticKnowledge WorkDocs & Sheets
الأفضل لـ

Kimi K3 هو أول إصدار من Kimi يستحق مكانًا بجوار منصات الذكاء اليومية، لا في مخطط النماذج فحسب. يجمع قدرات استدلال متقدمة مع محادثة الويب والهاتف، وتدفقات Agent المستقلة، وDocs وSheets وSlides وDeep Research وKimi Work وKimi Code. النموذج يقدم بالفعل أداءً لافتًا، مع بقاء حدود عملية في بعض تدفقات Agent.

لماذا تفوز

تمنح Artificial Analysis النموذج 57 إجمالًا، و1668 Elo في GDPval-AA v2، و1547 Elo في AA-Briefcase، و53% في AutomationBench-AA. يقبل المنتج النص والصور، ويوفر النموذج سياق 1M، ويستطيع Kimi إنتاج مواقع وتقارير وملفات Word وجداول وعروض وكود. توجد خطة مجانية ثم خطط مدفوعة تبدأ من 19 دولارًا شهريًا.

انتبه إلى

عقل Kimi الاصطناعي قوي فعلًا، لكن التفاصيل العملية تحمل بعض القيود: قد ينسى Agent العادي تعليمات مبكرة في محادثة طويلة، وعادة ما يخرج ملفًا واحدًا لكل مهمة، ويستخدم عمليًا سياقًا أصغر من حد المليون للنموذج. قاست Artificial Analysis أيضًا هلوسة 51% واستهلاكًا مرتفعًا للرموز وسرعة دون المتوسط. Kimi ليس مرتبطًا بـWorkspace وAndroid وChrome وSearch مثل Gemini.

01

ما هو في الواقع

تُبنى معظم مساعدات الذكاء الاصطناعي حول نافذة محادثة بسيطة: تسأل فتحصل على إجابة. يذهب Kimi K3 أبعد من ذلك، إذ يجمع المحادثة مع أدوات متخصصة للبحث والوثائق والجداول والعروض والمواقع والبرمجة والأتمتة. لم تدرب Moonshot نموذجًا أكبر فحسب، بل بنت مجموعة من المنتجات التي تحول استدلاله إلى عمل مكتمل.

تبرر النتائج المستقلة أخذه بجدية. تمنح Artificial Analysis النموذج 57 نقطة و1668 Elo في GDPval-AA v2 و1547 Elo في AA-Briefcase. في اختبار العمل المهني الطويل هذا لا يتقدمه سوى Claude Fable 5. كما يحقق 53% والمركز الأول في AutomationBench-AA. أي أن K3 لا يعرف الأشياء فحسب، بل يستطيع دفع مهمة متعددة الخطوات نحو ملف يُسلَّم.

مجموعة منتجات Kimi واسعة. يبحث Agent ويبني مواقع وينتج وثائق ويحلل جداول ويصنع عروضًا. ينقل Kimi Work تدفقات الوكلاء إلى تطبيق سطح المكتب، ويخدم Kimi Code المطورين، ويوزع Agent Swarm الأبحاث الكبيرة والمهام الدفعية على عدة وكلاء، ويحافظ Claw على الأتمتة. وهي تلبي حاجة عملية: يريد الناس غالبًا الجدول أو العرض أو التقرير المكتمل، لا مجرد تعليمات لإنتاجه.

يشكل سياق المليون رمز مع الصور طاولة قراءة ضخمة. يمكن دراسة التقارير واللقطات والمخططات والمصادر معًا. السياق الأكبر ليس ذاكرة مثالية، وكثرة الأوراق قد تزيد الارتباك. لكنه مفيد فعلًا للمقارنات القانونية ومجموعات الأبحاث والتحليل المالي.

يسهل تجربة Kimi على الويب والهاتف. تشمل الخطة المجانية عددًا قليلًا من مهام Agent، وتبدأ الخطط المدفوعة من 19 دولارًا شهريًا. تكلف الـAPI 3 دولارات للإدخال و15 للإخراج لكل مليون. K3 ليس نموذجًا رخيصًا؛ فسعره موجه للعمل المهني.

لماذا المركز الرابع فقط؟ لأن هذه الفئة تقيم النظام المتكامل كله، لا النموذج وحده. قد يكون Gemini أضعف في بعض الاختبارات المستقلة، لكن Google تربطه مباشرة بالبريد والوثائق والتقاويم والمتصفحات والهواتف والبحث وصلاحيات المؤسسات. لدى Kimi أدوات كثيرة، لكنها ليست متكاملة بالعمق نفسه مع الخدمات التي يستخدمها الناس يوميًا. ولمن يختار مساعدًا واحدًا، تمثل هذه السهولة ميزة حقيقية.

الموثوقية هي القيد الآخر. وجدت Artificial Analysis دقة أعلى مع هلوسة 51%. يشبه ذلك زميلًا لامعًا يجيب صحيحًا أكثر لكنه أقل استعدادًا لقول «لا أعرف». يصبح منتجًا جدًا مع فحص المصادر والصيغ، وخطرًا من دونه.

ويجب التحقق من حد المليون رمز في المنتج المعني: يدعمه النموذج، لكن بعض تدفقات Agent توثق حدودًا عملية أصغر. وصلت الأوزان المفتوحة الكاملة في 27 يوليو تحت رخصة Modified MIT — لكن بـ 2.8 تريليون معامل وحجم يقارب 1.4 تيرابايت بصيغة MXFP4، تتطلب أجهزة بمستوى مراكز البيانات. لذلك يستحق Kimi K3 المركز الرابع للبحث العميق والوثائق الكثيرة والملفات النهائية. يندمج Gemini بسهولة أكبر في تدفق عمل قائم على Google. أما Kimi فبديل قوي، لكن ينبغي فحص حدود أداة Agent المحددة قبل بناء مهمة كبيرة عليها.

02

نقاط القوة والقيود بصراحة

نقاط القوة الرئيسية

  • أداء العمل المعرفي المستقل قريب من القمة: يحقق K3 1668 Elo في GDPval-AA v2 و1547 Elo في AA-Briefcase، حيث تضعه Artificial Analysis خلف Fable 5 فقط. هذا دليل على التقارير والتحليل والعمل المهني متعدد الخطوات، لا أسئلة أكاديمية فحسب.
  • يسلم النظام ملفات بدل التوقف عند النصائح: ينشئ Kimi Agent ملفات Word ويعدلها، ويحلل Excel وينتجه، ويبني عروضًا وPDF ومواقع وتقارير بحث عميق. للمستخدم غير التقني، ملف قابل للتنزيل أثمن غالبًا من فقرة أخرى تشرح صنعه.
  • تدفقات الوكلاء قوة حقيقية: تسجل Artificial Analysis 53% والمركز الأول في AutomationBench-AA. تنقل منتجات Agent وAgent Swarm وWork وCode وClaw هذه القوة إلى مهام الويب وسطح المكتب والبرمجة والأتمتة المستمرة.
  • يساعد السياق الكبير وإدخال الصور في العمل المكثف على الوثائق: يقبل K3 النص والصور ضمن سياق 1M. يمكنه الربط بين العقود والتقارير واللقطات والمخططات ومجموعات الوثائق الكبيرة من دون أن يفقد السياق المهم باستمرار.
  • هناك سلم وصول مفيد: يعمل Kimi على الويب وiOS وAndroid وHarmonyOS. توفر الخطة المجانية عددًا قليلًا من مهام Agent، وتبدأ العضوية من 19 دولارًا شهريًا مع حصص أكبر للوكلاء والسرب والكود وقواعد البيانات.
  • تبقى الـAPI منافسة للعمل الجاد: بسعر 3/15 دولارًا لكل مليون رمز إدخال/إخراج و0.30 دولار للمدخل المخبأ، ليس K3 رخيصًا. لكن Artificial Analysis تقدر نحو 0.94 دولار للمهمة في مؤشرها، قريبًا من GPT-5.6 Sol وأقل كثيرًا من Fable 5 هناك.

قيود صادقة

  • يظل Gemini أعمق تكاملًا مع أدوات الحياة اليومية: يتكامل Gemini مع Workspace وAndroid وChrome وSearch. لدى Kimi أدوات كثيرة، لكن عددًا أقل بكثير من الناس يستخدمونها يوميًا؛ لذلك يبقى K3 في المركز الرابع خلف Gemini.
  • موثوقية الحقائق ما زالت مقلقة: قاست Artificial Analysis هلوسة 51% مقابل 39% لـK2.6 رغم تحسن الدقة. يجب التحقق من المصادر والصيغ وبنود العقود والادعاءات التجارية.
  • حد النموذج ليس دائمًا حد المنتج: يدعم K3 مليون رمز، بينما تصف وثائق Agent حدودًا عملية أصغر لبعض التدفقات. تحقق من الواجهة الفعلية قبل الوعد بأن أي مهمة وثائق ضخمة ستناسبها.
  • الاستدلال الأقصى ليس محادثة فورية: أُطلق K3 بجهد تفكير أقصى افتراضيًا، ووجدته Artificial Analysis كثير الكلام وأبطأ من المتوسط. يناسب تقريرًا صعبًا، لكنه مبالغ فيه لسؤال بسيط عن موعد اجتماع.
  • الأوزان المفتوحة متاحة الآن، لكن تشغيلها مسألة أخرى: نشرت Moonshot الأوزان الكاملة البالغة 2.8 تريليون معامل في 27 يوليو تحت رخصة Modified MIT، مؤكدةً أن K3 قابل للاستضافة الذاتية فعلاً. لكن بحجم يقارب 1.4 تيرابايت بصيغة MXFP4، يحتاج التشغيل الإنتاجي إلى عشرات معالجات H100 عبر عقد متعددة. لمعظم المستخدمين تبقى واجهة API المستضافة هي المسار العملي؛ الأوزان تهم بشكل أساسي المؤسسات والمختبرات البحثية التي تشغل بالفعل مجموعات معالجات رسومات.
03

لمحة عن المعايير

Artificial Analysis Intelligence Index — ‏57

نتيجة مستقلة قريبة من القمة، خلف Fable 5 وGPT-5.6 Sol وأمام Grok 4.5. قد تغير مستويات جهد متعددة المركز الرقمي الظاهر.

GDPval-AA v2 — ‏1668 Elo

عمل وكيل مهني واقعي. يأتي K3 خلف Fable 5 وGPT-5.6 Sol، لكنه يتقدم على Opus 4.8 وGrok 4.5 في المقارنة المذكورة.

AA-Briefcase — ‏1547 Elo (المركز 2)

اختبار خاص للعمل المعرفي الطويل. يأتي K3 خلف Fable 5 فقط ويتميز خصوصًا في الجودة التحليلية.

AutomationBench-AA — ‏53% (المركز 1)

تنفيذ مستقل لمهام أتمتة SaaS، يدعم أن وكلاء Kimi يفعلون أكثر من المحادثة.

تكلفة Intelligence Index — نحو 0.94 دولار للمهمة

تقدير مبني على استهلاك الرموز المقاس وأسعار الـAPI. تعتمد الكلفة الفعلية بشدة على طول التفكير وإعادة استخدام الذاكرة المخبأة.

04

الحكم

يدخل Kimi K3 ترتيب Everyday Ecosystem في المركز الرابع. قدرته كافية بوضوح: تضعه اختبارات مستقلة قرب القمة، وبنت Kimi واحدة من أوسع حزم الوكلاء المنتجة لملفات نهائية خارج المنصات الثلاث المهيمنة. يبقى خلف Gemini لأن النظام اليومي يتعلق أيضًا بمكان البريد والوثائق والمتصفح والهاتف والزملاء أصلًا. اختر Kimi للبحث العميق أو مجموعات الوثائق أو التدفقات المستقلة أو ملفات Office النهائية في خدمة واحدة. احتفظ بمراجعة للحقائق، وانتبه إلى أنه رغم إمكانية تنزيل الأوزان المفتوحة الآن، فإن تشغيلها بنفسك يتطلب أجهزة بمستوى مراكز البيانات.

05

الأسئلة الشائعة