O'rin #6 Lokal / Shaxsiy SI — ongingiz, qurilmangiz, qoidalaringiz
Moonshot AI

Kimi K3

2,8 trillion parametrli, ochiq vaznli frontier model: u xususiy AI nihoyatda ulkan va juda kuchli bo‘lishi mumkinligini isbotlaydi. Shu bilan birga, yuklab olish bepul bo‘lsa ham, uni ishlatadigan mashina bepul emasligini ham ko‘rsatadi.

Yangilangan 2026-yil 29-avgust Open WeightsModified MIT2.8T MoE
8.510 dan
Rasmiy veb-sayt
Eng mos

2,8 trillion parametrli, ochiq vaznli frontier model: u xususiy AI nihoyatda ulkan va juda kuchli bo‘lishi mumkinligini isbotlaydi. Shu bilan birga, yuklab olish bepul bo‘lsa ham, uni ishlatadigan mashina bepul emasligini ham ko‘rsatadi.

Nima uchun bu eng yaxshisi

Artificial Analysis joriy Intelligence Index’da Kimi K3’ga taxminan 60 ball beradi; bu ochiq vaznli frontier’da yetakchi GLM-5.3 bilan teng natija. Bunga ichki multimodallik, 1M kontekst va Moonshot e’lon qilgan kuchli kodlash natijalari qo‘shiladi.

E'tibor bering

MXFP4 vaznlar to‘plami hajmi taxminan 1,4 TB; production xizmat ko‘rsatish uchun o‘nlab tezlatkich talab qilinishi mumkin, Modified MIT litsenziyasi esa standart MIT bilan aynan bir xil emas. Endi ushbu Lokal reytingda undan yuqorida turadigan, amalda qulayroq 75–306 GB hajmli raqiblar bor.

01

Aslida bu nima

Kimi K3 — “o‘zingiz ishga tushiring” degan ibora ma’lumotlar markazi miqyosigacha cho‘zilganda nima bo‘lishining namunasidir. Vaznlarni yuklab olish mumkin, model tashkilot chegarasi ichida qoladi va uning intellekti frontier darajasiga yaqin. Ammo rasmiy siqilgan vaznlar to‘plami taxminan 1,4 terabayt. Maxfiylikka erishish mumkin; soddalikka esa yo‘q.

Artificial Analysis hozir Kimi K3’ni joriy Intelligence Index’da taxminan 60 ballga qo‘yadi; bu yetakchi ochiq vaznli guruhdagi flagman GLM-5.3 bilan teng. Saytdagi avvalgi matnda eski shkala bo‘yicha 80 ga yaqin ball va beshinchi o‘rin tilga olingan edi. U suratning muddati tugadi. Yangi ball intellekt yomonlashganini anglatmaydi; o‘lchov chizig‘i o‘zgardi.

Moonshot’ning muayyan vazifalar bo‘yicha hikoyasi hamon ta’sirli. Kompaniya Terminal-Bench 2.1’da 88.3, DeepSWE’da 67.5 va FrontierSWE’da 81.2 natijani qayd etadi. Tasvir va videoni ichki tushunish qobiliyati hamda bir million tokenlik kontekst K3’ni oddiy matn dvigatelidan kattaroq tizimga aylantiradi. Xususiy tizim vizual materiallar, katta repozitoriylar va uzoq tarixlarni uchinchi tomon model provayderiga yubormasdan tekshira oladi.

Keyin fizika hisobni taqdim etadi. Mixture-of-Experts arxitekturasi har bir token uchun taxminan 104 milliard parametrni faollashtiradi, biroq tizim 2,8 trillion parametrli ekspertlar jamlanmasining barchasini saqlashi va yo‘naltirishi kerak. Tajriba qurilmalari ko‘plab katta xotirali tezlatkichlardan boshlanadi; jiddiy production tizimi esa o‘nlab tezlatkich talab qilishi mumkin. Har bir bemor bilan mutaxassislarning faqat ayrimlari ishlashi kasalxonaga qolgan xonalarni buzib tashlash imkonini bermaydi.

Raqobat zinapoyasi ham o‘zgardi. GLM-5.3-Flash 306 GiB hajmdagi rasmiy FP8 vaznlar to‘plami, MIT huquqlari va mustaqil sinovlarda biroz pastroq qobiliyatni taklif etadi. Qwen3.8-Flash-Next agressiv kvantlashda taxminan 75 GB gacha tushadi va faqat olti milliard faol parametr ishlatadi, ammo uning litsenziyasi torroq. Qwen3.8-27B to‘rt bitda taxminan 18 GB’ga sig‘adi. Ularning hech biri Kimi’ning barcha kuchli tomonlarini takrorlamaydi, lekin har biriga egalik qilish ancha oson.

Shu sabab Kimi K3 amaliy top-ikki tavsiyadan biri bo‘lmasa ham, muhim bosqichligicha qoladi. Tashkilotingiz zarur infratuzilmani allaqachon boshqarsa va modelning multimodal profili bir xil sharoitdagi baholashda g‘olib chiqsa, uni tanlang. Qolganlar uchun ochiq vaznlar inqilobi endi o‘sha binoga kirish uchun kichikroq eshiklarni ham taklif etadi.

02

Kuchli tomonlar va halol cheklovlar

Asosiy afzalliklari

  • Ochiq vaznlar orasidagi sof salohiyati favqulodda yuqori: Artificial Analysis’ning joriy sinovlari Kimi K3’ni taxminan 60 ballga qo‘yadi — u yuklab olinadigan eng kuchli modellar guruhida va eng yaxshi yopiq modellarga yaqin.
  • Multimodallik va kontekst keyin qo‘shilgan bezak emas: Tasvir va videoni ichki tushunish qobiliyati hamda bir million tokenlik kontekst xususiy hujjatlar, repozitoriylar va uzoq davom etuvchi agent jarayonlariga mos keladi.
  • Moonshot jiddiy kodlash kuchini qayd etadi: Ishlab chiqaruvchi oshkor qilgan sharoitlarda Terminal-Bench 2.1’da 88.3, DeepSWE’da 67.5 va FrontierSWE’da 81.2 natijalar modelni frontier darajasiga olib chiqadi.
  • Vaznlar to‘plami mustaqil, suveren joylashtirish imkonini beradi: Yetarli infratuzilmaga ega tashkilotlar o‘zgarib turadigan tashqi API nuqtasiga tayanmasdan, model ishlashini va maxfiy kontekstni o‘z chegarasi ichida saqlashi mumkin.

Haqiqiy cheklovlar

  • Hajmi terabaytlarda o‘lchanadi: Taxminan 1,4 TB MXFP4 vaznlar va katta tezlatkich klasterlarini ko‘zda tutadigan production tavsiyalari deyarli barcha yakka foydalanuvchi va kichik jamoalarni chetda qoldiradi.
  • Faol parametrlar saqlash hajmini yo‘qqa chiqarmaydi: Har bir token uchun taxminan 104B parametr ishlaydi, ammo 2,8T ekspertlarning to‘liq jamlanmasi baribir saqlanishi va yo‘naltirilishi kerak.
  • Vazifalarga oid batafsil ballarning aksariyati ishlab chiqaruvchiga tegishli: Artificial Analysis umumiy qobiliyatni mustaqil tasdiqlaydi; Moonshot’ning aniq kodlash va kernel natijalari esa baribir uning sinov tizimiga bog‘liq va bir xil sharoitda qayta tekshirilishi kerak.
  • Litsenziya standart MIT emas, Modified MIT: Tijoriy foydalanish keng doirada mumkin, lekin operatorlar qisqa yorliqqa suyanmay, manbani ko‘rsatish va mahsulot nomiga oid shartlarni o‘qib chiqishi lozim.
03

Benchmark natijalari

Artificial Analysis Intelligence Index — taxminan 60

Joriy mustaqil kompleks dalillar Kimi K3’ni ochiq vaznli frontier yaqinida GLM-5.3 bilan tenglashtiradi. Saytdagi avvalgi 80 ballik shkala ishlatilgan matn endi eskirgan.

Terminal-Bench 2.1 — 88.3 (Moonshot sinovi)

Ishlab chiqaruvchi taqqoslashida boshqa frontier tizimlariga yaqin kuchli terminal-agent natijasi. Sinov tizimi va versiya albatta ko‘rsatilishi kerak.

DeepSWE — 67.5 (Moonshot sinovi)

Uzoq davom etadigan kodlash vazifalari bo‘yicha ta’sirli dalil, ammo natija sozlamalarga bog‘liq va uni mustaqil lokal kvant natijasi deb bo‘lmaydi.

Vaznlar to‘plami hajmi — taxminan 1,4 TB MXFP4

Ushbu reyting o‘rnini belgilaydigan amaliy raqam: hatto siqilgan rasmiy vaznlar ham ma’lumotlar markazi darajasidagi saqlash va tezlatkich xotirasini talab qiladi.

04

Xulosa

Kimi K3 Lokal / Xususiy AI reytingida 8.5 ball bilan #6 o‘ringa tushadi. U hanuz muhim bosqich va tashkilot egalik qilishi mumkin bo‘lgan eng aqlli modellardan biri, ammo endi kategoriyada qulayroq zinapoyalar bor: bitta mashinada ishlatish uchun Qwen3.8-27B, MIT litsenziyali multimodal klaster uchun GLM-5.3-Flash, katta RAM’dan samarali foydalanish uchun Qwen3.8-Flash-Next, matn va kod xizmatlari uchun DeepSeek hamda kichikroq klasterda maksimal qobiliyat uchun yetakchi GLM-5.3. Kimi’ni juda katta o‘rnatishni oqlaydigan o‘ziga xos multimodal va kodlash profili kerak bo‘lganda tanlang — eski maqolada u hali ham #2 deb yozilgani uchun emas.

05

Ko'p so'raladigan savollar