O'rin #2 Lokal / Maxfiy SI — Sizning miyangiz, Sizning qurilmangiz, Sizning qoidalaringiz
Moonshot AI

Kimi K3

Yopiq frontier-doninga o'xshaydigan birinchi ochiq vaznli model. 2.8 trillion parametrdan iborat Mixture-of-Experts arxitekturasi, tub ko'rish qobiliyati, to'liq bir million tokenlik kontekst va tijoriy foydalanishga ruxsat beruvchi litsenziya — barchasi siz nazorat qiladigan mashinaga yuklab olinadi. Muammo mashinada: u ish stoliga emas, ma'lumotlar markaziga muhtoj.

Yangilangan July 28, 2026 Open WeightsModified MIT2.8T MoE
8.510 dan
Rasmiy veb-sayt
Eng mos

Yopiq frontier-doninga o'xshaydigan birinchi ochiq vaznli model. 2.8 trillion parametrdan iborat Mixture-of-Experts arxitekturasi, tub ko'rish qobiliyati, to'liq bir million tokenlik kontekst va tijoriy foydalanishga ruxsat beruvchi litsenziya — barchasi siz nazorat qiladigan mashinaga yuklab olinadi. Muammo mashinada: u ish stoliga emas, ma'lumotlar markaziga muhtoj.

Nima uchun bu eng yaxshisi

Tarixdagi eng yirik ochiq vaznli model. Artificial Analysis uni dunyoda 5-o'ringa qo'yadi (Claude Fable 5 dan atigi uch ochko orqada). Ushbu kategoriyadagi hech qanday ochiq model taklif etmaydigan tub ko'rish va video tushunish. Kuchli ishlab chiqaruvchi kodlash natijalari — FrontierSWE 81.2, Terminal-Bench 88.3, DeepSWE 67.5. Modified MIT litsenziyasi manbani ko'rsatish bilan tijoriy self-hosting ga ruxsat beradi. Birinchi kundan boshlab vLLM, SGLang, Docker, Together AI va HuggingChat orqali joylashtirish qo'llab-quvvatlashi.

E'tibor bering

MXFP4 vaznlari taxminan 1.4 terabaytni tashkil etadi. Eksperimental ishga tushirish kamida sakkizta H100 80 GB GPU talab qiladi; ishlab chiqarish uchun 64 va undan ortiq tezlatkich ko'p tugunlarda tavsiya etiladi. Bu noutbuk, ish stoli yoki yagona ish stansiyasi modeli emas. Ko'pgina ko'rsatkichlar ishlab chiqaruvchidan keladi — mustaqil baholashlar 27-iyul chiqarilishidan keyin to'ldirilmoqda. O'zgartirilgan litsenziya toza MIT yoki Apache 2.0 emas va modelda fikrlash tarixi va haddan tashqari tashabkorlik bilan bog'liq ma'lum barqarorlik muammolari bor.

01

Aslida bu nima

Yillar davomida ochiq vazn hamjamiyati oddiy qoida bilan yashadi: siz maxfiylik yoki frontier intellektga ega bo’lishingiz mumkin edi, lekin ikkalasini bir vaqtda emas. Yuklab olish va o’zingiz ishga tushirish mumkin bo’lgan eng yaxshi modellar doimo yopiq gigantlardan bir pog’ona orqada edi. Ko’plab vazifalar uchun yetarli darajada yaxshi, lekin qiyinlari uchun emas.

Kimi K3 — shu qoidani eskirgandek ko’rsatadigan model.

Moonshot AI to’liq vaznlarni 2026-yil 27-iyulda chiqardi va raqamlar hayratlanarli. 2.8 trillion parametr, Mixture-of-Experts arxitekturasi sifatida tashkil etilgan — 896 ekspert, ulardan har bir tokenda 16 tasi ishga tushadi (104 milliard faol). MoonViT-V2 deb ataladigan ichki vision encoder modelga ekran tasvirlari, diagrammalar, grafiklar, hujjatlar va hatto video kadrlarni tubdan o’qishga imkon beradi. Kontekst oynasi bir million token ga cho’ziladi — taxminan o’nta to’liq roman. Va hammasi tijoriy foydalanishga ruxsat beruvchi Modified MIT litsenziyasi ostida.

Mustaqil dalil imkoniyat da’vosini tasdiqlaydi. Artificial Analysis — AI sohasidagi eng yaqin betaraf hakam — K3 ni Intelligence Index da 100 dan taxminan 80 ballga baholaydi va dunyodagi 215 model orasida 5-o’ringa qo’yadi. Bu uni Claude Fable 5 — haqiqiy pul turadigan yopiq model — dan atigi uch ochko ichiga olib kiradi. Hech qanday boshqa ochiq vaznli model bu darajaga yetmagan.

Arxitektura hikoyasi

Sof parametr soni — bu sarlavha, lekin uning ostidagi muhandislik e’tiborga loyiq. K3 Moonshot Kimi Delta Attention (KDA) va Attention Residuals deb ataydigan ikki g’oya ustiga qurilgan. KDA standart yondashuvlardan yaxshiroq masshtablanadigan samarali diqqat mexanizmidir; Attention Residuals ma’lumotni model chuqurligi bo’ylab bir xilda to’plamasdan, tanlab oladi. Birgalikda Moonshot K2 ga nisbatan taxminan 2.5× masshtablash samaradorligi yaxshilanishini xabar qiladi.

Bu amalda nima degani: model o’zining ulkan parametr byudjetini sodda masshtablashtirishdan ko’ra aqlliroq ishlatadi. U shuningdek tub MXFP4 kvantlash bilan keladi — vaznlar 4-bit aniqlikda, aktivatsiyalar 8-bit da saqlanadi va bu siqish keyin qo’shilgan emas, balki o’qitish davomida kiritilgan. Shuning uchun model butun ma’lumotlar markazini to’liq aniqlikda talab qilmasdan, “faqat” sakkizta H100 da ishlay oladi.

Nega u ushbu kategoriyada 1-o’rin emas

Mana halolis taranglik. Kimi K3 yer yuzidagi eng kuchli ochiq vaznli model. U shuningdek ushbu kategoriyadagi aksariyat o’quvchilar uchun eng amaliy bo’lmagan model.

MXFP4 vaznlari taxminan 1.4 terabaytni tashkil etadi. Moonshot tasvirlagan minimum eksperimental konfiguratsiya sakkizta H100 80 GB GPU ni — 640 gigabayt VRAM ni talab qiladi, bu joriy narxlarda taxminan 200 000 dollarlik uskunaga teng. Ishlab chiqarish 64 va undan ortiq tezlatkichni yuqori o’tkazuvchanlikli ulagichlar bilan bog’langan ko’p tugunlarda xohlaydi. Bu ish stansiyasi emas. Bu kichik superkompyuter.

Buni GLM-5.2, ushbu kategoriyadagi joriy 1-o’rin bilan solishtiring. GLM-5.2 — 744 milliard parametrli model (taxminan 40 milliard faol) bo’lib, agressiv 2-bit kvantlash bilan taxminan 241 gigabaytga sig’adi — 256 GB birlashtirilgan xotirali Mac Studio yoki ikkita GPU li ish stansiyasi yetarli. U toza MIT litsenziyasini oladi. U hamjamiyatning oylab mustaqil tasdig’iga ega, jumladan Design Arena kodlash reytingida birinchi o’rin.

K3 sof intellekt, multimodal imkoniyat va sof masshtabda g’alaba qozonadi. GLM-5.2 oddiy odam yoki kichik jamoa uni haqiqatan ishlatishi mumkinligini belgilovchi hamma narsada g’alaba qozonadi. “Mahalliy / Shaxsiy AI” deb nomlangan kategoriya uchun bu amaliy farq hal qiluvchi — shuning uchun K3 2-o’ringa kiradi, 1-o’ringa emas.

K3 haqiqatan nima yaxshi qiladi

Uskuna masalasini chetga surib qo’yib, imkoniyat profili hayratlanarli. Moonshot ning o’z baholashlarida K3 FrontierSWE 81.2% (katta repozitoriyalarda real dasturiy injeneriya vazifalari), Terminal-Bench 88.3 (buyruq satri agenti kompetentsiyasi) va GPQA Diamond 93.5 (magistratura darajasidagi ilmiy mulohaza) ga erishadi. Kernel optimallashtirish benchmarkida Moonshot K3 GPT-5.6 Sol, GPT-5.5 va Opus 4.8 ni sezilarli darajada ortda qoldirdi deb xabar beradi — garchi bu kompaniya raqamlari bo’lib, mustaqil tasdiqlashni kutmoqda.

Tub multimodal imkoniyat — K3 ni GLM-5.2 dan ushbu kategoriyada eng aniq ajratib turadigan xususiyat. GLM-5.2 faqat matn va kod. K3 tasvirlar, ekran tasvirlari, grafiklar va videoni o’qiydi. Vizual kiritma bilan ishlaydigan self-hosted jarayonlarda — PDF ni tahlil qilish, ekran tasviridan interfeysni sozlash, ma’lumotlarni vizualizatsiyasini ko’rib chiqish — K3 buni alohida ko’rish modelini qo’shmasdan tubdan boshqaradi. Bu o’z fayrvoli ortidan multimodal jarayonlar qurayotgan jamoalar uchun haqiqiy arxitektura afzalligi.

Joylashtirish haqiqati

Agar tashkilotingiz allaqachon GPU klasterini boshqarsa — tadqiqot laboratoriyasi, bulut kompaniyasi, korporativ AI jamoasi — bir kunlik reliz uchun joylashtirish hikoyasi g’oyat darajada etuk. vLLM 22-iyulda ishlab chiqarish masshtabidagi qo’llab-quvvatlash ko’rinishini e’lon qildi, Moonshot ochiq manbali hamjamiyatga qaytargan KDA prefix-caching optimallashtirishlari bilan. SGLang, Docker, Together AI va HuggingChat hammasi modelni xizmat ko’rsatish uchun darhol yo’llarni taklif etadi. Asboblar to’siq emas; uskuna — to’siq.

Boshqa hamma uchun Moonshot API xuddi shu modelni kirish tokenlari millioniga 3 dollar va chiqish tokenlari millioniga 15 dollar ga (keshlangan kirish 0.30 dollar) taklif etadi. Bu frontier-sinf ish uchun oqilona narx, lekin u “mahalliy AI” reytingining maqsadini barbod qiladi: ma’lumotlar sizning mashinangizdan chiqib ketadi.

Ma’lum qo’polliklar

Moonshot K3 ning cheklovlarini o’z hujjatlarida maqtarli darajada shaffof ko’rsatadi. Model fikrlash tarixi rejimiga sezgir — seans davomida inference dvigatelini almashtirish natijani beqarorlashtirishi mumkin, bu bir nechta xizmat ko’rsatish freymvorklarini boshqaradigan jamoalar uchun muhim. U shuningdek haddan tashqari tashabkor bo’lib, foydalanuvchi so’ramagan mustaqil qarorlar qabul qilishi mumkin. Moonshot modelni o’z yo’nalishida ushlab turish uchun system prompt larda yoki AGENTS.md faylida aniq cheklovlarni tavsiya qiladi.

Shuningdek foydalanuvchi tajribasidagi sezilarli bo’shliq bor — Moonshot o’zi tan olganidek, Claude Fable 5 va GPT-5.6 Sol kabi jilolangan yopiq mahsulotlar bilan solishtirganda. Sof intellekt joyida; silliqlik hali emas.

Xulosa

Kimi K3 — ochiq vazn frontier-i kelganini isbotlovchi model. Eng yaxshi yopiq modellar bilan raqobatlashadigan, tasvirlar va videoni o’qiydigan va tijoriy litsenziyani olib yuradigan yuklab olinadigan miya endi gipoteza emas — u Hugging Face dagi fayl. Uni ishga tushirish fizikasi (1.4 terabayt, minimum sakkizta H100) shuni anglatadiki, aksariyat o’quvchilar uni uzoqdan qadr qiladi yoki o’z serverlari orqali emas, API orqali yetib boradi. Lekin infratuzilma bor jamoalar uchun va ochiq AI qayerga ketayotganini kuzatuvchi hamma uchun K3 — yangi shift va shift endi dramatik tarzda yuqoriga ko’tarildi.

02

Kuchli tomonlar va halol cheklovlar

Asosiy afzalliklari

  • Yuklab olish mumkin bo’lgan eng katta miya: Jami 2.8 trillion parametr bilan (har bir tokenda 104 milliard faol, 896 ekspertdan 16 tasi tanlanadi) Kimi K3 — nashr etilgan tarixdagi eng yirik ochiq vaznli model. Artificial Analysis uni Intelligence Index da taxminan 100 dan 80 ballga baholaydi — 215 reytinglangan model orasida 5-o’rin va Claude Fable 5 dan atigi uch ochko orqada. Hech qanday boshqa self-host qilinadigan model bu mustaqil darajaga yaqin kelmagan.
  • Tub ko’rish, nafaqat matn: GLM-5.2 va aksariyat ochiq kodlash modellaridan farqli o’laroq, K3 ichki vision encoder (MoonViT-V2, 401 million parametr) bilan keladi. U ekran tasvirlari, diagrammalar, grafiklar, hujjatlar va hatto video kadrlarni ham o’qiydi. Vizual kiritma bilan ishlaydigan self-hosted jarayonlarda — interfeyslarni sozlash, hujjatlarni tahlil qilish, grafiklarni o’qish — alohida ko’rish modelini zanjirlash zaruratini yo’qotadi.
  • Yopiq yetakchilar darajasidagi kodlash natijalari: Moonshot ning o’z baholashlari FrontierSWE 81.2%, Terminal-Bench 88.3 va DeepSWE 67.5 ni ko’rsatadi. Kernel optimallashtirish vazifasida K3 Moonshot taqqoslamasiga ko’ra GPT-5.6 Sol, GPT-5.5 va Opus 4.8 ni sezilarli darajada ortda qoldirdi. Bular rasmiy raqamlar, lekin Artificial Analysis reytingi mustaqil ravishda K3 frontier munozarasiga loyiq ekanligini tasdiqlaydi.
  • Tijoriy foydalanishga ruxsat beruvchi litsenziya: Modified MIT litsenziyasi kompaniyalarga K3 ni tijoriy tarzda self-host qilish, sozlash, distillash va manbani ko’rsatgan holda mahsulotlarga kiritishga imkon beradi. Bu toza Apache 2.0 yoki standart MIT emas — o’qitish ma’lumotlari va jarayoni nashr etilmagan — lekin himoya qilinadigan tijoriy yo’lni xohlaydigan jamoalar uchun shartlar qo’llaniladigan, ko’plab frontier alternativalar esa hech narsa taklif etmaydi.
  • Birinchi kundan joylashtirish infratuzilmasi: vLLM 22-iyulda ishlab chiqarish masshtabidagi qo’llab-quvvatlash ko’rinishini e’lon qildi, jamoatchilikka qaytarilgan KDA prefix-caching optimallashtirishlari bilan. SGLang, Docker, Together AI va HuggingChat hammasi darhol yo’llarni taklif etadi. Agar jamoangiz allaqachon GPU klasterini boshqarsa, K3 ni xizmat ko’rsatish uchun asbob oylab uzoqda emas — u vaznlar bilan birga keldi.

Haqiqiy cheklovlar

  • Bu ma’lumotlar markazi modeli, mahalliy emas: MXFP4 vaznlari taxminan 1.4 terabaytni tashkil etadi. Minimum eksperimental konfiguratsiya — sakkizta H100 80 GB GPU (640 GB VRAM) va Moonshot ishlab chiqarish uchun 64 va undan ortiq tezlatkichli super-nodelarni tavsiya qiladi. Taqqoslash uchun: GLM-5.2 — ushbu kategoriyada 1-o’rin — taxminan 241 GB sig’adi va yuqori darajadagi Mac Studio da ishlaydi. Mahalliy AI yo’riqnomasining aksariyat o’quvchilari K3 ni allaqachon egalik qiladigan uskunada host qila olmaydi.
  • Mustaqil tasdiqlash hali erta: Vaznlar 2026-yil 27-iyulda chiqdi. Artificial Analysis o’zining qo’shma reytingini e’lon qildi, lekin to’liq mustaqil benchmark to’plami — SWE-Bench, LiveBench, turli vazifalarda Arena Elo — hali to’ldirilmoqda. Model kartasidagi batafsil natijalarning aksariyati ishlab chiqaruvchidan keladi. Ularni mustaqil baholovchilar o’tkazishlarini tugatgunicha kuchli signallar sifatida qabul qiling, yakuniy hukm emas.
  • Litsenziya o’zgartirilgan, standart emas: Modified MIT shartlari manbani ko’rsatish bilan tijoriy foydalanishga ruxsat beradi, lekin GLM-5.2 va Gemma 4 ning toza, cheklovsiz MIT yoki Apache 2.0 si emas. O’qitish ma’lumotlari nashr etilmaydi va aniq o’zgartirilgan shartlar ushbu vaznlar ustida tijoriy mahsulot qurishdan oldin diqqat bilan o’qib chiqishga loyiq.
  • Ma’lum barqarorlik muammolari: Moonshot ning o’z hujjatlari K3 ning fikrlash tarixi rejimiga sezgir ekanligi haqida ogohlantiradi — seans davomida inference dvigatelini almashtirish natijani beqarorlashtirishi mumkin. Model shuningdek haddan tashqari tashabkor bo’lib, foydalanuvchi so’ramagan mustaqil qarorlar qabul qilishi mumkin. Moonshot system prompt larda yoki AGENTS.md faylida aniq cheklovlarni tavsiya qiladi. Bu boshqariladigan, lekin real, ayniqsa avtomatlashtirilgan jarayonlarda.
  • Mahalliy AI xaridorlarining aksariyati uchun GLM-5.2 yaxshiroq tanlov bo’lib qoladi: K3 qog’ozda kuchliroq, lekin GLM-5.2 jiddiy shaxs yoki kichik jamoa haqiqatan sotib olishi mumkin bo’lgan uskunada ishlaydi, toza MIT litsenziyasini oladi va mustaqil hamjamiyat tasdig’ining oylariga ega. K3 imkoniyat tojini oladi; GLM-5.2 amaliy tojini saqlaydi. Shuning uchun K3 2-o’ringa kiradi, 1-o’ringa emas.
03

Benchmark natijalari

Artificial Analysis Intelligence Index — ~80 (215 dan 5-o'rin)

Mavjud eng kuchli mustaqil signal. K3 dunyoda 5-o'rinni egallaydi va Claude Fable 5 dan uch ochko ichida — bu darajaga yetgan birinchi ochiq vaznli model. Qo'shma ball; vazifa bo'yicha taqsimot hali nashr etilmoqda.

FrontierSWE — 81.2% / Terminal-Bench 2.1 — 88.3

Moonshot ning dasturiy injeneriya va terminal agenti benchmarklari. FrontierSWE katta repozitoriyalarda real vazifalarni o'lchaydi; Terminal-Bench buyruq satri kompetentsiyasini o'lchaydi. Kuchli raqamlar, lekin vaznlar barqarorlashganidan keyin mustaqil tasdiqlashni kutmoqda.

GPQA Diamond — 93.5

Magistratura darajasidagi ilmiy savollar. Har qanday ochiq yoki yopiq reytingning cho'qqisiga yaqin. K3 intellekti kodlashdan tashqari umumiy mulohazagacha cho'zilishini ko'rsatadi.

Arxitektura — 2.8T MoE / 104B faol

896 ekspert, har bir tokenda 16 tasi tanlanadi. Kimi Delta Attention va Attention Residuals K2 ga nisbatan taxminan 2.5× masshtablash samaradorligini beradi. SFT bosqichidan boshlab o'qitishga kiritilgan quantization-aware training bilan tub MXFP4 vaznlari va MXFP8 aktivatsiyalari.

04

Xulosa

Kimi K3 — yuklab olish mumkin bo’lgan eng kuchli ochiq vaznli model va bu gap endi orzu emas, haqiqat. Self-host qilinadigan miya — dunyoda Artificial Analysis da 5-o’rinni egallagan, tasvirlar va videoni o’qiydigan, bir million token kontekstni ushlab turgan va tijoriy litsenziyani olib yuradigan — bu chinakam bosqich. Lekin bosqichlar fizikani bekor qilmaydi. 1.4 terabaytlik iz va sakkizta H100 minimumi ushbu modelni allaqachon GPU klasterlarini boshqaradigan jamoalardan tashqari hamma uchun yetib bo’lmaydigan qiladi. GLM-5.2 ushbu kategoriyada 1-o’rinda qoladi, chunki u odam sotib olishi mumkin bo’lgan uskunada frontier-ga yaqin kodlash intellektini yetkazadi, toza MIT litsenziyasi va mustaqil tasdiqlash oylari bilan. K3 2-o’rinni shiftni suruvchi model sifatida oladi: ochiq vazn frontier-i kelganining isboti, hatto aksariyat o’quvchilar unga o’z serverlari orqali emas, API orqali yetib borishsa ham. Agar sizda infratuzilma bo’lsa — yoki agar sof imkoniyat yagona o’zgaruvchi bo’lsa — K3 ochiq vaznlarning yangi qiroli. Agar haqiqatan mahalliy ishga tushirish uchun bitta modelni tanlasangiz, GLM-5.2 bilan boshlang.

05

Ko'p so'raladigan savollar