O'rin #5 Kundalik ekotizim — Yetakchi SI yordamchilari
Moonshot AI

Kimi K3

Kimi K3 — faqat model jadvalida emas, kundalik AI platformalari qatorida turishga loyiq birinchi Kimi versiyasi. U ilg‘or fikrlash qobiliyatini web va mobil chat, mustaqil Agent jarayonlari, Docs, Sheets, Slides, Deep Research, Kimi Work va Kimi Code bilan birlashtiradi. Modelning o‘zi allaqachon juda ko‘p ishni qoyilmaqom bajaradi, ammo ayrim Agent jarayonlarida hali amaliy cheklovlar bor.

Yangilangan 2026-yil 28-iyul AgenticKnowledge WorkDocs & Sheets
9.610 dan
Rasmiy veb-sayt
Eng mos

Kimi K3 — faqat model jadvalida emas, kundalik AI platformalari qatorida turishga loyiq birinchi Kimi versiyasi. U ilg‘or fikrlash qobiliyatini web va mobil chat, mustaqil Agent jarayonlari, Docs, Sheets, Slides, Deep Research, Kimi Work va Kimi Code bilan birlashtiradi. Modelning o‘zi allaqachon juda ko‘p ishni qoyilmaqom bajaradi, ammo ayrim Agent jarayonlarida hali amaliy cheklovlar bor.

Nima uchun bu eng yaxshisi

Artificial Analysis K3’ga umumiy 57, GDPval-AA v2’da 1668 Elo, AA-Briefcase’da 1547 Elo va AutomationBench-AA’da 53% beradi. Mahsulot matn va tasvirni qabul qiladi, model 1M kontekstga ega, Kimi esa sayt, hisobot, Word, jadval, taqdimot va kod yaratadi. Bepul daraja va oyiga $19dan boshlanadigan pullik rejalar mavjud.

E'tibor bering

Kimi ichidagi AI model allaqachon juda kuchli. Ammo mahsulotning ayrim aniq cheklovlari bor: oddiy Agent uzoq suhbatda avvalgi ko‘rsatmalarni unutishi, odatda har vazifada faqat bitta fayl chiqarishi va modelning 1M tokenli eng yuqori chegarasidan kichikroq amaliy kontekst ishlatishi mumkin. Artificial Analysis 51% gallyutsinatsiya, yuqori token sarfi va o’rtachadan past tezlikni ham o’lchadi. Kimi esa Workspace, Android, Chrome va Search bilan Gemini kabi chambarchas bog‘lanmagan.

01

Aslida bu nima

Ko‘p AI yordamchilari oddiy chat oynasi atrofida qurilgan: savol berasiz va javob olasiz. Kimi K3 bundan kengroq imkoniyat beradi. U chatni tadqiqot, hujjat, jadval, taqdimot, sayt, dasturlash va avtomatlashtirish uchun maxsus vositalar bilan birlashtiradi. Moonshot shunchaki kattaroq model yaratmadi; modelning tahlilini tayyor ish natijasiga aylantira oladigan mahsulotlar majmuasini ham qurdi.

Mustaqil natijalar bu mahsulotlarga jiddiy qarash kerakligini ko‘rsatadi. Artificial Analysis K3’ga Intelligence Index’da 57, GDPval-AA v2’da 1668 Elo va AA-Briefcase’da 1547 Elo beradi. Uzoq davom etadigan professional bilim mehnati sinovi bo‘lgan oxirgi reytingda faqat Claude Fable 5 yuqorida turadi. AutomationBench-AA’da esa K3 53% va 1-o‘rin oladi. Oddiy qilib aytganda, K3 faqat savollarga javob bermaydi; foydali natija chiqarish uchun o‘zaro bog‘liq bir nechta bosqichni ham bajara oladi.

Kimi mahsulotlari doirasi juda keng. Umumiy Agent tadqiqot o‘tkazadi, sayt va hujjat yaratadi, jadvallarni tahlil qiladi hamda taqdimot tayyorlaydi. Kimi Work agent jarayonlarini kompyuter ilovasiga olib keladi. Kimi Code dasturchilar uchun mo‘ljallangan, Agent Swarm katta tadqiqot va ommaviy vazifalarni bir nechta agentga taqsimlaydi, Kimi Claw esa doimiy avtomatlashtirishni bajaradi. Bular amaliy ehtiyojni qoplaydi: odamlarga ko‘pincha jadval, taqdimot yoki hisobotni qanday yaratish bo‘yicha ko‘rsatma emas, tayyor faylning o‘zi kerak.

Bir million tokenli kontekst va tasvirlarni qabul qilish imkoniyati modelga juda katta hajmdagi manbalarni bir vaqtda ko‘rib chiqish imkonini beradi. U hisobot, skrinshot, grafik va boshqa hujjatlardagi ma’lumotlarni o‘zaro bog‘lay oladi. Katta kontekst mukammal xotira degani emas, ortiqcha material esa modelni baribir chalg‘itishi mumkin. Shunga qaramay, bu imkoniyat huquqiy taqqoslash, ilmiy manbalar to‘plami, moliyaviy tahlil va ko‘p hujjatli boshqa loyihalarda juda foydali.

Kimi’ni web va mobil qurilmalarda sinab ko‘rish oson. Bepul daraja bir nechta Agent vazifasini beradi, pullik a’zolik esa oyiga $19dan boshlanadi. API har million uchun $3 kirish va $15 chiqish turadi. K3 arzon model emas; uning narxi professional ishga moslangan.

Nega unda faqat #4? Chunki bu turkum faqat modelni emas, butun ekotizimni baholaydi. Ayrim mustaqil testlarda Gemini kuchsizroq bo‘lishi mumkin, ammo Google uni email, hujjat, taqvim, brauzer, telefon, qidiruv va tashkilot ruxsatlari bilan bevosita bog‘lagan. Kimi’da ko‘p vosita bor, lekin ular odamlar har kuni ishlatadigan xizmatlarga hozircha bunchalik chuqur singmagan. Bitta yordamchini tanlayotgan foydalanuvchi uchun bunday qulaylikning o‘zi ham muhim imkoniyatdir.

Ehtiyotkorlikning ikkinchi sababi — ishonchlilik. Artificial Analysis K3’ning aniqligi K2.6’ga qaraganda oshganini, ammo gallyutsinatsiya ham ko‘payib, o‘lchangan daraja 51% bo‘lganini aniqladi. Ya’ni model ko‘proq savolga to‘g‘ri javob berishi bilan birga, ayrim xato javoblarni ham ishonch bilan taqdim qilishi mumkin. U juda unumli vosita, biroq muhim manbalar, formulalar va biznes da’volarini tekshirish kerak.

Million token haqidagi da’voni aniq mahsulot darajasida tekshirish kerak. K3 modelining o‘zi bu hajmni qo‘llaydi, ammo Kimi hujjatlarida ayrim Agent jarayonlari uchun kichikroq amaliy limitlar ko‘rsatilgan. Modelning eng yuqori kontekst hajmi bilan muayyan ilovada mavjud hajm har doim ham bir xil emas. Juda katta hujjat vazifasini rejalashtirishdan oldin aynan foydalanmoqchi bo‘lgan vositangizdagi limitni tekshiring.

Nihoyat, K3 hali juda yangi. U maksimal reasoning rejimi bilan chiqarildi; bu murakkab vazifalarda puxtaroq javob berishga yordam beradi, ammo javoblarni uzunroq va sekinroq qiladi. To’liq ochiq vaznlar 27-iyulda Modified MIT litsenziyasi ostida chiqdi — lekin 2.8 trillion parametr va MXFP4 formatida taxminan 1.4 terabayt hajm bilan, ularni ishga tushirish uchun ma’lumotlar markazi darajasidagi uskunalar kerak. Aksariyat foydalanuvchilar uchun joylashtirilgan API va mahsulot to’plami K3 dan foydalanishning amaliy usuli bo’lib qoladi.

Hozircha Kimi K3 #4 o‘ringa loyiq. Oddiy chatdan kattaroq vazifalar — chuqur tadqiqot, ko‘p hujjat, tahrirlanadigan hisobot, jadval, taqdimot, sayt yoki uzoq davom etadigan Agent jarayoni — uchun uni tanlang. Gemini mavjud Google ish jarayoniga osonroq qo‘shiladi. Kimi kuchli muqobil, ammo katta vazifani rejalashdan oldin aynan ishlatmoqchi bo‘lgan Agent vositasining chegaralarini tekshiring.

02

Kuchli tomonlar va halol cheklovlar

Asosiy afzalliklari

  • Mustaqil bilim mehnati allaqachon cho‘qqiga yaqin: K3 GDPval-AA v2’da 1668 Elo va AA-Briefcase’da 1547 Elo oladi; Artificial Analysis uni faqat Fable 5’dan keyin qo‘yadi. Bu hisobot, tahlil va ko‘p bosqichli professional ish dalili, faqat akademik savollar emas.
  • Ekotizim maslahat bilan cheklanmay, tayyor fayl yaratadi: Kimi Agent Word fayllarini yaratadi va tahrirlaydi, Excel jadvallarini tahlil qiladi va yaratadi, taqdimot hamda PDF tayyorlaydi, saytni ishga tushiradi va chuqur tadqiqot hisobotini beradi. Texnik bo‘lmagan foydalanuvchi uchun yuklab olinadigan tayyor fayl ko‘pincha uni qanday yaratish haqidagi yana bir izohdan foydaliroq.
  • Agent oqimlari haqiqiy kuch: Artificial Analysis AutomationBench-AA’da 53% va 1-o‘rin haqida xabar beradi. Agent, Agent Swarm, Work, Code va Claw bu kuchni web, desktop, dasturlash va doimiy avtomatlashtirishga olib chiqadi.
  • Katta kontekst va tasvirlarni qabul qilish hujjatlar bilan ishlashda yordam beradi: K3 matn va tasvirlarni 1M tokenli kontekstda qabul qiladi. U shartnomalar, hisobotlar, skrinshotlar, grafiklar va katta hujjat to‘plamlarini birgalikda ko‘rib chiqib, muhim kontekstni qayta-qayta yo‘qotmasdan ishlashi mumkin.
  • Bepul va pullik rejalar turli ish hajmlariga mos: Kimi web, iOS, Android va HarmonyOS’da ishlaydi. Bepul reja bir nechta Agent vazifasini beradi; oyiga $19dan boshlanadigan a’zolik Agent, Swarm, Code va professional ma’lumotlar bazasi limitlarini oshiradi.
  • API jiddiy ish uchun raqobatbardosh: Har million kirish/chiqish tokeni uchun $3/$15 va kesh uchun $0.30 narxda K3 arzon emas. Ammo Artificial Analysis Intelligence Index’da har vazifaga taxminan $0.94 baholaydi—GPT-5.6 Sol’ga yaqin va Fable 5’dan ancha past.

Haqiqiy cheklovlar

  • Gemini kundalik vositalarga hali ham chuqurroq integratsiyalashgan: Gemini Workspace, Android, Chrome va Search bilan bevosita bog‘langan. Kimi’da ko‘plab o‘z vositalari bor, ammo ancha kam odam ulardan kundalik ishining bir qismi sifatida foydalanadi; shu sabab K3 #4 o‘rinda qoladi.
  • Faktlarning ishonchliligi hali ham muammo: K3 aniqligi oshgan bo‘lsa-da, Artificial Analysis 51% gallyutsinatsiya o‘lchadi; K2.6’da bu 39% edi. Manbalar, formulalar, shartnoma bandlari va biznes da’volarini tekshirish zarur.
  • Model limiti va mahsulot limiti doim bir xil emas: K3 1M tokenni qo‘llaydi, ammo Agent hujjatlari ayrim oqimlarda kichikroq amaliy chegarani ko‘rsatadi. Ulkan hujjat vazifasi sig‘ishini va’da qilishdan oldin aniq interfeysni tekshiring.
  • Maksimal fikrlash tezkor suhbat emas: K3 maksimal reasoning bilan standart tarzda chiqdi; Artificial Analysis uni sergap va o‘rtachadan sekin topdi. Bu murakkab hisobot uchun to‘g‘ri, uchrashuv vaqtini so‘rash uchun ortiqcha.
  • Ochiq vaznlar endi mavjud, ammo ularni ishga tushirish boshqa masala: Moonshot 27-iyulda to’liq 2.8 trillion parametrli vaznlarni Modified MIT litsenziyasi ostida nashr etdi va K3 haqiqatan ham o’z-o’ziga host qilish mumkinligini tasdiqladi. Lekin MXFP4 formatida taxminan 1.4 terabayt hajmda, ishlab chiqarishda ishlash uchun bir necha tugunda o’nlab H100 sinfidagi GPU kerak. Aksariyat foydalanuvchilar uchun joylashtirilgan API amaliy yo’l bo’lib qoladi; vaznlar asosan allaqachon GPU klasterlarini boshqarayotgan korxonalar va tadqiqot laboratoriyalari uchun muhim.
03

Benchmark natijalari

Artificial Analysis Intelligence Index — 57

Fable 5 va GPT-5.6 Sol’dan keyin, Grok 4.5’dan oldinda turgan mustaqil frontierga yaqin natija. Bir necha effort darajasi ko‘rsatilgan o‘rinni o‘zgartirishi mumkin.

GDPval-AA v2 — 1668 Elo

Realistik professional agent ishi. K3 Fable 5 va GPT-5.6 Sol’dan keyin, Opus 4.8 va Grok 4.5’dan oldinda.

AA-Briefcase — 1547 Elo (#2)

Yopiq uzoq muddatli bilim mehnati sinovi. K3 faqat Fable 5’dan keyin va ayniqsa tahliliy sifatda kuchli.

AutomationBench-AA — 53% (#1)

SaaS avtomatlashtirish vazifalarining mustaqil tatbiqi, Kimi agentlari chatdan ko‘proq ish qilishini tasdiqlaydi.

Intelligence Index narxi — vazifaga taxminan $0.94

O‘lchangan token sarfi va API narxlariga asoslangan baho. Haqiqiy narx reasoning uzunligi va keshdan qayta foydalanishga kuchli bog‘liq.

04

Xulosa

Kimi K3 Everyday Ecosystem reytingiga 4-o‘rinda kiradi. Modelning kuchi bemalol yetadi: mustaqil testlar uni yetakchilarga yaqin qo‘yadi, Kimi esa uch hukmron platformadan tashqaridagi eng keng agent vositalari to‘plamlaridan birini qurgan. U Gemini’dan past, chunki kundalik ekotizim email, hujjat, brauzer, telefon va hamkasblar allaqachon qaysi xizmatlarda ekaniga ham bog‘liq. Chuqur tadqiqot, katta hujjatlar, mustaqil ish yoki bitta xizmatda tayyor Office fayllari uchun Kimi’ni tanlang. Muhim faktlarni tekshiring va ochiq vaznlarni endi yuklab olish mumkin bo’lsa-da, ularni o’zingiz ishga tushirish uchun ma’lumotlar markazi darajasidagi uskunalar kerakligini unutmang.

05

Ko'p so'raladigan savollar