Место #5 Повседневная экосистема — Ведущие ИИ-помощники
Moonshot AI

Kimi K3

Kimi K3 — первая версия Kimi, которая заслуживает места рядом с повседневными ИИ-платформами, а не только на графике моделей. Она сочетает передовые возможности с web- и мобильным чатом, автономными Agent-сценариями, Docs, Sheets, Slides, Deep Research, Kimi Work и Kimi Code. Модель уже умеет впечатляюще много, хотя у некоторых Agent-сценариев есть практические ограничения.

Обновлено 28 июля 2026 года AgenticKnowledge WorkDocs & Sheets
Лучше всего для

Kimi K3 — первая версия Kimi, которая заслуживает места рядом с повседневными ИИ-платформами, а не только на графике моделей. Она сочетает передовые возможности с web- и мобильным чатом, автономными Agent-сценариями, Docs, Sheets, Slides, Deep Research, Kimi Work и Kimi Code. Модель уже умеет впечатляюще много, хотя у некоторых Agent-сценариев есть практические ограничения.

Почему он побеждает

Artificial Analysis дает K3 общий балл 57, 1668 Elo на GDPval-AA v2, 1547 Elo на AA-Briefcase и 53% на AutomationBench-AA. Продукт принимает текст и изображения, модель поддерживает контекст 1M, а Kimi создает сайты, отчеты, Word, таблицы, презентации и код. Есть бесплатный уровень, затем платные планы от $19 в месяц.

Обратите внимание

ИИ-модель внутри Kimi уже впечатляет. Но в деталях продукта есть конкретные ограничения: обычный Agent может забыть ранние инструкции в долгом разговоре, обычно выдает лишь один файл за задачу и использует меньший практический контекст, чем модельный максимум в 1M токенов. Artificial Analysis также измерил 51% галлюцинаций, высокий расход токенов и скорость ниже средней. При этом с Workspace, Android, Chrome и Search Kimi связан не так тесно, как Gemini.

01

Что это на самом деле

Большинство ИИ-помощников построены вокруг простого окна чата: вы задаете вопрос и получаете ответ. Kimi K3 идет дальше и объединяет чат с отдельными инструментами для исследований, документов, таблиц, презентаций, сайтов, программирования и автоматизации. Moonshot не просто обучила более крупную модель, а создала набор продуктов, которые превращают рассуждения модели в готовую работу.

Независимые результаты оправдывают серьезное отношение. Artificial Analysis дает K3 57, 1668 Elo на GDPval-AA v2 и 1547 Elo на AA-Briefcase. В этом тесте длительной профессиональной работы выше только Claude Fable 5. На AutomationBench-AA K3 получает 53% и первое место. Проще говоря, модель не только знает ответы, но умеет доводить многошаговое задание до результата.

Набор продуктов Kimi необычно широк. Agent проводит исследования, создает сайты и документы, анализирует таблицы и готовит презентации. Kimi Work переносит агентные сценарии в настольное приложение. Kimi Code предназначен для разработчиков, Agent Swarm распределяет большие исследования и пакетные задачи между несколькими агентами, а Claw отвечает за постоянную автоматизацию. Все это решает практическую задачу: людям часто нужны готовые таблица, презентация или отчет, а не инструкция по их самостоятельному созданию.

Контекст в один миллион токенов и поддержка изображений позволяют модели работать с очень большим объемом исходных материалов. Она может связывать информацию из отчетов, скриншотов, графиков и других документов. Большой контекст не гарантирует идеальную память, а лишние материалы все равно могут запутать модель. И все же эта емкость действительно полезна для юридических сравнений, научных подборок, финансового анализа и других проектов со множеством документов.

Kimi легко попробовать в web и на телефонах. Бесплатный уровень дает немного Agent-задач, платные планы начинаются с $19 в месяц. API стоит $3 за ввод и $15 за вывод на миллион. K3 — не бюджетная модель: ее цена рассчитана на профессиональную работу.

Почему же только №4? Потому что здесь оценивается вся экосистема, а не только модель. На некоторых независимых тестах Gemini может быть слабее, но Google уже напрямую связывает его с почтой, документами, календарями, браузерами, телефонами, поиском и корпоративными правами доступа. Инструментов у Kimi много, но они пока не так глубоко встроены в сервисы, которыми люди уже пользуются каждый день. Для человека, выбирающего одного ИИ-помощника, это удобство — самостоятельное преимущество.

Вторая причина для осторожности — надежность. Artificial Analysis обнаружил, что K3 стал точнее K2.6, но при этом чаще галлюцировал: измеренный уровень составил 51%. Иначе говоря, модель может верно отвечать на большее число вопросов, но все еще уверенно подавать часть ошибочных ответов. K3 может быть очень продуктивным, но важные ссылки, формулы и деловые утверждения необходимо проверять.

Заявление о миллионе токенов нужно уточнять на уровне конкретного продукта. Сама модель K3 поддерживает такой контекст, но в документации Kimi для некоторых Agent-сценариев указаны меньшие практические лимиты. Максимум модели и доступный объем в отдельном приложении не обязательно совпадают. Перед планированием очень большой задачи с документами проверьте лимит именно в том инструменте, который собираетесь использовать.

Наконец, K3 пока очень нов. Модель запустили с максимальным уровнем усилий на рассуждение: это помогает в сложных задачах, но делает ответы более многословными и медленными. Полные открытые веса вышли 27 июля под лицензией Modified MIT — но при 2,8 трлн параметров и объёме около 1,4 ТБ в MXFP4 они требуют оборудования дата-центр класса для запуска. Для большинства пользователей размещённый API и набор продуктов остаются практичным способом использовать K3.

На данный момент Kimi K3 заслуживает №4. Выбирайте его для задач, которые выходят за рамки обычного чата: глубокое исследование, множество документов, редактируемый отчет, таблица, презентация, сайт или длительная Agent-задача. Gemini пока проще вписывается в уже существующий рабочий процесс Google. Kimi — мощная альтернатива, но перед большой задачей стоит проверить ограничения именно того Agent-инструмента, который вы собираетесь использовать.

02

Сильные стороны и честные ограничения

Ключевые преимущества

  • Независимая интеллектуальная работа уже близка к вершине: K3 достигает 1668 Elo на GDPval-AA v2 и 1547 Elo на AA-Briefcase, где Artificial Analysis ставит его только ниже Fable 5. Это данные об отчетах, анализе и многошаговой профессиональной работе, не просто академических вопросах.
  • Экосистема выдает файлы, а не останавливается на советах: Kimi Agent создает и редактирует Word, анализирует и генерирует Excel, строит презентации и PDF, публикует сайты и готовит глубокие исследования. Для обычного пользователя скачиваемый файл часто ценнее очередной инструкции.
  • Агентные процессы — настоящая сильная сторона: Artificial Analysis сообщает 53% и первое место на AutomationBench-AA. Agent, Agent Swarm, Work, Code и Claw переносят это в web-, desktop-, программистские и постоянные автоматизированные задачи.
  • Большой контекст и поддержка изображений помогают в работе с документами: K3 принимает текст и изображения с контекстом 1M. Он может сопоставлять договоры, отчеты, скриншоты, графики и большие коллекции, не теряя постоянно важный контекст.
  • Бесплатные и платные планы рассчитаны на разный объем работы: Kimi работает в web, iOS, Android и HarmonyOS. Бесплатный план дает небольшое число Agent-задач; подписки от $19 в месяц увеличивают лимиты Agent, Swarm, Code и профессиональных баз.
  • API конкурентен для серьезной работы: При цене $3/$15 за миллион входных/выходных токенов и $0,30 за кэш K3 не дешев. Но Artificial Analysis оценивает около $0,94 за задачу Intelligence Index—рядом с GPT-5.6 Sol и намного ниже Fable 5 в этом тесте.

Честные ограничения

  • Gemini пока глубже встроен в повседневные инструменты: Gemini интегрирован с Workspace, Android, Chrome и Search. У Kimi много собственных инструментов, но значительно меньше людей уже используют их каждый день; поэтому K3 остается на №4.
  • Достоверность фактов остается проблемой: Artificial Analysis измерил 51% галлюцинаций, против 39% у K2.6, хотя точность выросла. Источники, формулы, пункты договоров и деловые утверждения нужно проверять.
  • Лимит модели и продукта не всегда одинаков: K3 поддерживает 1M токенов, но документация Agent описывает меньшие практические пределы в некоторых процессах. Проверьте конкретный интерфейс до обещания обработать гигантский архив.
  • Максимальное рассуждение — не мгновенная беседа: K3 стартовал с максимальным усилием по умолчанию; Artificial Analysis увидел многословие и скорость ниже средней. Это уместно для сложного отчета, но чрезмерно для вопроса о времени встречи.
  • Открытые веса выпущены, но запустить их — другое дело: Moonshot опубликовала полные веса на 2,8 трлн параметров 27 июля под лицензией Modified MIT, подтвердив, что K3 действительно можно хостить самостоятельно. Но при объёме около 1,4 ТБ в формате MXFP4 для работы в продакшене нужны десятки GPU класса H100 на нескольких узлах. Для большинства пользователей размещённый API остаётся практичным путём; веса важны в первую очередь для компаний и исследовательских лабораторий, уже эксплуатирующих GPU-кластеры.
03

Результаты тестов

Artificial Analysis Intelligence Index — 57

Независимый результат у границы, ниже Fable 5 и GPT-5.6 Sol, выше Grok 4.5. Несколько уровней усилия могут менять отображаемое место.

GDPval-AA v2 — 1668 Elo

Реалистичная профессиональная агентная работа. K3 ниже Fable 5 и GPT-5.6 Sol, но выше Opus 4.8 и Grok 4.5 в приведенном сравнении.

AA-Briefcase — 1547 Elo (#2)

Закрытая оценка длительной интеллектуальной работы. K3 уступает только Fable 5 и особенно силен по аналитическому качеству.

AutomationBench-AA — 53% (#1)

Независимая реализация задач автоматизации SaaS, подтверждающая, что агенты Kimi умеют больше обычного чата.

Стоимость Intelligence Index — около $0,94 за задачу

Оценка по измеренным токенам и тарифам API. Реальная стоимость сильно зависит от длины рассуждения и повторного использования кэша.

04

Вердикт

Kimi K3 входит в Everyday Ecosystem на четвертом месте. Сама модель точно достаточно сильна: независимые тесты ставят ее рядом с лидерами, а Kimi собрала один из самых широких наборов агентных инструментов вне трех доминирующих платформ. Ниже Gemini он остается потому, что экосистема зависит и от того, где уже находятся почта, документы, браузер, телефон и коллеги. Выбирайте Kimi для глубокого исследования, больших коллекций документов, автономной работы или готовых Office-файлов в одном сервисе. Проверяйте важные факты и учтите: хотя открытые веса теперь можно скачать, для самостоятельного запуска требуется оборудование дата-центр класса.

05

Часто задаваемые вопросы