TL;DR: Moonshot AI выпустила Kimi K3 16 июля 2026 года — прорывную модель с открытыми весами на 2.8 трлн параметров (первая в классе 3T) с нативной мультимодальностью, контекстом в 1 миллион токенов и передовой производительностью, соперничающей или превосходящей топовые проприетарные модели, такие как Claude Fable 5 и GPT-5.6 Sol, в программировании, агентных задачах, фронтенд‑разработке и знаниевых задачах.
Ключевые выводы
- Масштаб и инновации: 2.8T параметров, MoE с 16/896 активными экспертами, Kimi Delta Attention (KDA), Attention Residuals — ~2.5x эффективность масштабирования по сравнению с K2, Kimi K3 - Kimi API Platform
- Производительность: Artificial Analysis Intelligence Index ~57 (топ‑4, впереди Claude Opus 4.8), лидирует в Frontend Code Arena, сильна на Terminal-Bench (88.3%), BrowseComp (91.2%), GPQA-Diamond (93.5%). В целом уступает Fable 5/Sol, но обходит большинство других; #1 на Arena.ai Frontend Code Arena (1,679 Elo, обходит Fable 5), пост Arena в X и материал Tom's Hardware.
- Возможности: Нативное зрение/видео, контекст 1M для огромных репозиториев/кодовых баз, агентное программирование, 3D‑рассуждение, видеомонтаж, исследовательские дашборды.
- Доступ: Немедленно через kimi.com, API (модель kimi-k3, гайд по доступу); открытые веса скоро. Moonshot временно приостановила новые подписки Kimi K3 после всплеска спроса. Легко интегрируется через CometAPI.
- Ценность: Более низкая стоимость на задачу (~$0.94 в некоторых оценках), меньше отказов, идеально для рабочих процессов coding/Vision.
Kimi K3 Tech Blog описывает Kimi K3 как «Open Frontier Intelligence, Kimi K3 marks a pivotal moment in AI democratization. As Chinese AI labs like Moonshot push boundaries despite compute constraints, this open model challenges the dominance of closed U.S. frontiers and empowers developers worldwide.
Что такое Kimi K3? Открытая модель класса 3T от Moonshot AI
Moonshot AI, стартап из Пекина, запустила Kimi K3 16 июля 2026 года как свой флагман. Это явно позиционируется как первая открытая модель в классе примерно 3 трлн параметров — 2.8 трлн общих параметров в разреженной архитектуре Mixture‑of‑Experts (MoE). На токен активируются лишь 16 из 896 экспертов, сочетая огромный масштаб с эффективностью.
Это развитие серии Kimi K2 (K2.5, K2.6 и др.), уже получившей признание в кодинге и мультимодальности. K3 вводит архитектурные инновации: Kimi Delta Attention (KDA) и Attention Residuals (AttnRes), а также Stable LatentMoE и обучение с учетом квантизации (веса MXFP4, активации MXFP8 начиная со стадии SFT). Это дает ~2.5x лучшую эффективность масштабирования и до 6.3x более быстрое декодирование по сравнению с предшественниками.
Ключевые характеристики ( Kimi K3 Technical Specifications):
- Параметры: всего 2.8T (разреженная MoE).
- Контекстное окно: 1,048,576 токенов (~1M).
- Модальности: нативное понимание текста + изображений + видео; текстовый вывод.
- Макс. вывод: по умолчанию 131k токенов, до предела контекста.
- Рассуждение: по умолчанию максимальное усилие на запуске; появятся режимы ниже/выше.
- Открытые веса: обещаны к 27 июля 2026 (модифицированная MIT‑лицензия, по прецеденту K2).
K3 нацелена на долгие горизонты — не просто быстрые ответы, а завершение сложных инженерных, исследовательских или агентных рабочих процессов с визуальной обратной связью ("Vision in the Loop"). Демонстрации включают автономную сборку GPU‑компилятора (сопоставимого с Triton), проектирование чипов на 45нм процессе и быстрые исследования в астрофизике.
Спрос уже нагрузил мощности
Ранний прием модели оказался настолько сильным, что создал нагрузку на мощности. Moonshot сообщила в X, что спрос за предыдущие 48 часов приблизился к текущим лимитам GPU, и новые подписки будут временно приостановлены, пока компания наращивает емкость. Business Insider сообщил о той же паузе по мощности и отметил, что на существующих подписчиков это не повлияло.
Это важно для производственного планирования. Модель может быть превосходной и при этом сталкиваться с ограничениями доступности, если спрос обгоняет вычислительные ресурсы. Командам, оценивающим Kimi K3, следует избегать зависимости от одного провайдера, мониторить задержки и уровень ошибок и использовать маршрутизацию на запасные варианты через унифицированного провайдера, такого как CometAPI , где это возможно.
Бенчмарки по коду: где Kimi K3 сильнее всего
Профиль Kimi K3 в программировании — ключевая причина внимания разработчиков. Она почти наравне с GPT-5.6 Sol на Terminal-Bench 2.1, обходит GPT-5.6 Sol и Claude Fable 5 на Program Bench и лидирует над GPT-5.6 Sol с заметным отрывом на FrontierSWE. Также опережает сравниваемые модели на SWE Marathon в таблице OpenLM.
Результат во фронтенде на Arena добавляет практический сигнал. Arena сообщила о 1679 баллах Kimi K3 на Frontend Code Arena, впереди Claude Fable 5. Этот бенчмарк важен, потому что фронтенд часто оценивается по человеческим предпочтениям, а не только по юнит‑тестам. Ассистент кодирования, способный по промпту выдавать чистый, визуально цельный UI, ценен для продуктовых команд, агентств, SaaS‑разработчиков и внутренних инструментов.
Общие рейтинги
- Artificial Analysis AI Leaderboard: дебют на #3. Индекс интеллекта ~57.1 в некоторых оценках — конкурентный.
- Частная оценка долгих знаниевых задач: Elo 1547 (+732 от K2.6), позади лишь Fable 5.
Бенчмарки по коду и агентности (самоотчеты и независимые)
K3 здесь сияет, используя масштаб и архитектуру для устойчивой агентной производительности.
- Frontend Code Arena (Arena.ai): #1 с 1,679 баллами, обходит Fable 5 и GPT-5.6 Sol. Сильна по слепым предпочтениям разработчиков в веб‑разработке.
- DeepSWE: 67.3–67.5 (сильный результат, с использованием KimiCode harness).
- Program Bench: #1 с 77.8.
- SWE Marathon: #1 с 42.0 (в некоторых harness).
- Terminal-Bench 2.1: конкурентна, близко к GPT-5.6 Sol.
Визуальные и мультимодальные
Нативное обучение (а не надстройка) дает уверенные результаты:
- MMMU-Pro: 81.6%
- MathVision: конкурентно/высокие 90‑е в некоторых отчетах.
- OmniDocBench: 91.1% (лидер).
Поддерживает скриншоты, диаграммы, видео для замкнутых циклов задач вроде уточнения UI или разработки игр.
Сравнительная таблица: Kimi K3 vs. ведущие модели (приблизительно/собрано из отчетов; Max Effort, где указано)
| Бенчмарк | Kimi K3 | Claude Fable 5 | GPT-5.6 Sol | Примечания/Источник |
|---|---|---|---|---|
| Frontend Code Arena | 1,679 (#1) | Ниже | Ниже | Arena.ai |
| DeepSWE | 67.3–67.5 | Конкурентно | - | Moonshot/KimiCode |
| Program Bench | 77.8 (#1) | - | Близко | Vals.ai |
| Intelligence Index (AA) | ~57.1 | ~59.9 | ~58.9 | Artificial Analysis |
| Long-Horizon Elo | 1547 | Выше | - | Внутр. Moonshot |
| Cost per Task (Evals) | ~$0.94 | Выше | Выше | Независимые |
Данные получены из технического блога Moonshot, независимых таблиц лидеров и анализов. Результаты зависят от harness/усилий; всегда проверяйте актуальные.
K3 демонстрирует меньше отказов на чувствительных темах и высокую согласованность в агентных потоках. Независимые тесты (например, YouTube‑оценки, Vals AI) подтверждают, что это одна из самых сильных открытых моделей для реальных задач программирования.
Что умеет Kimi K3? Возможности в коде, визионе и не только
Программирование и агентная инженерия
K3 поддерживает длинные сессии с минимальным надзором: ориентируется в огромных репозиториях, использует инструменты, отлаживает по скриншотам («vision in the loop»).
Примеры:
- Оптимизация ядра и разработка компилятора: построила MiniTriton (компилятор в стиле Triton) с нуля, сопоставимый с оптимизированными стеками. Оптимизировала GPU‑ядра на уровне, конкурентном Fable 5.
- Разработка игр: превращает концепты/изображения/видео в играбельные 3D/многопользовательские проекты с итеративной доработкой.
- Проектирование чипов: автономный 48‑часовой запуск, спроектировавший наномодель чипа.
- Фронтенд: возглавляет рейтинги по веб‑приложениям, full‑stack задачам.
Визион и мультимодальность
Нативное понимание изображений/видео позволяет:
- Видеомонтаж: смонтировала собственный тизер из 56 клипов (отбор, резка, синхронизация, правки) — часы работы за минуты.
- 3D‑рассуждение, моушн‑графика, интерактивные дашборды.
- «Vision in the loop» для итераций кода по скриншотам.
Документация Kimi API показывает ввод изображений через base64 data URL и видео — через загруженные файлы с ссылками вида ms://. Также они предупреждают, что публичные URL изображений не поддерживаются во входе для vision, поэтому разработчикам следует отправлять base64 или ссылки на загруженные файлы и делать содержимое сообщения массивом объектов. Это важная деталь реализации: не сериализуйте смешанный ввод изображения и текста в одну простую строку.
Знаниевые задачи и исследования
Для бизнеса это может быть ценнее, чем обычный чат‑бот. Модель спроектирована для «агентной» работы, где она может поддерживать план, вызывать инструменты, обрабатывать промежуточные результаты и выдавать финальный артефакт. Примеры: отчеты по рынку, ассистенты очистки данных, комплаенс‑саммари, поддержка базы знаний поддержки клиентов, внутренние инженерные копилоты.
- Генерирует отчеты уровня консалтинга, интерактивные визуализации, дашборды (например, анализ 42‑летней индустрии ASIC из тысяч источников).
- Научные пайплайны: воспроизвела астрофизические связи, анализировала гравитационные волны с саб‑агентами.
- Виджеты/дашборды в Kimi Work для постоянных, ориентированных на данные представлений.
K3 соединяет литературу с исполняемым кодом, эффективно выдавая результаты уровня публикаций.
Kimi K3 vs другие модели на фронтире: практическое сравнение
| Модель | Лучшая сфера применения | Сильные стороны | На что обратить внимание | Рекомендация CometAPI |
|---|---|---|---|---|
| Kimi K3 | Длинный контекст в коде, знаниевые задачи, агенты, визион | Масштаб 2.8T MoE, контекст 1M, сильные код/агенты, дорожная карта открытых весов | Давление на емкость в неделю запуска, чувствительна к истории размышлений, визион зависит от маршрута | Тестировать как флагманскую модель для кода и длинного контекста |
| GPT-5.6 Sol | Сложные рассуждения, код, исследования, широкое продакшн | Очень сильный профиль бенчмарков и зрелые инструменты | Более высокая цена во многих маршрутах | Использовать как сравнение и модель эскалации |
| Claude Fable 5 | Письмо, код, агентные рабочие процессы, задачи с предпочтениями | Сильный UX и широкая фронтирная производительность | Более высокая стоимость и возможные политические откаты в ряде задач | Сравнивать для пользовательских агентов и задач с письмом |
| Claude Opus 4.8 | Глубокие рассуждения и надежная проф. работа | Стабильное высокоуровневое поведение ассистента | Старше последних флагманов | Держать как запасной вариант или базовый бенчмарк |
| GLM-5.2 | Оценка открытых моделей при ограниченном бюджете | Конкурентная альтернатива из открытых моделей | Слабее в нескольких сравнениях с K3 | Включить в тесты маршрутизации цена/производительность |
Как получить доступ к Kimi K3: пошаговое руководство
- Веб/приложение: посетите kimi.com или скачайте приложение Kimi (iOS/Android). Выберите K3 (K3 Max или Swarm Max).
- Kimi Code: ориентирован на терминал/IDE для разработчиков. Отлично для кодовых агентов.
- Доступ через API:
- Базовый URL: https://api.moonshot.ai/v1
- Модель: kimi-k3
- Получите ключ на platform.moonshot.ai/console.
- Пример SDK, совместимый с OpenAI (Python):
Python
from openai import OpenAI
client = OpenAI(api_key="YOUR_KEY", base_url="https://api.moonshot.ai/v1")
response = client.chat.completions.create(
model="kimi-k3",
messages=[{"role": "user", "content": "Your prompt"}]
)
Поддерживает инструменты, JSON‑режим, кэширование контекста. Цены: $3 за вход, $15 за выход на M токенов (кэш $0.30).
- Агрегаторы: используйте CometAPI (cometapi.com) для унифицированного доступа к Kimi K3 + 500+ моделей с одним ключом, более низких затрат (экономия 20–40%) и простого переключения. Идеально для продакшна — совместимо по OpenAI, низкая задержка.
- Самохостинг: после 27 июля релиз весов на Hugging Face. Ожидаются тяжелые требования к железу (суперузлы, рекомендуется 64+ ускорителей). Инструменты сообщества вроде vLLM последуют.
Рекомендация CometAPI: интегрируйте Kimi K3 через CometAPI, чтобы избежать множества ключей/биллинга. Тестируйте вместе с Claude/GPT для A/B, оптимизируйте стоимость и масштабирйтесь надежно. Их дашборд отслеживает использование по моделям — идеально для мониторинга экспериментов с K3. Зарегистрируйтесь на cometapi.com для бесплатных кредитов и унифицированного доступа.
Итоговый вердикт
Kimi K3 — один из самых важных релизов моделей 2026 года. Она сочетает огромный масштаб, серьезную стратегию открытых весов, контекст в 1M токенов, нативное визуальное понимание и результаты бенчмарков, поднимающие ее к вершине текущих кодовых и агентных ИИ‑систем. Она не отменяет необходимость GPT, Claude, Gemini, DeepSeek, Qwen или других моделей, но дает разработчикам достойную новую опцию для самых сложных задач с длинным контекстом.
Начните уже сегодня на kimi.com или через CometAPI для бесшовной интеграции. Экспериментируйте с ее сильными сторонами в коде и визионе — результаты говорят сами за себя.
