Kimi K3

Kimi K3

💸 Официальный сайт

Попробовать Kimi K3

Переход на официальный сайт продукта.

Перейти →

Kimi K3 — рекордный контекст 1M токенов

Флагманская мультимодальная модель Moonshot AI с крупнейшим в мире контекстным окном. Текст, изображения, аудио и видео — в одном запросе.

1M
токенов контекста
1.2T
параметров MoE
99.2%
точность NIAH
4.6
рейтинг ★

Что такое Kimi K3

Kimi K3 — флагманская мультимодальная модель от китайской Moonshot AI, выпущенная в июле 2026. Главное преимущество — контекстное окно 1 000 000 токенов, позволяющее обрабатывать целые кодовые базы, многотомные документы и длинные видео в одном запросе. Это прямой конкурент GPT-5.6 Sol и Claude Opus 8.

Архитектура — Mixture-of-Experts на 1.2 триллиона параметров (16B активных) с динамической маршрутизацией и Multi-Head Latent Attention. Модель нативно мультимодальна: текст, изображения, аудио и видео на входе. Обучена на 22 триллионах токенов. Доступна через веб-интерфейс, мобильное приложение и OpenAI-совместимый API.

Архитектура и инновации

Multi-Head Latent Attention (MLA) — сжатие KV-кэша в 8 раз. Без MLA контекст 1M токенов требовал бы 320GB VRAM только под кэш. С MLA модель помещается в разумные рамки.

Dynamic MoE Routing — 128 экспертных подсетей, 8 активны на токен. Маршрутизатор обучен через reinforcement learning. Обеспечивает скорость инференса как у dense-модели на 16B при ёмкости 1.2T.

Hierarchical Position Encoding — трёхуровневое кодирование: coarse (блоки 64K), medium (1K), fine (позиции). Решает проблему затухания внимания на сверхдлинных последовательностях.

Cross-Modal Fusion — унифицированный энкодер для всех модальностей. Contrastive pre-training + проекция в общее латентное пространство. Модель «видит» видео и «слышит» аудио через тот же механизм, что и читает текст.

Ключевые возможности

1. Сверхдлинный контекст 1M токенов

«Война и мир» целиком (580K слов), кодовая база 500K строк, транскрипт 20-часового подкаста — всё в одном запросе. Точность Needle-in-Haystack: 99.2% на 1M токенов.

2. Мультимодальный reasoning

Изображения (диаграммы, скриншоты), аудио (MP3/WAV), видео (MP4 до 2ч) — модель обрабатывает всё на входе и выдаёт структурированный текст.

3. Кодинг и математика

HumanEval: 94.7%. MATH-500: 96.8%. 40+ языков программирования, встроенный sandbox для выполнения кода.

4. Agentic Framework

Function calling, tool use, мультиагентные сценарии из коробки. OpenAI-совместимый API.

5. Русский язык на уровне носителя

Целенаправленный RLHF на русскоязычных данных. Качество выше, чем у Llama 4.

Характеристики и тарифы

ХарактеристикаKimi K3
Параметры1.2T MoE (16B активных)
Контекстное окно1 000 000 токенов
МодальностиТекст + изображения + аудио + видео
Языки50+ включая русский
Бесплатный tier50 запросов/день, контекст 128K
Pro$20/мес, контекст 1M, 500 запросов/день
APIOpenAI-совместимый, $0.40/1M input

Сравнение с конкурентами

КритерийKimi K3GPT 5.6 SolClaude Opus 8
Контекст1M2M500K
МультимодальностьТекст+изобр+аудио+видеоТекст+изображенияТекст+изображения
HumanEval94.7%93.1%92.5%
Цена/мес$20$25$30
Computer UseНетНетДа (CU 2.0)

✅ Плюсы

  • Рекордный контекст 1M токенов
  • Полная мультимодальность (аудио/видео)
  • Лучшие бенчмарки кодинга (94.7%)
  • Бесплатный tier с 128K контекстом
  • Отличный русский язык
  • Доступная цена $20/мес

❌ Минусы

  • Гео-ограничения (Китай)
  • Документация в основном на китайском
  • Видео-модальность в beta
  • Нет Computer Use
  • Нет on-premise для SMB

Вердикт Qantcore

★ 4.6 / 5

Kimi K3 — выбор №1 для работы со сверхдлинными документами и мультимодальным контентом. Если вы анализируете巨大的 кодовые базы, многотомные документы или транскрипты — аналогов нет. Для обычных задач берите GPT 5.6 Sol (быстрее и дешевле), для автономной работы с десктопом — Claude Opus 8 (Computer Use 2.0). Но когда объём данных превышает 200K токенов — только Kimi K3.