Каталог О нас Тарифы Реквизиты Соглашение Миллион токенов Что умеет Рейтинги Характеристики Вопросы
K3Открытые веса · 27 июля 2026

Kimi K3

Модель, которая читает целиком. Миллион токенов контекста — это ваш договор, переписка и весь репозиторий в одном запросе, без нарезки на куски и без «напомни, о чём мы говорили выше».

2,8трлн
Всего параметров
104млрд
Активных на токен
1млн
Токенов контекста
Текст·фото·видео
Что понимает на входе
01 — Контекст

Миллион токенов
на ощупь

«Миллион токенов» — цифра, которая ничего не говорит, пока не переведёшь её в страницы и строки. Потяните ползунок и посмотрите, что помещается в один запрос.

1 048 576
токенов контекста
1 456 стр.страниц обычного текста — договоры, регламенты, стенограммы
2,62 млн знаковзнаков русского текста в одном запросе
91 750 строккода — целый сервис вместе с тестами и историей правок
4,9 шт.книг среднего объёма, которые модель держит одновременно

Пересчёт приблизительный: для русского текста один токен — это примерно 2,5 знака, страница — 1800 знаков, строка кода — около 40 знаков. На вашем тексте цифры сдвинутся в ту или другую сторону, но порядок будет такой.

02 — Архитектура

16 экспертов
из 896

Модель не думает всей своей массой сразу. На каждый токен маршрутизатор выбирает шестнадцать экспертов из восьмисот девяноста шести и два общих, которые работают всегда. Поэтому из 2,8 трлн параметров в счёт идут 104 млрд.

Почему это важно

Разреженность даёт качество большой модели при вычислениях модели поменьше. Каждая точка справа — эксперт: маленький кусок сети, специализированный на своём. Пурпурные загораются на текущий токен, жёлтые — два общих, они участвуют в каждом.

16 выбранных 2 общих 878 в покое
03 — Возможности

Что она делает

K3 задумана как рабочая лошадь, а не как собеседник: код, документы, поиск, разбор картинок и видео. Всё это в одном окне и на русском.

Код и терминал

Читает репозиторий целиком, а не по файлу за раз: видит, откуда вызывается функция и что сломается, если её тронуть. Работает с командной строкой и умеет доводить задачу до конца сама.

  • Разбор незнакомого проекта без пересказа архитектуры
  • Правки, которые учитывают весь остальной код
  • Первое место во Frontend Code Arena на момент выхода

Документы и переписка

Загрузите пачку договоров, отчётов или выгрузку переписки — модель удержит их одновременно и будет сравнивать между собой, а не пересказывать по очереди.

  • Сверка редакций договора и поиск расхождений
  • Свод по десяткам файлов со ссылками на источник
  • Вопросы по массиву документов без предварительной нарезки

Картинки и видео

Зрение встроено в модель, а не привинчено сбоку. Скриншот интерфейса, фотография документа, схема, кадр из ролика — всё это ей на вход наравне с текстом.

  • Второе место среди отслеживаемых моделей по мультимодальности
  • Разбор скриншотов и таблиц с картинки
  • Понимание видео без отдельной расшифровки

Поиск в вебе

Модель ходит по ссылкам, собирает и сверяет источники. На BrowseComp — тесте на способность найти труднодоступный факт — заявлено 91,2 балла.

  • Проверка утверждений по нескольким источникам
  • Сбор фактуры под обзор рынка или конкурентов
  • Цепочки поиска, где следующий шаг зависит от найденного

Три уровня размышления

Усилие переключается между low, high и max. По умолчанию стоит максимальный: модель думает дольше, но точнее. На простых вопросах уровень имеет смысл снизить.

  • Цепочка рассуждений видна, а не спрятана
  • GPQA-Diamond — 93,5 по заявлению разработчика
  • MathVision с Python — 97,8

Инструменты и агенты

Умеет вызывать функции и возвращать строгий JSON, поэтому её можно ставить внутрь своего процесса, а не только разговаривать с ней в чате.

  • Вызов инструментов и структурированный ответ
  • Многошаговые задачи без ручного присмотра
  • Terminal-Bench 2.0 — 88,3 по заявлению разработчика
04 — Внимание

Откуда взялся
миллион

Обычное внимание дорожает квадратично: вдвое длиннее текст — вчетверо больше работы. Поэтому у большинства моделей контекст упирается в потолок задолго до миллиона.

Три лёгких слоя на один тяжёлый

Moonshot чередует собственное линейное внимание Kimi Delta Attention с полным Gated MLA примерно в отношении три к одному: 69 слоёв KDA и 24 слоя MLA. Лёгкие слои тянут длину, тяжёлые — точность. Такая связка срезает до 75 % кэша ключей и значений, а он и есть главный ограничитель длины.

−75 % KV-кэша по сравнению с полным вниманием на всех слоях — за счёт этого миллион токенов вообще помещается в память
69 слоёв KDA — линейное внимание 24 слоя Gated MLA — полное
05 — Замеры

Где она стоит

Ниже — цифры как есть, без округления в свою пользу. Часть замеров опубликована самой Moonshot, часть — независимыми площадками; источник подписан у каждой строки.

FrontierSWEзаявлено Moonshot81,2
Terminal-Bench 2.0заявлено Moonshot88,3
BrowseCompзаявлено Moonshot91,2
GPQA-Diamondзаявлено Moonshot93,5
MathVision с Pythonзаявлено Moonshot97,8
Мультимодальностьнезависимый замер, 2-е место86,2
Коднезависимый замер, 4-е место78,7
Агентные задачинезависимый замер, 4-е место74,3

В сводных индексах на момент выхода K3 занимала третье место у Artificial Analysis и второе у Vals AI, уступая только Claude Fable 5 и GPT-5.6 Sol. Для модели с открытыми весами это лучший результат, который вообще был: разрыв между открытыми и закрытыми моделями сократился с девяти месяцев примерно до трёх-пяти.

06 — История

Обратная сторона
Луны

Компанию основали в Пекине в марте 2023 года. По-китайски она называется 月之暗面 — «обратная сторона Луны», в честь альбома Pink Floyd. Kimi — личное английское прозвище основателя Ян Чжилиня, которое стало именем всей линейки.

Март 2023
Основание Moonshot AI

Пекин, трое основателей во главе с Ян Чжилинем. Ставка с самого начала — длинный контекст.

Конец 2023
Kimi первого поколения

Чат, который брал документы объёмом в сотни тысяч знаков, когда все остальные считали контекст десятками тысяч.

Январь 2025
K1.5

Появились рассуждения: модель научилась думать перед ответом, а не отвечать первым, что пришло.

11 июля 2025
K2 — триллион параметров

Открытые веса на модель такого размера. Тот момент, когда стало ясно, что открытые модели догоняют.

Начало 2026
K2.5 и линейка Code

Нативное зрение и отдельные варианты, заточенные под агентную работу с кодом.

16 июля 2026
K3

2,8 трлн параметров, миллион токенов, видео на входе. Веса выложены 27 июля под собственной лицензией Kimi K3.

07 — Сценарии

Когда брать именно её

У K3 есть чёткая специализация. Там, где задача упирается в объём материала или в длинную цепочку шагов, она сильнее большинства. Там, где нужен быстрый короткий ответ, — берите модель полегче.

Юристы и закупки

Сверить пачку договоров разом

Десять редакций одного договора, приложения, протоколы разногласий — всё загружается вместе. Модель сравнивает формулировки между документами, а не пересказывает каждый по очереди, и показывает, в какой редакции условие изменилось.

Разработка

Разобраться в чужом коде

Проект, который вам достался по наследству, помещается в контекст целиком. Можно спросить, зачем нужен модуль и что отвалится, если его убрать, — и получить ответ с учётом всех вызовов, а не одного файла.

Аналитика

Собрать обзор по источникам

Модель сама ходит по ссылкам, сверяет данные между источниками и отмечает расхождения. Пригодится там, где нужен не пересказ первой выдачи, а перепроверенная фактура.

Исследования

Прочитать литературу по теме

Полсотни статей в одном окне: модель держит их одновременно, находит противоречия в выводах и собирает общую картину. Формулы и графики со страниц она тоже видит — зрение встроенное.

08 — Характеристики

Сухие цифры

Данные из карточки модели и технического блога Moonshot на август 2026 года.

РазработчикMoonshot AI (月之暗面), Пекин
Представлена16 июля 2026, веса опубликованы 27 июля 2026
Всего параметров2,8 трлн
Активных на токен104 млрд
Экспертов896, из них 16 выбираются на токен и 2 общих
Слои внимания69 Kimi Delta Attention и 24 Gated MLA
Контекст1 048 576 токенов
Входтекст, изображения, видео
Уровни размышленияlow, high, max — по умолчанию max
Инструментывызов функций, строгий JSON, работа в терминале
Квантизациявеса MXFP4, активации MXFP8
Весаопубликованы под лицензией Kimi K3
Прирост к K2примерно в 2,5 раза по эффективности масштабирования
Доступ в Strelka AIиз России, без VPN и зарубежных карт
09 — Честно

Что учесть

Универсальных моделей не бывает. Три вещи, из-за которых K3 может не подойти под вашу задачу.

1

Она неторопливая

Около 34 токенов в секунду при медиане по рынку примерно 97. Для длинного разбора это незаметно, для живой переписки — раздражает. Если нужен быстрый диалог, возьмите модель полегче из того же каталога.

2

Долго молчит перед ответом

В режиме максимального усилия модель сначала выстраивает цепочку рассуждений и только потом начинает печатать. На сложной задаче ожидание окупается, на простом вопросе — нет. Уровень усилия стоит понижать.

3

Не первая в общем зачёте

В сводных рейтингах K3 идёт следом за Claude Fable 5 и GPT-5.6 Sol. Её преимущество — контекст и работа с большими объёмами, а не абсолютный максимум качества на коротких задачах.

10 — Вопросы

Коротко о главном

01Что такое Kimi K3 и кто её сделал
Флагманская языковая модель китайской компании Moonshot AI, представленная 16 июля 2026 года. Компанию основали в Пекине в марте 2023-го, её китайское название 月之暗面 переводится как «обратная сторона Луны» — отсылка к альбому Pink Floyd. Имя Kimi — личное английское прозвище основателя Ян Чжилиня.
02Сколько текста помещается в контекст
1 048 576 токенов. Для русского текста это примерно 2,5 млн знаков — около 1400 страниц или порядка пяти средних книг за один запрос. Кода помещается примерно 90 тысяч строк. Пересчёт грубый и на вашем материале сдвинется, но порядок такой.
03Kimi K3 понимает русский язык
Да, отвечает по-русски и разбирает русские документы без предварительного перевода. Ничего переключать не нужно — просто пишите запрос по-русски.
04Чем K3 отличается от K2
K2 была моделью на триллион параметров с контекстом 128–256 тысяч токенов и без встроенного зрения. K3 выросла до 2,8 трлн параметров, контекст поднялся до миллиона, добавилось понимание изображений и видео, а эффективность масштабирования, по данным Moonshot, выросла примерно в 2,5 раза.
05Что значит «открытые веса» и зачем это мне
Moonshot выложила веса модели в публичный доступ 27 июля 2026 года под собственной лицензией Kimi K3. Практически это значит, что модель может проверить и доработать кто угодно, а не только её авторы. Вам для работы ничего скачивать не нужно: в Strelka AI это обычный чат в браузере.
06Почему ответ иногда начинается не сразу
По умолчанию включён максимальный уровень усилия: перед ответом модель строит длинную цепочку рассуждений. На сложных задачах это заметно поднимает качество, но первые слова появляются позже, чем у быстрых моделей. Для коротких вопросов уровень имеет смысл снизить.
07Можно ли загружать картинки и видео
Да, зрение встроено в саму модель. Скриншоты интерфейсов, фотографии документов, схемы, графики и кадры из роликов идут на вход наравне с текстом — отдельная расшифровка не нужна.
08Нужен ли VPN
Нет. Strelka AI работает из России напрямую, без VPN и зарубежных карт. Оплата проходит российскими картами, для юридических лиц доступны счёт и закрывающие документы.

Загрузите то, что
не влезало никуда

Kimi K3 и ещё полсотни нейросетей в одном окне. Из России, без VPN и зарубежных карт.

Kimi K3 — уже в подписке Попробовать