Релизы и изменения моделей
Kimi K3 открылась в каталоге по 10 ₽
31 августа kimi-k3 вышла из статуса review и стала доступной: availability и protocols.chat_completions поменялись на available, ставка каталога — 10 ₽ за миллион входных токенов и столько же за миллион выходных. У самой Moonshot та же модель стоит $3 за миллион входа и $15 за выход, то есть 256,80 и 1284,01 ₽ по курсу ЦБ 85,6007. Контекст — 1 048 576 токенов, 2,8 трлн параметров, модель рассуждает всегда. Проверенными в нашем каталоге числятся только chat_completions и streaming: tool calls и JSON-режим у вендора описаны, у нас пока стоят как unknown.
Когда Kimi K3 стала доступна в каталоге
Одна позиция сменила статус: kimi-k3 перешла из review в available.
Разница между этими двумя словами практическая. Запрос к модели в статусе review отклоняется кодом model_under_review — до резервирования баланса и до обращения к самой модели. Денег не списывают, но и ответа не будет. Модель видна в выдаче, числится в каталоге и при этом не работает.
Мы писали про Kimi K3 12 августа, когда Moonshot выложила веса. Тогда в той статье пришлось поставить оговорку: в каталоге модель есть, но живой API её не отдаёт. Оговорка держалась девятнадцать дней.
| Поле | 30 августа | 31 августа |
|---|---|---|
availability | review | available |
protocols.chat_completions | review | available |
capabilities.chat_completions | unknown | verified |
capabilities.streaming | unknown | verified |
capabilities_verified_at | 2026-08-12 | 2026-08-30T15:00Z |
estimated_route_context_tokens | null | 2200 |
Всего в каталоге 41 позиция, протокол chat_completions открыт у 25 из них. Семейство Kimi представлено одной моделью: вторая его позиция, kimi-k2-7-code, ушла из выдачи 29 августа и статуса available так и не получила.
Сколько стоит Kimi K3 в рублях и сколько у Moonshot
В каталоге — 10 ₽ за миллион входных и 10 ₽ за миллион выходных токенов. У вендора — три доллара и пятнадцать.
Курс ЦБ на день написания — 85,6007 ₽ за доллар. Файл XML_daily.asp 31 августа отдаёт дату 29.08.2026: понедельничное значение публикуется позже, и это нормальное поведение источника, а не сбой.
| Moonshot | Каталог KeyDealer | |
|---|---|---|
| Вход за 1 млн | $3,00 → 256,80 ₽ | 10 ₽ |
| Вход при попадании в кэш | $0,30 → 25,68 ₽ | кэш не поддерживается |
| Выход за 1 млн | $15,00 → 1284,01 ₽ | 10 ₽ |
| Выход дороже входа | в 5 раз | одинаково |
Разрыв на входе — 25,68 раза, на выходе — 128,4. Такая асимметрия объясняется просто: у Moonshot выход стоит впятеро дороже входа, а рублёвая ставка каталога одинакова в обе стороны. Чем больше модель пишет, тем сильнее расходятся счета.
Возьмём типичный агентский прогон: миллион токенов на вход, двести тысяч на выход. По вендорскому прайсу это 513,60 ₽, по каталожной ставке — 12 ₽. Разрыв 42,8 раза.
Одна честная поправка к этой картине. Кто у Moonshot активно пользуется автоматическим кэшем контекста, платит за попадания 25,68 ₽ за миллион, а не 256,80 — и тогда разрыв на входе сжимается до 2,57 раза. У нас кэша нет ни у одной позиции, так что сравнивать надо именно так: наши 10 ₽ против вендорских 25,68 ₽ на кэшированном входе и против 256,80 ₽ на холодном. Общая рублёвая картина по каталогу собрана в отдельном материале, там же живут остальные ставки.
Ставка каталога к вендорскому прайсу не привязана и вслед за ним не пересчитывается. Меняться она может, поэтому актуальное значение всегда читается из GET /v1/models, а не из статьи месячной давности.
Что такое Kimi K3 и чем она отличается от K2
Kimi K3 — флагман Moonshot на 2,8 трлн параметров с контекстом в 1 048 576 токенов и нативным пониманием изображений.
Архитектурно это разрежённая Mixture-of-Experts: 896 экспертов, из которых на токен активируется 16 — меньше двух процентов. Вендор описывает два новых механизма, Kimi Delta Attention и Attention Residuals, и фреймворк Stable LatentMoE; заявленная эффективность масштабирования — примерно в 2,5 раза выше, чем у K2.
Обратите внимание на контекст. В таблице цен напечатано 1,048,576 tokens. Это ровно два в двадцатой степени; «около миллиона» — уже вольный пересказ. Разница в сорок восемь тысяч токенов кажется мелочью ровно до того момента, когда вы упираетесь в верхнюю границу и получаете ошибку вместо ответа. Сколько контекста нужно на самом деле — считали отдельно.
Почему Kimi K3 всегда рассуждает и во что это обходится
Модель рассуждает всегда — выключить это нельзя. Регулируется только глубина, полем reasoning_effort верхнего уровня: low, high или max, по умолчанию max.
Это важнее, чем выглядит. Рассуждение — это выходные токены, а выходные токены оплачиваются. Значение по умолчанию у Moonshot стоит на максимуме, то есть модель без вашего вмешательства работает в самом дорогом режиме.
{
"model": "kimi-k3",
"messages": [{"role": "user", "content": "..."}],
"reasoning_effort": "low"
}
Тем, кто переезжает с K2.x, вендор велит убрать старую конфигурацию thinking и перейти на reasoning_effort. Ещё одно требование из документации: в многоходовых диалогах и при работе с инструментами полное assistant-сообщение нужно возвращать в messages как есть, вместе с reasoning_content и tool_calls. Обрежете — сломается цепочка.
Из нового в K3 вендор называет ограничения выбора инструмента через tool_choice и динамическую загрузку инструментов. Отдельно предупреждает: встроенный веб-поиск сейчас переписывается и пользоваться им в ближайшее время не рекомендуется.
Какие возможности Kimi K3 проверены в каталоге, а какие нет
Проверены две: chat_completions и streaming. Всё остальное числится как unknown.
| Возможность | Статус в каталоге |
|---|---|
chat_completions | verified |
streaming | verified |
tools | unknown |
forced_tool_choice | unknown |
parallel_tool_calls | unknown |
json_output | unknown |
anthropic_messages | unknown, протокол в review |
responses | unknown, протокол в review |
prompt_cache | unsupported |
Формулировка unknown означает ровно одно: возможность не проверена на нашей стороне. Не «не работает» и не «работает». В документации Moonshot и tool calls, и JSON-режим, и структурированный вывод описаны — но между вендорской документацией и нашим маршрутом стоит слой, который эти сценарии пока не прогонял. Дата проверки у позиции стоит 2026-08-30T15:00Z, и за этот прогон подтвердились только два поля.
Практический вывод: если ваш код опирается на вызов функций, заложите проверку и запасной вариант. Как читать эти статусы вообще — разбирали здесь.
Сколько служебного контекста добавляет маршрут к Kimi K3
2200 токенов на запрос — по первому измерению, сделанному 30 августа.
До этого дня поле estimated_route_context_tokens у Kimi K3 было пустым: модель стояла в review, трафика через неё не шло, измерять было нечего. Теперь в route_context появились настоящие цифры: медиана 1190, девяносто пятый процентиль 2190, размер выборки — шесть запросов.
Шесть. Цифра честная, статистики за ней почти нет. Медиана вдвое ниже опубликованной оценки, и по мере набора трафика значение поедет. Само поле помечено context_value_is_estimate: true — вендор контракта, то есть мы, прямо говорит, что это оценка.
В деньгах при ставке 10 ₽ за миллион 2200 токенов служебного контекста стоят 0,022 ₽ за запрос, или 22 ₽ на тысячу запросов. Для короткого чата это заметная доля счёта, для запроса с большим документом — шум. Механику этой надбавки разбирали отдельно; списание всегда идёт по фактическому usage в ответе, а не по оценке из каталога.
Что выбрать: Kimi K3 или другие модели за те же деньги
По ставке 10 ₽ в каталоге сегодня стоят четыре позиции, и проверено у них разное.
| Модель | Ставка | Что подтверждено |
|---|---|---|
kimi-k3 | 10 ₽ | chat_completions, streaming |
gpt-5-4 | 20 ₽ | chat_completions, streaming, tools, forced_tool_choice, parallel_tool_calls, tool_result_messages, streaming_with_tools, json_output |
grok-4-20 | 10 ₽ | chat_completions, streaming |
grok-4-3 | 10 ₽ | chat_completions, streaming |
Если задача упирается в вызов функций и строгий JSON, gpt-5-4 сегодня подтверждена шире. Если нужен длинный контекст и работа по большим кодовым базам — это профиль Kimi K3, под который её и делали: вендор описывает её как модель для долгих инженерных задач с минимальным присмотром человека.
Выбирать по одному числу в прайсе — плохая стратегия. Ставка одинаковая, а набор гарантий разный, и именно он определяет, придётся ли вам переписывать интеграцию через неделю.
Как подключить Kimi K3 через KeyDealer
Идентификатор модели — kimi-k3, эндпоинт OpenAI-совместимый, менять клиент не нужно.
- Получите ключ на странице входа.
- Проверьте статус позиции:
curl -H "Authorization: Bearer $KEY" https://api.keydealer.ru/v1/modelsи найдитеkimi-k3. Фильтровать нужно по полюprotocols.chat_completions:availabilityсчитает иначе и может показать доступной позицию с закрытым протоколом. - Подставьте
base_urlKeyDealer в свой SDK и"model": "kimi-k3"в запрос. Пошагово этот переезд описан здесь. - Поставьте
reasoning_effortосознанно. Значение по умолчанию — самое дорогое. - Не рассчитывайте на скидку за кэш:
prompt_cache.statusравенunsupported.
Даты отключения у Kimi K3 нет — ни в вендорской документации, ни в нашем каталоге. Публичного расписания вывода моделей Moonshot не публикует, так что рассчитывать на предупреждение заранее не стоит. То, что известно по срокам у остальных семейств, собрано в календаре отключений.
Чего мы не утверждаем
Несколько вещей, которые проверить не удалось, и мы их не выдумываем.
Мы не утверждаем, что через наш маршрут работают tool calls, JSON-режим и структурированный вывод: в каталоге они unknown. Не утверждаем, что reasoning_effort доходит до модели через наш маршрут в неизменном виде — поле вендорское, отдельной проверки на нашей стороне у него нет. Не утверждаем, что нативное понимание изображений доступно: поля vision в живой выдаче каталога сейчас нет вообще ни у одной позиции.
И не обещаем, что ставка 10 ₽ продержится. Цены каталога меняются, статья остаётся снимком на 31 августа 2026 года.
Что держать в голове
Девятнадцать дней между «модель есть в каталоге» и «модель отвечает» — это и есть настоящий срок поставки. Веса Moonshot выложила в июле, в нашей выдаче позиция появилась 13 августа, работать начала 31-го.
Отсюда рабочая привычка: строить выбор модели не по лендингу и не по дате релиза у вендора, а по живому ответу GET /v1/models в день, когда вы пишете код. Три поля статуса в этом ответе считают по-разному, и решает то, которое ближе всего к вашему протоколу.
Ключ, которым можно прямо сейчас проверить kimi-k3 в своей выдаче, выдаётся на keydealer.ru/login.
Частые вопросы
Kimi K3 доступна в KeyDealer?
Да, с 31 августа 2026 года. В живой выдаче GET /v1/models у неё availability available и protocols.chat_completions available, ставка — 10 рублей за миллион входных токенов и столько же за миллион выходных. До этого дня модель числилась в каталоге со статусом review и запросы к ней отклонялись кодом model_under_review.
Сколько Kimi K3 стоит у самой Moonshot?
Три доллара за миллион входных токенов при промахе кэша, тридцать центов при попадании и пятнадцать долларов за миллион выходных. Цифры взяты со страницы цен platform.kimi.ai 31 августа 2026 года.
Какой у Kimi K3 контекст?
Ровно 1 048 576 токенов — это число напечатано в вендорской таблице цен, а не округление до миллиона.
Можно ли пользоваться tool calls и JSON-режимом через KeyDealer?
В документации Moonshot они описаны, но в нашем каталоге поля tools и json_output у этой позиции стоят в значении unknown. Проверенными на 31 августа значатся только chat_completions и streaming, поэтому обещать остальное мы не можем.
Работает ли скидка за кэш промптов?
Нет. У всех позиций каталога prompt_cache.status равен unsupported, поэтому вендорская ставка попадания в кэш в тридцать центов через нас не действует.
Сколько моделей Kimi в каталоге?
Одна — kimi-k3. Семейство Kimi открыто впервые: до 31 августа обе его позиции стояли в review.
Как подключить Kimi K3 из России?
Через OpenAI-совместимый эндпоинт KeyDealer: получить ключ на keydealer.ru/login, подставить base_url в свой SDK и указать в запросе идентификатор kimi-k3. Оплата в рублях, зарубежная карта и VPN не нужны.
Что означает ошибка model_under_review?
Что протокол у этой модели ещё не открыт. Запрос отклоняется до резервирования баланса и до обращения к модели, деньги не списываются. У kimi-k3 такой ответ приходил до 31 августа 2026 года.