LLM API и интеграция
Kimi API: как подключить, цены и статус позиций
Kimi API подключается как OpenAI-совместимый: адрес, ключ, имя модели. В каталоге KeyDealer на 12 сентября 2026 года две позиции, и работает из них одна: kimi-k3 за 10 ₽ за миллион токенов — длинный контекст и сложные документы, понимание изображений подтверждено замером. Вторая, kimi-k2-7-code за 20 ₽, стоит в статусе review: запросы к ней сейчас не принимаются.
Об этом честнее сказать в первом абзаце, чем дать читателю дойти до примера кода и получить отказ. Ниже — подключение рабочей позиции, что вообще значит статус review, где длинный контекст окупается и где съедает бюджет, и чем закрыть кодовый сценарий, пока старшая позиция закрыта.
Две позиции, и одна из них сейчас закрыта
Линейка в каталоге короткая, поэтому разложим сразу.
kimi-k3 — доступна, тарифицируется, принимает запросы. Назначение по каталогу: длинный контекст и сложные документы. Понимание изображений у неё подтверждено нашим замером — это редкая пометка, большинство позиций каталога стоят с unknown.
kimi-k2-7-code — назначение по каталогу: разработка и большие репозитории. Статус — review. Практически это значит, что позиция числится в каталоге, но обращения к ней не обрабатываются. Не «медленно», не «иногда», а не обрабатываются.
Что означает статус review
Статус review в каталоге — не маркетинговая формулировка «скоро будет». Это рабочее состояние позиции, в котором она не отдаётся в трафик.
Причины бывают разные: позиция ведёт себя нестабильно на наших проверках, отвечает не тем, чем должна, или мы ещё не закончили её замер. Общее одно — пока идёт разбор, мы не выпускаем её к клиентам, потому что молчаливо отдавать сомнительную позицию хуже, чем честно её закрыть.
Что из этого следует для вашего кода. Во-первых, не ставьте kimi-k2-7-code в конфиг «на будущее»: вызов вернёт ошибку, и если у вас нет обработчика, упадёт весь сценарий. Во-вторых, если позиция всё же фигурирует у вас в списке маршрутов, заведите запасной вариант — как устроены отказы маршрута и переключение на резерв, разобрано в статье отказы маршрута и fallback.
Статусы меняются: позиция из review может открыться, и тогда в каталоге появится доступность, а не обещание. Ровно так в своё время открылась младшая позиция линейки — история в заметке Kimi K3 открылась в каталоге.
Подключение
Адрес. https://api.keydealer.ru/v1/chat/completions. Формат OpenAI, библиотеки под OpenAI работают без правок кода.
Ключ. Один на весь каталог, отдельной регистрации под семейство не нужно.
Имя модели. kimi-k3, символ в символ, через дефис. Подвижных суффиксов вроде latest в каталоге нет ни у одного семейства.
curl https://api.keydealer.ru/v1/chat/completions \
-H "Authorization: Bearer $KEYDEALER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"kimi-k3","messages":[{"role":"user","content":"Привет"}]}'
Если вы переезжаете с другого маршрута, меняются адрес и ключ, остальное тело остаётся прежним. Пошаговый разбор первого вызова — в статье первый запрос к API нейросети.
Ставки в каталоге
На 12 сентября 2026 года, рубли за миллион токенов, одинаково на вход и на выход.
| Модель | ₽ за миллион | Назначение по каталогу | Статус |
|---|---|---|---|
kimi-k3 | 10 | длинный контекст и сложные документы | доступна |
kimi-k2-7-code | 20 | разработка и большие репозитории | review, запросы не принимаются |
Ставка зафиксирована в рублях и не двигается вслед за курсом: для справки, курс ЦБ на 12 сентября 2026 года — 84,2569 ₽ за доллар. Позиция в статусе review тарифицируется по своей ставке тогда, когда откроется; пока она закрыта, счёт по ней не идёт просто потому, что запросы не проходят.
kimi-k3: длинный контекст и картинки на входе
Длинный контекст — это возможность положить в один запрос то, что обычно приходится резать. Три сценария, где это меняет результат, а не просто увеличивает счёт.
Документ, который теряет смысл при нарезке. Договор с перекрёстными ссылками между пунктами, регламент, техзадание. Если резать на куски, модель отвечает по фрагменту и не видит, что пункт 4.2 отменяет пункт 2.7. Класс задач разобран в статье нейросеть для документов бизнеса.
Сравнение двух длинных версий. Старая редакция и новая целиком в одном запросе — и вопрос «что изменилось по существу». Нарезка тут ломает саму задачу, потому что различие может быть в порядке разделов. Подход описан в статье сравнение документов нейросетью.
Длинная переписка или лог. Тред поддержки на сотню сообщений, выгрузка событий за сутки — когда нужен вывод по всей истории, а не по последнему экрану.
Важная оговорка: длинный контекст нужен реже, чем кажется. Часто задача решается поиском нужного куска и коротким запросом по нему, и это дешевле на порядок. Где проходит граница — в статье сколько контекста реально нужно.
Понимание изображений подтверждено замером. У kimi-k3 в каталоге стоит подтверждённый статус понимания изображений. Это значит, что мы отправляли картинку на вход и получали осмысленный текстовый ответ — не предположение по документации, а наш замер.
Практически это открывает смешанный вход: страница договора фотографией плюс вопрос по ней текстом, скан акта плюс просьба вытащить поля, скриншот отчёта плюс просьба объяснить расхождение. В связке с длинным контекстом получается рабочий инструмент для бумажной работы — смежная механика разобрана в статье как обработать PDF через API, а список проверенных на картинках позиций — в статье vision появился в каталоге.
Вызов функций у kimi-k3 при этом стоит как unknown: мы его не замеряли. Если строите агента с инструментами, проверьте это на своём сценарии прежде, чем ставить позицию в прод.
Арифметика длинного контекста
Здесь чаще всего уезжает бюджет, поэтому считаем явно.
Одна страница плотного текста — примерно 500–700 токенов. Договор на сорок страниц — порядка 25 тысяч токенов только на вход. Один запрос с ним — четверть процента от миллиона, то есть копейки по ставке из таблицы.
Проблема начинается на втором вопросе. В диалоге вся переписка отправляется заново на каждом шаге: если вы задаёте по тому же договору десять уточняющих вопросов, документ уходит на вход десять раз. Двадцать пять тысяч токенов превращаются в двести пятьдесят, и счёт растёт нелинейно при том, что ставка не менялась. Как это считать — в статье как считать токены.
Два приёма снимают большую часть перерасхода. Первый — кеш промптов там, где длинная неизменная часть повторяется из запроса в запрос; разбор в статье кеш промптов: как экономить. Второй — не тащить документ в каждый ход, а один раз получить структурированный конспект и дальше работать с ним.
И третье, скучное, но важное: заведите журнал запросов до того, как нагрузка станет заметной. Когда счёт вырастет вдвое, вопрос «какой сценарий это сделал» должен решаться запросом к логу — см. логирование запросов к моделям.
Чем закрыть кодовый сценарий, пока позиция в review
Если вы шли за kimi-k2-7-code, в каталоге есть на что опереться прямо сейчас. Ставки за миллион токенов, одинаково на вход и на выход.
| Модель | ₽ за миллион | Под что |
|---|---|---|
deepseek-v4-flash | 1 | дешёвые массовые правки и генерация обвязок |
grok-build-0-1 | 5 | быстрая разработка и правки в одном файле |
glm-5-3 | 15 | сложный код и агентные задачи |
Выбор зависит от того, что именно у вас упирается в модель: объём однотипных правок, скорость итерации или связность изменений между файлами. Обзор класса задач — в статье нейросеть для написания кода, а порядок переезда без переписывания интеграции — в статье как перейти на другую модель.
Ошибки при подключении
Ставить kimi-k2-7-code в конфиг. Позиция в review, запрос вернёт ошибку. Это не временная сетевая проблема, повтор не поможет.
Путать kimi-k3 с отключённой позицией прошлого поколения. Старая кодовая модель линейки была отключена вендором, и код, написанный под её имя, работать не будет — история в статье Kimi K2.5 отключили: чем заменить.
Слать документ заново на каждом ходу. Самая дорогая ошибка на этой позиции, разобрана выше.
Не задавать потолок ответа. Длинный контекст на входе провоцирует длинный ответ на выходе, а платите вы за оба конца по одной ставке.
Забытый заголовок Content-Type. Тело уходит, но не разбирается. Что означают типовые коды ответа — в статье ошибки API нейросетей.
Что работает из России
Регистрация в консоли вендора проходит, оплата российской картой — нет. Ключ без пополненного баланса существует, но запросы отклоняются.
Рублёвый маршрут снимает оба барьера: пополнение российской картой, ставка зафиксирована в рублях, VPN не нужен ни для запросов, ни для кабинета. Что ещё ломается при прямом доступе — в статье как оплатить API нейросети из России.
Отдельный сценарий — открытые веса линейки: это уже не про API, а про своё железо. Разбор — в заметке Kimi K3: открытые веса.
Чего мы не утверждаем
Мы не обещаем, что kimi-k2-7-code откроется к определённой дате. Статус review — состояние на 12 сентября 2026 года, и мы не даём по нему прогнозов.
Мы не утверждаем вызов функций у kimi-k3: он стоит как unknown, замера у нас нет, и это означает отсутствие проверки, а не отсутствие возможности.
Мы не называем вендорских цен. Их страница тарифов отдаётся скриптом, и число оттуда не читается достоверно, поэтому мы его не приводим вовсе. Наша ставка — в таблице выше, подставляется токеном, а не вбита руками.
Что нужно, чтобы попробовать
Ключ заводится за минуту на keydealer.ru/login: почта и пароль, без документов и без зарубежной карты. Один ключ открывает kimi-k3 и остальной каталог.
Платные текстовые позиции доступны на приветственном бонусе сразу — прогнать свой документ и посмотреть реальный расход на длинном контексте можно до первого пополнения. Это разумный порядок: сначала померить, потом закладывать в бюджет.
Что держать в голове
Подключение — адрес, ключ, имя модели. Формат совместим с OpenAI, переезд занимает две строки.
Из двух позиций линейки сегодня работает одна. kimi-k3 доступна, понимание изображений у неё подтверждено замером; kimi-k2-7-code в статусе review и запросов не принимает — под код в каталоге есть другие позиции.
Длинный контекст — возможность, а не режим по умолчанию: вы платите за каждый переданный токен на каждом шаге диалога, даже если модель использовала малую часть. Как мы проверяем факты и почему у каждой цифры стоит дата — на странице о проекте. Завести ключ: keydealer.ru/login.
Частые вопросы
Как подключить Kimi API?
Формат совместим с OpenAI: меняются адрес, ключ и имя модели. Адрес — https://api.keydealer.ru/v1/chat/completions, рабочее имя позиции — kimi-k3.
Сколько стоит Kimi API в рублях?
В каталоге две позиции, старшая вдвое дороже младшей, ставка одинаковая на вход и на выход. Точные числа — в таблице ставок в статье.
Работает ли kimi-k2-7-code?
Нет. На 12 сентября 2026 года эта позиция в статусе review, запросы к ней не принимаются. Она остаётся в каталоге, но вызвать её сейчас нельзя.
Понимает ли Kimi картинки?
У kimi-k3 понимание изображений подтверждено нашим замером. У kimi-k2-7-code статус unknown, и проверить его сейчас нельзя из-за статуса review.
Зачем Kimi длинный контекст?
Под задачи, где документ нельзя резать на куски без потери смысла: договор целиком, длинная переписка, объёмная выгрузка. Но длина стоит денег на каждом шаге диалога.
Работает ли Kimi API из России?
Да, через рублёвый маршрут: пополнение российской картой, один ключ на весь каталог, без зарубежной карты и без VPN.