Релизы и изменения моделей
Каталог вырос до 37 моделей: что работает, а что в review
За сутки каталог KeyDealer вырос с 25 моделей до 37: 12 новых позиций, рост почти на половину. Приехало семейство Grok целиком. Текущие ставки: 4.5 — 20 ₽, 4.3 — 10 ₽, Grok Build 0.1 — 5 ₽, Grok 4.20 Multi-Agent — 20 ₽ за миллион входных и выходных токенов. Впервые появились Kimi и Qwen, которых лендинг обещал с самого начала. Статусы доступности в остальной части статьи — исторический срез на 13 августа 2026 года; перед запросом проверяйте поле protocols.chat_completions в живом каталоге.
Ставки в рублях по всему каталогу и метод расчёта живут в разборе сколько стоит 1 млн токенов в рублях. Здесь — только то, что изменилось 13 августа, и как читать каталог, чтобы не поймать отказ на проде.
Что именно изменилось в каталоге за сутки
Снимок GET /v1/models от 12 августа отдавал 25 моделей. Снимок от 13 августа — 37. Причём прибавка легла сразу на пять семейств.
| Семейство | Было 12.08 | Стало 13.08 | Прибавка |
|---|---|---|---|
| Grok | 1 | 5 | +4 |
| Gemini | 4 | 7 | +3 |
| GLM | 3 | 5 | +2 |
| Kimi | 0 | 2 | +2 |
| Qwen | 0 | 1 | +1 |
| Claude | 8 | 8 | — |
| GPT | 6 | 6 | — |
| GPT-OSS | 1 | 1 | — |
| GPT Image | 2 | 2 | — |
Одна позиция при этом исчезла: grok-4-20-research из выдачи пропал, а вместо него появился grok-4-20-multi-agent. Модель никуда не делась — у неё сменился идентификатор. Но если старый ID зашит у вас в коде, запрос теперь вернёт model_not_found. Замена: grok-4-20-multi-agent, текущая ставка 20 ₽.
Вместе с моделями в ответе появились два новых поля, которых сутками раньше не было вовсе: availability и protocols. Про них — ниже, потому что именно они решают, поедет ваш запрос или нет.
Какие модели Grok теперь доступны и сколько стоят
Пять штук: Grok 4.5, Grok 4.3, Grok 4.20, Grok 4.20 Multi-Agent и Grok Build 0.1. У всех пятерых protocols.chat_completions открыт, то есть зовутся они сегодня же.
Девятого августа в разборе про то, что Grok 4.5 и 4.3 вышли у вендора, но в каталоге их нет, стояла честная строчка: сроков появления не обещаем. Четыре дня спустя обещать уже нечего.
Цены вендора — со страницы моделей xAI, пересчёт по курсу ЦБ на 13 августа 2026 года: 82,9977 ₽ за доллар.
| Модель | ID в каталоге | Наша ставка, ₽ вход/выход | У xAI, $ вход/выход | У xAI в ₽ вход/выход |
|---|---|---|---|---|
| Grok 4.5 | grok-4-5 | 20 / 20 | 2,00 / 6,00 | 166,00 / 497,99 |
| Grok 4.3 | grok-4-3 | 15 / 15 | 1,25 / 2,50 | 103,75 / 207,49 |
| Grok 4.20 | grok-4-20 | 15 / 15 | 1,25 / 2,50 | 103,75 / 207,49 |
| Grok 4.20 Multi-Agent | grok-4-20-multi-agent | 25 / 25 | 1,25 / 2,50 | 103,75 / 207,49 |
| Grok Build 0.1 | grok-build-0-1 | 8 / 8 | 1,00 / 2,00 | 83,00 / 166,00 |
Долларовые ставки xAI приведены для запроса до 200 тысяч токенов. Выше порога они удваиваются: у Grok 4.5 становятся 4 и 12 долларов, у 4.3 и всей линейки 4.20 — 2,50 и 5. Механика порога разобрана отдельно в материале про двухуровневые тарифы по контексту; коротко — дороже становится весь запрос, а не только та часть, что перевалила за 200 тысяч. У рублёвой ставки KeyDealer такого порога нет: текущие 20 ₽ остаются той же ставкой и на 10 тысячах токенов, и на 900 тысячах.
Отдельно про Grok Build 0.1: у неё контекст ограничен 256 тысячами токенов против миллиона у остальных. Текущая ставка — 5 ₽, но окно остаётся самым узким в семействе.
Есть ли Kimi и Qwen в каталоге KeyDealer
Появились в выдаче. Вызвать их нельзя.
Лендинг перечислял Kimi и Qwen с самого запуска, а живой /v1/models их не отдавал — расхождение висело с 8 августа. Сегодня оно закрылось наполовину: модели в каталоге есть, но у всех трёх базовый протокол в статусе review.
| Модель | ID | Ставка, ₽ вход/выход | Статус Chat Completions |
|---|---|---|---|
| Kimi K3 | kimi-k3 | 35 / 35 | review |
| Kimi K2.7 Code | kimi-k2-7-code | 20 / 20 | review |
| Qwen 3.6 35B A3B | qwen-3-6-35b-a3b | 40 / 280 | review |
Qwen здесь выбивается из всего каталога. У остальных 34 текстовых моделей вход и выход стоят одинаково — это давняя особенность рублёвого прайса. У Qwen 3.6 выход дороже входа в семь раз: 40 ₽ против 280 ₽. Если вы планировали её под генерацию длинных ответов, считайте бюджет по выходу, а не по среднему.
Про саму K3 и её открытые веса написано в отдельном разборе — Kimi K3 и позиция вендоров по открытым весам. Здесь важно другое: строчка на лендинге и строчка в API — разные вещи, и вторая главнее.
Что означает статус review в GET /v1/models
Что маршрут виден в каталоге, но закрыт для запросов. У слова здесь узкий технический смысл, прописанный в контракте.
Формулировка из публичного контракта KeyDealer: запрос к базовому протоколу со статусом review завершается отказом до резервирования баланса и до обращения к сервису модели. Три следствия, которые стоит держать в голове:
- Денег не спишут. Отказ происходит раньше, чем система трогает баланс. Пробный запрос к модели в review не стоит ничего.
- Ошибка стабильная и называется
model_under_review. Она входит в список стабильных кодов вместе сmodel_not_found,insufficient_balanceиunsupported_parameter. На неё можно писать обработчик. - Статус живёт на уровне протокола, а не модели. У одной и той же модели Chat Completions может быть открыт, а Anthropic Messages и Responses — закрыты. И наоборот:
sonnet-5,opus-4-8иhaiku-4-5к вечеру 13 августа отдавалиanthropic_messages: availableприchat_completions: review.
Последний пункт важнее, чем кажется, и за один день он успел развернуться. Утром 13 августа anthropic_messages стоял в review у всего каталога; к вечеру протокол открылся у восьми моделей Claude — fable-5, opus-5, opus-4-8, opus-4-7, opus-4-6, sonnet-5, sonnet-4-6 и haiku-4-5. То есть подключение KeyDealer как бэкенда для Claude Code через /v1/messages из невозможного стало возможным за несколько часов. Это лучшая иллюстрация к тому, зачем вообще читать статус из живой выдачи, а не из статьи.
Почему availability и protocols могут не совпадать
Потому что считают они разное — и на трёх моделях расходятся.
В ответе появились два поля со статусами:
availability— 27 моделейavailable, 8review;protocols.chat_completions— 24available, 11review.
Разница в три модели. Это sonnet-5, opus-4-8 и haiku-4-5: верхнее поле у них говорит available, а протокол Chat Completions при этом закрыт. Ровно те же три модели имеют capabilities.chat_completions: unknown.
Практический вывод простой: фильтровать каталог по availability недостаточно. Клиент, который соберёт список доступных моделей по верхнему полю и предложит его пользователю, положит в этот список Sonnet 5 — одну из самых востребованных позиций — и получит model_under_review на первом же запросе.
Проверять нужно protocols.chat_completions. Расхождение зафиксировано на 13 августа 2026 года; трактовать его как заявленное поведение или как рассинхрон двух полей — по открытым документам нельзя, в контракте availability отдельно не описано. Поэтому берём то, что описано: решает протокол.
Сколько стоят новые Gemini и GLM в рублях
Gemini 2.5 Pro — 23 ₽ за миллион входных токенов и столько же за миллион выходных, обе Flash-Lite по 8 ₽, GLM-5 — 5 ₽, GLM-5.1 — 15 ₽. Статусы в этом разделе зафиксированы на 13 августа 2026 года; актуальную доступность нужно читать из GET /v1/models.
| Модель | ID | Наша ставка, ₽ | Статус | У вендора, $ вход/выход |
|---|---|---|---|---|
| Gemini 2.5 Pro | gemini-2-5-pro | 23 / 23 | available | 1,25 / 10,00 |
| Gemini 2.5 Flash-Lite | gemini-2-5-flash-lite | 8 / 8 | review | 0,10 / 0,40 |
| Gemini 3.1 Flash-Lite | gemini-3-1-flash-lite | 8 / 8 | review | 0,25 / 1,50 |
| GLM-5 | glm-5 | 6 / 6 | review | 1,00 / 3,20 |
| GLM-5.1 | glm-5-1 | 15 / 15 | review | 1,40 / 4,40 |
Цены Gemini — с прайса Google, у 2.5 Pro они действуют до 200 тысяч токенов, выше становятся 2,50 и 15 долларов. Цены GLM — с прайса Z.ai; там же видно, что GLM-5.1 и GLM-5.2 стоят одинаково, 1,4 и 4,4 доллара, а GLM-5 дешевле обеих.
Сильнее всего разрыв виден на выходе Gemini 2.5 Pro: 23 ₽ против 829,98 ₽ по курсу ЦБ. Курс объясняет тут меньшую часть разрыва. У официальных API выход традиционно дороже входа в 5–8 раз, а в рублёвом прайсе вход и выход равны. Чем длиннее ответы вашего сервиса, тем сильнее расходятся два счёта.
И ещё одно, что не изменилось: prompt_cache.status у всех 35 текстовых моделей по-прежнему unsupported. Двенадцать новых моделей не принесли кэша промптов. Скидку за кэширование не закладывайте в расчёт — её нет ни у одной позиции каталога.
Как проверить доступность модели перед запросом
Читать поле protocols.chat_completions в ответе GET /v1/models — оно и решает, поедет запрос или нет. Порядок целиком, чтобы не сломался при следующем расширении каталога:
- Забрать живой список.
GET https://api.keydealer.ru/v1/models— источник правды. Ни лендинг, ни эта статья, ни вчерашний закешированный ответ на эту роль не годятся. - Фильтровать по протоколу, который вы реально зовёте. Для
/v1/chat/completionsэтоprotocols.chat_completions === "available". Для/v1/messages—protocols.anthropic_messages. - Сверить возможность, а не только доступность.
capabilities.tools,capabilities.json_outputи прочие имеют три статуса:verified,unsupported,unknown.unknownозначает, что заявления нет — пробовать можно там, где базовый Chat verified, и ответ придёт с заголовкомx-kd-unverified-capabilities. - Обработать
model_under_reviewотдельно отmodel_not_found. Первая означает «есть, но закрыто» и может открыться завтра. Вторая — «такого ID нет», и её надо чинить в коде. - Не забыть служебный контекст. К вашему промпту прибавляется контекст маршрута — у новых Grok это 2 700 токенов оценочно. Как он попадает в счёт, разобрано в материале про служебный контекст маршрута.
Одной строкой на bash, чтобы увидеть только то, что реально зовётся сегодня:
curl -s https://api.keydealer.ru/v1/models | jq -r '.data[] | select(.protocols.chat_completions=="available") | .id'
Что делать с этим в своей интеграции
Меняет три вещи, и каждая — на одно действие.
Если вы ждали Grok — можно подключать. Grok 4.5 доступен по 20 ₽, Grok 4.3 — по 10 ₽ за миллион в обе стороны, без порога 200 тысяч токенов, который есть у самого вендора. Для длинных запросов это заметнее всего: у xAI запрос на 201 тысячу токенов стоит вдвое дороже, чем на 199 тысяч, а рублёвая ставка на длину не реагирует.
Если у вас в коде зашит grok-4-20-research — его больше нет. Идентификатор переименован в grok-4-20-multi-agent. Ставка не изменилась, но старый ID теперь вернёт model_not_found. Это правка на одну строку, но пока её не сделали, маршрут не работает.
Если вы строите выбор модели для пользователя — переберите фильтр. Условие availability === "available" сегодня пропускает Sonnet 5, Opus 4.8 и Haiku 4.5 в список доступных, а запрос к ним завершится отказом. Условие по protocols.chat_completions отрабатывает верно.
Отдельно стоит заглянуть в календарь отключений моделей 2026: расширение каталога не отменяет того, что часть моделей вендоры выводят по расписанию, и эти два процесса идут одновременно.
Ключ, которым вызываются все 37 позиций, один и тот же — отдельная заявка на новые семейства не нужна. Получить его можно на странице входа, а проверить, что именно он открывает сегодня, — тем же запросом к /v1/models.
Коротко
До 13 августа число моделей в каталоге и число рабочих маршрутов совпадали, поэтому одного счётчика хватало. Теперь счётчика два, и расходятся они на трёх позициях.
Отсюда практика на ближайшие недели. Одиннадцать закрытых маршрутов — это очередь, которая движется, а не постоянное свойство каталога: позиции из неё открываются по мере проверки. Значит, вчерашний закешированный список моделей устаревает теперь быстрее, чем раньше, причём в обе стороны — вчера закрытое сегодня может работать, а grok-4-20-research уже не отвечает. Перечитывайте /v1/models перед тем, как показать пользователю выбор модели. Это дешевле, чем потом вылавливать model_under_review из логов прода.
Частые вопросы
Сколько моделей в каталоге KeyDealer на 13 августа 2026 года?
Тридцать семь: 35 текстовых и 2 модели генерации изображений. Сутками раньше их было 25. Но доступность считается не по общему числу: Chat Completions открыт у 24 текстовых моделей, у остальных 11 базовый протокол помечен review. Живое число всегда возвращает GET /v1/models.
Появились ли Grok 4.5 и Grok 4.3 в каталоге?
Да. На 13 августа 2026 года обе были доступны по 15 рублей за миллион входных и выходных токенов. Текущие ставки — 20 ₽ для Grok 4.5 и 10 ₽ для Grok 4.3. Ещё в разборе от 9 августа их в каталоге не было, там значился только Grok 4.20 Research. Вместе с ними приехали Grok 4.20, Grok 4.20 Multi-Agent и Grok Build 0.1.
Можно ли уже вызвать Kimi K3 и Qwen через API KeyDealer?
Нет. Kimi K3, Kimi K2.7 Code и Qwen 3.6 35B A3B в каталоге появились, но у всех трёх базовый протокол Chat Completions находится в статусе review. Запрос к ним завершится ошибкой model_under_review. В выдаче они видны, вызвать их сегодня нельзя.
Что означает статус review в GET /v1/models?
Что маршрут виден в каталоге, но ещё не открыт. По контракту, опубликованному в llms.txt, запрос к протоколу со статусом review завершается отказом до резервирования баланса и до обращения к модели. Деньги за такой запрос не списываются, код ошибки — model_under_review.
Списываются ли деньги за запрос к модели в статусе review?
Нет. Отказ происходит раньше резервирования баланса и раньше обращения к сервису модели. Это описано в контракте на keydealer.ru/llms.txt. Ошибка возвращается сразу, счёт не выставляется.
Какое поле проверять, чтобы понять, доступна ли модель?
protocols.chat_completions, а не availability. На 13 августа 2026 у трёх моделей — sonnet-5, opus-4-8 и haiku-4-5 — верхнее поле availability показывает available, а protocols.chat_completions при этом стоит в review. Ориентироваться нужно на протокол, потому что именно он решает судьбу запроса.
Сколько стоит Gemini 2.5 Pro в каталоге KeyDealer?
На 13 августа 2026 года ставка была 20 рублей за миллион входных и выходных токенов; текущая ставка — 23 ₽. У Google та же модель тогда стоила 1,25 доллара за миллион входа и 10 долларов за миллион выхода при запросе до 200 тысяч токенов, то есть 103,75 и 829,98 рубля по курсу ЦБ на дату статьи.
Почему у Qwen 3.6 35B A3B вход и выход стоят по-разному?
Это единственная модель каталога с асимметричной ставкой: 40 рублей за миллион входных токенов и 280 за миллион выходных, разница в семь раз. У всех остальных моделей каталога вход и выход стоят одинаково. Правда, вызвать Qwen пока нельзя — она в статусе review.
Можно ли подключить Claude Code к KeyDealer через /v1/messages?
Да, на восьми моделях Claude. К вечеру 13 августа протокол Anthropic Messages открылся у fable-5, opus-5, opus-4-8, opus-4-7, opus-4-6, sonnet-5, sonnet-4-6 и haiku-4-5. У остальных 27 текстовых моделей он остаётся в статусе review, как и протокол Responses у всего каталога.
Куда делась модель grok-4-20-research?
Её переименовали в grok-4-20-multi-agent. На 13 августа 2026 года ставка была 25 рублей за миллион входных и выходных токенов; текущая ставка — 20 ₽. Старый идентификатор из выдачи GET /v1/models пропал 13 августа 2026 года. Запрос по прежнему ID вернёт model_not_found, в коде нужна замена на grok-4-20-multi-agent.
Изменился ли кэш промптов у новых моделей?
Нет. У всех 35 текстовых моделей каталога prompt_cache.status по-прежнему равен unsupported. Скидка за кэширование промптов не обещается и не применяется ни у одной модели, включая все двенадцать новых.