Релизы и изменения моделей

Каталог вырос до 37 моделей: что работает, а что в review

Каталог вырос до 37 моделей: что работает, а что в review

За сутки каталог KeyDealer вырос с 25 моделей до 37: 12 новых позиций, рост почти на половину. Приехало семейство Grok целиком. Текущие ставки: 4.5 — 20 ₽, 4.3 — 10 ₽, Grok Build 0.1 — 5 ₽, Grok 4.20 Multi-Agent — 20 ₽ за миллион входных и выходных токенов. Впервые появились Kimi и Qwen, которых лендинг обещал с самого начала. Статусы доступности в остальной части статьи — исторический срез на 13 августа 2026 года; перед запросом проверяйте поле protocols.chat_completions в живом каталоге.

Ставки в рублях по всему каталогу и метод расчёта живут в разборе сколько стоит 1 млн токенов в рублях. Здесь — только то, что изменилось 13 августа, и как читать каталог, чтобы не поймать отказ на проде.

Что именно изменилось в каталоге за сутки

Снимок GET /v1/models от 12 августа отдавал 25 моделей. Снимок от 13 августа — 37. Причём прибавка легла сразу на пять семейств.

СемействоБыло 12.08Стало 13.08Прибавка
Grok15+4
Gemini47+3
GLM35+2
Kimi02+2
Qwen01+1
Claude88
GPT66
GPT-OSS11
GPT Image22

Одна позиция при этом исчезла: grok-4-20-research из выдачи пропал, а вместо него появился grok-4-20-multi-agent. Модель никуда не делась — у неё сменился идентификатор. Но если старый ID зашит у вас в коде, запрос теперь вернёт model_not_found. Замена: grok-4-20-multi-agent, текущая ставка 20 ₽.

Вместе с моделями в ответе появились два новых поля, которых сутками раньше не было вовсе: availability и protocols. Про них — ниже, потому что именно они решают, поедет ваш запрос или нет.

Какие модели Grok теперь доступны и сколько стоят

Пять штук: Grok 4.5, Grok 4.3, Grok 4.20, Grok 4.20 Multi-Agent и Grok Build 0.1. У всех пятерых protocols.chat_completions открыт, то есть зовутся они сегодня же.

Девятого августа в разборе про то, что Grok 4.5 и 4.3 вышли у вендора, но в каталоге их нет, стояла честная строчка: сроков появления не обещаем. Четыре дня спустя обещать уже нечего.

Цены вендора — со страницы моделей xAI, пересчёт по курсу ЦБ на 13 августа 2026 года: 82,9977 ₽ за доллар.

МодельID в каталогеНаша ставка, ₽ вход/выходУ xAI, $ вход/выходУ xAI в ₽ вход/выход
Grok 4.5grok-4-520 / 202,00 / 6,00166,00 / 497,99
Grok 4.3grok-4-315 / 151,25 / 2,50103,75 / 207,49
Grok 4.20grok-4-2015 / 151,25 / 2,50103,75 / 207,49
Grok 4.20 Multi-Agentgrok-4-20-multi-agent25 / 251,25 / 2,50103,75 / 207,49
Grok Build 0.1grok-build-0-18 / 81,00 / 2,0083,00 / 166,00

Долларовые ставки xAI приведены для запроса до 200 тысяч токенов. Выше порога они удваиваются: у Grok 4.5 становятся 4 и 12 долларов, у 4.3 и всей линейки 4.20 — 2,50 и 5. Механика порога разобрана отдельно в материале про двухуровневые тарифы по контексту; коротко — дороже становится весь запрос, а не только та часть, что перевалила за 200 тысяч. У рублёвой ставки KeyDealer такого порога нет: текущие 20 ₽ остаются той же ставкой и на 10 тысячах токенов, и на 900 тысячах.

Отдельно про Grok Build 0.1: у неё контекст ограничен 256 тысячами токенов против миллиона у остальных. Текущая ставка — 5 ₽, но окно остаётся самым узким в семействе.

Есть ли Kimi и Qwen в каталоге KeyDealer

Появились в выдаче. Вызвать их нельзя.

Лендинг перечислял Kimi и Qwen с самого запуска, а живой /v1/models их не отдавал — расхождение висело с 8 августа. Сегодня оно закрылось наполовину: модели в каталоге есть, но у всех трёх базовый протокол в статусе review.

МодельIDСтавка, ₽ вход/выходСтатус Chat Completions
Kimi K3kimi-k335 / 35review
Kimi K2.7 Codekimi-k2-7-code20 / 20review
Qwen 3.6 35B A3Bqwen-3-6-35b-a3b40 / 280review

Qwen здесь выбивается из всего каталога. У остальных 34 текстовых моделей вход и выход стоят одинаково — это давняя особенность рублёвого прайса. У Qwen 3.6 выход дороже входа в семь раз: 40 ₽ против 280 ₽. Если вы планировали её под генерацию длинных ответов, считайте бюджет по выходу, а не по среднему.

Про саму K3 и её открытые веса написано в отдельном разборе — Kimi K3 и позиция вендоров по открытым весам. Здесь важно другое: строчка на лендинге и строчка в API — разные вещи, и вторая главнее.

Что означает статус review в GET /v1/models

Что маршрут виден в каталоге, но закрыт для запросов. У слова здесь узкий технический смысл, прописанный в контракте.

Формулировка из публичного контракта KeyDealer: запрос к базовому протоколу со статусом review завершается отказом до резервирования баланса и до обращения к сервису модели. Три следствия, которые стоит держать в голове:

  1. Денег не спишут. Отказ происходит раньше, чем система трогает баланс. Пробный запрос к модели в review не стоит ничего.
  2. Ошибка стабильная и называется model_under_review. Она входит в список стабильных кодов вместе с model_not_found, insufficient_balance и unsupported_parameter. На неё можно писать обработчик.
  3. Статус живёт на уровне протокола, а не модели. У одной и той же модели Chat Completions может быть открыт, а Anthropic Messages и Responses — закрыты. И наоборот: sonnet-5, opus-4-8 и haiku-4-5 к вечеру 13 августа отдавали anthropic_messages: available при chat_completions: review.

Последний пункт важнее, чем кажется, и за один день он успел развернуться. Утром 13 августа anthropic_messages стоял в review у всего каталога; к вечеру протокол открылся у восьми моделей Claude — fable-5, opus-5, opus-4-8, opus-4-7, opus-4-6, sonnet-5, sonnet-4-6 и haiku-4-5. То есть подключение KeyDealer как бэкенда для Claude Code через /v1/messages из невозможного стало возможным за несколько часов. Это лучшая иллюстрация к тому, зачем вообще читать статус из живой выдачи, а не из статьи.

Почему availability и protocols могут не совпадать

Потому что считают они разное — и на трёх моделях расходятся.

В ответе появились два поля со статусами:

  • availability — 27 моделей available, 8 review;
  • protocols.chat_completions — 24 available, 11 review.

Разница в три модели. Это sonnet-5, opus-4-8 и haiku-4-5: верхнее поле у них говорит available, а протокол Chat Completions при этом закрыт. Ровно те же три модели имеют capabilities.chat_completions: unknown.

Практический вывод простой: фильтровать каталог по availability недостаточно. Клиент, который соберёт список доступных моделей по верхнему полю и предложит его пользователю, положит в этот список Sonnet 5 — одну из самых востребованных позиций — и получит model_under_review на первом же запросе.

Проверять нужно protocols.chat_completions. Расхождение зафиксировано на 13 августа 2026 года; трактовать его как заявленное поведение или как рассинхрон двух полей — по открытым документам нельзя, в контракте availability отдельно не описано. Поэтому берём то, что описано: решает протокол.

Сколько стоят новые Gemini и GLM в рублях

Gemini 2.5 Pro — 23 ₽ за миллион входных токенов и столько же за миллион выходных, обе Flash-Lite по 8 ₽, GLM-5 — 5 ₽, GLM-5.1 — 15 ₽. Статусы в этом разделе зафиксированы на 13 августа 2026 года; актуальную доступность нужно читать из GET /v1/models.

МодельIDНаша ставка, ₽СтатусУ вендора, $ вход/выход
Gemini 2.5 Progemini-2-5-pro23 / 23available1,25 / 10,00
Gemini 2.5 Flash-Litegemini-2-5-flash-lite8 / 8review0,10 / 0,40
Gemini 3.1 Flash-Litegemini-3-1-flash-lite8 / 8review0,25 / 1,50
GLM-5glm-56 / 6review1,00 / 3,20
GLM-5.1glm-5-115 / 15review1,40 / 4,40

Цены Gemini — с прайса Google, у 2.5 Pro они действуют до 200 тысяч токенов, выше становятся 2,50 и 15 долларов. Цены GLM — с прайса Z.ai; там же видно, что GLM-5.1 и GLM-5.2 стоят одинаково, 1,4 и 4,4 доллара, а GLM-5 дешевле обеих.

Сильнее всего разрыв виден на выходе Gemini 2.5 Pro: 23 ₽ против 829,98 ₽ по курсу ЦБ. Курс объясняет тут меньшую часть разрыва. У официальных API выход традиционно дороже входа в 5–8 раз, а в рублёвом прайсе вход и выход равны. Чем длиннее ответы вашего сервиса, тем сильнее расходятся два счёта.

И ещё одно, что не изменилось: prompt_cache.status у всех 35 текстовых моделей по-прежнему unsupported. Двенадцать новых моделей не принесли кэша промптов. Скидку за кэширование не закладывайте в расчёт — её нет ни у одной позиции каталога.

Как проверить доступность модели перед запросом

Читать поле protocols.chat_completions в ответе GET /v1/models — оно и решает, поедет запрос или нет. Порядок целиком, чтобы не сломался при следующем расширении каталога:

  1. Забрать живой список. GET https://api.keydealer.ru/v1/models — источник правды. Ни лендинг, ни эта статья, ни вчерашний закешированный ответ на эту роль не годятся.
  2. Фильтровать по протоколу, который вы реально зовёте. Для /v1/chat/completions это protocols.chat_completions === "available". Для /v1/messagesprotocols.anthropic_messages.
  3. Сверить возможность, а не только доступность. capabilities.tools, capabilities.json_output и прочие имеют три статуса: verified, unsupported, unknown. unknown означает, что заявления нет — пробовать можно там, где базовый Chat verified, и ответ придёт с заголовком x-kd-unverified-capabilities.
  4. Обработать model_under_review отдельно от model_not_found. Первая означает «есть, но закрыто» и может открыться завтра. Вторая — «такого ID нет», и её надо чинить в коде.
  5. Не забыть служебный контекст. К вашему промпту прибавляется контекст маршрута — у новых Grok это 2 700 токенов оценочно. Как он попадает в счёт, разобрано в материале про служебный контекст маршрута.

Одной строкой на bash, чтобы увидеть только то, что реально зовётся сегодня:

curl -s https://api.keydealer.ru/v1/models | jq -r '.data[] | select(.protocols.chat_completions=="available") | .id'

Что делать с этим в своей интеграции

Меняет три вещи, и каждая — на одно действие.

Если вы ждали Grok — можно подключать. Grok 4.5 доступен по 20 ₽, Grok 4.3 — по 10 ₽ за миллион в обе стороны, без порога 200 тысяч токенов, который есть у самого вендора. Для длинных запросов это заметнее всего: у xAI запрос на 201 тысячу токенов стоит вдвое дороже, чем на 199 тысяч, а рублёвая ставка на длину не реагирует.

Если у вас в коде зашит grok-4-20-research — его больше нет. Идентификатор переименован в grok-4-20-multi-agent. Ставка не изменилась, но старый ID теперь вернёт model_not_found. Это правка на одну строку, но пока её не сделали, маршрут не работает.

Если вы строите выбор модели для пользователя — переберите фильтр. Условие availability === "available" сегодня пропускает Sonnet 5, Opus 4.8 и Haiku 4.5 в список доступных, а запрос к ним завершится отказом. Условие по protocols.chat_completions отрабатывает верно.

Отдельно стоит заглянуть в календарь отключений моделей 2026: расширение каталога не отменяет того, что часть моделей вендоры выводят по расписанию, и эти два процесса идут одновременно.

Ключ, которым вызываются все 37 позиций, один и тот же — отдельная заявка на новые семейства не нужна. Получить его можно на странице входа, а проверить, что именно он открывает сегодня, — тем же запросом к /v1/models.

Коротко

До 13 августа число моделей в каталоге и число рабочих маршрутов совпадали, поэтому одного счётчика хватало. Теперь счётчика два, и расходятся они на трёх позициях.

Отсюда практика на ближайшие недели. Одиннадцать закрытых маршрутов — это очередь, которая движется, а не постоянное свойство каталога: позиции из неё открываются по мере проверки. Значит, вчерашний закешированный список моделей устаревает теперь быстрее, чем раньше, причём в обе стороны — вчера закрытое сегодня может работать, а grok-4-20-research уже не отвечает. Перечитывайте /v1/models перед тем, как показать пользователю выбор модели. Это дешевле, чем потом вылавливать model_under_review из логов прода.

Частые вопросы

Сколько моделей в каталоге KeyDealer на 13 августа 2026 года?

Тридцать семь: 35 текстовых и 2 модели генерации изображений. Сутками раньше их было 25. Но доступность считается не по общему числу: Chat Completions открыт у 24 текстовых моделей, у остальных 11 базовый протокол помечен review. Живое число всегда возвращает GET /v1/models.

Появились ли Grok 4.5 и Grok 4.3 в каталоге?

Да. На 13 августа 2026 года обе были доступны по 15 рублей за миллион входных и выходных токенов. Текущие ставки — 20 ₽ для Grok 4.5 и 10 ₽ для Grok 4.3. Ещё в разборе от 9 августа их в каталоге не было, там значился только Grok 4.20 Research. Вместе с ними приехали Grok 4.20, Grok 4.20 Multi-Agent и Grok Build 0.1.

Можно ли уже вызвать Kimi K3 и Qwen через API KeyDealer?

Нет. Kimi K3, Kimi K2.7 Code и Qwen 3.6 35B A3B в каталоге появились, но у всех трёх базовый протокол Chat Completions находится в статусе review. Запрос к ним завершится ошибкой model_under_review. В выдаче они видны, вызвать их сегодня нельзя.

Что означает статус review в GET /v1/models?

Что маршрут виден в каталоге, но ещё не открыт. По контракту, опубликованному в llms.txt, запрос к протоколу со статусом review завершается отказом до резервирования баланса и до обращения к модели. Деньги за такой запрос не списываются, код ошибки — model_under_review.

Списываются ли деньги за запрос к модели в статусе review?

Нет. Отказ происходит раньше резервирования баланса и раньше обращения к сервису модели. Это описано в контракте на keydealer.ru/llms.txt. Ошибка возвращается сразу, счёт не выставляется.

Какое поле проверять, чтобы понять, доступна ли модель?

protocols.chat_completions, а не availability. На 13 августа 2026 у трёх моделей — sonnet-5, opus-4-8 и haiku-4-5 — верхнее поле availability показывает available, а protocols.chat_completions при этом стоит в review. Ориентироваться нужно на протокол, потому что именно он решает судьбу запроса.

Сколько стоит Gemini 2.5 Pro в каталоге KeyDealer?

На 13 августа 2026 года ставка была 20 рублей за миллион входных и выходных токенов; текущая ставка — 23 ₽. У Google та же модель тогда стоила 1,25 доллара за миллион входа и 10 долларов за миллион выхода при запросе до 200 тысяч токенов, то есть 103,75 и 829,98 рубля по курсу ЦБ на дату статьи.

Почему у Qwen 3.6 35B A3B вход и выход стоят по-разному?

Это единственная модель каталога с асимметричной ставкой: 40 рублей за миллион входных токенов и 280 за миллион выходных, разница в семь раз. У всех остальных моделей каталога вход и выход стоят одинаково. Правда, вызвать Qwen пока нельзя — она в статусе review.

Можно ли подключить Claude Code к KeyDealer через /v1/messages?

Да, на восьми моделях Claude. К вечеру 13 августа протокол Anthropic Messages открылся у fable-5, opus-5, opus-4-8, opus-4-7, opus-4-6, sonnet-5, sonnet-4-6 и haiku-4-5. У остальных 27 текстовых моделей он остаётся в статусе review, как и протокол Responses у всего каталога.

Куда делась модель grok-4-20-research?

Её переименовали в grok-4-20-multi-agent. На 13 августа 2026 года ставка была 25 рублей за миллион входных и выходных токенов; текущая ставка — 20 ₽. Старый идентификатор из выдачи GET /v1/models пропал 13 августа 2026 года. Запрос по прежнему ID вернёт model_not_found, в коде нужна замена на grok-4-20-multi-agent.

Изменился ли кэш промптов у новых моделей?

Нет. У всех 35 текстовых моделей каталога prompt_cache.status по-прежнему равен unsupported. Скидка за кэширование промптов не обещается и не применяется ни у одной модели, включая все двенадцать новых.

Источники