Релизы и изменения моделей
У xAI вышли Grok 4.5 и 4.3: что это значит для каталога
xAI опубликовала цены на Grok 4.5 и Grok 4.3, и обе модели используют двухуровневый тариф: до 200 тысяч токенов в запросе Grok 4.5 стоит 2 доллара за миллион входных и 6 за миллион выходных, свыше порога — 4 и 12. У Grok 4.3 это 1,25 и 2,50 против 2,50 и 5. Знание-отсечка Grok 4.5 — 1 февраля 2026 года. В каталоге KeyDealer на 9 августа 2026 доступен Grok 4.20 Research по 25 рублей за миллион входных и выходных токенов; новых версий там пока нет, и обещать их сроки мы не будем. Зато сам механизм порога стоит понимать: он есть и у Gemini, и на нём переплачивают чаще, чем на выборе модели.
Разберём, что именно опубликовал вендор, чем это отличается от привычной схемы и что доступно сегодня.
Что опубликовала xAI
Данные со страницы моделей xAI на 9 августа 2026 года. Цены за миллион токенов в долларах.
| Модель | Вход до 200k | Выход до 200k | Вход свыше | Выход свыше |
|---|---|---|---|---|
| grok-4.5 | 2,00 | 6,00 | 4,00 | 12,00 |
| grok-4.3 | 1,25 | 2,50 | 2,50 | 5,00 |
| grok-4.20 reasoning | 1,25 | 2,50 | 2,50 | 5,00 |
| grok-4.20 non-reasoning | 1,25 | 2,50 | 2,50 | 5,00 |
| grok-build-0.1 | 1,00 | 2,00 | 2,00 | 4,00 |
Отдельная деталь, которая заметна только при внимательном чтении: у Grok 4.5 разрыв между входом и выходом трёхкратный, у остальных — двукратный. То есть новая модель дороже не равномерно, а именно на генерации.
Страницы отключений у xAI нет: docs.x.ai/docs/changelog отдаёт 404, расписание вывода моделей в открытой документации не публикуется, и планировать миграцию по документации вендора здесь не получится. Это отличает вендора от OpenAI с точными датами и от Anthropic с нижними границами — подробное сравнение в календаре отключений.
Почему порог в 200k дороже, чем кажется
Двухуровневый тариф работает не как скидка за объём, а наоборот. Пока запрос помещается в 200 тысяч токенов, вы платите базовую ставку. Как только переходите порог — ставка удваивается на весь запрос, а не на превышение.
Разница между 199 тысячами и 201 тысячей токенов в деньгах двукратная. Это ровно тот случай, когда лишний документ, добавленный в контекст «на всякий случай», удваивает счёт всей операции.
Такой же механизм у Gemini: у 3.1 Pro вход растёт с 2 до 4 долларов после того же порога. Совпадение не случайное — длинный контекст дороже в обслуживании, и вендоры тарифицируют его отдельно.
Практический вывод: если ваш сценарий ходит рядом с порогом, следите за размером запроса как за отдельной метрикой. Обрезка истории диалога или выкидывание одного лишнего вложения экономит не проценты, а половину счёта.
Что доступно в каталоге сегодня
На 9 августа 2026 года GET /v1/models отдаёт из семейства Grok одну модель.
| Модель в каталоге | Вход | Выход |
|---|---|---|
| Grok 4.20 Research | 25 ₽ за 1 млн | 25 ₽ за 1 млн |
Новых версий там нет. Сроков появления мы не называем: обещать то, чего ещё нет в выдаче API, — тот же обман, что и придуманная цифра в таблице.
Обратите внимание на важное отличие от вендорской схемы: у нас вход и выход стоят одинаково, и порога по контексту нет. Двухуровневый тариф — свойство прайса разработчика модели, а не общее правило рынка.
Это меняет арифметику для сценариев с длинными запросами. У вендора переход через 200 тысяч токенов удваивает ставку; в каталоге ставка не зависит от размера запроса.
Как понять, что вы близко к порогу
Порог считается по размеру запроса, а не по вашему тексту. В него входит всё, что уходит модели: системное сообщение, история диалога, описания инструментов и служебный контекст маршрута.
Проверить проще всего по факту. Отправьте типовой запрос и посмотрите prompt_tokens в ответе — это и есть то число, которое сравнивается с порогом.
Три вещи, которые незаметно двигают вас к 200 тысячам:
История диалога целиком. Если вы кладёте в запрос все предыдущие сообщения, размер растёт с каждым ходом. Двадцатый ход в длинной переписке может весить в десятки раз больше первого.
Документы «на всякий случай». Классика RAG-обвязок: вместо трёх релевантных фрагментов в контекст летят двадцать, потому что так проще. На пороге это удваивает цену всей операции.
Описания инструментов. Поле tools уходит в модель при каждом запросе. Десяток подробно описанных функций легко весит больше самого вопроса.
Подробный разбор с числами по каждому семейству моделей — в материале про то, почему prompt_tokens больше, чем вы отправили.
Чем закрыть задачу, если нужна свежая модель
Три подхода, в зависимости от того, зачем вам была нужна новая версия.
Нужны рассуждения и сложные цепочки. В каталоге для этого есть Opus 5 по 65 ₽, GPT-5.6 Sol по 25 ₽ и Sonnet 5 по 20 ₽. Сравнение по задачам — в подборе модели на главной странице.
Нужен длинный контекст. Здесь как раз работает отсутствие порога: Gemini 3.1 Pro в каталоге стоит 20 ₽ за миллион независимо от размера запроса, тогда как у самого Google ставка удваивается после 200 тысяч токенов.
Нужна конкретно модель xAI. Сегодня это Grok 4.20 Research. Если задача не решается им, честнее сказать это прямо, чем предлагать замену, которая не подойдёт.
Как узнать, что модель появилась
Не по новостям и не по нашему блогу, а по машиночитаемому списку — он меняется раньше, чем об этом кто-нибудь напишет.
curl -s https://api.keydealer.ru/v1/models | grep -o '"id":"[^"]*"'
Сравнение сегодняшнего вывода со вчерашним занимает секунду и ловит всё: появление моделей, изменение ставок, смену статуса возможностей. Половина фактов для этого блога находится именно так.
Тот же приём работает и с вендорской стороны. Страница цен xAI и её аналоги у остальных разработчиков обновляются молча, без анонсов: именно так и была замечена эта пара моделей.
Почему у нас нет порога по контексту
Вопрос возникает сам собой: если вендоры тарифицируют длинный контекст отдельно, почему в каталоге ставка одна.
Ответ скучный и честный: так устроена наша тарифная сетка. Цена привязана к модели, а не к размеру запроса, и в ответе GET /v1/models у каждой позиции стоит одна пара чисел — вход и выход.
Что из этого следует практически. Для коротких частых запросов разницы нет, там счёт определяет служебный контекст маршрута. Для длинных запросов схема без порога работает в вашу пользу: сценарий с большим документом в контексте не удваивается на ровном месте.
Чего из этого НЕ следует: что так будет всегда. Тарифные сетки меняются у всех, и наша не исключение. Актуальная всегда лежит в GET /v1/models, а личные условия аккаунта — в GET /v1/balance.
Что держать в голове
xAI опубликовала Grok 4.5 и 4.3 с двухуровневым тарифом: 2 и 6 долларов до порога в 200 тысяч токенов, 4 и 12 после. У Grok 4.3 — 1,25 и 2,50 против 2,50 и 5.
В каталоге на 9 августа доступен Grok 4.20 Research по 25 ₽ за миллион в обе стороны, без порога по контексту. Появятся ли новые версии и когда — сказать не можем, а придумывать не станем.
Полезное из этой новости работает независимо от того, дождётесь вы Grok 4.5 или нет: порог в 200 тысяч токенов есть у двух крупных вендоров, и переплата на нём случается чаще, чем ошибка в выборе модели.
Пересчёт всех официальных ставок в рубли по курсу ЦБ — в опорном разборе, сколько стоит 1 млн токенов в рублях. Что уходит в модель помимо вашего промпта и как это влияет на счёт — в материале про служебный контекст маршрута. Как мы проверяем цифры — на странице о проекте.
Один ключ ко всему каталогу, чтобы пробовать модели без новой интеграции под каждую и без отдельного баланса у каждого вендора: keydealer.ru/login.
Частые вопросы
Сколько стоят Grok 4.5 и Grok 4.3 у самой xAI?
По документации xAI на 9 августа 2026 года Grok 4.5 стоит 2 доллара за миллион входных токенов и 6 за миллион выходных при запросе до 200 тысяч токенов, и 4 против 12 при запросе больше. Grok 4.3 — 1,25 и 2,50 доллара, свыше порога 2,50 и 5.
Есть ли Grok 4.5 в каталоге KeyDealer?
На 9 августа 2026 года в каталоге доступен Grok 4.20 Research по ставке 25 рублей за миллион входных и выходных токенов. Актуальный список всегда возвращает GET /v1/models.
Что такое двухуровневый тариф по контексту?
Ставка удваивается, когда размер запроса переходит порог в 200 тысяч токенов. Это не плавный рост, а скачок: запрос на 199 тысяч и на 201 тысячу стоят по-разному вдвое.
Какая знание-отсечка у Grok 4.5?
Документация xAI указывает 1 февраля 2026 года.