Релизы и изменения моделей
Grok 4.6 в каталоге: 20 ₽ без порога по контексту
15 августа в каталоге появился grok-4-6 по 20 ₽ за миллион входных и выходных токенов — через три дня после релиза у xAI. Контекст 500 тысяч токенов, отсечка знаний 1 февраля 2026 года, на Artificial Analysis Intelligence Index 61 балл: столько же, сколько у GPT-5.6 Sol, и на балл меньше, чем у Fable 5. Это делает её самой дешёвой моделью на фронтире. У самого xAI она стоит $2 за миллион входа и $6 за выход — но только до 200 тысяч токенов в запросе, после чего весь запрос считается по $4 и $12. Наша ставка порога не имеет вовсе, и дальше объясняем, почему в реальном счёте эта разница обычно весит больше, чем сама цена.
Что приехало
За сутки каталог вырос с 36 позиций до 38, и обе новые — из семейства Grok.
| Модель | Ставка, ₽ вход/выход | Статус |
|---|---|---|
grok-4-6 | 25 / 25 | доступна |
grok-4-5 | 20 / 20 | доступна |
Про grok-4-5 отдельная оговорка: она уже была в каталоге 13 августа, 14-го её в выдаче не оказалось, а 15-го она вернулась. Такое бывает, и это ровно та причина, по которой доступность надо читать из живой выдачи перед запросом, а не запоминать.
Заодно открылись протоколы у трёх моделей Claude, которые до этого числились доступными, но запросы не принимали: sonnet-5, opus-4-8 и haiku-4-5 теперь отдают chat_completions: available. Расхождение между полем availability и реальным статусом протокола, о котором мы предупреждали в разборе роста каталога, сейчас нулевое: все 28 моделей с открытым чатом открыты и по верхнему полю.
Цена у вендора и порог
Здесь начинается самое практичное. Прайс xAI устроен двухуровнево, и второй уровень дороже, чем кажется.
| До 200k токенов | Свыше 200k | |
|---|---|---|
| Вход | $2 | $4 |
| Вход из кэша | $0,50 | $1 |
| Выход | $6 | $12 |
Ключевая деталь, на которой переплачивают: при переходе порога дороже становится весь запрос, а не только та часть, что перевалила за 200 тысяч. Запрос на 201 тысячу токенов считается по удвоенной ставке целиком. Механику мы разбирали отдельно в материале про двухуровневые тарифы по контексту.
По курсу ЦБ на 15 августа 2026 года — 84,5449 ₽ за доллар — вендорские ставки выглядят так:
| До 200k | Свыше 200k | |
|---|---|---|
| Вход | 169,09 ₽ | 338,18 ₽ |
| Выход | 507,27 ₽ | 1 014,54 ₽ |
Наша ставка — 20 ₽ в обе стороны, независимо от длины запроса. Разрыв получается примерно 8,5 раза на входе и 25,4 раза на выходе при коротком контексте, а на длинном выход расходится уже в 50,7 раза.
Где сравнение честное, а где нет
Сразу оговорим границы, потому что цифры выше легко превратить в рекламу, которой они не являются.
У вендора есть кэш промптов, у нас нет. Вход из кэша стоит $0,50 против $2 — вчетверо дешевле. Если ваша нагрузка это длинный неизменный контекст, повторяемый сотни раз, разрыв сокращается. У всех 36 текстовых моделей нашего каталога prompt_cache помечен unsupported, и обещать скидку за повторы мы не будем. Как устроена такая экономика у тех, кто её даёт, — в разборе DeepSeek V4 Pro.
Симметрия работает в обе стороны. У нас вход и выход стоят одинаково. На задачах с коротким запросом и длинным ответом это выгодно, на задачах с огромным контекстом и односложным ответом — вендорская схема ближе. Почему это принципиально, разбирали на единственной асимметричной позиции каталога.
Мы не сравниваем качество. 61 балл — это оценка Artificial Analysis, не наша. Своих замеров мы не делали и на чужой рейтинг как на доказательство пригодности для вашей задачи не ссылаемся.
Что за модель по существу
Технические параметры, подтверждённые у вендора.
Контекст — 500 тысяч токенов, вдвое меньше миллиона у линейки 4.20, но вдвое больше типичных 256 тысяч. Отсечка знаний — 1 февраля 2026 года.
На вход принимает текст и изображения, поддерживает рассуждения, вызов функций и структурированный вывод. Заявленный фокус — долгоживущие агенты, агентское программирование и интерактивная работа.
Последнее объясняет, зачем вообще эта модель при наличии 4.5 по 20 ₽. Ставки 4.5 и 4.6 сейчас одинаковы, поэтому выбирать стоит только по результату на своей задаче. Проверка занимает вечер и стоит рубли.
Когда порог у вендора начинает работать против вас
Стоит показать на числах, потому что «весь запрос дороже» звучит абстрактно, пока не посчитаешь.
Возьмём сценарий, который у многих и есть: агент с большим системным промптом и накопленной историей диалога. Допустим, к десятому ходу контекст дорос до 210 тысяч токенов, ответ — 2 тысячи.
У вендора, свыше порога: 210 000 × $4 / 1 000 000 + 2 000 × $12 / 1 000 000 = 0,84 + 0,024 = $0,864, то есть 73,05 ₽ по курсу на 15 августа.
Тот же запрос, если бы контекст остался на 199 тысячах: 199 000 × $2 / 1 000 000 + 2 000 × $6 / 1 000 000 = 0,398 + 0,012 = $0,41, то есть 34,66 ₽.
Одиннадцать тысяч лишних токенов удвоили счёт. Не на 5%, соответствующие приросту объёма, а ровно вдвое — потому что ставка сменилась для всего запроса.
У нас тот же запрос: (210 000 + 2 000) × 20 ₽ / 1 000 000 = 4,24 ₽, и никакого порога, за который можно случайно перевалить.
Отсюда практический вывод, который полезен независимо от того, где вы покупаете доступ: если у вашего провайдера есть порог, за ним надо следить в коде. Обрезка истории диалога, которая держит контекст ниже границы, стоит нескольких строк и экономит половину счёта.
Чего мы не утверждаем
Не обещаем, что ставка сохранится. Каталог за неделю менялся почти ежедневно, ставки внутри него тоже. Актуальные значения — только из GET /v1/models в момент запроса.
Не обещаем, что модель останется в выдаче. История с grok-4-5, исчезнувшей на сутки, — прямая иллюстрация.
Родной протокол xAI у нас не открыт. protocols.anthropic_messages у всего семейства Grok в статусе review — он для этих моделей и не предназначен. Открыт OpenAI-совместимый chat_completions, и его достаточно.
Кэш промптов не поддерживается. Ни у Grok, ни у остальных 35 текстовых позиций.
Что делать
Короткий порядок для тех, кому нужно решение, а не новость.
- Проверьте, упирается ли ваша задача в контекст. Если запросы стабильно короче 200 тысяч токенов, преимущество отсутствия порога для вас теоретическое, и сравнивать надо по обычной ставке.
- Прогоните свои реальные запросы через 4.6 и 4.5. Разница в цене 20 против 20 ₽ окупается только там, где заметна разница в качестве.
- Читайте статус протокола перед запросом. Одна строка кода, которая экономит разбор непонятных отказов.
- Считайте вход и выход раздельно. На симметричной ставке это не влияет на сумму, но показывает, где именно у вас расход.
Как разложить расход по строкам и посчитать бюджет — в разборе стоимости миллиона токенов в рублях.
Что держать в голове
Grok 4.6 приехал в каталог и сейчас стоит 20 ₽ за миллион в обе стороны, без порога по длине контекста. У вендора та же модель стоит от $2/$6 до $4/$12 в зависимости от размера запроса, и переход порога удорожает запрос целиком.
Каталог сейчас 38 позиций, чат открыт у 28, расхождение между availability и статусом протокола обнулилось. Но всё это состояние на 15 августа, и единственный надёжный способ узнать текущее — прочитать его в живой выдаче.
Как мы проверяем цифры и почему у каждой стоит дата — на странице о проекте. Один ключ на весь каталог: keydealer.ru/login.
Частые вопросы
Grok 4.6 есть в каталоге KeyDealer?
Да, с 15 августа 2026 года. Ставка 20 рублей за миллион входных токенов и столько же за миллион выходных, protocols.chat_completions открыт.
Сколько Grok 4.6 стоит у самого xAI?
Два доллара за миллион входных и шесть за миллион выходных токенов при запросе до 200 тысяч токенов. Свыше порога весь запрос считается по 4 и 12 долларов.
Какой у модели контекст?
500 тысяч токенов. Отсечка знаний — 1 февраля 2026 года.
Насколько она сильная?
На Artificial Analysis Intelligence Index у неё 61 балл — столько же, сколько у GPT-5.6 Sol, и на один балл меньше, чем у Claude Fable 5. При этом она самая дешёвая среди моделей этого уровня.
Сколько всего моделей в каталоге?
Тридцать восемь позиций на 15 августа 2026 года: 36 текстовых и 2 модели генерации изображений. Chat Completions открыт у 28 из них.