Релизы и изменения моделей

Grok 4.6 в каталоге: 20 ₽ без порога по контексту

Grok 4.6 в каталоге: 20 ₽ без порога по контексту

15 августа в каталоге появился grok-4-6 по 20 ₽ за миллион входных и выходных токенов — через три дня после релиза у xAI. Контекст 500 тысяч токенов, отсечка знаний 1 февраля 2026 года, на Artificial Analysis Intelligence Index 61 балл: столько же, сколько у GPT-5.6 Sol, и на балл меньше, чем у Fable 5. Это делает её самой дешёвой моделью на фронтире. У самого xAI она стоит $2 за миллион входа и $6 за выход — но только до 200 тысяч токенов в запросе, после чего весь запрос считается по $4 и $12. Наша ставка порога не имеет вовсе, и дальше объясняем, почему в реальном счёте эта разница обычно весит больше, чем сама цена.

Что приехало

За сутки каталог вырос с 36 позиций до 38, и обе новые — из семейства Grok.

МодельСтавка, ₽ вход/выходСтатус
grok-4-625 / 25доступна
grok-4-520 / 20доступна

Про grok-4-5 отдельная оговорка: она уже была в каталоге 13 августа, 14-го её в выдаче не оказалось, а 15-го она вернулась. Такое бывает, и это ровно та причина, по которой доступность надо читать из живой выдачи перед запросом, а не запоминать.

Заодно открылись протоколы у трёх моделей Claude, которые до этого числились доступными, но запросы не принимали: sonnet-5, opus-4-8 и haiku-4-5 теперь отдают chat_completions: available. Расхождение между полем availability и реальным статусом протокола, о котором мы предупреждали в разборе роста каталога, сейчас нулевое: все 28 моделей с открытым чатом открыты и по верхнему полю.

Цена у вендора и порог

Здесь начинается самое практичное. Прайс xAI устроен двухуровнево, и второй уровень дороже, чем кажется.

До 200k токеновСвыше 200k
Вход$2$4
Вход из кэша$0,50$1
Выход$6$12

Ключевая деталь, на которой переплачивают: при переходе порога дороже становится весь запрос, а не только та часть, что перевалила за 200 тысяч. Запрос на 201 тысячу токенов считается по удвоенной ставке целиком. Механику мы разбирали отдельно в материале про двухуровневые тарифы по контексту.

По курсу ЦБ на 15 августа 2026 года — 84,5449 ₽ за доллар — вендорские ставки выглядят так:

До 200kСвыше 200k
Вход169,09 ₽338,18 ₽
Выход507,27 ₽1 014,54 ₽

Наша ставка — 20 ₽ в обе стороны, независимо от длины запроса. Разрыв получается примерно 8,5 раза на входе и 25,4 раза на выходе при коротком контексте, а на длинном выход расходится уже в 50,7 раза.

Где сравнение честное, а где нет

Сразу оговорим границы, потому что цифры выше легко превратить в рекламу, которой они не являются.

У вендора есть кэш промптов, у нас нет. Вход из кэша стоит $0,50 против $2 — вчетверо дешевле. Если ваша нагрузка это длинный неизменный контекст, повторяемый сотни раз, разрыв сокращается. У всех 36 текстовых моделей нашего каталога prompt_cache помечен unsupported, и обещать скидку за повторы мы не будем. Как устроена такая экономика у тех, кто её даёт, — в разборе DeepSeek V4 Pro.

Симметрия работает в обе стороны. У нас вход и выход стоят одинаково. На задачах с коротким запросом и длинным ответом это выгодно, на задачах с огромным контекстом и односложным ответом — вендорская схема ближе. Почему это принципиально, разбирали на единственной асимметричной позиции каталога.

Мы не сравниваем качество. 61 балл — это оценка Artificial Analysis, не наша. Своих замеров мы не делали и на чужой рейтинг как на доказательство пригодности для вашей задачи не ссылаемся.

Что за модель по существу

Технические параметры, подтверждённые у вендора.

Контекст — 500 тысяч токенов, вдвое меньше миллиона у линейки 4.20, но вдвое больше типичных 256 тысяч. Отсечка знаний — 1 февраля 2026 года.

На вход принимает текст и изображения, поддерживает рассуждения, вызов функций и структурированный вывод. Заявленный фокус — долгоживущие агенты, агентское программирование и интерактивная работа.

Последнее объясняет, зачем вообще эта модель при наличии 4.5 по 20 ₽. Ставки 4.5 и 4.6 сейчас одинаковы, поэтому выбирать стоит только по результату на своей задаче. Проверка занимает вечер и стоит рубли.

Когда порог у вендора начинает работать против вас

Стоит показать на числах, потому что «весь запрос дороже» звучит абстрактно, пока не посчитаешь.

Возьмём сценарий, который у многих и есть: агент с большим системным промптом и накопленной историей диалога. Допустим, к десятому ходу контекст дорос до 210 тысяч токенов, ответ — 2 тысячи.

У вендора, свыше порога: 210 000 × $4 / 1 000 000 + 2 000 × $12 / 1 000 000 = 0,84 + 0,024 = $0,864, то есть 73,05 ₽ по курсу на 15 августа.

Тот же запрос, если бы контекст остался на 199 тысячах: 199 000 × $2 / 1 000 000 + 2 000 × $6 / 1 000 000 = 0,398 + 0,012 = $0,41, то есть 34,66 ₽.

Одиннадцать тысяч лишних токенов удвоили счёт. Не на 5%, соответствующие приросту объёма, а ровно вдвое — потому что ставка сменилась для всего запроса.

У нас тот же запрос: (210 000 + 2 000) × 20 ₽ / 1 000 000 = 4,24 ₽, и никакого порога, за который можно случайно перевалить.

Отсюда практический вывод, который полезен независимо от того, где вы покупаете доступ: если у вашего провайдера есть порог, за ним надо следить в коде. Обрезка истории диалога, которая держит контекст ниже границы, стоит нескольких строк и экономит половину счёта.

Чего мы не утверждаем

Не обещаем, что ставка сохранится. Каталог за неделю менялся почти ежедневно, ставки внутри него тоже. Актуальные значения — только из GET /v1/models в момент запроса.

Не обещаем, что модель останется в выдаче. История с grok-4-5, исчезнувшей на сутки, — прямая иллюстрация.

Родной протокол xAI у нас не открыт. protocols.anthropic_messages у всего семейства Grok в статусе review — он для этих моделей и не предназначен. Открыт OpenAI-совместимый chat_completions, и его достаточно.

Кэш промптов не поддерживается. Ни у Grok, ни у остальных 35 текстовых позиций.

Что делать

Короткий порядок для тех, кому нужно решение, а не новость.

  1. Проверьте, упирается ли ваша задача в контекст. Если запросы стабильно короче 200 тысяч токенов, преимущество отсутствия порога для вас теоретическое, и сравнивать надо по обычной ставке.
  2. Прогоните свои реальные запросы через 4.6 и 4.5. Разница в цене 20 против 20 ₽ окупается только там, где заметна разница в качестве.
  3. Читайте статус протокола перед запросом. Одна строка кода, которая экономит разбор непонятных отказов.
  4. Считайте вход и выход раздельно. На симметричной ставке это не влияет на сумму, но показывает, где именно у вас расход.

Как разложить расход по строкам и посчитать бюджет — в разборе стоимости миллиона токенов в рублях.

Что держать в голове

Grok 4.6 приехал в каталог и сейчас стоит 20 ₽ за миллион в обе стороны, без порога по длине контекста. У вендора та же модель стоит от $2/$6 до $4/$12 в зависимости от размера запроса, и переход порога удорожает запрос целиком.

Каталог сейчас 38 позиций, чат открыт у 28, расхождение между availability и статусом протокола обнулилось. Но всё это состояние на 15 августа, и единственный надёжный способ узнать текущее — прочитать его в живой выдаче.

Как мы проверяем цифры и почему у каждой стоит дата — на странице о проекте. Один ключ на весь каталог: keydealer.ru/login.

Частые вопросы

Grok 4.6 есть в каталоге KeyDealer?

Да, с 15 августа 2026 года. Ставка 20 рублей за миллион входных токенов и столько же за миллион выходных, protocols.chat_completions открыт.

Сколько Grok 4.6 стоит у самого xAI?

Два доллара за миллион входных и шесть за миллион выходных токенов при запросе до 200 тысяч токенов. Свыше порога весь запрос считается по 4 и 12 долларов.

Какой у модели контекст?

500 тысяч токенов. Отсечка знаний — 1 февраля 2026 года.

Насколько она сильная?

На Artificial Analysis Intelligence Index у неё 61 балл — столько же, сколько у GPT-5.6 Sol, и на один балл меньше, чем у Claude Fable 5. При этом она самая дешёвая среди моделей этого уровня.

Сколько всего моделей в каталоге?

Тридцать восемь позиций на 15 августа 2026 года: 36 текстовых и 2 модели генерации изображений. Chat Completions открыт у 28 из них.

Источники