Релизы и изменения моделей
Grok 4.7 в каталоге: Responses проверен, а не открыт
Каталог KeyDealer вырос с 56 позиций до 57: приехал grok-4-7 по 20 ₽ за миллион токенов одинаково на входе и на выходе. Интереснее ставки набор статусов: у этой позиции протокол Responses не просто открыт, а подтверждён пробой — вместе со стримингом, инструментами и принудительным выбором инструмента внутри него. У большинства позиций каталога Responses стоит в режиме проверки, так что это редкий случай.
Разберём, что именно проверено, почему это важнее цены и кому такой набор реально нужен.
Что приехало
Одна позиция, доступна сразу.
| Поле каталога | Значение |
|---|---|
| Идентификатор | grok-4-7 |
| Назначение | код, автономные агентные задачи, длинный контекст |
| Ставка входа и выхода | 20 ₽ за 1 млн токенов |
| Статус | доступна |
| Кэш промптов | не поддерживается |
Ставка симметричная — считать бюджет проще: складываете все токены и умножаете, без раздельного учёта.
Почему «проверен» важнее, чем «открыт»
В каталоге у каждой позиции два разных поля, и их постоянно путают.
Протокол открыт — значит через него можно делать запросы. Это разрешение.
Возможность проверена — значит мы отправили пробу и получили корректный ответ. Это факт.
У grok-4-7 подтверждены пробой: протокол чат-дополнений, протокол Responses, стриминг в обоих, вызов инструментов, принудительный выбор инструмента, сообщения с результатом инструмента, стриминг вместе с инструментами и работа с изображениями.
Список длиннее обычного. У большинства позиций каталога Responses стоит в режиме проверки, и строить на нём интеграцию до смены статуса нельзя. Здесь можно — и это единственная причина, по которой стоит обратить внимание на новую позицию, если вас устраивает текущая. Что вообще даёт этот протокол и чем отличается от привычного, разобрано в материале Responses открылся у первой модели.
Что не проверено
Одно: протокол Anthropic Messages стоит в режиме проверки. Если ваш код написан под него, эта позиция пока не ваш вариант.
И отдельно про кэш: prompt_cache помечен как unsupported. Формулировка каталога прямая — попадания в кэш могут наблюдаться, но кэшированный вход и запись в кэш тарифицируются по обычной ставке, пока не опубликована подтверждённая скидка. Это верно сейчас для всех текстовых позиций, и закладывать экономию на повторяющемся системном промпте в расчёт не нужно.
Как мы получаем эти статусы
Вопрос законный: откуда вообще берётся разница между «открыт» и «проверен».
Открытость протокола — это конфигурация маршрута: запрос через него проходит и доходит до модели. Проверка — отдельная процедура: на позицию отправляется набор проб, и каждая возможность подтверждается или остаётся неизвестной. Проба на инструменты проверяет, что модель их вызывает и возвращает результат в ожидаемом виде. Проба на стриминг с инструментами — что вызов не ломается в потоковом режиме, а это отдельная история: бывает, что по отдельности работает и то и другое, а вместе нет.
Отсюда и статус unknown у части полей у других позиций. Это не оценка качества и не подозрение — это буквально «пробы не было». Подставлять на место unknown своё предположение и планировать на нём интеграцию — самый дешёвый способ получить сюрприз в проде.
Практический вывод: перед интеграцией открывайте каталог и читайте статусы нужных вам возможностей у конкретной позиции. Статья устаревает, каталог — нет.
Что проверить в первый день
Четыре вещи, каждая занимает минуты и снимает вопросы на неделю вперёд.
Имя модели. Скопировано из каталога, а не из документации вендора и не из статьи.
Протокол. Тот, что подтверждён, а не тот, который привычнее. Если код написан под Anthropic Messages, здесь он не поедет.
Формат ответа. Новая позиция почти всегда держит формат иначе. Если у вас на выходе строгая структура, проверьте её на тридцати ответах, а не на трёх.
Длина. Посмотрите в журнале среднюю длину выхода до и после. Это то место, где счёт растёт незаметно и объясняется потом как «подорожало».
Что именно писать в журнал, чтобы такие проверки занимали минуты, разобрано в материале логирование запросов к моделям.
Кому эта позиция нужна
Три случая, и во всех решает не ставка.
Тем, кто строит на Responses. До сих пор выбор был невелик, теперь появилась проверенная позиция с полным набором инструментов внутри этого протокола.
Тем, у кого агент дёргает инструменты в стриме. Связка «стриминг вместе с инструментами» подтверждена, то есть проверять её самому не нужно.
Тем, кому нужна картинка на входе с гарантией. Статус подтверждённый, а не unknown — разница между «работает» и «не проверяли».
Всем остальным менять рабочую позицию незачем. Двадцать рублей за миллион — это середина каталога, и если ваша задача закрывается дешевле, переезд не окупится.
Почему агентные сценарии упираются не в модель
Это стоит проговорить рядом с новой позицией под агентные задачи, потому что ожидания обычно завышены.
Модель отвечает за качество отдельного шага. Всё остальное — сколько шагов сделает агент, сколько служебного текста уйдёт в каждый вызов, что попадёт в контекст после сжатия, как обрабатываются ошибки — это обвязка. И именно она чаще определяет счёт.
Мы разбирали замер, где одна и та же модель в разных обвязках стоила вдвое по-разному при почти одинаковом числе ходов, — в материале HarnessTax: обвязка агента. Вывод оттуда простой: если агент работает плохо или дорого, смена позиции — не первое, что стоит проверять.
Что стоит проверять первым, разобрано в материале почему ИИ-агент не работает. Новая позиция с подтверждённым набором инструментов убирает одну переменную из этого уравнения — но только одну.
Чем считать разницу перед переездом
Не ставкой, а стоимостью решённой задачи. Рассуждающая модель под агентные сценарии пишет длинно, и симметричная ставка это не компенсирует: если выход вырос вдвое, счёт вырос вдвое.
Порядок проверки простой. Возьмите тридцать своих реальных задач, прогоните на текущей позиции и на новой, отберите те, что решены обеими, и сравните суммарные токены. Сравнивать по всем задачам подряд нельзя: в выборку попадёт экономия на недоделанной работе. Почему это так, мы подробно разбирали в материале JetBrains смешала две Qwen, а механика счёта — в материале сколько стоит миллион токенов в рублях.
Что в каталоге сейчас
Пятьдесят семь позиций: 46 текстовых с рублёвой ставкой, 11 генерируют изображения, плюс переранжирование. Доступны 44. В режиме проверки две позиции — gemini-3-6-flash и fable-5, про них корректно говорить «в проверке», а не «работает».
Бесплатных текстовых пять: gpt-oss-20b, llama-3-2-11b-vision и три Nemotron. Они открываются после первого платного пополнения и дальше не тарифицируются.
Один ключ открывает весь список с оплатой российской картой в рублях, ставки начинаются от 1 ₽ за миллион токенов, расход виден по каждому запросу. Смена позиции — строка в конфигурации: именно поэтому пополнение каталога ничего не ломает у тех, кто уже работает, и ничего не требует делать прямо сейчас.
Чего мы не утверждаем
Три оговорки.
Мы не пересказываем характеристики со страниц вендора. Контекстное окно, архитектура и заявленные показатели — там, где их публикует вендор. Здесь речь о том, что появилось у нас и что мы проверили сами.
Мы не называем цену вендора. Рядом с рублёвой ставкой это публиковало бы экономику маршрута. Долларовые цифры смотрите у вендора.
Мы не утверждаем, что новая позиция лучше на вашей задаче. «Флагман линейки» — это позиционирование, а не характеристика вашего потока запросов. Как сравнивать корректно, разобрано в материале как сравнивать модели.
Что сделать, если решили попробовать
Ключ на keydealer.ru/login, тридцать реальных задач, час времени. Имя модели в конфигурации пишется ровно как в каталоге — через дефис, grok-4-7, а не через точку. Это самая частая причина ответа «модель не найдена».
Дальше смотрите не на первые несколько ответов, а на журнал за день: токены выхода раздельно, доля повторных обращений, фактическая сумма. Впечатление от пяти ответов обманывает, журнал — нет.
Что держать в голове
Первое. Появление позиции в каталоге — это расширение выбора, а не рекомендация переезжать.
Второе. Статусы читайте буквально. «Проверено» значит подтверждено пробой, «в проверке» значит нельзя планировать, unknown значит проверять вам.
Третье. Набор подтверждённых возможностей у этой позиции необычно полный, и именно он, а не ставка, делает её интересной для агентных сценариев. Что мы за проект — на странице о проекте, ключ заводится на keydealer.ru/login.
Частые вопросы
Что добавилось в каталог 22 сентября?
Позиция grok-4-7 — флагман линейки Grok, заявленный под код, автономные агентные задачи и работу с длинным контекстом. Каталог вырос с 56 позиций до 57, доступных стало 44. Ставка 20 ₽ за миллион токенов одинаково на входе и на выходе.
Чем этот набор статусов отличается от обычного?
Тем, что протокол Responses у позиции не просто открыт, а подтверждён пробой — вместе со стримингом, инструментами, принудительным выбором инструмента и сообщениями с результатом инструмента внутри этого протокола. У большинства позиций каталога Responses стоит в режиме проверки, так что это исключение, а не норма.
Работа с изображениями у неё есть?
Да, и статус подтверждённый, а не unknown. То есть картинку на вход можно подавать, не выясняя это опытным путём. Генерации изображений у позиции нет — это текстовая модель, которая умеет читать картинки.
Есть ли скидка за кэш промптов?
Нет. prompt_cache помечен как unsupported: попадания в кэш могут наблюдаться, но кэшированный вход и запись в кэш тарифицируются по обычной ставке, пока не опубликована подтверждённая скидка. Так сейчас у всех текстовых позиций каталога.
Что с протоколом Anthropic Messages?
Он в режиме проверки. Планировать интеграцию на него пока нельзя — работают chat_completions и Responses, оба подтверждены.
Сколько всего позиций в каталоге?
Пятьдесят семь: 46 текстовых с рублёвой ставкой, 11 генерируют изображения, плюс переранжирование. Доступны 44. В режиме проверки две позиции — gemini-3-6-flash и fable-5.