Релизы и изменения моделей

Grok 4.7 в каталоге: Responses проверен, а не открыт

Grok 4.7 в каталоге: Responses проверен, а не открыт

Каталог KeyDealer вырос с 56 позиций до 57: приехал grok-4-7 по 20 ₽ за миллион токенов одинаково на входе и на выходе. Интереснее ставки набор статусов: у этой позиции протокол Responses не просто открыт, а подтверждён пробой — вместе со стримингом, инструментами и принудительным выбором инструмента внутри него. У большинства позиций каталога Responses стоит в режиме проверки, так что это редкий случай.

Разберём, что именно проверено, почему это важнее цены и кому такой набор реально нужен.

Что приехало

Одна позиция, доступна сразу.

Поле каталогаЗначение
Идентификаторgrok-4-7
Назначениекод, автономные агентные задачи, длинный контекст
Ставка входа и выхода20 ₽ за 1 млн токенов
Статусдоступна
Кэш промптовне поддерживается

Ставка симметричная — считать бюджет проще: складываете все токены и умножаете, без раздельного учёта.

Почему «проверен» важнее, чем «открыт»

В каталоге у каждой позиции два разных поля, и их постоянно путают.

Протокол открыт — значит через него можно делать запросы. Это разрешение.

Возможность проверена — значит мы отправили пробу и получили корректный ответ. Это факт.

У grok-4-7 подтверждены пробой: протокол чат-дополнений, протокол Responses, стриминг в обоих, вызов инструментов, принудительный выбор инструмента, сообщения с результатом инструмента, стриминг вместе с инструментами и работа с изображениями.

Список длиннее обычного. У большинства позиций каталога Responses стоит в режиме проверки, и строить на нём интеграцию до смены статуса нельзя. Здесь можно — и это единственная причина, по которой стоит обратить внимание на новую позицию, если вас устраивает текущая. Что вообще даёт этот протокол и чем отличается от привычного, разобрано в материале Responses открылся у первой модели.

Что не проверено

Одно: протокол Anthropic Messages стоит в режиме проверки. Если ваш код написан под него, эта позиция пока не ваш вариант.

И отдельно про кэш: prompt_cache помечен как unsupported. Формулировка каталога прямая — попадания в кэш могут наблюдаться, но кэшированный вход и запись в кэш тарифицируются по обычной ставке, пока не опубликована подтверждённая скидка. Это верно сейчас для всех текстовых позиций, и закладывать экономию на повторяющемся системном промпте в расчёт не нужно.

Как мы получаем эти статусы

Вопрос законный: откуда вообще берётся разница между «открыт» и «проверен».

Открытость протокола — это конфигурация маршрута: запрос через него проходит и доходит до модели. Проверка — отдельная процедура: на позицию отправляется набор проб, и каждая возможность подтверждается или остаётся неизвестной. Проба на инструменты проверяет, что модель их вызывает и возвращает результат в ожидаемом виде. Проба на стриминг с инструментами — что вызов не ломается в потоковом режиме, а это отдельная история: бывает, что по отдельности работает и то и другое, а вместе нет.

Отсюда и статус unknown у части полей у других позиций. Это не оценка качества и не подозрение — это буквально «пробы не было». Подставлять на место unknown своё предположение и планировать на нём интеграцию — самый дешёвый способ получить сюрприз в проде.

Практический вывод: перед интеграцией открывайте каталог и читайте статусы нужных вам возможностей у конкретной позиции. Статья устаревает, каталог — нет.

Что проверить в первый день

Четыре вещи, каждая занимает минуты и снимает вопросы на неделю вперёд.

Имя модели. Скопировано из каталога, а не из документации вендора и не из статьи.

Протокол. Тот, что подтверждён, а не тот, который привычнее. Если код написан под Anthropic Messages, здесь он не поедет.

Формат ответа. Новая позиция почти всегда держит формат иначе. Если у вас на выходе строгая структура, проверьте её на тридцати ответах, а не на трёх.

Длина. Посмотрите в журнале среднюю длину выхода до и после. Это то место, где счёт растёт незаметно и объясняется потом как «подорожало».

Что именно писать в журнал, чтобы такие проверки занимали минуты, разобрано в материале логирование запросов к моделям.

Кому эта позиция нужна

Три случая, и во всех решает не ставка.

Тем, кто строит на Responses. До сих пор выбор был невелик, теперь появилась проверенная позиция с полным набором инструментов внутри этого протокола.

Тем, у кого агент дёргает инструменты в стриме. Связка «стриминг вместе с инструментами» подтверждена, то есть проверять её самому не нужно.

Тем, кому нужна картинка на входе с гарантией. Статус подтверждённый, а не unknown — разница между «работает» и «не проверяли».

Всем остальным менять рабочую позицию незачем. Двадцать рублей за миллион — это середина каталога, и если ваша задача закрывается дешевле, переезд не окупится.

Почему агентные сценарии упираются не в модель

Это стоит проговорить рядом с новой позицией под агентные задачи, потому что ожидания обычно завышены.

Модель отвечает за качество отдельного шага. Всё остальное — сколько шагов сделает агент, сколько служебного текста уйдёт в каждый вызов, что попадёт в контекст после сжатия, как обрабатываются ошибки — это обвязка. И именно она чаще определяет счёт.

Мы разбирали замер, где одна и та же модель в разных обвязках стоила вдвое по-разному при почти одинаковом числе ходов, — в материале HarnessTax: обвязка агента. Вывод оттуда простой: если агент работает плохо или дорого, смена позиции — не первое, что стоит проверять.

Что стоит проверять первым, разобрано в материале почему ИИ-агент не работает. Новая позиция с подтверждённым набором инструментов убирает одну переменную из этого уравнения — но только одну.

Чем считать разницу перед переездом

Не ставкой, а стоимостью решённой задачи. Рассуждающая модель под агентные сценарии пишет длинно, и симметричная ставка это не компенсирует: если выход вырос вдвое, счёт вырос вдвое.

Порядок проверки простой. Возьмите тридцать своих реальных задач, прогоните на текущей позиции и на новой, отберите те, что решены обеими, и сравните суммарные токены. Сравнивать по всем задачам подряд нельзя: в выборку попадёт экономия на недоделанной работе. Почему это так, мы подробно разбирали в материале JetBrains смешала две Qwen, а механика счёта — в материале сколько стоит миллион токенов в рублях.

Что в каталоге сейчас

Пятьдесят семь позиций: 46 текстовых с рублёвой ставкой, 11 генерируют изображения, плюс переранжирование. Доступны 44. В режиме проверки две позиции — gemini-3-6-flash и fable-5, про них корректно говорить «в проверке», а не «работает».

Бесплатных текстовых пять: gpt-oss-20b, llama-3-2-11b-vision и три Nemotron. Они открываются после первого платного пополнения и дальше не тарифицируются.

Один ключ открывает весь список с оплатой российской картой в рублях, ставки начинаются от 1 ₽ за миллион токенов, расход виден по каждому запросу. Смена позиции — строка в конфигурации: именно поэтому пополнение каталога ничего не ломает у тех, кто уже работает, и ничего не требует делать прямо сейчас.

Чего мы не утверждаем

Три оговорки.

Мы не пересказываем характеристики со страниц вендора. Контекстное окно, архитектура и заявленные показатели — там, где их публикует вендор. Здесь речь о том, что появилось у нас и что мы проверили сами.

Мы не называем цену вендора. Рядом с рублёвой ставкой это публиковало бы экономику маршрута. Долларовые цифры смотрите у вендора.

Мы не утверждаем, что новая позиция лучше на вашей задаче. «Флагман линейки» — это позиционирование, а не характеристика вашего потока запросов. Как сравнивать корректно, разобрано в материале как сравнивать модели.

Что сделать, если решили попробовать

Ключ на keydealer.ru/login, тридцать реальных задач, час времени. Имя модели в конфигурации пишется ровно как в каталоге — через дефис, grok-4-7, а не через точку. Это самая частая причина ответа «модель не найдена».

Дальше смотрите не на первые несколько ответов, а на журнал за день: токены выхода раздельно, доля повторных обращений, фактическая сумма. Впечатление от пяти ответов обманывает, журнал — нет.

Что держать в голове

Первое. Появление позиции в каталоге — это расширение выбора, а не рекомендация переезжать.

Второе. Статусы читайте буквально. «Проверено» значит подтверждено пробой, «в проверке» значит нельзя планировать, unknown значит проверять вам.

Третье. Набор подтверждённых возможностей у этой позиции необычно полный, и именно он, а не ставка, делает её интересной для агентных сценариев. Что мы за проект — на странице о проекте, ключ заводится на keydealer.ru/login.

Частые вопросы

Что добавилось в каталог 22 сентября?

Позиция grok-4-7 — флагман линейки Grok, заявленный под код, автономные агентные задачи и работу с длинным контекстом. Каталог вырос с 56 позиций до 57, доступных стало 44. Ставка 20 ₽ за миллион токенов одинаково на входе и на выходе.

Чем этот набор статусов отличается от обычного?

Тем, что протокол Responses у позиции не просто открыт, а подтверждён пробой — вместе со стримингом, инструментами, принудительным выбором инструмента и сообщениями с результатом инструмента внутри этого протокола. У большинства позиций каталога Responses стоит в режиме проверки, так что это исключение, а не норма.

Работа с изображениями у неё есть?

Да, и статус подтверждённый, а не unknown. То есть картинку на вход можно подавать, не выясняя это опытным путём. Генерации изображений у позиции нет — это текстовая модель, которая умеет читать картинки.

Есть ли скидка за кэш промптов?

Нет. prompt_cache помечен как unsupported: попадания в кэш могут наблюдаться, но кэшированный вход и запись в кэш тарифицируются по обычной ставке, пока не опубликована подтверждённая скидка. Так сейчас у всех текстовых позиций каталога.

Что с протоколом Anthropic Messages?

Он в режиме проверки. Планировать интеграцию на него пока нельзя — работают chat_completions и Responses, оба подтверждены.

Сколько всего позиций в каталоге?

Пятьдесят семь: 46 текстовых с рублёвой ставкой, 11 генерируют изображения, плюс переранжирование. Доступны 44. В режиме проверки две позиции — gemini-3-6-flash и fable-5.

Источники