Обзоры и сравнения моделей

GLM-5 API: цена в рублях и что доступно сейчас

GLM-5 API: цена в рублях и что доступно сейчас

Z.ai опубликовала GLM-5 и GLM-5-Turbo: 1 доллар за миллион входных токенов и 3,2 за выходные у первой, 1,2 и 4 у второй. Текущие публичные ставки KeyDealer: GLM-5.2 по 15 ₽ за миллион в обе стороны и GLM-4.7 с GLM-4.6V по 3 ₽ — это самые дешёвые платные модели каталога. Попутно разберём случай, который отлично показывает, зачем проверять цифры у вендора: 9 августа агрегатор показывал падение цены GLM-5.2 в два с половиной раза, а у Z.ai прайс не менялся вовсе. Это была скидка площадки, и статья про «подешевение» оказалась бы статьёй про несуществующее событие.

Обновление от 9 сентября 2026 года. С 9 сентября 2026 года в каталоге KeyDealer из линейки GLM-5 остаётся одна модель — glm-5-3 (15 ₽ за 1 млн токенов): под идентификаторами GLM-5, 5.1 и 5.2 фактически отвечает GLM-5.3, поэтому отдельные позиции glm-5, glm-5-1, glm-5-2 и glm-4-7 сняты. Ниже сохранён текст на дату публикации.

Ниже — что опубликовал вендор, что доступно сегодня и когда дешёвая модель на самом деле выходит дороже.

Что опубликовала Z.ai

Данные со страницы тарифов Z.ai на 9 августа 2026 года, цены за миллион токенов в долларах.

МодельВходВыход
GLM-51,003,20
GLM-5-Turbo1,204,00
GLM-5.21,404,40
GLM-4.70,602,20
GLM-4.6V0,300,90

Любопытная деталь: GLM-5 у вендора дешевле, чем GLM-5.2, хотя номер версии меньше. Это не опечатка и не редкость — нумерация у разработчиков моделей не всегда означает «новее значит дороже», линейки развиваются параллельно и решают разные задачи.

Расписания отключений у Z.ai нет. Отдельной страницы с датами вывода моделей, аналогичной тем, что есть у OpenAI, Anthropic и Google, в открытой документации мы не нашли — подробное сравнение подходов в календаре отключений.

Что доступно в каталоге

Статья зафиксировала три GLM, доступные 9 августа. Текущие ставки этих позиций ниже; фактическую доступность маршрутов всегда нужно брать из GET /v1/models.

Модель в каталогеВходВыход
GLM-5.215 ₽ за 1 млн15 ₽ за 1 млн
GLM-4.73 ₽ за 1 млн3 ₽ за 1 млн
GLM-4.6V3 ₽ за 1 млн3 ₽ за 1 млн

GLM-4.7 и GLM-4.6V — самые дешёвые платные позиции каталога. Для сравнения, Opus 5 стоит 30 ₽, то есть текущий разрыв в ставке десятикратный.

Состав семейства меняется независимо от этой исторической статьи. Обещать наличие модели по тексту публикации нельзя: источником доступности остаётся ответ API, а не дата выхода у вендора.

Случай, ради которого стоит проверять вендора

9 августа при обходе источников машиночитаемый каталог агрегатора показал падение цены GLM-5.2: вход упал с 0,252 до 0,098 доллара, то есть в два с половиной раза. Готовая новость: «модель подешевела».

Проверка у Z.ai показала, что прайс не менялся — там по-прежнему 1,4 и 4,4 доллара. Разница объяснялась скидкой самой площадки, а не решением разработчика модели.

Если бы мы взяли цифру из агрегатора и опубликовали, вышла бы статья про событие, которого не было. Читатель, который зашёл бы на сайт вендора проверить, поймал бы нас на первом же абзаце.

Отсюда правило, которое стоит держать всем, кто следит за ценами: цена у площадки и цена у разработчика модели — разные числа. Первая меняется от промоакций и условий конкретного посредника, вторая отражает решение вендора. Новость есть только во второй.

Когда дешёвая модель дороже дорогой

Ставка 3 ₽ против 30 ₽ выглядит как решённый вопрос. Но счёт формируется не только ставкой.

К каждому запросу добавляется служебный контекст маршрута — системная часть, которая уходит модели вместе с вашим текстом и тарифицируется по обычной входной ставке. У разных семейств он различается на порядок: у GLM это около 2000 токенов, у линейки Opus — 9500.

Посчитаем на коротком запросе: промпт 300 токенов, ответ 100 токенов.

МодельСтавкаВаши токеныСлужебныеЦена запроса
GLM-4.73 ₽4002 0000,0072 ₽
GLM-5.215 ₽4002 0000,036 ₽
Opus 530 ₽4009 5000,297 ₽

Разрыв между GLM-4.7 и Opus 5 здесь не десятикратный, а примерно сорокаоднократный: к разнице в ставке добавляется разница в служебной части.

На длинном запросе картина меняется. Документ на 40 тысяч токенов растворяет служебную часть, и разрыв возвращается примерно к десятикратному, то есть к разнице ставок.

Вывод простой: на коротких частых запросах дешёвые семейства выигрывают дважды, и второй выигрыш крупнее первого. Разбор с цифрами по всем семействам — в материале про служебный контекст маршрута.

Для каких задач брать GLM

Честно про границы применения, без обещаний.

Подходит: классификация обращений, извлечение полей из текста, разметка, перевод, короткие ответы в поддержке, массовая обработка однотипных документов. Всё, где важен объём и предсказуемость, а не глубина рассуждения.

Стоит проверить на своих данных: работа с кодом и длинные цепочки рассуждений. Здесь разница между семействами заметна, и решает не наше мнение, а прогон на ваших задачах.

Как проверить: возьмите двадцать реальных запросов своего сценария, прогоните через GLM-4.7 и через модель, которой пользуетесь сейчас, сравните результаты глазами. Стоимость такой проверки на двадцати коротких запросах — меньше рубля.

Отдельно про возможности: в каталоге у каждой модели есть статус — подтверждено пробой, не поддерживается или пока не проверено. Третье не выдаём за первое: если в GET /v1/models стоит unknown, значит мы не проверяли, а не «наверное работает».

Три GLM в каталоге решают разные задачи

Одинаковая цена у GLM-4.7 и GLM-4.6V не означает взаимозаменяемость. В каталоге у каждой модели есть поле назначения, и оно объясняет, зачем держать обе.

МодельНазначение по каталогуСтавка
GLM-4.6Vпонимание изображений и документов с текстовым ответом3 ₽
GLM-4.7код и рассуждения3 ₽
GLM-5.2анализ, код и многоязычные задачи15 ₽

Практическая разница: GLM-4.6V читает изображения, а не генерирует их. Это частая путаница из-за буквы в названии. Модель принимает картинку или скан документа на вход и отвечает текстом — распознать таблицу, вытащить поля из накладной, описать содержимое. Для создания изображений в каталоге отдельное семейство GPT Image с другой механикой оплаты, разбор в материале про то, сколько стоит картинка через API.

Отсюда типовая связка для обработки документов за копейки: GLM-4.6V вытаскивает данные из скана, GLM-4.7 их обрабатывает. Оба шага сейчас стоят по 3 ₽ за миллион токенов.

Как следить за появлением моделей

Не по новостям, а по списку — он меняется раньше, чем об этом кто-то напишет.

curl -s https://api.keydealer.ru/v1/models | grep -o '"id":"glm[^"]*"'

Сравнение с предыдущим выводом занимает секунду. Тот же приём с вендорской стороны: страница тарифов Z.ai обновляется молча, без анонсов — именно так и была замечена пара GLM-5.

Снимок стоит складывать в файл и сравнивать с вчерашним автоматически. Тогда изменение ставки, появление модели и смена статуса возможностей приходят к вам раньше, чем к клиентам, которые обнаружат их по счёту или по сломавшемуся запросу.

Что держать в голове

У Z.ai появились GLM-5 за 1 и 3,2 доллара и GLM-5-Turbo за 1,2 и 4. Текущие публичные ставки: GLM-5.2 по 15 ₽ и пара GLM-4.7 с GLM-4.6V по 3 ₽, самые дешёвые платные позиции каталога.

Главное из этой истории даже не про GLM. Падение цены, которое показывает площадка, и решение вендора — разные события, и новость есть только во втором. Мы поймали это на себе за день до публикации.

Пересчёт официальных ставок всех вендоров в рубли по курсу ЦБ — в опорном разборе, сколько стоит 1 млн токенов в рублях. Как мы проверяем цифры и почему указываем дату у каждой — на странице о проекте.

Один ключ ко всему каталогу, чтобы сравнить дешёвую и сильную модель на своих задачах без отдельной интеграции: keydealer.ru/login.

Частые вопросы

Сколько стоят GLM-5 и GLM-5-Turbo у Z.ai?

По документации Z.ai на 9 августа 2026 года GLM-5 стоит 1 доллар за миллион входных токенов и 3,2 за миллион выходных. GLM-5-Turbo — 1,2 и 4 доллара.

Какие GLM доступны в каталоге KeyDealer?

Текущие публичные ставки: GLM-5.2 по 15 рублей за миллион входных и выходных токенов, GLM-4.7 и GLM-4.6V по 3 рубля. Доступность конкретного маршрута возвращает GET /v1/models.

Правда ли, что GLM-5.2 подешевела в два с половиной раза?

Нет. 9 августа агрегатор показывал падение цены, но у самого вендора прайс не менялся: Z.ai держит 1,4 и 4,4 доллара. Это была скидка площадки, а не изменение цены разработчика.

Когда дешёвая модель обходится дороже?

Когда запросы короткие и частые. Тогда счёт определяет не ставка, а служебный контекст маршрута, который добавляется к каждому запросу независимо от длины вашего промпта.

Источники