Обзоры и сравнения моделей
GLM-5 у вендора уже есть, в каталоге пока GLM-5.2
Z.ai опубликовала GLM-5 и GLM-5-Turbo: 1 доллар за миллион входных токенов и 3,2 за выходные у первой, 1,2 и 4 у второй. В каталоге KeyDealer на 9 августа 2026 доступны GLM-5.2 по 20 ₽ за миллион в обе стороны и GLM-4.7 с GLM-4.6V по 4 ₽ — это самые дешёвые модели каталога. Попутно разберём случай, который отлично показывает, зачем проверять цифры у вендора: 9 августа агрегатор показывал падение цены GLM-5.2 в два с половиной раза, а у Z.ai прайс не менялся вовсе. Это была скидка площадки, и статья про «подешевение» оказалась бы статьёй про несуществующее событие.
Ниже — что опубликовал вендор, что доступно сегодня и когда дешёвая модель на самом деле выходит дороже.
Что опубликовала Z.ai
Данные со страницы тарифов Z.ai на 9 августа 2026 года, цены за миллион токенов в долларах.
| Модель | Вход | Выход |
|---|---|---|
| GLM-5 | 1,00 | 3,20 |
| GLM-5-Turbo | 1,20 | 4,00 |
| GLM-5.2 | 1,40 | 4,40 |
| GLM-4.7 | 0,60 | 2,20 |
| GLM-4.6V | 0,30 | 0,90 |
Любопытная деталь: GLM-5 у вендора дешевле, чем GLM-5.2, хотя номер версии меньше. Это не опечатка и не редкость — нумерация у разработчиков моделей не всегда означает «новее значит дороже», линейки развиваются параллельно и решают разные задачи.
Расписания отключений у Z.ai нет. Отдельной страницы с датами вывода моделей, аналогичной тем, что есть у OpenAI, Anthropic и Google, в открытой документации мы не нашли — подробное сравнение подходов в календаре отключений.
Что доступно в каталоге
На 9 августа 2026 года GET /v1/models отдаёт из семейства GLM три модели.
| Модель в каталоге | Вход | Выход |
|---|---|---|
| GLM-5.2 | 20 ₽ за 1 млн | 20 ₽ за 1 млн |
| GLM-4.7 | 4 ₽ за 1 млн | 4 ₽ за 1 млн |
| GLM-4.6V | 4 ₽ за 1 млн | 4 ₽ за 1 млн |
GLM-4.7 и GLM-4.6V — самые дешёвые позиции всего каталога. Для сравнения, Opus 5 стоит 65 ₽, то есть разрыв внутри одного каталога шестнадцатикратный.
GLM-5 и GLM-5-Turbo в выдаче пока нет, и сроков их появления мы не называем. Обещать то, чего нет в ответе API, — то же самое, что придумать цифру в таблице.
Случай, ради которого стоит проверять вендора
9 августа при обходе источников машиночитаемый каталог агрегатора показал падение цены GLM-5.2: вход упал с 0,252 до 0,098 доллара, то есть в два с половиной раза. Готовая новость: «модель подешевела».
Проверка у Z.ai показала, что прайс не менялся — там по-прежнему 1,4 и 4,4 доллара. Разница объяснялась скидкой самой площадки, а не решением разработчика модели.
Если бы мы взяли цифру из агрегатора и опубликовали, вышла бы статья про событие, которого не было. Читатель, который зашёл бы на сайт вендора проверить, поймал бы нас на первом же абзаце.
Отсюда правило, которое стоит держать всем, кто следит за ценами: цена у площадки и цена у разработчика модели — разные числа. Первая меняется от промоакций и условий конкретного посредника, вторая отражает решение вендора. Новость есть только во второй.
Когда дешёвая модель дороже дорогой
Ставка 4 ₽ против 65 ₽ выглядит как решённый вопрос. Но счёт формируется не только ставкой.
К каждому запросу добавляется служебный контекст маршрута — системная часть, которая уходит модели вместе с вашим текстом и тарифицируется по обычной входной ставке. У разных семейств он различается на порядок: у GLM это около 2000 токенов, у линейки Opus — 9500.
Посчитаем на коротком запросе: промпт 300 токенов, ответ 100 токенов.
| Модель | Ставка | Ваши токены | Служебные | Цена запроса |
|---|---|---|---|---|
| GLM-4.7 | 4 ₽ | 400 | 2 000 | 0,0096 ₽ |
| GLM-5.2 | 20 ₽ | 400 | 2 000 | 0,048 ₽ |
| Opus 5 | 65 ₽ | 400 | 9 500 | 0,644 ₽ |
Разрыв между GLM-4.7 и Opus 5 здесь не шестнадцатикратный, а шестидесятисемикратный: к разнице в ставке добавляется разница в служебной части.
На длинном запросе картина меняется. Документ на 40 тысяч токенов растворяет служебную часть, и разрыв возвращается примерно к шестнадцатикратному, то есть к разнице ставок.
Вывод простой: на коротких частых запросах дешёвые семейства выигрывают дважды, и второй выигрыш крупнее первого. Разбор с цифрами по всем семействам — в материале про служебный контекст маршрута.
Для каких задач брать GLM
Честно про границы применения, без обещаний.
Подходит: классификация обращений, извлечение полей из текста, разметка, перевод, короткие ответы в поддержке, массовая обработка однотипных документов. Всё, где важен объём и предсказуемость, а не глубина рассуждения.
Стоит проверить на своих данных: работа с кодом и длинные цепочки рассуждений. Здесь разница между семействами заметна, и решает не наше мнение, а прогон на ваших задачах.
Как проверить: возьмите двадцать реальных запросов своего сценария, прогоните через GLM-4.7 и через модель, которой пользуетесь сейчас, сравните результаты глазами. Стоимость такой проверки на двадцати коротких запросах — меньше рубля.
Отдельно про возможности: в каталоге у каждой модели есть статус — подтверждено пробой, не поддерживается или пока не проверено. Третье не выдаём за первое: если в GET /v1/models стоит unknown, значит мы не проверяли, а не «наверное работает».
Три GLM в каталоге решают разные задачи
Одинаковая цена у GLM-4.7 и GLM-4.6V не означает взаимозаменяемость. В каталоге у каждой модели есть поле назначения, и оно объясняет, зачем держать обе.
| Модель | Назначение по каталогу | Ставка |
|---|---|---|
| GLM-4.6V | понимание изображений и документов с текстовым ответом | 4 ₽ |
| GLM-4.7 | код и рассуждения | 4 ₽ |
| GLM-5.2 | анализ, код и многоязычные задачи | 20 ₽ |
Практическая разница: GLM-4.6V читает изображения, а не генерирует их. Это частая путаница из-за буквы в названии. Модель принимает картинку или скан документа на вход и отвечает текстом — распознать таблицу, вытащить поля из накладной, описать содержимое. Для создания изображений в каталоге отдельное семейство GPT Image с другой механикой оплаты, разбор в материале про то, сколько стоит картинка через API.
Отсюда типовая связка для обработки документов за копейки: GLM-4.6V вытаскивает данные из скана, GLM-4.7 их обрабатывает. Оба шага по 4 ₽ за миллион токенов.
Как следить за появлением моделей
Не по новостям, а по списку — он меняется раньше, чем об этом кто-то напишет.
curl -s https://api.keydealer.ru/v1/models | grep -o '"id":"glm[^"]*"'
Сравнение с предыдущим выводом занимает секунду. Тот же приём с вендорской стороны: страница тарифов Z.ai обновляется молча, без анонсов — именно так и была замечена пара GLM-5.
Снимок стоит складывать в файл и сравнивать с вчерашним автоматически. Тогда изменение ставки, появление модели и смена статуса возможностей приходят к вам раньше, чем к клиентам, которые обнаружат их по счёту или по сломавшемуся запросу.
Что держать в голове
У Z.ai появились GLM-5 за 1 и 3,2 доллара и GLM-5-Turbo за 1,2 и 4. В каталоге на 9 августа — GLM-5.2 по 20 ₽ и пара GLM-4.7 с GLM-4.6V по 4 ₽, самые дешёвые позиции всего каталога.
Главное из этой истории даже не про GLM. Падение цены, которое показывает площадка, и решение вендора — разные события, и новость есть только во втором. Мы поймали это на себе за день до публикации.
Пересчёт официальных ставок всех вендоров в рубли по курсу ЦБ — в опорном разборе, сколько стоит 1 млн токенов в рублях. Как мы проверяем цифры и почему указываем дату у каждой — на странице о проекте.
Один ключ ко всему каталогу, чтобы сравнить дешёвую и сильную модель на своих задачах без отдельной интеграции: keydealer.ru/login.
Частые вопросы
Сколько стоят GLM-5 и GLM-5-Turbo у Z.ai?
По документации Z.ai на 9 августа 2026 года GLM-5 стоит 1 доллар за миллион входных токенов и 3,2 за миллион выходных. GLM-5-Turbo — 1,2 и 4 доллара.
Какие GLM доступны в каталоге KeyDealer?
На 9 августа 2026 года это GLM-5.2 по 20 рублей за миллион входных и выходных токенов, а также GLM-4.7 и GLM-4.6V по 4 рубля. Актуальный список возвращает GET /v1/models.
Правда ли, что GLM-5.2 подешевела в два с половиной раза?
Нет. 9 августа агрегатор показывал падение цены, но у самого вендора прайс не менялся: Z.ai держит 1,4 и 4,4 доллара. Это была скидка площадки, а не изменение цены разработчика.
Когда дешёвая модель обходится дороже?
Когда запросы короткие и частые. Тогда счёт определяет не ставка, а служебный контекст маршрута, который добавляется к каждому запросу независимо от длины вашего промпта.