Релизы и изменения моделей

GPT-6 Sol и Luna: вдвое дешевле прошлого поколения

GPT-6 Sol и Luna: вдвое дешевле прошлого поколения

22 сентября OpenAI выпустила GPT-6 Sol и GPT-6 Luna — среднюю и младшую модели шестого поколения. По стандартному тарифу на странице цен вендора Sol стоит 2 доллара за миллион входных токенов и 10 за миллион выходных, Luna — 0,1 и 0,5 доллара. Это вдвое дешевле соответствующих моделей предыдущего поколения по тому же прайсу. В тот же день Anthropic выпустила Claude Opus 5.5, так что цены на флагманском уровне двинулись вниз у двух вендоров сразу.

Разберём, что именно вышло, как устроен прайс и почему ставка за миллион — только половина ответа на вопрос «сколько это будет стоить».

Что вышло

Две модели, которые встали под флагманом GPT-6 Astra.

GPT-6 Sol — средняя модель поколения. По позиционированию вендора это рабочая лошадь для большинства задач: код, анализ, агентные сценарии среднего уровня сложности.

GPT-6 Luna — младшая и самая дешёвая. Рассчитана на массовые простые операции: классификацию, извлечение полей, короткие ответы.

Анонс на сайте OpenAI на момент написания отдаёт ошибку доступа, поэтому все цифры ниже взяты со страницы цен в документации для разработчиков. Эта страница собирает таблицу в браузере, и очищенный текст с неё неполный — числа мы брали из данных, встроенных в саму страницу.

Прайс: стандартный уровень

МодельВход, $ за 1 млнКэшированный вход, $ за 1 млнВыход, $ за 1 млн
GPT-6 Sol20,210
GPT-6 Luna0,10,010,5

По курсу ЦБ на 24 сентября 2026 года — 84,3969 ₽ за доллар — это около 169 ₽ за миллион входных токенов и 844 ₽ за миллион выходных у Sol, около 8,4 ₽ и 42 ₽ у Luna.

Обратите внимание на соотношение входа и выхода: выход дороже входа в пять раз у обеих моделей. Для задач с длинным ответом именно выход определяет счёт. Как это считается, разобрано в материале сколько стоит миллион токенов в рублях.

Уровни обслуживания

У одной и той же модели на странице цен четыре режима, и путать их — дорого.

РежимЦена относительно стандартногоЧто вы получаете
Стандартныйбазоваяобычная скорость ответа
Пакетныйвдвое дешевлеответ из очереди, без гарантии скорости
Гибкийвдвое дешевлеможет задерживаться при нагрузке
Быстрыйвдвое дорожеприоритетная обработка

Модель во всех режимах одна и та же — меняется только очередь. Практический вывод: всё, что не требует ответа в реальном времени, выгоднее отправлять пакетом. Отчёты, разметка архива, ночная обработка документов. Механика этих режимов подробно разобрана в материале Batch, Flex и Fast: цена запроса.

Кому какая модель подходит

Разводка по линейке простая, если смотреть на задачу, а не на название.

Luna — для потока однотипных коротких операций. Классификация обращений, извлечение полей, маршрутизация, короткий перевод. На таких задачах разница с более дорогой моделью часто не видна вовсе, а разница в счёте — двадцатикратная.

Sol — для работы, где нужен разбор: код в существующей кодовой базе, анализ документа целиком, агентный сценарий с несколькими шагами. Здесь младшая модель начинает ошибаться, и экономия съедается правками.

Astra — для задач на границе возможностей: длинные автономные цепочки, сложные рассуждения, работа, где цена ошибки высока. Использовать её на рутине — самый дорогой способ сделать то, что Luna делает так же.

Типичная картина в продакшене — не одна модель, а маршрут: основной поток идёт на младшую, спорные случаи уходят на старшую. Как это устроить, разобрано в материале маршрутизация между моделями.

Как читать прайс и не ошибиться

Три ловушки, на которых спотыкаются чаще всего.

Кэшированный вход — не бесплатный. Он дешевле обычного в десять раз, но работает только когда начало запроса совпадает с предыдущим. Если системный промпт меняется от запроса к запросу, кэш не срабатывает, и вы платите полную ставку.

Выход дороже входа в пять раз. Считать бюджет по объёму отправляемых документов — значит ошибиться в разы на задачах с длинным ответом. Считайте по сумме входа и выхода раздельно.

Режим задаётся запросом. Пакетная цена не применяется автоматически — запрос нужно отправить в пакетном режиме явно. Иначе он уйдёт по стандартной ставке.

Что говорит независимый замер

У вендора в анонсе свои цифры, и они, как обычно, выгодные. Полезнее посмотреть, что сказал сторонний замер.

Artificial Analysis 22 сентября опубликовала оценку обеих моделей. Короткий вывод из их анонса: новые модели сдвигают границу эффективности по цене, потому что стоят вдвое меньше предшественников, а по сводным индексам — интеллектуальному и индексу кодинг-агентов — остаются на уровне GPT-5.6, с прогрессом в одних тестах и регрессом в других.

Это важная поправка к заголовкам. «Вдвое дешевле» — правда. «Вдвое лучше» — нет: по независимому замеру качество примерно то же, а выигрыш именно в цене. Для задачи, которая уже закрывается предыдущим поколением, это значит, что переезд окупится только счётом — и только если модель не станет писать длиннее.

Почему флагманы дешевеют

Два вендора в один день снизили цену своего основного уровня — это не совпадение, а направление.

Anthropic в анонсе Opus 5.5 прямо пишет, что новая модель требует меньше вычислений. Для OpenAI похожего заявления в документации нет, но картина та же: новое поколение стоит дешевле предыдущего при той же ступени в линейке.

Для покупателя из этого следует простая вещь: ставка за миллион перестала быть стабильной характеристикой модели. Она меняется с каждым поколением, а поколения выходят раз в несколько месяцев. Планировать бюджет на год по сегодняшнему прайсу — значит переплатить или недоплатить, но точно ошибиться.

Второй сюжет того же дня — Opus 5.5, где новая цена сопровождается четырьмя изменениями, которые ломают код при переходе. Разбор — в материале Claude Opus 5.5: на 20% дешевле, но четыре поломки.

Ставка — только половина цены

Самое важное в этой новости, и о нём почти не пишут.

Ставка говорит, сколько стоит миллион токенов. Она не говорит, сколько токенов модель потратит на вашу задачу. Новое поколение может быть вдвое дешевле за токен и при этом писать вдвое длиннее — и тогда экономия исчезает целиком.

Бывает и обратное: модель дороже за токен, но решает задачу короче и с первого раза. Тогда она дешевле по счёту.

Отсюда правило, которое мы повторяем в каждом разборе новых моделей: сравнивать нужно стоимость решённой задачи, а не ставку. Прогоните тридцать своих задач на обеих позициях, отберите решённые обеими, сложите токены выхода и умножьте на ставку. Механика такого замера разобрана в материале как сравнивать модели.

Что с этим делать, если вы на предыдущем поколении

Ничего срочного. Модель, которая закрывает задачу, не перестаёт её закрывать оттого, что вышла новая.

Порядок разумный такой.

Первое: проверьте, не объявлено ли отключение вашей модели. Не по новостям, а по странице отключений вендора. Если нет — у вас есть время. План переездов удобно вести по материалу календарь отключений моделей 2026.

Второе: не переезжайте в день релиза. Новые модели в первые недели меняют поведение, у них уточняются лимиты и статусы возможностей.

Третье: когда соберётесь, меняйте что-то одно. Либо модель, либо промпт. Иначе при ухудшении вы не узнаете, что виновато. Подробно — в материале как обновлять промпты при смене модели.

Что есть в каталоге KeyDealer

GPT-6 Sol и Luna в каталоге на 24 сентября нет. Есть флагман шестого поколения GPT-6 Astra и предыдущее поколение этой линейки — 5.6 Sol, Luna и Terra. Их ставки опубликованы в каталоге в рублях за миллион токенов; цены вендора на модели, которые мы продаём, мы рядом не публикуем.

Появление новых позиций зависит не от нас, и дату мы не обещаем. Когда позиция появится, мы напишем о ней отдельно — с тем, что у неё проверено, а что нет.

Один ключ KeyDealer открывает каталог из 57 позиций, 44 из которых доступны сейчас, с оплатой российской картой в рублях и ставками от 1 ₽ за миллион токенов. Смена позиции — это одна строка в конфигурации, поэтому выход нового поколения у вендора не заставляет заключать новый договор, когда модель появится в каталоге.

Чего мы не утверждаем

Три оговорки.

Мы не утверждаем, что новые модели лучше на вашей задаче. Позиционирование вендора — это не характеристика вашего потока запросов. Сравнение делается на своей выборке.

Мы не пересказываем бенчмарки. Цифры качества, которые вендор публикует о себе, — это его замер, а не ваш. В этой статье только то, что можно проверить на странице цен.

Мы не гарантируем актуальность цен. Прайс вендора меняется без предупреждения, и числа выше верны на дату публикации. Проверяйте по первоисточнику перед расчётом бюджета.

Что держать в голове

Первое. Ставка за миллион дешевеет с каждым поколением, и это устойчивое направление, а не разовая акция. Планируйте бюджет с запасом на пересмотр каждые несколько месяцев.

Второе. Режим обслуживания меняет цену вдвое в обе стороны при той же модели. Если ваша задача не требует ответа в реальном времени, вы, скорее всего, переплачиваете.

Третье. Решает не ставка, а стоимость решённой задачи. Модель вдвое дешевле за токен может оказаться дороже по счёту, если пишет вдвое длиннее. Что мы за проект — на странице о проекте, ключ заводится на keydealer.ru/login.

Частые вопросы

Что вышло у OpenAI 22 сентября?

Две модели шестого поколения, GPT-6 Sol и GPT-6 Luna. Они встали в линейку под флагманом GPT-6 Astra. Sol — средняя модель, Luna — младшая и самая дешёвая. В тот же день Anthropic выпустила Claude Opus 5.5, поэтому в лентах этот день назвали днём двух флагманов.

Сколько стоит GPT-6 Sol?

По стандартному тарифу на странице цен OpenAI: 2 доллара за миллион входных токенов, 0,2 доллара за кэшированный вход и 10 долларов за миллион выходных. По курсу ЦБ на 24 сентября это около 169 рублей за вход и 844 рубля за выход. Цены могут меняться, актуальные смотрите у вендора.

Сколько стоит GPT-6 Luna?

0,1 доллара за миллион входных токенов, 0,01 доллара за кэшированный вход и 0,5 доллара за миллион выходных. Это на порядок дешевле Sol и рассчитано на массовые простые задачи.

Что за уровни batch, flex и fast?

Это режимы обслуживания одной и той же модели. Пакетный и гибкий вдвое дешевле стандартного, но без гарантии быстрого ответа: пакетный отрабатывает очередь, гибкий может задерживаться при нагрузке. Быстрый вдвое дороже стандартного и даёт приоритет. Модель во всех режимах одна и та же.

Есть ли GPT-6 Sol и Luna в каталоге KeyDealer?

На 24 сентября нет. В каталоге есть флагман шестого поколения GPT-6 Astra и предыдущее поколение этой линейки — 5.6 Sol, Luna и Terra. Появление новых позиций зависит не от нас, и дату мы не обещаем.

Стоит ли ждать и переходить?

Если вы уже на предыдущем поколении и оно закрывает задачу, спешить незачем: смена модели ломает промпты и меняет длину ответов. Разумный порядок — дождаться, прогнать свою выборку на обеих позициях и сравнить стоимость решённой задачи, а не ставку.

Источники