Релизы и изменения моделей
GPT-6 Sol и Luna: вдвое дешевле прошлого поколения
22 сентября OpenAI выпустила GPT-6 Sol и GPT-6 Luna — среднюю и младшую модели шестого поколения. По стандартному тарифу на странице цен вендора Sol стоит 2 доллара за миллион входных токенов и 10 за миллион выходных, Luna — 0,1 и 0,5 доллара. Это вдвое дешевле соответствующих моделей предыдущего поколения по тому же прайсу. В тот же день Anthropic выпустила Claude Opus 5.5, так что цены на флагманском уровне двинулись вниз у двух вендоров сразу.
Разберём, что именно вышло, как устроен прайс и почему ставка за миллион — только половина ответа на вопрос «сколько это будет стоить».
Что вышло
Две модели, которые встали под флагманом GPT-6 Astra.
GPT-6 Sol — средняя модель поколения. По позиционированию вендора это рабочая лошадь для большинства задач: код, анализ, агентные сценарии среднего уровня сложности.
GPT-6 Luna — младшая и самая дешёвая. Рассчитана на массовые простые операции: классификацию, извлечение полей, короткие ответы.
Анонс на сайте OpenAI на момент написания отдаёт ошибку доступа, поэтому все цифры ниже взяты со страницы цен в документации для разработчиков. Эта страница собирает таблицу в браузере, и очищенный текст с неё неполный — числа мы брали из данных, встроенных в саму страницу.
Прайс: стандартный уровень
| Модель | Вход, $ за 1 млн | Кэшированный вход, $ за 1 млн | Выход, $ за 1 млн |
|---|---|---|---|
| GPT-6 Sol | 2 | 0,2 | 10 |
| GPT-6 Luna | 0,1 | 0,01 | 0,5 |
По курсу ЦБ на 24 сентября 2026 года — 84,3969 ₽ за доллар — это около 169 ₽ за миллион входных токенов и 844 ₽ за миллион выходных у Sol, около 8,4 ₽ и 42 ₽ у Luna.
Обратите внимание на соотношение входа и выхода: выход дороже входа в пять раз у обеих моделей. Для задач с длинным ответом именно выход определяет счёт. Как это считается, разобрано в материале сколько стоит миллион токенов в рублях.
Уровни обслуживания
У одной и той же модели на странице цен четыре режима, и путать их — дорого.
| Режим | Цена относительно стандартного | Что вы получаете |
|---|---|---|
| Стандартный | базовая | обычная скорость ответа |
| Пакетный | вдвое дешевле | ответ из очереди, без гарантии скорости |
| Гибкий | вдвое дешевле | может задерживаться при нагрузке |
| Быстрый | вдвое дороже | приоритетная обработка |
Модель во всех режимах одна и та же — меняется только очередь. Практический вывод: всё, что не требует ответа в реальном времени, выгоднее отправлять пакетом. Отчёты, разметка архива, ночная обработка документов. Механика этих режимов подробно разобрана в материале Batch, Flex и Fast: цена запроса.
Кому какая модель подходит
Разводка по линейке простая, если смотреть на задачу, а не на название.
Luna — для потока однотипных коротких операций. Классификация обращений, извлечение полей, маршрутизация, короткий перевод. На таких задачах разница с более дорогой моделью часто не видна вовсе, а разница в счёте — двадцатикратная.
Sol — для работы, где нужен разбор: код в существующей кодовой базе, анализ документа целиком, агентный сценарий с несколькими шагами. Здесь младшая модель начинает ошибаться, и экономия съедается правками.
Astra — для задач на границе возможностей: длинные автономные цепочки, сложные рассуждения, работа, где цена ошибки высока. Использовать её на рутине — самый дорогой способ сделать то, что Luna делает так же.
Типичная картина в продакшене — не одна модель, а маршрут: основной поток идёт на младшую, спорные случаи уходят на старшую. Как это устроить, разобрано в материале маршрутизация между моделями.
Как читать прайс и не ошибиться
Три ловушки, на которых спотыкаются чаще всего.
Кэшированный вход — не бесплатный. Он дешевле обычного в десять раз, но работает только когда начало запроса совпадает с предыдущим. Если системный промпт меняется от запроса к запросу, кэш не срабатывает, и вы платите полную ставку.
Выход дороже входа в пять раз. Считать бюджет по объёму отправляемых документов — значит ошибиться в разы на задачах с длинным ответом. Считайте по сумме входа и выхода раздельно.
Режим задаётся запросом. Пакетная цена не применяется автоматически — запрос нужно отправить в пакетном режиме явно. Иначе он уйдёт по стандартной ставке.
Что говорит независимый замер
У вендора в анонсе свои цифры, и они, как обычно, выгодные. Полезнее посмотреть, что сказал сторонний замер.
Artificial Analysis 22 сентября опубликовала оценку обеих моделей. Короткий вывод из их анонса: новые модели сдвигают границу эффективности по цене, потому что стоят вдвое меньше предшественников, а по сводным индексам — интеллектуальному и индексу кодинг-агентов — остаются на уровне GPT-5.6, с прогрессом в одних тестах и регрессом в других.
Это важная поправка к заголовкам. «Вдвое дешевле» — правда. «Вдвое лучше» — нет: по независимому замеру качество примерно то же, а выигрыш именно в цене. Для задачи, которая уже закрывается предыдущим поколением, это значит, что переезд окупится только счётом — и только если модель не станет писать длиннее.
Почему флагманы дешевеют
Два вендора в один день снизили цену своего основного уровня — это не совпадение, а направление.
Anthropic в анонсе Opus 5.5 прямо пишет, что новая модель требует меньше вычислений. Для OpenAI похожего заявления в документации нет, но картина та же: новое поколение стоит дешевле предыдущего при той же ступени в линейке.
Для покупателя из этого следует простая вещь: ставка за миллион перестала быть стабильной характеристикой модели. Она меняется с каждым поколением, а поколения выходят раз в несколько месяцев. Планировать бюджет на год по сегодняшнему прайсу — значит переплатить или недоплатить, но точно ошибиться.
Второй сюжет того же дня — Opus 5.5, где новая цена сопровождается четырьмя изменениями, которые ломают код при переходе. Разбор — в материале Claude Opus 5.5: на 20% дешевле, но четыре поломки.
Ставка — только половина цены
Самое важное в этой новости, и о нём почти не пишут.
Ставка говорит, сколько стоит миллион токенов. Она не говорит, сколько токенов модель потратит на вашу задачу. Новое поколение может быть вдвое дешевле за токен и при этом писать вдвое длиннее — и тогда экономия исчезает целиком.
Бывает и обратное: модель дороже за токен, но решает задачу короче и с первого раза. Тогда она дешевле по счёту.
Отсюда правило, которое мы повторяем в каждом разборе новых моделей: сравнивать нужно стоимость решённой задачи, а не ставку. Прогоните тридцать своих задач на обеих позициях, отберите решённые обеими, сложите токены выхода и умножьте на ставку. Механика такого замера разобрана в материале как сравнивать модели.
Что с этим делать, если вы на предыдущем поколении
Ничего срочного. Модель, которая закрывает задачу, не перестаёт её закрывать оттого, что вышла новая.
Порядок разумный такой.
Первое: проверьте, не объявлено ли отключение вашей модели. Не по новостям, а по странице отключений вендора. Если нет — у вас есть время. План переездов удобно вести по материалу календарь отключений моделей 2026.
Второе: не переезжайте в день релиза. Новые модели в первые недели меняют поведение, у них уточняются лимиты и статусы возможностей.
Третье: когда соберётесь, меняйте что-то одно. Либо модель, либо промпт. Иначе при ухудшении вы не узнаете, что виновато. Подробно — в материале как обновлять промпты при смене модели.
Что есть в каталоге KeyDealer
GPT-6 Sol и Luna в каталоге на 24 сентября нет. Есть флагман шестого поколения GPT-6 Astra и предыдущее поколение этой линейки — 5.6 Sol, Luna и Terra. Их ставки опубликованы в каталоге в рублях за миллион токенов; цены вендора на модели, которые мы продаём, мы рядом не публикуем.
Появление новых позиций зависит не от нас, и дату мы не обещаем. Когда позиция появится, мы напишем о ней отдельно — с тем, что у неё проверено, а что нет.
Один ключ KeyDealer открывает каталог из 57 позиций, 44 из которых доступны сейчас, с оплатой российской картой в рублях и ставками от 1 ₽ за миллион токенов. Смена позиции — это одна строка в конфигурации, поэтому выход нового поколения у вендора не заставляет заключать новый договор, когда модель появится в каталоге.
Чего мы не утверждаем
Три оговорки.
Мы не утверждаем, что новые модели лучше на вашей задаче. Позиционирование вендора — это не характеристика вашего потока запросов. Сравнение делается на своей выборке.
Мы не пересказываем бенчмарки. Цифры качества, которые вендор публикует о себе, — это его замер, а не ваш. В этой статье только то, что можно проверить на странице цен.
Мы не гарантируем актуальность цен. Прайс вендора меняется без предупреждения, и числа выше верны на дату публикации. Проверяйте по первоисточнику перед расчётом бюджета.
Что держать в голове
Первое. Ставка за миллион дешевеет с каждым поколением, и это устойчивое направление, а не разовая акция. Планируйте бюджет с запасом на пересмотр каждые несколько месяцев.
Второе. Режим обслуживания меняет цену вдвое в обе стороны при той же модели. Если ваша задача не требует ответа в реальном времени, вы, скорее всего, переплачиваете.
Третье. Решает не ставка, а стоимость решённой задачи. Модель вдвое дешевле за токен может оказаться дороже по счёту, если пишет вдвое длиннее. Что мы за проект — на странице о проекте, ключ заводится на keydealer.ru/login.
Частые вопросы
Что вышло у OpenAI 22 сентября?
Две модели шестого поколения, GPT-6 Sol и GPT-6 Luna. Они встали в линейку под флагманом GPT-6 Astra. Sol — средняя модель, Luna — младшая и самая дешёвая. В тот же день Anthropic выпустила Claude Opus 5.5, поэтому в лентах этот день назвали днём двух флагманов.
Сколько стоит GPT-6 Sol?
По стандартному тарифу на странице цен OpenAI: 2 доллара за миллион входных токенов, 0,2 доллара за кэшированный вход и 10 долларов за миллион выходных. По курсу ЦБ на 24 сентября это около 169 рублей за вход и 844 рубля за выход. Цены могут меняться, актуальные смотрите у вендора.
Сколько стоит GPT-6 Luna?
0,1 доллара за миллион входных токенов, 0,01 доллара за кэшированный вход и 0,5 доллара за миллион выходных. Это на порядок дешевле Sol и рассчитано на массовые простые задачи.
Что за уровни batch, flex и fast?
Это режимы обслуживания одной и той же модели. Пакетный и гибкий вдвое дешевле стандартного, но без гарантии быстрого ответа: пакетный отрабатывает очередь, гибкий может задерживаться при нагрузке. Быстрый вдвое дороже стандартного и даёт приоритет. Модель во всех режимах одна и та же.
Есть ли GPT-6 Sol и Luna в каталоге KeyDealer?
На 24 сентября нет. В каталоге есть флагман шестого поколения GPT-6 Astra и предыдущее поколение этой линейки — 5.6 Sol, Luna и Terra. Появление новых позиций зависит не от нас, и дату мы не обещаем.
Стоит ли ждать и переходить?
Если вы уже на предыдущем поколении и оно закрывает задачу, спешить незачем: смена модели ломает промпты и меняет длину ответов. Разумный порядок — дождаться, прогнать свою выборку на обеих позициях и сравнить стоимость решённой задачи, а не ставку.