Доступ к ИИ из России

Сколько стоит 1 млн токенов в рублях в августе 2026

Сколько стоит 1 млн токенов в рублях в августе 2026

Миллион входных токенов у официальных API стоит от 8 до 411 ₽, миллион выходных — от 33 до 2 465 ₽. Между самой дешёвой и самой дорогой ставкой — больше чем в 300 раз, и это по курсу ЦБ 82,1665 ₽ за доллар на 8 августа 2026 года. Но главная ловушка не в курсе: у моделей Claude 4.7 и новее сменился токенизатор, и один и тот же текст теперь превращается примерно в 30% большее число токенов. Цена за миллион осталась прежней, счёт вырос.

Ниже — пересчёт официальных ставок в рубли, разбор трёх мест, где расчёт «на глаз» ломается, и способ посчитать собственный расход до первого запроса.

Сколько стоит 1 млн токенов у разработчиков моделей

Все цены взяты с официальных страниц тарифов и пересчитаны по курсу Банка России на 8 августа 2026 года: 1 доллар = 82,1665 ₽. Стандартный режим обработки, без batch-скидок и без кэша.

МодельВход, $Выход, $Вход, ₽Выход, ₽
gpt-5.6-sol5,0030,004112 465
gpt-5.6-terra2,0012,00164986
gpt-5.6-luna0,201,201699
gpt-5.42,5015,002051 232
gpt-5.4-mini0,754,5062370
Claude Opus 55,0025,004112 054
Claude Sonnet 52,0010,00164822
Claude Sonnet 4.63,0015,002461 232
Claude Haiku 4.51,005,0082411
Gemini 3.1 Pro2,0012,00164986
Gemini 2.5 Flash0,302,5025205
Gemini 2.5 Flash-Lite0,100,40833

Первое, что бросается в глаза: выходные токены везде дороже входных в пять-шесть раз. У gpt-5.6-sol разрыв шестикратный. Это значит, что бюджет проекта определяет не размер промпта, а длина ответа. Задача, где модель пишет код или длинный текст, стоит принципиально дороже задачи, где она классифицирует входящее сообщение в одно слово.

Второе — курс. Он двигается. Ещё 5 августа доллар стоил 81,1291 ₽, к 8 августа — 82,1665 ₽. За три дня рублёвая себестоимость запроса выросла на 1,3% без единого изменения в прайсах. Любая рублёвая цифра в статье про долларовые тарифы живёт ровно до следующего рабочего дня ЦБ.

Почему цена за миллион токенов не равна цене за текст

Здесь начинается то, что почти никогда не попадает в сравнительные таблицы.

Anthropic прямо указывает в документации: модели Claude 4.7 и новее используют новый токенизатор, и он выдаёт примерно на 30% больше токенов на том же тексте. Точная разница зависит от содержания.

Считайте, что это значит на практике. Возьмём Claude Opus 4.6 и Claude Opus 4.7. Ставка у обоих одинаковая — 5 долларов за миллион входных токенов. Но один и тот же документ на входе у 4.7 превратится не в 100 000 токенов, а примерно в 130 000. Тариф не изменился. Счёт вырос почти на треть.

Отсюда практический вывод: сравнивать модели по цене за миллион токенов корректно только внутри одного токенизатора. Между поколениями это сравнение молча врёт. Единственный честный способ — прогнать свой реальный текст и посмотреть фактический usage в ответе.

Что изменится 1 сентября 2026 года

У Claude Sonnet 5 сейчас действует вводная цена: 2 доллара за вход и 10 за выход. Anthropic пишет об этом отдельной сноской — вводные ставки работают до 31 августа 2026 года, а с 1 сентября включаются стандартные 3 и 15 долларов.

В рублях по сегодняшнему курсу это выглядит так:

ПериодВход, ₽Выход, ₽
По 31 августа 2026164822
С 1 сентября 20262461 232

Рост в полтора раза. Если вы сейчас считаете экономику проекта на Sonnet 5 и планируете запуск на осень, закладывайте вторую строку, а не первую.

Почему у Gemini 3.1 Pro две цены

Google считает длинный контекст отдельно. У Gemini 3.1 Pro тариф удваивается по входу, как только запрос переваливает за 200 000 токенов:

  • запрос до 200k — 2 доллара вход и 12 выход, то есть 164 ₽ и 986 ₽;
  • запрос свыше 200k — 4 доллара вход и 18 выход, то есть 329 ₽ и 1 479 ₽.

Это ровно тот случай, когда «залить в модель весь репозиторий» стоит дороже, чем кажется по строчке в прайсе. Переход через порог удваивает цену входа мгновенно, а не пропорционально.

Похожая логика у Gemini 2.5 Pro: до 200k — 1,25 доллара, свыше — 2,50.

Сколько это стоит в рублях через KeyDealer

KeyDealer публикует ставки сразу в рублях, отдельно вход и выход, и они видны до первого запроса — в каталоге моделей и в ответе GET /v1/models. Сравнение с официальными ставками по курсу на ту же дату:

МодельОфициально, вход ₽Официально, выход ₽KeyDealer, вход и выход ₽
gpt-5.6-sol4112 46525
gpt-5.6-terra16498620
Claude Opus 54112 05465
Claude Sonnet 516482220
Claude Haiku 4.58241120
Gemini 3.1 Pro16498620
Gemini 2.5 Flash252057

Важная деталь, которая меняет расчёт: у KeyDealer вход и выход стоят одинаково. У официальных API выход дороже входа в пять-шесть раз, поэтому чем длиннее ответы в вашем сценарии, тем сильнее расходится итог. Для генерации текста и кода разрыв максимальный, для классификации коротких сообщений — минимальный.

Точная формула списания опубликована и не содержит скрытых коэффициентов:

списание = prompt_tokens × ставка входа / 1 000 000
         + completion_tokens × ставка выхода / 1 000 000

Считается по фактическому usage из завершённого ответа. Подробности контракта — в документации API.

Что нельзя закладывать в расчёт

Три вещи, на которых расчёты чаще всего разъезжаются с реальностью.

Скидка за кэш промптов. У Anthropic попадание в кэш стоит 0,1 от базовой ставки входа, у OpenAI кэшированный вход дешевле обычного в десять раз. Соблазн заложить это в модель расходов большой. Но кэш — не свойство запроса, а свойство маршрута. В каталоге KeyDealer сейчас у всех моделей поле prompt_cache.status равно unsupported, поэтому скидка за кэш не обещается и не применяется. Наличие поля cache_control в вашем запросе само по себе ничего не доказывает.

Системный контекст маршрута. К вашему промпту может добавляться служебный контекст, и он попадает в prompt_tokens. GET /v1/models публикует оценку этого объёма вместе с датой измерения. Оценка — это оценка: авторитетным для списания остаётся usage в завершённом ответе, а не прогноз до запроса. Измерить и при необходимости консервативно ужать свой контекст помогает KD Context.

Batch-скидки. У Anthropic и Google пакетная обработка даёт минус 50%, но это отдельный асинхронный режим с другими гарантиями по времени. В сравнении обычных синхронных запросов ему не место.

Как посчитать свой расход до первого запроса

Порядок, который работает лучше прикидок в уме:

  1. Возьмите десять реальных запросов вашего сценария, а не синтетический «Привет».
  2. Отправьте их и посмотрите usage в ответах — там точное число входных и выходных токенов.
  3. Посчитайте среднее соотношение входа к выходу. Для чат-ботов поддержки типично около 80 на 20, для генерации кода доля выхода заметно выше.
  4. Умножьте на месячное число запросов и на опубликованные ставки.
  5. Проверьте результат по GET /v1/balance — он возвращает точный рублёвый баланс и отдельно посчитанные токен-эквиваленты для каждой доступной модели с учётом ваших условий.

Последний шаг важнее остальных: именно /v1/balance показывает ставки, действующие для вашего аккаунта, а не общие каталожные.

Коротко

Официальный миллион входных токенов стоит от 8 до 411 ₽, выходных — от 33 до 2 465 ₽ по курсу ЦБ на 8 августа 2026 года. Курс двигается каждый рабочий день, вводная цена Sonnet 5 заканчивается 31 августа, длинный контекст у Gemini дорожает вдвое после 200k, а новый токенизатор Claude добавляет около 30% к числу токенов при неизменной ставке.

Всё это — причины считать по фактическому usage, а не по красивой строчке в прайсе.

Частые вопросы

Почему цены у разработчиков моделей указаны в долларах, а не в рублях?

OpenAI, Anthropic и Google выставляют счета в долларах и не публикуют рублёвых прайсов. Рублёвая цифра появляется только после пересчёта по курсу на дату списания, поэтому она меняется каждый день вместе с курсом ЦБ.

Что дороже — входные или выходные токены?

У официальных API выходные токены дороже входных в 5–6 раз. У gpt-5.6-sol разрыв шестикратный: 5 долларов вход против 30 долларов выход за миллион.

Можно ли рассчитывать на скидку за кэш промптов?

Только если провайдер прямо подтверждает попадание в кэш. В каталоге KeyDealer сейчас у всех моделей prompt_cache.status равен unsupported, поэтому скидка за кэш не обещается и не применяется.

Сколько токенов в одном русском слове?

Зависит от модели и токенизатора. Надёжнее считать не по словам, а по факту: в ответе API поле usage показывает точное число входных и выходных токенов конкретного запроса.

Источники