Доступ к ИИ из России
Сколько стоит 1 млн токенов в рублях в августе 2026
Миллион входных токенов у официальных API стоит от 8 до 411 ₽, миллион выходных — от 33 до 2 465 ₽. Между самой дешёвой и самой дорогой ставкой — больше чем в 300 раз, и это по курсу ЦБ 82,1665 ₽ за доллар на 8 августа 2026 года. Но главная ловушка не в курсе: у моделей Claude 4.7 и новее сменился токенизатор, и один и тот же текст теперь превращается примерно в 30% большее число токенов. Цена за миллион осталась прежней, счёт вырос.
Ниже — пересчёт официальных ставок в рубли, разбор трёх мест, где расчёт «на глаз» ломается, и способ посчитать собственный расход до первого запроса.
Сколько стоит 1 млн токенов у разработчиков моделей
Все цены взяты с официальных страниц тарифов и пересчитаны по курсу Банка России на 8 августа 2026 года: 1 доллар = 82,1665 ₽. Стандартный режим обработки, без batch-скидок и без кэша.
| Модель | Вход, $ | Выход, $ | Вход, ₽ | Выход, ₽ |
|---|---|---|---|---|
| gpt-5.6-sol | 5,00 | 30,00 | 411 | 2 465 |
| gpt-5.6-terra | 2,00 | 12,00 | 164 | 986 |
| gpt-5.6-luna | 0,20 | 1,20 | 16 | 99 |
| gpt-5.4 | 2,50 | 15,00 | 205 | 1 232 |
| gpt-5.4-mini | 0,75 | 4,50 | 62 | 370 |
| Claude Opus 5 | 5,00 | 25,00 | 411 | 2 054 |
| Claude Sonnet 5 | 2,00 | 10,00 | 164 | 822 |
| Claude Sonnet 4.6 | 3,00 | 15,00 | 246 | 1 232 |
| Claude Haiku 4.5 | 1,00 | 5,00 | 82 | 411 |
| Gemini 3.1 Pro | 2,00 | 12,00 | 164 | 986 |
| Gemini 2.5 Flash | 0,30 | 2,50 | 25 | 205 |
| Gemini 2.5 Flash-Lite | 0,10 | 0,40 | 8 | 33 |
Первое, что бросается в глаза: выходные токены везде дороже входных в пять-шесть раз. У gpt-5.6-sol разрыв шестикратный. Это значит, что бюджет проекта определяет не размер промпта, а длина ответа. Задача, где модель пишет код или длинный текст, стоит принципиально дороже задачи, где она классифицирует входящее сообщение в одно слово.
Второе — курс. Он двигается. Ещё 5 августа доллар стоил 81,1291 ₽, к 8 августа — 82,1665 ₽. За три дня рублёвая себестоимость запроса выросла на 1,3% без единого изменения в прайсах. Любая рублёвая цифра в статье про долларовые тарифы живёт ровно до следующего рабочего дня ЦБ.
Почему цена за миллион токенов не равна цене за текст
Здесь начинается то, что почти никогда не попадает в сравнительные таблицы.
Anthropic прямо указывает в документации: модели Claude 4.7 и новее используют новый токенизатор, и он выдаёт примерно на 30% больше токенов на том же тексте. Точная разница зависит от содержания.
Считайте, что это значит на практике. Возьмём Claude Opus 4.6 и Claude Opus 4.7. Ставка у обоих одинаковая — 5 долларов за миллион входных токенов. Но один и тот же документ на входе у 4.7 превратится не в 100 000 токенов, а примерно в 130 000. Тариф не изменился. Счёт вырос почти на треть.
Отсюда практический вывод: сравнивать модели по цене за миллион токенов корректно только внутри одного токенизатора. Между поколениями это сравнение молча врёт. Единственный честный способ — прогнать свой реальный текст и посмотреть фактический usage в ответе.
Что изменится 1 сентября 2026 года
У Claude Sonnet 5 сейчас действует вводная цена: 2 доллара за вход и 10 за выход. Anthropic пишет об этом отдельной сноской — вводные ставки работают до 31 августа 2026 года, а с 1 сентября включаются стандартные 3 и 15 долларов.
В рублях по сегодняшнему курсу это выглядит так:
| Период | Вход, ₽ | Выход, ₽ |
|---|---|---|
| По 31 августа 2026 | 164 | 822 |
| С 1 сентября 2026 | 246 | 1 232 |
Рост в полтора раза. Если вы сейчас считаете экономику проекта на Sonnet 5 и планируете запуск на осень, закладывайте вторую строку, а не первую.
Почему у Gemini 3.1 Pro две цены
Google считает длинный контекст отдельно. У Gemini 3.1 Pro тариф удваивается по входу, как только запрос переваливает за 200 000 токенов:
- запрос до 200k — 2 доллара вход и 12 выход, то есть 164 ₽ и 986 ₽;
- запрос свыше 200k — 4 доллара вход и 18 выход, то есть 329 ₽ и 1 479 ₽.
Это ровно тот случай, когда «залить в модель весь репозиторий» стоит дороже, чем кажется по строчке в прайсе. Переход через порог удваивает цену входа мгновенно, а не пропорционально.
Похожая логика у Gemini 2.5 Pro: до 200k — 1,25 доллара, свыше — 2,50.
Сколько это стоит в рублях через KeyDealer
KeyDealer публикует ставки сразу в рублях, отдельно вход и выход, и они видны до первого запроса — в каталоге моделей и в ответе GET /v1/models. Сравнение с официальными ставками по курсу на ту же дату:
| Модель | Официально, вход ₽ | Официально, выход ₽ | KeyDealer, вход и выход ₽ |
|---|---|---|---|
| gpt-5.6-sol | 411 | 2 465 | 25 |
| gpt-5.6-terra | 164 | 986 | 20 |
| Claude Opus 5 | 411 | 2 054 | 65 |
| Claude Sonnet 5 | 164 | 822 | 20 |
| Claude Haiku 4.5 | 82 | 411 | 20 |
| Gemini 3.1 Pro | 164 | 986 | 20 |
| Gemini 2.5 Flash | 25 | 205 | 7 |
Важная деталь, которая меняет расчёт: у KeyDealer вход и выход стоят одинаково. У официальных API выход дороже входа в пять-шесть раз, поэтому чем длиннее ответы в вашем сценарии, тем сильнее расходится итог. Для генерации текста и кода разрыв максимальный, для классификации коротких сообщений — минимальный.
Точная формула списания опубликована и не содержит скрытых коэффициентов:
списание = prompt_tokens × ставка входа / 1 000 000
+ completion_tokens × ставка выхода / 1 000 000
Считается по фактическому usage из завершённого ответа. Подробности контракта — в документации API.
Что нельзя закладывать в расчёт
Три вещи, на которых расчёты чаще всего разъезжаются с реальностью.
Скидка за кэш промптов. У Anthropic попадание в кэш стоит 0,1 от базовой ставки входа, у OpenAI кэшированный вход дешевле обычного в десять раз. Соблазн заложить это в модель расходов большой. Но кэш — не свойство запроса, а свойство маршрута. В каталоге KeyDealer сейчас у всех моделей поле prompt_cache.status равно unsupported, поэтому скидка за кэш не обещается и не применяется. Наличие поля cache_control в вашем запросе само по себе ничего не доказывает.
Системный контекст маршрута. К вашему промпту может добавляться служебный контекст, и он попадает в prompt_tokens. GET /v1/models публикует оценку этого объёма вместе с датой измерения. Оценка — это оценка: авторитетным для списания остаётся usage в завершённом ответе, а не прогноз до запроса. Измерить и при необходимости консервативно ужать свой контекст помогает KD Context.
Batch-скидки. У Anthropic и Google пакетная обработка даёт минус 50%, но это отдельный асинхронный режим с другими гарантиями по времени. В сравнении обычных синхронных запросов ему не место.
Как посчитать свой расход до первого запроса
Порядок, который работает лучше прикидок в уме:
- Возьмите десять реальных запросов вашего сценария, а не синтетический «Привет».
- Отправьте их и посмотрите
usageв ответах — там точное число входных и выходных токенов. - Посчитайте среднее соотношение входа к выходу. Для чат-ботов поддержки типично около 80 на 20, для генерации кода доля выхода заметно выше.
- Умножьте на месячное число запросов и на опубликованные ставки.
- Проверьте результат по
GET /v1/balance— он возвращает точный рублёвый баланс и отдельно посчитанные токен-эквиваленты для каждой доступной модели с учётом ваших условий.
Последний шаг важнее остальных: именно /v1/balance показывает ставки, действующие для вашего аккаунта, а не общие каталожные.
Коротко
Официальный миллион входных токенов стоит от 8 до 411 ₽, выходных — от 33 до 2 465 ₽ по курсу ЦБ на 8 августа 2026 года. Курс двигается каждый рабочий день, вводная цена Sonnet 5 заканчивается 31 августа, длинный контекст у Gemini дорожает вдвое после 200k, а новый токенизатор Claude добавляет около 30% к числу токенов при неизменной ставке.
Всё это — причины считать по фактическому usage, а не по красивой строчке в прайсе.
Частые вопросы
Почему цены у разработчиков моделей указаны в долларах, а не в рублях?
OpenAI, Anthropic и Google выставляют счета в долларах и не публикуют рублёвых прайсов. Рублёвая цифра появляется только после пересчёта по курсу на дату списания, поэтому она меняется каждый день вместе с курсом ЦБ.
Что дороже — входные или выходные токены?
У официальных API выходные токены дороже входных в 5–6 раз. У gpt-5.6-sol разрыв шестикратный: 5 долларов вход против 30 долларов выход за миллион.
Можно ли рассчитывать на скидку за кэш промптов?
Только если провайдер прямо подтверждает попадание в кэш. В каталоге KeyDealer сейчас у всех моделей prompt_cache.status равен unsupported, поэтому скидка за кэш не обещается и не применяется.
Сколько токенов в одном русском слове?
Зависит от модели и токенизатора. Надёжнее считать не по словам, а по факту: в ответе API поле usage показывает точное число входных и выходных токенов конкретного запроса.