Мир ИИ

DeepSeek V4 Pro вышел из preview: 1,6 трлн параметров

DeepSeek V4 Pro вышел из preview: 1,6 трлн параметров

DeepSeek перевёл флагманский V4 Pro из preview в общий доступ: сборка 0813, архитектура Mixture-of-Experts на 1,6 трлн параметров с примерно 49 млрд активных на токен, контекст 1 048 576 токенов и максимальный выход 384 000. Цена перешла из превью без изменений: 0,435 доллара за миллион входных токенов при промахе кэша и 0,003625 при попадании — разрыв ровно в 120 раз. Выход стоит 0,87 доллара, ровно вдвое дороже входа. По курсу ЦБ на 13 августа (82,9977 ₽) это 36,10 ₽, 0,30 ₽ и 72,21 ₽ соответственно. В каталоге KeyDealer DeepSeek нет ни в каком виде — и дальше объясняем, что из этой новости всё равно применимо к вашему счёту.

Что за модель

Цифры компактно, потому что заголовочные параметры снова вводят в заблуждение.

ПараметрЗначение
Всего параметров~1,6 трлн
Активных на токен~49 млрд
Контекст1 048 576 токенов
Максимальный выход384 000 токенов
Архитектураразреженная Mixture-of-Experts

Как и в случае с Kimi K3 на 2,8 трлн параметров, считать вычислительную нагрузку надо по активным параметрам, а не по общим. 49 млрд из 1,6 трлн — это около 3% модели на каждый токен.

Отдельно стоит отметить максимальный выход в 384 тысячи токенов — это много даже по меркам моделей с миллионным контекстом. Арифметика тут неожиданно приятная: ответ по самой верхней границе обошёлся бы примерно в 28 рублей. Полезное упражнение против интуиции — «огромный ответ» и «дорогой ответ» это не одно и то же, и прикидывать стоит счётом, а не ощущением.

Экономика кэша: разрыв в 120 раз

Самая содержательная часть прайса — не абсолютные цифры, а отношение между ними.

Промах кэша: 0,435 доллара за миллион входных токенов. Попадание: 0,003625 доллара за тот же миллион.

Делим одно на другое и получаем ровно 120. Не «примерно», не «около сотни» — сто двадцать.

Смысл механизма простой. Если вы отправляете один и тот же длинный контекст много раз подряд — системный промпт, документацию, историю диалога, — вендор не пересчитывает его заново, а достаёт готовое состояние. Считать нечего, поэтому и берут символически.

Практическое следствие для тех, кто строит на таких API: структура промпта начинает влиять на счёт сильнее, чем его длина. Неизменная часть должна идти первой и не меняться между запросами, иначе кэш промахивается и вы платите полную ставку за то, что могло стоить в 120 раз дешевле.

Что из этого работает у нас, а что нет

Здесь нужна прямота, потому что тема располагает к умолчанию.

Кэша промптов в каталоге KeyDealer нет. У всех 35 текстовых моделей поле prompt_cache имеет статус unsupported. Скидки за повторно отправленный контекст мы не обещаем, и никакая структура промпта её не включит.

DeepSeek в каталоге тоже нет. На 13 августа там 37 позиций: Claude, GPT, Gemini, GLM, Grok, Kimi, Qwen и GPT Image. DeepSeek отсутствует, и сроков мы не называем.

Что работает — расчёт по объёму. Наши ставки симметричны у 34 позиций из 35, то есть вход и выход стоят одинаково, а размер запроса на ставку не влияет. Это другая экономика: проще считать, но без кэш-скидки. Единственное исключение — Qwen 3.6, у которого выход дороже входа в семь раз, и об этом отдельный разбор про асимметричную цену выхода.

Сравнивать «дешевле или дороже» в лоб бессмысленно: у DeepSeek низкая база и скидка за повторы, у нас ровная ставка без сюрпризов. Выигрывает тот вариант, который совпадает с профилем вашей нагрузки.

Как устроен промах кэша

Раз уж разрыв в 120 раз — главная цифра прайса, стоит понимать, отчего кэш промахивается. Ошибок тут делают три, и все они бесплатно исправляются.

Изменчивое в начале промпта. Кэш работает по совпадению начала запроса. Если вы ставите в первую строку текущую дату, идентификатор сессии или случайный номер, совпадения не будет ни разу, и весь длинный контекст ниже посчитается по полной ставке.

Перетасовка блоков. Сегодня инструкция идёт перед документом, завтра после — для кэша это два разных запроса. Порядок должен быть зафиксирован в коде, а не собираться каждый раз заново.

Слишком короткая неизменная часть. У кэша обычно есть минимальный порог, ниже которого он не включается. Если общего у запросов всего пара сотен токенов, механизм не сработает, и городить под него архитектуру бессмысленно.

Правильный порядок простой: сначала всё, что никогда не меняется, затем то, что меняется редко, и только в конце — запрос пользователя. Тогда кэш ловит максимально длинный общий префикс.

Оговорка, которую важно не потерять: всё это относится к провайдерам, у которых кэш есть. В нашем каталоге его нет, и переставлять блоки ради несуществующей скидки не нужно.

Открытые веса под MIT

Деталь, которая в новостях о GA обычно теряется, хотя стоит дороже всего остального.

Линейка V4 была представлена в апреле 2026 года, и веса Pro и Flash тогда же выложили под лицензией MIT — одной из самых свободных существующих. Она не ограничивает коммерческое использование, не требует раскрывать производные и не навязывает условия дальнейшего распространения.

Для сравнения: значительная часть «открытых» моделей выходит под собственными лицензиями вендора с оговорками про масштаб бизнеса, про запрет обучения конкурирующих моделей или про обязательную атрибуцию. MIT не содержит ничего из этого.

Что это значит на практике, мы разбирали в материале о позиции вендоров по открытым весам: открытая лицензия давит на цены закрытых моделей сильнее, чем конкуренция между самими закрытыми.

Второй важный момент — сама схема выката. DeepSeek показала линейку в апреле сразу с весами, в конце июля вывела в общий доступ младшую Flash, и только теперь — старшую Pro. То есть открытые веса появились раньше, чем стабильный платный API, а не после него.

Порядок нетипичный и говорит о разном отношении к тому, что считать продуктом. У закрытых вендоров веса — главный актив, и наружу они не выходят никогда. Здесь наружу выходит всё, а зарабатывают на удобстве: готовом API, аптайме и том самом кэше. Для рынка это означает, что нижняя граница цены задаётся не конкурентом, а возможностью в принципе развернуть то же самое у себя.

Чего мы не утверждаем

Мы не тестировали модель. Её нет в нашем каталоге, все характеристики — из публикаций, перечисленных в источниках.

Мы не проверяли бенчмарки. Сравнения V4 Pro с флагманами в этой статье не приводятся сознательно: цифры расходятся между публикациями, а проверить их у себя мы не можем.

Даты в источниках расходятся. Сборка появилась на агрегаторе 12 августа, о выкатке в собственном API сообщалось 13 августа. Мы приводим оба факта, а не выбираем удобный.

Цена может измениться. Прайс приведён на дату публикации; курс ЦБ на 13 августа — 82,9977 ₽ за доллар, и он тоже двигается.

Рублёвые суммы здесь — пересчёт, а не тариф. Вендор выставляет счёт в долларах, и в рубли мы переводим только чтобы цифры были сопоставимы с нашими ставками. Ваш банк применит свой курс и свою комиссию.

Открытые веса не означают, что модель легко запустить. 1,6 трлн параметров требуют серверной сборки, которую разворачивают компании с готовым парком GPU, а не отдельные разработчики. Лицензия снимает юридические ограничения, а не аппаратные.

Что держать в голове

DeepSeek вывел V4 Pro в общий доступ: 1,6 трлн параметров при 49 млрд активных, миллионный контекст, выход до 384 тысяч токенов, веса линейки открыты под MIT.

Самое полезное из новости — не модель, а число 120. Если ваш провайдер даёт скидку за попадание в кэш, порядок частей промпта стоит дороже его длины. Если не даёт, как в нашем случае, — считайте по объёму и не ищите оптимизацию там, где её нет.

Как мы отделяем проверенное от предполагаемого — на странице о проекте. Актуальные ставки по всем 37 позициям отдаёт GET /v1/models, ключ заводится за минуту: keydealer.ru/login.

Частые вопросы

Что такое DeepSeek V4 Pro 0813?

Флагманская модель DeepSeek в архитектуре Mixture-of-Experts: 1,6 трлн параметров всего и около 49 млрд активных на токен. Контекст 1 048 576 токенов, максимальный выход 384 000. Сборка 0813 получила статус общедоступной в августе 2026 года.

Сколько она стоит?

0,435 доллара за миллион входных токенов при промахе кэша, 0,003625 доллара при попадании и 0,87 доллара за миллион выходных. По курсу ЦБ на 13 августа 2026 года (82,9977 ₽) это примерно 36,10 ₽, 0,30 ₽ и 72,21 ₽.

Почему кэш настолько дешевле?

Попадание в кэш стоит в 120 раз меньше промаха. Повторно отправленный контекст не пересчитывается заново, и вендор берёт за него символическую плату.

DeepSeek есть в каталоге KeyDealer?

Нет. На 13 августа 2026 года в каталоге 37 позиций — семейства Claude, GPT, Gemini, GLM, Grok, Kimi, Qwen и GPT Image. DeepSeek среди них нет ни в каком виде.

Правда ли, что веса открыты?

Линейка V4 была представлена в апреле 2026 года с открытыми весами Pro и Flash под лицензией MIT — одной из самых свободных из существующих.

Источники