Мир ИИ
DeepSeek V4 Pro вышел из preview: 1,6 трлн параметров
DeepSeek перевёл флагманский V4 Pro из preview в общий доступ: сборка 0813, архитектура Mixture-of-Experts на 1,6 трлн параметров с примерно 49 млрд активных на токен, контекст 1 048 576 токенов и максимальный выход 384 000. Цена перешла из превью без изменений: 0,435 доллара за миллион входных токенов при промахе кэша и 0,003625 при попадании — разрыв ровно в 120 раз. Выход стоит 0,87 доллара, ровно вдвое дороже входа. По курсу ЦБ на 13 августа (82,9977 ₽) это 36,10 ₽, 0,30 ₽ и 72,21 ₽ соответственно. В каталоге KeyDealer DeepSeek нет ни в каком виде — и дальше объясняем, что из этой новости всё равно применимо к вашему счёту.
Что за модель
Цифры компактно, потому что заголовочные параметры снова вводят в заблуждение.
| Параметр | Значение |
|---|---|
| Всего параметров | ~1,6 трлн |
| Активных на токен | ~49 млрд |
| Контекст | 1 048 576 токенов |
| Максимальный выход | 384 000 токенов |
| Архитектура | разреженная Mixture-of-Experts |
Как и в случае с Kimi K3 на 2,8 трлн параметров, считать вычислительную нагрузку надо по активным параметрам, а не по общим. 49 млрд из 1,6 трлн — это около 3% модели на каждый токен.
Отдельно стоит отметить максимальный выход в 384 тысячи токенов — это много даже по меркам моделей с миллионным контекстом. Арифметика тут неожиданно приятная: ответ по самой верхней границе обошёлся бы примерно в 28 рублей. Полезное упражнение против интуиции — «огромный ответ» и «дорогой ответ» это не одно и то же, и прикидывать стоит счётом, а не ощущением.
Экономика кэша: разрыв в 120 раз
Самая содержательная часть прайса — не абсолютные цифры, а отношение между ними.
Промах кэша: 0,435 доллара за миллион входных токенов. Попадание: 0,003625 доллара за тот же миллион.
Делим одно на другое и получаем ровно 120. Не «примерно», не «около сотни» — сто двадцать.
Смысл механизма простой. Если вы отправляете один и тот же длинный контекст много раз подряд — системный промпт, документацию, историю диалога, — вендор не пересчитывает его заново, а достаёт готовое состояние. Считать нечего, поэтому и берут символически.
Практическое следствие для тех, кто строит на таких API: структура промпта начинает влиять на счёт сильнее, чем его длина. Неизменная часть должна идти первой и не меняться между запросами, иначе кэш промахивается и вы платите полную ставку за то, что могло стоить в 120 раз дешевле.
Что из этого работает у нас, а что нет
Здесь нужна прямота, потому что тема располагает к умолчанию.
Кэша промптов в каталоге KeyDealer нет. У всех 35 текстовых моделей поле prompt_cache имеет статус unsupported. Скидки за повторно отправленный контекст мы не обещаем, и никакая структура промпта её не включит.
DeepSeek в каталоге тоже нет. На 13 августа там 37 позиций: Claude, GPT, Gemini, GLM, Grok, Kimi, Qwen и GPT Image. DeepSeek отсутствует, и сроков мы не называем.
Что работает — расчёт по объёму. Наши ставки симметричны у 34 позиций из 35, то есть вход и выход стоят одинаково, а размер запроса на ставку не влияет. Это другая экономика: проще считать, но без кэш-скидки. Единственное исключение — Qwen 3.6, у которого выход дороже входа в семь раз, и об этом отдельный разбор про асимметричную цену выхода.
Сравнивать «дешевле или дороже» в лоб бессмысленно: у DeepSeek низкая база и скидка за повторы, у нас ровная ставка без сюрпризов. Выигрывает тот вариант, который совпадает с профилем вашей нагрузки.
Как устроен промах кэша
Раз уж разрыв в 120 раз — главная цифра прайса, стоит понимать, отчего кэш промахивается. Ошибок тут делают три, и все они бесплатно исправляются.
Изменчивое в начале промпта. Кэш работает по совпадению начала запроса. Если вы ставите в первую строку текущую дату, идентификатор сессии или случайный номер, совпадения не будет ни разу, и весь длинный контекст ниже посчитается по полной ставке.
Перетасовка блоков. Сегодня инструкция идёт перед документом, завтра после — для кэша это два разных запроса. Порядок должен быть зафиксирован в коде, а не собираться каждый раз заново.
Слишком короткая неизменная часть. У кэша обычно есть минимальный порог, ниже которого он не включается. Если общего у запросов всего пара сотен токенов, механизм не сработает, и городить под него архитектуру бессмысленно.
Правильный порядок простой: сначала всё, что никогда не меняется, затем то, что меняется редко, и только в конце — запрос пользователя. Тогда кэш ловит максимально длинный общий префикс.
Оговорка, которую важно не потерять: всё это относится к провайдерам, у которых кэш есть. В нашем каталоге его нет, и переставлять блоки ради несуществующей скидки не нужно.
Открытые веса под MIT
Деталь, которая в новостях о GA обычно теряется, хотя стоит дороже всего остального.
Линейка V4 была представлена в апреле 2026 года, и веса Pro и Flash тогда же выложили под лицензией MIT — одной из самых свободных существующих. Она не ограничивает коммерческое использование, не требует раскрывать производные и не навязывает условия дальнейшего распространения.
Для сравнения: значительная часть «открытых» моделей выходит под собственными лицензиями вендора с оговорками про масштаб бизнеса, про запрет обучения конкурирующих моделей или про обязательную атрибуцию. MIT не содержит ничего из этого.
Что это значит на практике, мы разбирали в материале о позиции вендоров по открытым весам: открытая лицензия давит на цены закрытых моделей сильнее, чем конкуренция между самими закрытыми.
Второй важный момент — сама схема выката. DeepSeek показала линейку в апреле сразу с весами, в конце июля вывела в общий доступ младшую Flash, и только теперь — старшую Pro. То есть открытые веса появились раньше, чем стабильный платный API, а не после него.
Порядок нетипичный и говорит о разном отношении к тому, что считать продуктом. У закрытых вендоров веса — главный актив, и наружу они не выходят никогда. Здесь наружу выходит всё, а зарабатывают на удобстве: готовом API, аптайме и том самом кэше. Для рынка это означает, что нижняя граница цены задаётся не конкурентом, а возможностью в принципе развернуть то же самое у себя.
Чего мы не утверждаем
Мы не тестировали модель. Её нет в нашем каталоге, все характеристики — из публикаций, перечисленных в источниках.
Мы не проверяли бенчмарки. Сравнения V4 Pro с флагманами в этой статье не приводятся сознательно: цифры расходятся между публикациями, а проверить их у себя мы не можем.
Даты в источниках расходятся. Сборка появилась на агрегаторе 12 августа, о выкатке в собственном API сообщалось 13 августа. Мы приводим оба факта, а не выбираем удобный.
Цена может измениться. Прайс приведён на дату публикации; курс ЦБ на 13 августа — 82,9977 ₽ за доллар, и он тоже двигается.
Рублёвые суммы здесь — пересчёт, а не тариф. Вендор выставляет счёт в долларах, и в рубли мы переводим только чтобы цифры были сопоставимы с нашими ставками. Ваш банк применит свой курс и свою комиссию.
Открытые веса не означают, что модель легко запустить. 1,6 трлн параметров требуют серверной сборки, которую разворачивают компании с готовым парком GPU, а не отдельные разработчики. Лицензия снимает юридические ограничения, а не аппаратные.
Что держать в голове
DeepSeek вывел V4 Pro в общий доступ: 1,6 трлн параметров при 49 млрд активных, миллионный контекст, выход до 384 тысяч токенов, веса линейки открыты под MIT.
Самое полезное из новости — не модель, а число 120. Если ваш провайдер даёт скидку за попадание в кэш, порядок частей промпта стоит дороже его длины. Если не даёт, как в нашем случае, — считайте по объёму и не ищите оптимизацию там, где её нет.
Как мы отделяем проверенное от предполагаемого — на странице о проекте. Актуальные ставки по всем 37 позициям отдаёт GET /v1/models, ключ заводится за минуту: keydealer.ru/login.
Частые вопросы
Что такое DeepSeek V4 Pro 0813?
Флагманская модель DeepSeek в архитектуре Mixture-of-Experts: 1,6 трлн параметров всего и около 49 млрд активных на токен. Контекст 1 048 576 токенов, максимальный выход 384 000. Сборка 0813 получила статус общедоступной в августе 2026 года.
Сколько она стоит?
0,435 доллара за миллион входных токенов при промахе кэша, 0,003625 доллара при попадании и 0,87 доллара за миллион выходных. По курсу ЦБ на 13 августа 2026 года (82,9977 ₽) это примерно 36,10 ₽, 0,30 ₽ и 72,21 ₽.
Почему кэш настолько дешевле?
Попадание в кэш стоит в 120 раз меньше промаха. Повторно отправленный контекст не пересчитывается заново, и вендор берёт за него символическую плату.
DeepSeek есть в каталоге KeyDealer?
Нет. На 13 августа 2026 года в каталоге 37 позиций — семейства Claude, GPT, Gemini, GLM, Grok, Kimi, Qwen и GPT Image. DeepSeek среди них нет ни в каком виде.
Правда ли, что веса открыты?
Линейка V4 была представлена в апреле 2026 года с открытыми весами Pro и Flash под лицензией MIT — одной из самых свободных из существующих.