Релизы и изменения моделей

DeepSeek отключила V4 Flash: имя осталось, модель другая

DeepSeek отключила V4 Flash: имя осталось, модель другая

10 сентября DeepSeek выпустила V4.1 Flash и в тот же день отключила модели предыдущего поколения — V4 Flash и V4 Flash Vision Exp. Имена deepseek-v4-flash и deepseek-v4-flash-vision-exp вендор пока принимает, но за ними стоит уже новая модель и её тариф. Флагманский deepseek-v4-pro должен был уйти туда же 14 сентября, но вендор объявленное отключение отменил — за сутки и без объяснения причин. Цена V4.1 Flash — $0,15 за миллион входных токенов и $0,60 за выходные в непиковые часы, вдвое дороже в пик; по курсу ЦБ на 10 сентября (85,4594 ₽) это 12,82 ₽ и 51,28 ₽. Главное здесь не цена, а механика: код не сломается, ошибки не будет, а отвечать станет другая модель.

Что DeepSeek изменила 10 сентября

Одним обновлением вендор сделал три вещи. Все они описаны в журнале изменений и на странице цен.

ЧтоПодробности
Вышла V4.1 FlashИмя модели deepseek-flash. Новая архитектура, нативное понимание изображений, контекст 1M, максимальный выход 384K
Отключены V4 Flash и V4 Flash Vision ExpИмена временно маршрутизируются на V4.1 Flash
Объявлено отключение V4 ProПосле 12:00 по Пекину 14 сентября 2026 года, позже отменено

Цены при этом снижены — вендор пишет об этом прямо, называя релиз причиной пересчёта.

А вот формулировка про V4 Pro интереснее. Про устаревание там не было ни слова — DeepSeek объясняла решение результатами тестов: по её замерам V4.1 Flash обходит V4 Pro сразу по четырём параметрам — качество, стоимость, скорость и суммарное время выполнения. То есть младшая модель нового поколения должна была заменить флагман старого. Через сутки вендор от этого отказался, и про отказ — отдельный раздел ниже. Что это была за модель и почему её выход из preview был событием, разбирали в августе.

Какие имена моделей DeepSeek больше не работают

Формально — никакие. Все три старых имени принимаются, и в этом вся проблема.

  • deepseek-v4-flash — модель отключена, имя ведёт на V4.1 Flash
  • deepseek-v4-flash-vision-exp — модель отключена, имя ведёт на V4.1 Flash
  • deepseek-v4-pro — работает, объявленный перевод на V4.1 Flash отменён

Вендор называет такую маршрутизацию временной и совместимостной. Слово «временно» тут ключевое: у него нет опубликованного срока. Значит, в какой-то момент имена перестанут приниматься совсем, и вот тогда придёт честная ошибка.

Асимметрия тут любопытная и после отмены стала ещё резче. Младшую модель отключили молча, окончательно и без предупреждения — про это можно узнать только постфактум из журнала изменений. Старшую сначала объявили к отключению за четыре дня, а потом передумали. Разное отношение к младшей и старшей модели, при том что технически происходило одно и то же.

Отключение V4 Pro объявили и отменили

10 сентября вендор написал, что после 12:00 по Пекину 14 сентября все запросы к deepseek-v4-pro уйдут на V4.1 Flash и будут тарифицироваться по её цене. В пересчёте это 04:00 UTC и 07:00 по Москве, понедельник.

11 сентября формулировка на странице тарифов изменилась на противоположную. Теперь там сказано, что в ответ на запросы пользователей DeepSeek продолжит обслуживать V4 Pro после 14 сентября, способ тарификации не меняется, а о любых изменениях вендор сообщит отдельно. Мы перечитали страницу 12 сентября — текст на месте.

Точного момента, когда решение поменялось, мы назвать не можем: сноска на странице не датирована, а в журнале изменений отдельной записи об отмене нет. Мы датируем своё чтение, а не чужое решение.

Для читателя практический итог такой: 14 сентября ничего не произойдёт, менять код под эту дату не нужно. Но обратите внимание, что произошло за двое суток. Сначала объявили отключение флагмана, потом отменили — и оба раза это была правка сноски на странице тарифов, а не отдельное объявление. Все даты отключений, которые мы отслеживаем по каталогу, собраны в календаре — там же видно, что по DeepSeek расписания у вендора раньше не было вовсе.

Отмена не отменяет главного. Модели, за которыми стоят имена deepseek-v4-flash и deepseek-v4-flash-vision-exp, по-прежнему отключены, а запросы к ним по-прежнему обслуживает другая модель. Подмена, о которой эта статья, никуда не делась — просто флагмана она пока не коснулась.

Сколько стоит DeepSeek V4.1 Flash в рублях

В непиковые часы — 12,82 ₽ за миллион входных токенов при промахе кэша и 51,28 ₽ за миллион выходных. В часы пик ровно вдвое дороже: 25,64 ₽ и 102,55 ₽. Пересчёт по курсу ЦБ на 10 сентября 2026 года — 85,4594 ₽ за доллар.

Непик ($)Пик ($)Непик (₽)Пик (₽)
Вход, промах кэша0,150,3012,8225,64
Вход, попадание в кэш0,0030,0060,260,51
Выход0,601,2051,28102,55

Для сравнения — уходящий V4 Pro на той же странице цен:

Непик ($)Пик ($)Непик (₽)Пик (₽)
Вход, промах кэша0,661,3256,40112,81
Вход, попадание в кэш0,0220,0441,883,76
Выход1,983,96169,21338,42

Отношения, посчитанные по этим числам: вход у Pro дороже в 4,4 раза, выход — в 3,3 раза. Попадание в кэш у Flash дешевле промаха в 50 раз, у Pro — в 30. Выход дороже входа вчетверо у Flash и втрое у Pro.

Тут пряталась ловушка, и она заслуживает внимания даже после отмены. Если бы перевод состоялся, счёт за V4 Pro упал бы в три-четыре раза — и это единственное, что заметила бы бухгалтерия. Метрика качества при этом могла пойти в любую сторону: вендорские бенчмарки замерялись вендором, на вашей задаче соотношение может оказаться другим. Резко подешевевший счёт без объяснения причин — это повод проверить, та ли модель отвечает, а не повод радоваться. Рублёвые ставки по всем семействам мы держим в одном месте, чтобы такие пересчёты не расползались по статьям.

Когда у DeepSeek часы пик и что это значит для Москвы

Окна не менялись с августа: с 01:00 до 04:00 и с 06:00 до 10:00 UTC, с понедельника по пятницу.

Часовой поясПервое окноВторое окно
UTC01:00–04:0006:00–10:00
Москва04:00–07:0009:00–13:00
Пекин09:00–12:0014:00–18:00

Всё прочее время — низкая ставка, выходные целиком по низкой. Получается 35 пиковых часов из 168 в неделе, то есть 20,8%. Пятая часть недели стоит вдвое дороже остальных четырёх пятых.

Для российского разработчика неприятна вторая строка. Второе окно, с 09:00 до 13:00 по Москве, — это первая половина рабочего дня. Ровно то время, когда сотрудники разгоняют дневную нагрузку, а фоновые задачи по расписанию обычно уже отработали ночью. Сама механика почасовых тарифов и то, что она ломает в учёте расходов, разобрана отдельно; первый случай такого тарифа, тоже у DeepSeek, мы описывали в августе.

Почему подмена модели опаснее ошибки 404

Ошибка видна. Подмена — нет.

Мы, кстати, поймали это не из новостей: сначала в суточном дифф-чеке машиночитаемых источников у старого имени изменилась структура цены, и только потом нашлась запись в журнале вендора. Новость дошла до лент через несколько часов после того, как подмена уже работала.

Когда имя модели перестаёт существовать, API возвращает отказ, отказ попадает в логи, логи попадают в мониторинг, и кто-то идёт разбираться. Неприятно, зато быстро.

Когда имя остаётся, а модель за ним меняется, не происходит ничего. Двухсотый код, валидный JSON, поле usage на месте. Меняются только ответы. Другой стиль, другая длина, другая склонность к вызову инструментов, другое поведение на краевых случаях — и всё это распределено по тысячам запросов, а не собрано в одну строку лога.

Проявляется это обычно так:

  1. Пользователи жалуются на «странные» ответы, но воспроизвести никто не может.
  2. Регрессионные тесты, если они на точное совпадение, начинают падать пачками без изменений в коде.
  3. Расход токенов на выход сдвигается — новая модель многословнее или, наоборот, короче.
  4. Промпты, вылизанные под старую модель, начинают работать хуже: они содержали обходы её конкретных особенностей.

Отдельная ловушка — vision. Прежняя V4 Flash была текстовой, и распознавание картинок жило в отдельной экспериментальной сборке. У V4.1 Flash понимание изображений встроено. Если у вас есть код, который отбраковывал картинки на входе, потому что «эта модель их не умеет», логика стала неверной — молча.

Что делать, если у вас в коде стоит deepseek-v4-flash

Коротко: сменить имя на актуальное явно и до этого снять слепок текущего поведения. Дальше по порядку, от быстрого к правильному.

  1. Найдите все места с именем модели. Не только конфиг: имена любят прятаться в переменных окружения, в миграциях, в тестовых фикстурах и в старых ветках.
  2. Зафиксируйте, какая версия отвечает сейчас. Прогоните десяток типовых запросов и сохраните ответы. Это ваша точка отсчёта — без неё через месяц вы не докажете, что поведение изменилось.
  3. Смените имя на актуальное явно. Полагаться на совместимостную маршрутизацию — значит зависеть от того, сколько вендор решит её держать.
  4. Перепроверьте промпты. Не переписывайте наугад: сначала прогоните старые на новой модели и посмотрите, что именно поехало.
  5. Пересчитайте бюджет по обеим ставкам. При почасовом тарифе средняя ставка врёт: считайте отдельно пиковый и непиковый профиль.
  6. Уберите допущения о возможностях из кода. Если где-то написано «эта модель не умеет картинки», это утверждение теперь надо перепроверить, а не унаследовать.

Пункт второй пропускают чаще всего, и зря. Слепок поведения до подмены стоит десяти часов последующих догадок.

Что это значит для каталога KeyDealer

В каталоге DeepSeek есть — на 12 сентября 2026 года под идентификатором deepseek-v4-flash, по 1 ₽ за миллион входных и столько же за миллион выходных токенов. Ставка одна на все сутки: почасовых окон у нас нет ни у одной позиции, и разница между четырьмя утра и полуднем по Москве в счёте не появляется.

Что стоит знать честно:

Проверка возможностей у этой позиции датирована 4 сентября. Тогда подтвердились чат, потоковая выдача, инструменты, обязательный выбор инструмента и продолжение диалога после результата инструмента. Поле vision у неё в статусе unknown — то есть «не проверяли», а не «не работает». Разницу между verified и unknown и почему её нельзя игнорировать, разбирали в материале про поля биллинга.

Кэш промптов не обещаем. У всех текстовых позиций каталога prompt_cache.status равен unsupported. Вендорская экономика кэша — попадание в 50 раз дешевле промаха — к нашему маршруту не относится.

Что делать практически. Если у вас длинная неизменная простыня контекста, повторяемая сотни раз, кэш вендора реально сэкономит, и считать надо у вендора. Если нагрузка обычная и разнородная, фиксированная рублёвая ставка без пиковых окон и без валютного пересчёта считается проще и не требует пересборки бюджета каждый раз, когда вендор двигает прайс. Проверить текущий состав каталога можно на странице моделей, а ключ выдаётся сразу после регистрации на keydealer.ru/login.

Чего мы не утверждаем

Мы не проверяли качество V4.1 Flash на собственных задачах. Все опубликованные результаты бенчмарков — замеры вендора его же харнессом, и переносить их на свою нагрузку без проверки не стоит.

Мы не знаем, до какого числа старые имена будут приниматься. В документации сказано «временно», конкретной даты нет.

Мы не знаем цены прежней V4 Flash у вендора: со страницы цен она убрана вместе с моделью, а сравнивать с показаниями агрегаторов нельзя — там своя наценка.

Мы не подтверждаем сроков выхода V4.1 Pro. Вендор пишет «в будущем», и это всё, что опубликовано.

Мы не знаем, когда именно вендор отменил отключение V4 Pro и почему. Сноска не датирована, отдельной записи в журнале изменений нет, а формулировка «в ответ на запросы пользователей» причиной в строгом смысле не является.

Что держать в голове

DeepSeek тут не главное. Главное — формулировка: имя модели больше не гарантирует модель.

Год назад отключение выглядело как дата и ошибка после неё. Теперь появился второй сценарий: имя живёт, а за ним меняют содержимое, и переход оформлен как забота о совместимости. А история с V4 Pro добавляет третий: объявленная дата может и не наступить, потому что решение поменяли правкой сноски. С точки зрения вендора это вежливо — ничей продакшен не падает в понедельник утром. С точки зрения того, кто отвечает за качество ответов, это худший из вариантов, потому что момент подмены не отражается нигде, кроме чужого журнала изменений.

Практический вывод простой и скучный: журнал изменений вендора надо читать так же регулярно, как счета. И держать под рукой слепок того, как ваша интеграция вела себя вчера, — потому что доказать изменение поведения задним числом без него невозможно.

Частые вопросы

Что произошло с DeepSeek 10 сентября 2026 года?

Вендор выпустил DeepSeek V4.1 Flash под именем `deepseek-flash` и одновременно отключил модели предыдущего поколения — V4 Flash и V4 Flash Vision Exp. Их имена временно принимаются, но запросы обслуживает уже новая модель.

Отключат ли DeepSeek V4 Pro 14 сентября?

Нет. Отключение было объявлено, а затем отменено: на странице тарифов вендора 12 сентября 2026 года сказано, что обслуживание V4 Pro продолжается после 14 сентября и способ тарификации не меняется.

Сколько стоит DeepSeek V4.1 Flash?

В непиковые часы 0,15 доллара за миллион входных токенов при промахе кэша и 0,60 за миллион выходных. В часы пик ровно вдвое дороже: 0,30 и 1,20. Попадание в кэш стоит 0,003 и 0,006 доллара.

Когда у DeepSeek часы пик?

С 01:00 до 04:00 и с 06:00 до 10:00 UTC по будням, то есть с 04:00 до 07:00 и с 09:00 до 13:00 по Москве. Всё остальное время, включая выходные целиком, тарифицируется по низкой ставке.

Что будет, если оставить в коде старое имя модели?

Запрос не упадёт. Он выполнится, но ответит другая модель, а счёт посчитается по её тарифу. Ошибки в логах не будет — именно поэтому такую подмену легко пропустить.

Чем DeepSeek V4.1 Flash отличается от V4 Flash?

V4.1 Flash построена на новой архитектуре и понимает изображения нативно, тогда как прежняя V4 Flash была текстовой, а распознавание картинок жило в отдельной экспериментальной сборке V4 Flash Vision Exp. Контекст у обеих 1M, максимальный выход 384K.

Есть ли DeepSeek в каталоге KeyDealer?

Да, под идентификатором `deepseek-v4-flash` по 1 ₽ за миллион входных и выходных токенов. Ставка фиксированная и от времени суток не зависит. Актуальные позиции всегда показывает GET /v1/models.

Источники