Релизы и изменения моделей
DeepSeek отключила V4 Flash: имя осталось, модель другая
10 сентября DeepSeek выпустила V4.1 Flash и в тот же день отключила модели предыдущего поколения — V4 Flash и V4 Flash Vision Exp. Имена deepseek-v4-flash и deepseek-v4-flash-vision-exp вендор пока принимает, но за ними стоит уже новая модель и её тариф. Флагманский deepseek-v4-pro должен был уйти туда же 14 сентября, но вендор объявленное отключение отменил — за сутки и без объяснения причин. Цена V4.1 Flash — $0,15 за миллион входных токенов и $0,60 за выходные в непиковые часы, вдвое дороже в пик; по курсу ЦБ на 10 сентября (85,4594 ₽) это 12,82 ₽ и 51,28 ₽. Главное здесь не цена, а механика: код не сломается, ошибки не будет, а отвечать станет другая модель.
Что DeepSeek изменила 10 сентября
Одним обновлением вендор сделал три вещи. Все они описаны в журнале изменений и на странице цен.
| Что | Подробности |
|---|---|
| Вышла V4.1 Flash | Имя модели deepseek-flash. Новая архитектура, нативное понимание изображений, контекст 1M, максимальный выход 384K |
| Отключены V4 Flash и V4 Flash Vision Exp | Имена временно маршрутизируются на V4.1 Flash |
| Объявлено отключение V4 Pro | После 12:00 по Пекину 14 сентября 2026 года, позже отменено |
Цены при этом снижены — вендор пишет об этом прямо, называя релиз причиной пересчёта.
А вот формулировка про V4 Pro интереснее. Про устаревание там не было ни слова — DeepSeek объясняла решение результатами тестов: по её замерам V4.1 Flash обходит V4 Pro сразу по четырём параметрам — качество, стоимость, скорость и суммарное время выполнения. То есть младшая модель нового поколения должна была заменить флагман старого. Через сутки вендор от этого отказался, и про отказ — отдельный раздел ниже. Что это была за модель и почему её выход из preview был событием, разбирали в августе.
Какие имена моделей DeepSeek больше не работают
Формально — никакие. Все три старых имени принимаются, и в этом вся проблема.
deepseek-v4-flash— модель отключена, имя ведёт на V4.1 Flashdeepseek-v4-flash-vision-exp— модель отключена, имя ведёт на V4.1 Flashdeepseek-v4-pro— работает, объявленный перевод на V4.1 Flash отменён
Вендор называет такую маршрутизацию временной и совместимостной. Слово «временно» тут ключевое: у него нет опубликованного срока. Значит, в какой-то момент имена перестанут приниматься совсем, и вот тогда придёт честная ошибка.
Асимметрия тут любопытная и после отмены стала ещё резче. Младшую модель отключили молча, окончательно и без предупреждения — про это можно узнать только постфактум из журнала изменений. Старшую сначала объявили к отключению за четыре дня, а потом передумали. Разное отношение к младшей и старшей модели, при том что технически происходило одно и то же.
Отключение V4 Pro объявили и отменили
10 сентября вендор написал, что после 12:00 по Пекину 14 сентября все запросы к deepseek-v4-pro уйдут на V4.1 Flash и будут тарифицироваться по её цене. В пересчёте это 04:00 UTC и 07:00 по Москве, понедельник.
11 сентября формулировка на странице тарифов изменилась на противоположную. Теперь там сказано, что в ответ на запросы пользователей DeepSeek продолжит обслуживать V4 Pro после 14 сентября, способ тарификации не меняется, а о любых изменениях вендор сообщит отдельно. Мы перечитали страницу 12 сентября — текст на месте.
Точного момента, когда решение поменялось, мы назвать не можем: сноска на странице не датирована, а в журнале изменений отдельной записи об отмене нет. Мы датируем своё чтение, а не чужое решение.
Для читателя практический итог такой: 14 сентября ничего не произойдёт, менять код под эту дату не нужно. Но обратите внимание, что произошло за двое суток. Сначала объявили отключение флагмана, потом отменили — и оба раза это была правка сноски на странице тарифов, а не отдельное объявление. Все даты отключений, которые мы отслеживаем по каталогу, собраны в календаре — там же видно, что по DeepSeek расписания у вендора раньше не было вовсе.
Отмена не отменяет главного. Модели, за которыми стоят имена deepseek-v4-flash и deepseek-v4-flash-vision-exp, по-прежнему отключены, а запросы к ним по-прежнему обслуживает другая модель. Подмена, о которой эта статья, никуда не делась — просто флагмана она пока не коснулась.
Сколько стоит DeepSeek V4.1 Flash в рублях
В непиковые часы — 12,82 ₽ за миллион входных токенов при промахе кэша и 51,28 ₽ за миллион выходных. В часы пик ровно вдвое дороже: 25,64 ₽ и 102,55 ₽. Пересчёт по курсу ЦБ на 10 сентября 2026 года — 85,4594 ₽ за доллар.
| Непик ($) | Пик ($) | Непик (₽) | Пик (₽) | |
|---|---|---|---|---|
| Вход, промах кэша | 0,15 | 0,30 | 12,82 | 25,64 |
| Вход, попадание в кэш | 0,003 | 0,006 | 0,26 | 0,51 |
| Выход | 0,60 | 1,20 | 51,28 | 102,55 |
Для сравнения — уходящий V4 Pro на той же странице цен:
| Непик ($) | Пик ($) | Непик (₽) | Пик (₽) | |
|---|---|---|---|---|
| Вход, промах кэша | 0,66 | 1,32 | 56,40 | 112,81 |
| Вход, попадание в кэш | 0,022 | 0,044 | 1,88 | 3,76 |
| Выход | 1,98 | 3,96 | 169,21 | 338,42 |
Отношения, посчитанные по этим числам: вход у Pro дороже в 4,4 раза, выход — в 3,3 раза. Попадание в кэш у Flash дешевле промаха в 50 раз, у Pro — в 30. Выход дороже входа вчетверо у Flash и втрое у Pro.
Тут пряталась ловушка, и она заслуживает внимания даже после отмены. Если бы перевод состоялся, счёт за V4 Pro упал бы в три-четыре раза — и это единственное, что заметила бы бухгалтерия. Метрика качества при этом могла пойти в любую сторону: вендорские бенчмарки замерялись вендором, на вашей задаче соотношение может оказаться другим. Резко подешевевший счёт без объяснения причин — это повод проверить, та ли модель отвечает, а не повод радоваться. Рублёвые ставки по всем семействам мы держим в одном месте, чтобы такие пересчёты не расползались по статьям.
Когда у DeepSeek часы пик и что это значит для Москвы
Окна не менялись с августа: с 01:00 до 04:00 и с 06:00 до 10:00 UTC, с понедельника по пятницу.
| Часовой пояс | Первое окно | Второе окно |
|---|---|---|
| UTC | 01:00–04:00 | 06:00–10:00 |
| Москва | 04:00–07:00 | 09:00–13:00 |
| Пекин | 09:00–12:00 | 14:00–18:00 |
Всё прочее время — низкая ставка, выходные целиком по низкой. Получается 35 пиковых часов из 168 в неделе, то есть 20,8%. Пятая часть недели стоит вдвое дороже остальных четырёх пятых.
Для российского разработчика неприятна вторая строка. Второе окно, с 09:00 до 13:00 по Москве, — это первая половина рабочего дня. Ровно то время, когда сотрудники разгоняют дневную нагрузку, а фоновые задачи по расписанию обычно уже отработали ночью. Сама механика почасовых тарифов и то, что она ломает в учёте расходов, разобрана отдельно; первый случай такого тарифа, тоже у DeepSeek, мы описывали в августе.
Почему подмена модели опаснее ошибки 404
Ошибка видна. Подмена — нет.
Мы, кстати, поймали это не из новостей: сначала в суточном дифф-чеке машиночитаемых источников у старого имени изменилась структура цены, и только потом нашлась запись в журнале вендора. Новость дошла до лент через несколько часов после того, как подмена уже работала.
Когда имя модели перестаёт существовать, API возвращает отказ, отказ попадает в логи, логи попадают в мониторинг, и кто-то идёт разбираться. Неприятно, зато быстро.
Когда имя остаётся, а модель за ним меняется, не происходит ничего. Двухсотый код, валидный JSON, поле usage на месте. Меняются только ответы. Другой стиль, другая длина, другая склонность к вызову инструментов, другое поведение на краевых случаях — и всё это распределено по тысячам запросов, а не собрано в одну строку лога.
Проявляется это обычно так:
- Пользователи жалуются на «странные» ответы, но воспроизвести никто не может.
- Регрессионные тесты, если они на точное совпадение, начинают падать пачками без изменений в коде.
- Расход токенов на выход сдвигается — новая модель многословнее или, наоборот, короче.
- Промпты, вылизанные под старую модель, начинают работать хуже: они содержали обходы её конкретных особенностей.
Отдельная ловушка — vision. Прежняя V4 Flash была текстовой, и распознавание картинок жило в отдельной экспериментальной сборке. У V4.1 Flash понимание изображений встроено. Если у вас есть код, который отбраковывал картинки на входе, потому что «эта модель их не умеет», логика стала неверной — молча.
Что делать, если у вас в коде стоит deepseek-v4-flash
Коротко: сменить имя на актуальное явно и до этого снять слепок текущего поведения. Дальше по порядку, от быстрого к правильному.
- Найдите все места с именем модели. Не только конфиг: имена любят прятаться в переменных окружения, в миграциях, в тестовых фикстурах и в старых ветках.
- Зафиксируйте, какая версия отвечает сейчас. Прогоните десяток типовых запросов и сохраните ответы. Это ваша точка отсчёта — без неё через месяц вы не докажете, что поведение изменилось.
- Смените имя на актуальное явно. Полагаться на совместимостную маршрутизацию — значит зависеть от того, сколько вендор решит её держать.
- Перепроверьте промпты. Не переписывайте наугад: сначала прогоните старые на новой модели и посмотрите, что именно поехало.
- Пересчитайте бюджет по обеим ставкам. При почасовом тарифе средняя ставка врёт: считайте отдельно пиковый и непиковый профиль.
- Уберите допущения о возможностях из кода. Если где-то написано «эта модель не умеет картинки», это утверждение теперь надо перепроверить, а не унаследовать.
Пункт второй пропускают чаще всего, и зря. Слепок поведения до подмены стоит десяти часов последующих догадок.
Что это значит для каталога KeyDealer
В каталоге DeepSeek есть — на 12 сентября 2026 года под идентификатором deepseek-v4-flash, по 1 ₽ за миллион входных и столько же за миллион выходных токенов. Ставка одна на все сутки: почасовых окон у нас нет ни у одной позиции, и разница между четырьмя утра и полуднем по Москве в счёте не появляется.
Что стоит знать честно:
Проверка возможностей у этой позиции датирована 4 сентября. Тогда подтвердились чат, потоковая выдача, инструменты, обязательный выбор инструмента и продолжение диалога после результата инструмента. Поле vision у неё в статусе unknown — то есть «не проверяли», а не «не работает». Разницу между verified и unknown и почему её нельзя игнорировать, разбирали в материале про поля биллинга.
Кэш промптов не обещаем. У всех текстовых позиций каталога prompt_cache.status равен unsupported. Вендорская экономика кэша — попадание в 50 раз дешевле промаха — к нашему маршруту не относится.
Что делать практически. Если у вас длинная неизменная простыня контекста, повторяемая сотни раз, кэш вендора реально сэкономит, и считать надо у вендора. Если нагрузка обычная и разнородная, фиксированная рублёвая ставка без пиковых окон и без валютного пересчёта считается проще и не требует пересборки бюджета каждый раз, когда вендор двигает прайс. Проверить текущий состав каталога можно на странице моделей, а ключ выдаётся сразу после регистрации на keydealer.ru/login.
Чего мы не утверждаем
Мы не проверяли качество V4.1 Flash на собственных задачах. Все опубликованные результаты бенчмарков — замеры вендора его же харнессом, и переносить их на свою нагрузку без проверки не стоит.
Мы не знаем, до какого числа старые имена будут приниматься. В документации сказано «временно», конкретной даты нет.
Мы не знаем цены прежней V4 Flash у вендора: со страницы цен она убрана вместе с моделью, а сравнивать с показаниями агрегаторов нельзя — там своя наценка.
Мы не подтверждаем сроков выхода V4.1 Pro. Вендор пишет «в будущем», и это всё, что опубликовано.
Мы не знаем, когда именно вендор отменил отключение V4 Pro и почему. Сноска не датирована, отдельной записи в журнале изменений нет, а формулировка «в ответ на запросы пользователей» причиной в строгом смысле не является.
Что держать в голове
DeepSeek тут не главное. Главное — формулировка: имя модели больше не гарантирует модель.
Год назад отключение выглядело как дата и ошибка после неё. Теперь появился второй сценарий: имя живёт, а за ним меняют содержимое, и переход оформлен как забота о совместимости. А история с V4 Pro добавляет третий: объявленная дата может и не наступить, потому что решение поменяли правкой сноски. С точки зрения вендора это вежливо — ничей продакшен не падает в понедельник утром. С точки зрения того, кто отвечает за качество ответов, это худший из вариантов, потому что момент подмены не отражается нигде, кроме чужого журнала изменений.
Практический вывод простой и скучный: журнал изменений вендора надо читать так же регулярно, как счета. И держать под рукой слепок того, как ваша интеграция вела себя вчера, — потому что доказать изменение поведения задним числом без него невозможно.
Частые вопросы
Что произошло с DeepSeek 10 сентября 2026 года?
Вендор выпустил DeepSeek V4.1 Flash под именем `deepseek-flash` и одновременно отключил модели предыдущего поколения — V4 Flash и V4 Flash Vision Exp. Их имена временно принимаются, но запросы обслуживает уже новая модель.
Отключат ли DeepSeek V4 Pro 14 сентября?
Нет. Отключение было объявлено, а затем отменено: на странице тарифов вендора 12 сентября 2026 года сказано, что обслуживание V4 Pro продолжается после 14 сентября и способ тарификации не меняется.
Сколько стоит DeepSeek V4.1 Flash?
В непиковые часы 0,15 доллара за миллион входных токенов при промахе кэша и 0,60 за миллион выходных. В часы пик ровно вдвое дороже: 0,30 и 1,20. Попадание в кэш стоит 0,003 и 0,006 доллара.
Когда у DeepSeek часы пик?
С 01:00 до 04:00 и с 06:00 до 10:00 UTC по будням, то есть с 04:00 до 07:00 и с 09:00 до 13:00 по Москве. Всё остальное время, включая выходные целиком, тарифицируется по низкой ставке.
Что будет, если оставить в коде старое имя модели?
Запрос не упадёт. Он выполнится, но ответит другая модель, а счёт посчитается по её тарифу. Ошибки в логах не будет — именно поэтому такую подмену легко пропустить.
Чем DeepSeek V4.1 Flash отличается от V4 Flash?
V4.1 Flash построена на новой архитектуре и понимает изображения нативно, тогда как прежняя V4 Flash была текстовой, а распознавание картинок жило в отдельной экспериментальной сборке V4 Flash Vision Exp. Контекст у обеих 1M, максимальный выход 384K.
Есть ли DeepSeek в каталоге KeyDealer?
Да, под идентификатором `deepseek-v4-flash` по 1 ₽ за миллион входных и выходных токенов. Ставка фиксированная и от времени суток не зависит. Актуальные позиции всегда показывает GET /v1/models.