LLM API и интеграция

DeepSeek API: как подключить, цены и ограничения

DeepSeek API: как подключить, цены и ограничения

DeepSeek API подключается как OpenAI-совместимый: меняется адрес на https://api.deepseek.com, ключ и имя модели deepseek-flash. Контекст — миллион токенов, выход до 384 000. Главная особенность тарифа: цена зависит от времени суток, вне пиковых часов она ровно вдвое ниже. Из России оплата у вендора не проходит, а в каталоге KeyDealer позиция deepseek-v4-flash стоит 1 ₽ за миллион в обе стороны и без почасовых окон.

Ниже — что нужно для подключения, что модель умеет по документации вендора, как устроен почасовой тариф и чем маршруты отличаются на практике.

Что нужно для подключения

Три вещи, и ни одна не требует переписывать логику приложения.

Адрес. https://api.deepseek.com для клиентов формата OpenAI. Для клиентов формата Anthropic вендор публикует отдельный адрес https://api.deepseek.com/anthropic.

Ключ. Выдаётся в кабинете разработчика после регистрации и пополнения баланса.

Имя модели. deepseek-flash — это DeepSeek-V4.1-Flash. Вторая позиция — deepseek-v4-pro, за ней стоит сборка DeepSeek-V4-Pro-0813.

Пример запроса

Минимальный вызов через совместимый маршрут с рублёвой оплатой выглядит так.

curl https://api.keydealer.ru/v1/chat/completions \
  -H "Authorization: Bearer $KEYDEALER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Привет"}]}'

Тело запроса стандартное, поэтому библиотеки, написанные под OpenAI, работают без правок. Общий разбор первого вызова — в статье первый запрос к API нейросети.

Что модель умеет по документации вендора

Снимок таблицы возможностей на 11 сентября 2026 года.

ВозможностьFlashV4 Pro
Контекст1M1M
Максимум на выходе384K384K
Режим рассужденияесть, включён по умолчаниюесть, включён по умолчанию
Строгий JSONдада
Вызов инструментовдада
Responses APIдада
Формат Anthropicдада
Понимание изображенийдане поддерживается
Лимит параллельных запросов2 500500

Лимит параллельных запросов у Flash в пять раз выше — это важнее, чем кажется, если вы гоните пакетную обработку, а не диалог. Как считать, сколько запросов выдержит ваш сценарий, — в статье сколько запросов в час выдержит.

Почасовой тариф и что он означает

Ставки вендора за миллион токенов, в долларах и в рублях по курсу ЦБ на 11 сентября 2026 года — 84,3508 ₽.

ПозицияВне пика, $Пик, $Вне пика, ₽Пик, ₽
Flash, вход без кэша0,150,3012,6525,31
Flash, вход из кэша0,0030,0060,250,51
Flash, выход0,601,2050,61101,22
V4 Pro, вход без кэша0,661,3255,67111,34
V4 Pro, выход1,983,96167,01334,03

Пиковые часы — с 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу. В московском времени это 04:00–07:00 и 09:00–13:00. Остальные часы и все выходные считаются по половинной ставке.

Практический вывод простой: пакетную обработку, которой всё равно, когда выполняться, выгодно ставить на ночь или на выходные — счёт падает ровно вдвое. Механика почасовой цены разобрана отдельно в статье тариф по часам у DeepSeek.

Имена моделей: на что смотреть

В документации вендора есть две сноски, которые стоит прочитать до того, как зашивать имя модели в код.

Первая: старые имена deepseek-v4-flash и deepseek-v4-flash-vision-exp по-прежнему принимаются, но модели за ними отключены, а запросы обслуживает DeepSeek-V4.1-Flash по цене Flash. Ошибки при этом не возникает — ответ приходит от другой модели молча.

Вторая: вендор сообщил, что продолжит обслуживать deepseek-v4-pro после 14 сентября 2026 года без изменения тарификации, хотя ранее объявлял перевод этих запросов на V4.1 Flash.

Отсюда правило, которое работает не только с DeepSeek: имя модели — не гарантия того, что за ним стоит. Проверять стоит не название, а поведение на своих задачах. Разбор этой ловушки — в статье модель приезжает с датой отключения.

Что из этого работает из России

Регистрация в кабинете вендора проходит, а оплата российской картой — нет. Без пополненного баланса ключ выдаётся, но запросы отклоняются, поэтому рабочего маршрута напрямую не получается.

Обходной путь — совместимый шлюз с рублёвым биллингом. В каталоге KeyDealer на 11 сентября 2026 года есть позиция deepseek-v4-flash со ставкой 1 ₽ за миллион токенов в обе стороны, со статусом available и открытым протоколом chat_completions. Возможности проверены замером 4 сентября: подтверждены чат-эндпоинт, стриминг, инструменты, принудительный выбор инструмента и стриминг вместе с инструментами. Понимание изображений у позиции в статусе unknown — значит, мы этого не проверяли и не утверждаем.

Почасовых окон в нашем каталоге нет: ставка одна и та же круглосуточно, включая те часы, которые у вендора считаются пиковыми.

Как сократить счёт

Четыре приёма, которые работают именно на этой модели.

Выключайте рассуждение там, где оно не нужно. Режим включён по умолчанию и тратит токены на выходе, а выход дороже входа вчетверо. Для извлечения полей из текста или классификации рассуждение не улучшает результат, зато удваивает счёт.

Ограничивайте длину ответа параметром. Максимум в 384 000 токенов — это потолок возможностей, а не разумное значение по умолчанию. Явный лимит защищает от случая, когда модель уходит в длинное объяснение вместо ответа из одной строки.

Двигайте пакетную обработку за пределы пиковых окон. Ночной прогон по московскому времени попадает в половинную ставку целиком.

Не отправляйте весь документ, если нужен один раздел. Миллион контекста — это возможность, а не рекомендация: вы платите за каждый переданный токен, даже если модель использовала два абзаца из сорока страниц. Сколько контекста реально нужно, разобрано в статье сколько контекста реально нужно.

Что проверить перед переносом в прод

Короткий список, который экономит неделю разбирательств.

Зафиксируйте формат ответа параметром, а не просьбой в промпте. Проверьте поведение на пустом и на мусорном входе — модель должна возвращать предсказуемую ошибку, а не выдумывать ответ. Убедитесь, что таймаут клиента больше, чем время генерации длинного ответа с включённым рассуждением. И заведите отдельный ключ под эту нагрузку, чтобы расход был виден отдельно от остальных, а в случае утечки отзывался без остановки всего остального приложения.

Когда DeepSeek подходит, а когда нет

Подходит для объёмной рутины, где важна цена: извлечение данных, классификация, черновые тексты, работа с длинными документами. Миллион контекста здесь работает на вас.

Не подходит, если вам нужна гарантированно та же сборка модели через полгода. Линейка обновляется быстро, имена переиспользуются, и это осознанное решение вендора, а не случайность.

Спорно для ответственных задач с проверяемыми фактами: режим рассуждения включён по умолчанию и тратит токены на выходе, а выход дороже входа вчетверо.

Чего мы не утверждаем

Мы не публикуем бенчмарки вендора как независимый результат. Цифры качества в его анонсах — замеры самой лаборатории.

Мы не утверждаем, что наша позиция и прямой маршрут ведут себя одинаково на всех задачах: у нас нет почасовых окон и своя настройка параллелизма.

Вендорские ставки — снимок страницы на 11 сентября 2026 года. DeepSeek прямо пишет, что оставляет за собой право менять цены, поэтому сверяйтесь с их страницей перед расчётом бюджета.

Что нужно, чтобы начать

Ключ заводится за минуту на keydealer.ru/login — почта и пароль, без документов и без зарубежной карты. Оплата российской картой в рублях, один ключ на весь каталог.

Платные текстовые модели доступны сразу на приветственном бонусе: прогнать свою задачу на deepseek-v4-flash и посмотреть расход можно без пополнения.

Что держать в голове

Подключение — это адрес, ключ и имя модели, логика приложения не меняется.

У вендора цена зависит от часа: вне пика ровно вдвое дешевле, и пакетную работу выгодно двигать в это окно.

Имена моделей у DeepSeek переиспользуются, поэтому проверять нужно поведение, а не название. Как мы проверяем факты и почему у каждой цифры стоит дата — на странице о проекте. Завести ключ: keydealer.ru/login.

Частые вопросы

Как подключить DeepSeek API?

Формат совместим с OpenAI: в клиенте меняется адрес на https://api.deepseek.com, подставляется ключ и имя модели deepseek-flash. Для клиентов формата Anthropic вендор публикует отдельный адрес https://api.deepseek.com/anthropic.

Какой контекст у DeepSeek?

Миллион токенов контекста и до 384 000 токенов на выходе. Режим рассуждения включён по умолчанию и переключается параметром.

Сколько стоит DeepSeek API?

По прайсу вендора на 11 сентября 2026 года у Flash миллион входных токенов без попадания в кэш стоит 0,15 доллара вне пиковых часов и 0,30 в пик, выход — 0,60 и 1,20. Цены в пиковые часы ровно вдвое выше.

Когда у DeepSeek пиковые часы?

С 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу. По московскому времени это 04:00–07:00 и 09:00–13:00. Всё остальное время, включая выходные, тарифицируется по половинной ставке.

Работает ли оплата DeepSeek из России?

Напрямую оплатить российской картой не получится. Доступ к модели с рублёвой оплатой даёт совместимый шлюз — позиция deepseek-v4-flash есть в каталоге KeyDealer.

Поддерживает ли DeepSeek вызов функций?

Да. В документации вендора у обеих моделей отмечены вызов инструментов, строгий JSON, Responses API и формат Anthropic.

Источники