LLM API и интеграция
DeepSeek API: как подключить, цены и ограничения
DeepSeek API подключается как OpenAI-совместимый: меняется адрес на https://api.deepseek.com, ключ и имя модели deepseek-flash. Контекст — миллион токенов, выход до 384 000. Главная особенность тарифа: цена зависит от времени суток, вне пиковых часов она ровно вдвое ниже. Из России оплата у вендора не проходит, а в каталоге KeyDealer позиция deepseek-v4-flash стоит 1 ₽ за миллион в обе стороны и без почасовых окон.
Ниже — что нужно для подключения, что модель умеет по документации вендора, как устроен почасовой тариф и чем маршруты отличаются на практике.
Что нужно для подключения
Три вещи, и ни одна не требует переписывать логику приложения.
Адрес. https://api.deepseek.com для клиентов формата OpenAI. Для клиентов формата Anthropic вендор публикует отдельный адрес https://api.deepseek.com/anthropic.
Ключ. Выдаётся в кабинете разработчика после регистрации и пополнения баланса.
Имя модели. deepseek-flash — это DeepSeek-V4.1-Flash. Вторая позиция — deepseek-v4-pro, за ней стоит сборка DeepSeek-V4-Pro-0813.
Пример запроса
Минимальный вызов через совместимый маршрут с рублёвой оплатой выглядит так.
curl https://api.keydealer.ru/v1/chat/completions \
-H "Authorization: Bearer $KEYDEALER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"deepseek-v4-flash","messages":[{"role":"user","content":"Привет"}]}'
Тело запроса стандартное, поэтому библиотеки, написанные под OpenAI, работают без правок. Общий разбор первого вызова — в статье первый запрос к API нейросети.
Что модель умеет по документации вендора
Снимок таблицы возможностей на 11 сентября 2026 года.
| Возможность | Flash | V4 Pro |
|---|---|---|
| Контекст | 1M | 1M |
| Максимум на выходе | 384K | 384K |
| Режим рассуждения | есть, включён по умолчанию | есть, включён по умолчанию |
| Строгий JSON | да | да |
| Вызов инструментов | да | да |
| Responses API | да | да |
| Формат Anthropic | да | да |
| Понимание изображений | да | не поддерживается |
| Лимит параллельных запросов | 2 500 | 500 |
Лимит параллельных запросов у Flash в пять раз выше — это важнее, чем кажется, если вы гоните пакетную обработку, а не диалог. Как считать, сколько запросов выдержит ваш сценарий, — в статье сколько запросов в час выдержит.
Почасовой тариф и что он означает
Ставки вендора за миллион токенов, в долларах и в рублях по курсу ЦБ на 11 сентября 2026 года — 84,3508 ₽.
| Позиция | Вне пика, $ | Пик, $ | Вне пика, ₽ | Пик, ₽ |
|---|---|---|---|---|
| Flash, вход без кэша | 0,15 | 0,30 | 12,65 | 25,31 |
| Flash, вход из кэша | 0,003 | 0,006 | 0,25 | 0,51 |
| Flash, выход | 0,60 | 1,20 | 50,61 | 101,22 |
| V4 Pro, вход без кэша | 0,66 | 1,32 | 55,67 | 111,34 |
| V4 Pro, выход | 1,98 | 3,96 | 167,01 | 334,03 |
Пиковые часы — с 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу. В московском времени это 04:00–07:00 и 09:00–13:00. Остальные часы и все выходные считаются по половинной ставке.
Практический вывод простой: пакетную обработку, которой всё равно, когда выполняться, выгодно ставить на ночь или на выходные — счёт падает ровно вдвое. Механика почасовой цены разобрана отдельно в статье тариф по часам у DeepSeek.
Имена моделей: на что смотреть
В документации вендора есть две сноски, которые стоит прочитать до того, как зашивать имя модели в код.
Первая: старые имена deepseek-v4-flash и deepseek-v4-flash-vision-exp по-прежнему принимаются, но модели за ними отключены, а запросы обслуживает DeepSeek-V4.1-Flash по цене Flash. Ошибки при этом не возникает — ответ приходит от другой модели молча.
Вторая: вендор сообщил, что продолжит обслуживать deepseek-v4-pro после 14 сентября 2026 года без изменения тарификации, хотя ранее объявлял перевод этих запросов на V4.1 Flash.
Отсюда правило, которое работает не только с DeepSeek: имя модели — не гарантия того, что за ним стоит. Проверять стоит не название, а поведение на своих задачах. Разбор этой ловушки — в статье модель приезжает с датой отключения.
Что из этого работает из России
Регистрация в кабинете вендора проходит, а оплата российской картой — нет. Без пополненного баланса ключ выдаётся, но запросы отклоняются, поэтому рабочего маршрута напрямую не получается.
Обходной путь — совместимый шлюз с рублёвым биллингом. В каталоге KeyDealer на 11 сентября 2026 года есть позиция deepseek-v4-flash со ставкой 1 ₽ за миллион токенов в обе стороны, со статусом available и открытым протоколом chat_completions. Возможности проверены замером 4 сентября: подтверждены чат-эндпоинт, стриминг, инструменты, принудительный выбор инструмента и стриминг вместе с инструментами. Понимание изображений у позиции в статусе unknown — значит, мы этого не проверяли и не утверждаем.
Почасовых окон в нашем каталоге нет: ставка одна и та же круглосуточно, включая те часы, которые у вендора считаются пиковыми.
Как сократить счёт
Четыре приёма, которые работают именно на этой модели.
Выключайте рассуждение там, где оно не нужно. Режим включён по умолчанию и тратит токены на выходе, а выход дороже входа вчетверо. Для извлечения полей из текста или классификации рассуждение не улучшает результат, зато удваивает счёт.
Ограничивайте длину ответа параметром. Максимум в 384 000 токенов — это потолок возможностей, а не разумное значение по умолчанию. Явный лимит защищает от случая, когда модель уходит в длинное объяснение вместо ответа из одной строки.
Двигайте пакетную обработку за пределы пиковых окон. Ночной прогон по московскому времени попадает в половинную ставку целиком.
Не отправляйте весь документ, если нужен один раздел. Миллион контекста — это возможность, а не рекомендация: вы платите за каждый переданный токен, даже если модель использовала два абзаца из сорока страниц. Сколько контекста реально нужно, разобрано в статье сколько контекста реально нужно.
Что проверить перед переносом в прод
Короткий список, который экономит неделю разбирательств.
Зафиксируйте формат ответа параметром, а не просьбой в промпте. Проверьте поведение на пустом и на мусорном входе — модель должна возвращать предсказуемую ошибку, а не выдумывать ответ. Убедитесь, что таймаут клиента больше, чем время генерации длинного ответа с включённым рассуждением. И заведите отдельный ключ под эту нагрузку, чтобы расход был виден отдельно от остальных, а в случае утечки отзывался без остановки всего остального приложения.
Когда DeepSeek подходит, а когда нет
Подходит для объёмной рутины, где важна цена: извлечение данных, классификация, черновые тексты, работа с длинными документами. Миллион контекста здесь работает на вас.
Не подходит, если вам нужна гарантированно та же сборка модели через полгода. Линейка обновляется быстро, имена переиспользуются, и это осознанное решение вендора, а не случайность.
Спорно для ответственных задач с проверяемыми фактами: режим рассуждения включён по умолчанию и тратит токены на выходе, а выход дороже входа вчетверо.
Чего мы не утверждаем
Мы не публикуем бенчмарки вендора как независимый результат. Цифры качества в его анонсах — замеры самой лаборатории.
Мы не утверждаем, что наша позиция и прямой маршрут ведут себя одинаково на всех задачах: у нас нет почасовых окон и своя настройка параллелизма.
Вендорские ставки — снимок страницы на 11 сентября 2026 года. DeepSeek прямо пишет, что оставляет за собой право менять цены, поэтому сверяйтесь с их страницей перед расчётом бюджета.
Что нужно, чтобы начать
Ключ заводится за минуту на keydealer.ru/login — почта и пароль, без документов и без зарубежной карты. Оплата российской картой в рублях, один ключ на весь каталог.
Платные текстовые модели доступны сразу на приветственном бонусе: прогнать свою задачу на deepseek-v4-flash и посмотреть расход можно без пополнения.
Что держать в голове
Подключение — это адрес, ключ и имя модели, логика приложения не меняется.
У вендора цена зависит от часа: вне пика ровно вдвое дешевле, и пакетную работу выгодно двигать в это окно.
Имена моделей у DeepSeek переиспользуются, поэтому проверять нужно поведение, а не название. Как мы проверяем факты и почему у каждой цифры стоит дата — на странице о проекте. Завести ключ: keydealer.ru/login.
Частые вопросы
Как подключить DeepSeek API?
Формат совместим с OpenAI: в клиенте меняется адрес на https://api.deepseek.com, подставляется ключ и имя модели deepseek-flash. Для клиентов формата Anthropic вендор публикует отдельный адрес https://api.deepseek.com/anthropic.
Какой контекст у DeepSeek?
Миллион токенов контекста и до 384 000 токенов на выходе. Режим рассуждения включён по умолчанию и переключается параметром.
Сколько стоит DeepSeek API?
По прайсу вендора на 11 сентября 2026 года у Flash миллион входных токенов без попадания в кэш стоит 0,15 доллара вне пиковых часов и 0,30 в пик, выход — 0,60 и 1,20. Цены в пиковые часы ровно вдвое выше.
Когда у DeepSeek пиковые часы?
С 01:00 до 04:00 и с 06:00 до 10:00 UTC с понедельника по пятницу. По московскому времени это 04:00–07:00 и 09:00–13:00. Всё остальное время, включая выходные, тарифицируется по половинной ставке.
Работает ли оплата DeepSeek из России?
Напрямую оплатить российской картой не получится. Доступ к модели с рублёвой оплатой даёт совместимый шлюз — позиция deepseek-v4-flash есть в каталоге KeyDealer.
Поддерживает ли DeepSeek вызов функций?
Да. В документации вендора у обеих моделей отмечены вызов инструментов, строгий JSON, Responses API и формат Anthropic.