LLM API и интеграция

Qwen API: как подключить, цены и ограничения

Qwen API: как подключить, цены и ограничения

Qwen API подключается как OpenAI-совместимый: меняются адрес, ключ и имя модели, код остаётся прежним. Семейство приехало в каталог KeyDealer 12 сентября 2026 года сразу четырьмя позициями — qwen-3-8-max, qwen-3-7-max, qwen-3-7-plus и qwen-3-6-flash, — и все четыре идут по ставке 3 ₽ за миллион токенов, одинаково на вход и на выход. Вызов функций подтверждён замером у всех четырёх; принудительный выбор инструмента у qwen-3-8-max и qwen-3-7-plus помечен как неподдерживаемый.

Ниже разобрано, что нужно для первого запроса, чем четыре позиции различаются между собой при одинаковой цене, где у семейства проходит граница проверенного и что чаще всего ломается при переносе кода с другого маршрута.

Что нужно для подключения

Адрес. Эндпоинт чата совместим с форматом OpenAI: https://api.keydealer.ru/v1/chat/completions. Библиотеки, написанные под OpenAI, работают без правок — меняется базовый URL, а не логика вызова.

Ключ. Один ключ на весь каталог, без отдельной регистрации под каждое семейство. Где его хранить и почему не в коде — разобрано в статье как хранить API-ключи.

Имя модели. Ровно то, что стоит в каталоге, символ в символ: qwen-3-8-max, qwen-3-7-max, qwen-3-7-plus, qwen-3-6-flash. Разделитель — дефис, не точка.

Больше ничего. Ни SDK семейства, ни отдельного домена, ни своего формата тела запроса.

Первый запрос

curl https://api.keydealer.ru/v1/chat/completions \
  -H "Authorization: Bearer $KEYDEALER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"qwen-3-8-max","messages":[{"role":"user","content":"Привет"}]}'

Тело стандартное: model, messages, дальше по вкусу — temperature, max_tokens, stream, tools. Если вы переезжаете с другого маршрута, правятся две строки: адрес и ключ. Пошаговый разбор самого первого вызова — в статье первый запрос к API нейросети, а общая механика переезда — в статье переход с OpenAI на совместимый API.

Четыре позиции по одной цене: в чём тогда разница

Обычно в линейке цена и есть подсказка: дороже — старше. Здесь этой подсказки нет, все четыре позиции стоят одинаково. Значит, выбирать приходится по назначению.

Имена в семействе следуют лестнице maxplusflash, и она читается так.

qwen-3-8-max — старшая и самая свежая позиция линейки. Её место — задачи, где ответ строится в несколько шагов: разбор длинного текста с выводами, анализ, планирование работы агента.

qwen-3-7-max — предыдущая старшая. Тот же класс задач, другое поколение. Держать её в каталоге имеет смысл ровно потому, что поведение моделей между поколениями меняется, и иногда старое поведение — то, под которое написан ваш промпт.

qwen-3-7-plus — средняя ступень: заметно быстрее старших на типовых задачах и достаточная там, где не нужна длинная цепочка рассуждений. Переводы, переписывание, структурирование текста.

qwen-3-6-flash — быстрая позиция под частые короткие ответы: классификация, теги, извлечение полей, ответы из готового контекста.

Это чтение лестницы имён, а не результат нашего замера качества. Мы не ранжируем позиции по «уму» и не публикуем чужие бенчмарки как свои. Правильный способ выбрать — прогнать одну и ту же задачу через все четыре и сравнить, методика описана в статье как сравнивать модели.

Ставки в каталоге

На 12 сентября 2026 года, рубли за миллион токенов, одинаково на вход и на выход.

Модель₽ за миллионПод что берут
qwen-3-6-flash3короткие частые ответы, классификация
qwen-3-7-plus3середина: переводы, переписывание, структурирование
qwen-3-7-max3старшая предыдущего поколения
qwen-3-8-max3старшая и самая свежая в линейке

Ставка рублёвая и зафиксирована: она не двигается вслед за курсом доллара. Для справки, курс ЦБ на 12 сентября 2026 года — 84,2569 ₽. Как ставка за миллион превращается в счёт за конкретный диалог — в статье сколько стоит 1M токенов в рублях.

Одинаковая цена внутри семейства даёт редкую свободу: можно поставить старшую позицию на весь трафик и не считать экономию от понижения. Расход вырастет только за счёт длины ответов, а не за счёт ставки.

Вызов функций: что подтверждено и где граница

Вызов функций (tools) подтверждён нашим замером у всех четырёх позиций. Это значит, что модель принимает описание инструментов и возвращает структурированный запрос на вызов — базовый механизм агентов работает. Как он устроен, разобрано в статье function calling в API.

Теперь прямо об ограничении. У qwen-3-8-max и qwen-3-7-plus принудительный выбор инструмента — forced_tool_choice — в каталоге помечен как не поддерживаемый. Это отдельная от tools возможность: она позволяет сказать модели «на этом шаге обязан быть вызван вот этот инструмент, текстом не отвечай». На двух названных позициях так сделать нельзя: модель решает сама, звать инструмент или ответить текстом.

Для части пайплайнов это безразлично, для части — блокер. Если ваш код после запроса сразу читает tool_calls[0] и падает, когда его нет, вы поймаете ошибку не на подключении, а на первом же нетипичном вводе.

Что с этим делать, по убыванию простоты:

Взять позицию без ограничения. У qwen-3-7-max и qwen-3-6-flash такой пометки нет. Цена та же, переезд — замена строки с именем модели.

Перестроить шаг на строгий JSON. Там, где инструмент по сути один и нужен просто разбор ответа в поля, принуждение к вызову вообще лишнее: достаточно схемы ответа. Подход описан в статье строгий JSON от нейросети.

Оставить ветку на текстовый ответ. Даже с поддержкой принуждения обработчик «модель ответила текстом вместо вызова» должен быть, иначе продовый агент однажды остановится на пустом месте.

Какие ещё позиции каталога умеют вызов функций — перечислено в статье какие модели поддерживают вызов функций.

Понимание изображений: не проверяли

У всех четырёх позиций Qwen статус понимания изображений — unknown. Формулировка честная и означает ровно одно: замера не было. Мы не утверждаем ни поддержки, ни её отсутствия, и не советуем строить продовый сценарий на предположении.

Если картинки на входе нужны сегодня, в каталоге есть позиции с подтверждённым замером — их список и то, как мы вообще это проверяем, в статье vision появился в каталоге.

Частые ошибки при подключении

Точки вместо дефисов в имени. В документации вендоров такие модели часто пишут через точку. В каталоге разделитель — дефис. qwen-3.8-max вернёт ошибку про неизвестную модель, а не про опечатку.

Ожидание суффикса latest. Подвижных алиасов у нас нет ни у одного семейства: имя указывает на конкретную позицию и не переезжает под вами. Для прода это плюс, но копировать имя из чужого примера с суффиксом бессмысленно.

Расчёт на принуждение к инструменту везде. Разобрано выше: на двух позициях его нет, и молчаливого запасного поведения тоже нет.

Отправка картинок «на пробу» в прод. Статус unknown — не приглашение проверить это на живом трафике.

Потерянный Content-Type. Классика: тело уходит, но не разбирается. Что означают типовые коды ответа и как их читать — в статье ошибки API нейросетей.

Сколько это в деньгах на практике

Арифметика простая, потому что ставка одна на вход и на выход. Диалог из системного промпта на 400 токенов, вопроса на 100 и ответа на 500 — это тысяча токенов, то есть одна тысячная миллиона. Тысяча таких диалогов в сутки — миллион токенов в сутки, ровно одна ставка из таблицы.

Дальше начинаются нюансы, и они не в цене, а в длине. В диалоге вся переписка отправляется заново на каждом шаге: десятый ход в сессии стоит дороже первого, хотя ставка не изменилась. Именно здесь чаще всего уезжает бюджет — считать это учит статья как считать токены.

Второй нюанс — длина ответа. Потолок max_tokens стоит задавать явно даже там, где кажется, что модель и так ответит коротко: на нестандартном вводе она может уйти в длинное рассуждение, и вы оплатите его целиком.

Что работает из России

Прямой доступ к консоли вендора упирается в оплату: карта не проходит, а без пополненного баланса ключ существует, но запросы отклоняются. Это не про Qwen конкретно, так устроено почти у всех зарубежных вендоров.

Рублёвый маршрут снимает оба барьера сразу. Пополнение российской картой, ставка зафиксирована в рублях, VPN не нужен ни для запросов, ни для кабинета. Что ещё ломается при попытке подключиться напрямую — в статье как оплатить API нейросети из России.

Отдельно про открытые веса: часть моделей семейства вендор выкладывает публично, и это другой сценарий — своё железо вместо чужого API. Разбор одного такого выпуска — в статье Qwen 3.8 27B: открытые веса.

Чего мы не утверждаем

Мы не ранжируем четыре позиции по качеству и не публикуем бенчмарки вендора как независимый результат. Одинаковая цена не означает одинакового результата на вашей задаче, и проверить это можно только замером на своих данных.

Мы не утверждаем возможностей со статусом unknown. Понимание изображений у всех четырёх позиций Qwen мы не проверяли, и в каталоге это написано прямо.

Мы не называем вендорских цен. Наш каталог — единственная цена, за которую мы отвечаем, и она стоит в таблице выше токеном, который подставляет актуальное значение.

Что нужно, чтобы попробовать

Ключ заводится за минуту на keydealer.ru/login: почта и пароль, без документов и без зарубежной карты. Оплата российской картой в рублях, один ключ на все четыре позиции Qwen и на остальной каталог.

Платные текстовые позиции доступны сразу на приветственном бонусе — прогнать свою задачу через все четыре и посмотреть расход можно до первого пополнения. Семейство приехало в каталог 12 сентября 2026 года, состав и статусы всегда можно сверить с живой выдачей списка моделей.

Что держать в голове

Подключение — это адрес, ключ и имя модели. Формат совместим с OpenAI, код не переписывается, переезд занимает две строки.

Одинаковая ставка на все четыре позиции убирает обычный компромисс «дешевле или умнее»: выбирать нужно по задаче и по замеру, а не по цене. И держать в уме одно исключение — принудительный выбор инструмента не поддерживается у qwen-3-8-max и qwen-3-7-plus.

Понимание изображений у семейства мы не проверяли, и статус unknown в каталоге значит именно это. Как мы проверяем факты и почему у каждой цифры стоит дата — на странице о проекте. Завести ключ: keydealer.ru/login.

Частые вопросы

Как подключить Qwen API?

Формат совместим с OpenAI: меняются адрес, ключ и имя модели, код остаётся прежним. Адрес — https://api.keydealer.ru/v1/chat/completions, имена позиций записаны через дефис.

Сколько стоит Qwen API в рублях?

Все четыре позиции семейства на 12 сентября 2026 года идут по одной ставке за миллион токенов, одинаково на вход и на выход. Точное число — в таблице ставок в статье.

Поддерживает ли Qwen вызов функций?

Да, вызов функций подтверждён замером у всех четырёх позиций. Но принудительный выбор конкретного инструмента у qwen-3-8-max и qwen-3-7-plus помечен как неподдерживаемый.

Понимает ли Qwen картинки?

Мы этого не проверяли. У всех четырёх позиций статус понимания изображений — unknown, и это означает именно отсутствие проверки, а не отсутствие возможности.

Какую позицию Qwen выбрать?

Ставка у всех одинаковая, поэтому выбор идёт не по деньгам, а по задаче: flash — под короткие частые ответы, plus — под середину, max — под длинные рассуждения.

Работает ли Qwen API из России?

Да, через рублёвый маршрут: пополнение российской картой, один ключ на весь каталог, без зарубежной карты и без VPN.

Источники