LLM API и интеграция
Qwen API: как подключить, цены и ограничения
Qwen API подключается как OpenAI-совместимый: меняются адрес, ключ и имя модели, код остаётся прежним. Семейство приехало в каталог KeyDealer 12 сентября 2026 года сразу четырьмя позициями — qwen-3-8-max, qwen-3-7-max, qwen-3-7-plus и qwen-3-6-flash, — и все четыре идут по ставке 3 ₽ за миллион токенов, одинаково на вход и на выход. Вызов функций подтверждён замером у всех четырёх; принудительный выбор инструмента у qwen-3-8-max и qwen-3-7-plus помечен как неподдерживаемый.
Ниже разобрано, что нужно для первого запроса, чем четыре позиции различаются между собой при одинаковой цене, где у семейства проходит граница проверенного и что чаще всего ломается при переносе кода с другого маршрута.
Что нужно для подключения
Адрес. Эндпоинт чата совместим с форматом OpenAI: https://api.keydealer.ru/v1/chat/completions. Библиотеки, написанные под OpenAI, работают без правок — меняется базовый URL, а не логика вызова.
Ключ. Один ключ на весь каталог, без отдельной регистрации под каждое семейство. Где его хранить и почему не в коде — разобрано в статье как хранить API-ключи.
Имя модели. Ровно то, что стоит в каталоге, символ в символ: qwen-3-8-max, qwen-3-7-max, qwen-3-7-plus, qwen-3-6-flash. Разделитель — дефис, не точка.
Больше ничего. Ни SDK семейства, ни отдельного домена, ни своего формата тела запроса.
Первый запрос
curl https://api.keydealer.ru/v1/chat/completions \
-H "Authorization: Bearer $KEYDEALER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model":"qwen-3-8-max","messages":[{"role":"user","content":"Привет"}]}'
Тело стандартное: model, messages, дальше по вкусу — temperature, max_tokens, stream, tools. Если вы переезжаете с другого маршрута, правятся две строки: адрес и ключ. Пошаговый разбор самого первого вызова — в статье первый запрос к API нейросети, а общая механика переезда — в статье переход с OpenAI на совместимый API.
Четыре позиции по одной цене: в чём тогда разница
Обычно в линейке цена и есть подсказка: дороже — старше. Здесь этой подсказки нет, все четыре позиции стоят одинаково. Значит, выбирать приходится по назначению.
Имена в семействе следуют лестнице max → plus → flash, и она читается так.
qwen-3-8-max — старшая и самая свежая позиция линейки. Её место — задачи, где ответ строится в несколько шагов: разбор длинного текста с выводами, анализ, планирование работы агента.
qwen-3-7-max — предыдущая старшая. Тот же класс задач, другое поколение. Держать её в каталоге имеет смысл ровно потому, что поведение моделей между поколениями меняется, и иногда старое поведение — то, под которое написан ваш промпт.
qwen-3-7-plus — средняя ступень: заметно быстрее старших на типовых задачах и достаточная там, где не нужна длинная цепочка рассуждений. Переводы, переписывание, структурирование текста.
qwen-3-6-flash — быстрая позиция под частые короткие ответы: классификация, теги, извлечение полей, ответы из готового контекста.
Это чтение лестницы имён, а не результат нашего замера качества. Мы не ранжируем позиции по «уму» и не публикуем чужие бенчмарки как свои. Правильный способ выбрать — прогнать одну и ту же задачу через все четыре и сравнить, методика описана в статье как сравнивать модели.
Ставки в каталоге
На 12 сентября 2026 года, рубли за миллион токенов, одинаково на вход и на выход.
| Модель | ₽ за миллион | Под что берут |
|---|---|---|
qwen-3-6-flash | 3 | короткие частые ответы, классификация |
qwen-3-7-plus | 3 | середина: переводы, переписывание, структурирование |
qwen-3-7-max | 3 | старшая предыдущего поколения |
qwen-3-8-max | 3 | старшая и самая свежая в линейке |
Ставка рублёвая и зафиксирована: она не двигается вслед за курсом доллара. Для справки, курс ЦБ на 12 сентября 2026 года — 84,2569 ₽. Как ставка за миллион превращается в счёт за конкретный диалог — в статье сколько стоит 1M токенов в рублях.
Одинаковая цена внутри семейства даёт редкую свободу: можно поставить старшую позицию на весь трафик и не считать экономию от понижения. Расход вырастет только за счёт длины ответов, а не за счёт ставки.
Вызов функций: что подтверждено и где граница
Вызов функций (tools) подтверждён нашим замером у всех четырёх позиций. Это значит, что модель принимает описание инструментов и возвращает структурированный запрос на вызов — базовый механизм агентов работает. Как он устроен, разобрано в статье function calling в API.
Теперь прямо об ограничении. У qwen-3-8-max и qwen-3-7-plus принудительный выбор инструмента — forced_tool_choice — в каталоге помечен как не поддерживаемый. Это отдельная от tools возможность: она позволяет сказать модели «на этом шаге обязан быть вызван вот этот инструмент, текстом не отвечай». На двух названных позициях так сделать нельзя: модель решает сама, звать инструмент или ответить текстом.
Для части пайплайнов это безразлично, для части — блокер. Если ваш код после запроса сразу читает tool_calls[0] и падает, когда его нет, вы поймаете ошибку не на подключении, а на первом же нетипичном вводе.
Что с этим делать, по убыванию простоты:
Взять позицию без ограничения. У qwen-3-7-max и qwen-3-6-flash такой пометки нет. Цена та же, переезд — замена строки с именем модели.
Перестроить шаг на строгий JSON. Там, где инструмент по сути один и нужен просто разбор ответа в поля, принуждение к вызову вообще лишнее: достаточно схемы ответа. Подход описан в статье строгий JSON от нейросети.
Оставить ветку на текстовый ответ. Даже с поддержкой принуждения обработчик «модель ответила текстом вместо вызова» должен быть, иначе продовый агент однажды остановится на пустом месте.
Какие ещё позиции каталога умеют вызов функций — перечислено в статье какие модели поддерживают вызов функций.
Понимание изображений: не проверяли
У всех четырёх позиций Qwen статус понимания изображений — unknown. Формулировка честная и означает ровно одно: замера не было. Мы не утверждаем ни поддержки, ни её отсутствия, и не советуем строить продовый сценарий на предположении.
Если картинки на входе нужны сегодня, в каталоге есть позиции с подтверждённым замером — их список и то, как мы вообще это проверяем, в статье vision появился в каталоге.
Частые ошибки при подключении
Точки вместо дефисов в имени. В документации вендоров такие модели часто пишут через точку. В каталоге разделитель — дефис. qwen-3.8-max вернёт ошибку про неизвестную модель, а не про опечатку.
Ожидание суффикса latest. Подвижных алиасов у нас нет ни у одного семейства: имя указывает на конкретную позицию и не переезжает под вами. Для прода это плюс, но копировать имя из чужого примера с суффиксом бессмысленно.
Расчёт на принуждение к инструменту везде. Разобрано выше: на двух позициях его нет, и молчаливого запасного поведения тоже нет.
Отправка картинок «на пробу» в прод. Статус unknown — не приглашение проверить это на живом трафике.
Потерянный Content-Type. Классика: тело уходит, но не разбирается. Что означают типовые коды ответа и как их читать — в статье ошибки API нейросетей.
Сколько это в деньгах на практике
Арифметика простая, потому что ставка одна на вход и на выход. Диалог из системного промпта на 400 токенов, вопроса на 100 и ответа на 500 — это тысяча токенов, то есть одна тысячная миллиона. Тысяча таких диалогов в сутки — миллион токенов в сутки, ровно одна ставка из таблицы.
Дальше начинаются нюансы, и они не в цене, а в длине. В диалоге вся переписка отправляется заново на каждом шаге: десятый ход в сессии стоит дороже первого, хотя ставка не изменилась. Именно здесь чаще всего уезжает бюджет — считать это учит статья как считать токены.
Второй нюанс — длина ответа. Потолок max_tokens стоит задавать явно даже там, где кажется, что модель и так ответит коротко: на нестандартном вводе она может уйти в длинное рассуждение, и вы оплатите его целиком.
Что работает из России
Прямой доступ к консоли вендора упирается в оплату: карта не проходит, а без пополненного баланса ключ существует, но запросы отклоняются. Это не про Qwen конкретно, так устроено почти у всех зарубежных вендоров.
Рублёвый маршрут снимает оба барьера сразу. Пополнение российской картой, ставка зафиксирована в рублях, VPN не нужен ни для запросов, ни для кабинета. Что ещё ломается при попытке подключиться напрямую — в статье как оплатить API нейросети из России.
Отдельно про открытые веса: часть моделей семейства вендор выкладывает публично, и это другой сценарий — своё железо вместо чужого API. Разбор одного такого выпуска — в статье Qwen 3.8 27B: открытые веса.
Чего мы не утверждаем
Мы не ранжируем четыре позиции по качеству и не публикуем бенчмарки вендора как независимый результат. Одинаковая цена не означает одинакового результата на вашей задаче, и проверить это можно только замером на своих данных.
Мы не утверждаем возможностей со статусом unknown. Понимание изображений у всех четырёх позиций Qwen мы не проверяли, и в каталоге это написано прямо.
Мы не называем вендорских цен. Наш каталог — единственная цена, за которую мы отвечаем, и она стоит в таблице выше токеном, который подставляет актуальное значение.
Что нужно, чтобы попробовать
Ключ заводится за минуту на keydealer.ru/login: почта и пароль, без документов и без зарубежной карты. Оплата российской картой в рублях, один ключ на все четыре позиции Qwen и на остальной каталог.
Платные текстовые позиции доступны сразу на приветственном бонусе — прогнать свою задачу через все четыре и посмотреть расход можно до первого пополнения. Семейство приехало в каталог 12 сентября 2026 года, состав и статусы всегда можно сверить с живой выдачей списка моделей.
Что держать в голове
Подключение — это адрес, ключ и имя модели. Формат совместим с OpenAI, код не переписывается, переезд занимает две строки.
Одинаковая ставка на все четыре позиции убирает обычный компромисс «дешевле или умнее»: выбирать нужно по задаче и по замеру, а не по цене. И держать в уме одно исключение — принудительный выбор инструмента не поддерживается у qwen-3-8-max и qwen-3-7-plus.
Понимание изображений у семейства мы не проверяли, и статус unknown в каталоге значит именно это. Как мы проверяем факты и почему у каждой цифры стоит дата — на странице о проекте. Завести ключ: keydealer.ru/login.
Частые вопросы
Как подключить Qwen API?
Формат совместим с OpenAI: меняются адрес, ключ и имя модели, код остаётся прежним. Адрес — https://api.keydealer.ru/v1/chat/completions, имена позиций записаны через дефис.
Сколько стоит Qwen API в рублях?
Все четыре позиции семейства на 12 сентября 2026 года идут по одной ставке за миллион токенов, одинаково на вход и на выход. Точное число — в таблице ставок в статье.
Поддерживает ли Qwen вызов функций?
Да, вызов функций подтверждён замером у всех четырёх позиций. Но принудительный выбор конкретного инструмента у qwen-3-8-max и qwen-3-7-plus помечен как неподдерживаемый.
Понимает ли Qwen картинки?
Мы этого не проверяли. У всех четырёх позиций статус понимания изображений — unknown, и это означает именно отсутствие проверки, а не отсутствие возможности.
Какую позицию Qwen выбрать?
Ставка у всех одинаковая, поэтому выбор идёт не по деньгам, а по задаче: flash — под короткие частые ответы, plus — под середину, max — под длинные рассуждения.
Работает ли Qwen API из России?
Да, через рублёвый маршрут: пополнение российской картой, один ключ на весь каталог, без зарубежной карты и без VPN.