LLM API и интеграция
Первый запрос к API нейросети: с чего начать
От регистрации до рабочего ответа — пятнадцать минут, и код для этого не нужен: достаточно одной команды в терминале. Сложность начинается не в подключении, а чуть позже, когда выясняется, что модель отвечает не тем, чем ожидали, или что выбранная позиция не принимает запросы, хотя числится в каталоге. Разбираем порядок по шагам, показываем, что проверить до первого запроса, и перечисляем четыре ошибки, на которые новички тратят первый вечер целиком.
Что нужно до начала
Три вещи, и ни одна не требует разработки.
Ключ. Заводится на keydealer.ru/login — почта и пароль, без документов. Минута.
Адрес интерфейса. Совместимый с OpenAI, то есть тот же путь /v1/chat/completions, который понимают стандартные библиотеки.
Название модели. Точный идентификатор из каталога, не человеческое название. sonnet-5, а не «Клод Соннет».
Всё. Ни SDK, ни аккаунта у зарубежного вендора, ни зарубежной карты.
Шаг ноль: посмотрите каталог до регистрации
Этот шаг пропускают, а он экономит больше всего.
GET /v1/models открыт без ключа и без регистрации. Оттуда видно всё, что нужно для решения: какие модели есть, в каком они статусе, сколько стоят и что для них требуется по доступу.
Три поля, на которые смотреть в первую очередь:
protocols.chat_completions. Значение available — модель принимает запросы. review — числится, но маршрут закрыт. Это главная причина непонятных отказов у новичков: модель в списке есть, а запрос не проходит.
pricing. Ставка за миллион токенов, отдельно вход и выход. У большинства позиций каталога они одинаковы.
access.policy. balance_required — достаточно ненулевого баланса, и приветственный бонус подходит. paid_topup_required — нужно платное пополнение от 100 ₽, бонус не засчитывается.
Подробный разбор остальных полей — в материале как узнать цену модели через GET /v1/models.
Первый запрос
Порядок действий.
- Заведите ключ и сохраните его сразу в переменную окружения, а не в файл проекта. Привычку лучше заводить с первой минуты — где хранить и где нельзя.
- Выберите модель с
chat_completions: availableи невысокой ставкой. На старте разница между позициями вас не касается. - Отправьте короткий запрос обычным HTTP-вызовом с заголовком авторизации.
- Посмотрите на ответ целиком, а не только на текст. Там есть поле с моделью, которая реально ответила, и количество потраченных токенов.
- Сверьте расход в кабинете. Так вы сразу поймёте порядок цен и не будете гадать.
Четвёртый пункт стоит выделить: поле model в ответе — не то же самое, что модель в запросе. Бывает, что запрос обслуживает другая позиция; знать об этом лучше на первом запросе, чем на тысячном.
Что стоит проверить сразу
Пять вещей, которые обычно откладывают и потом переделывают.
Сколько токенов ушло на самом деле. В ответе есть счётчик, и он почти всегда больше, чем кажется по длине вопроса — почему так.
Как ведёт себя кириллица. Русский текст расходует больше токенов, чем английский того же смысла. На первом же запросе это видно — как считать.
Что будет при неверном ключе. Сломайте его намеренно и посмотрите на ответ. Пять секунд сейчас — час отладки потом.
Что будет при несуществующей модели. То же самое.
Как выглядит длинный ответ. Задайте вопрос, требующий развёрнутого ответа, и посмотрите на задержку. Если она вас не устраивает — понадобится потоковая передача.
Четыре ошибки первого вечера
По частоте.
Взяли модель со статусом review. Она есть в каталоге, но маршрут закрыт. Запрос падает, а причина неочевидна. Лечится чтением protocols перед запросом.
Ждут, что модель знает свежие новости. По умолчанию она отвечает из того, что усвоила при обучении, и в интернет не ходит. Если нужны актуальные данные — их надо положить в запрос — что такое LLM и чего от неё ждать.
Считают, что модель помнит предыдущее сообщение. Не помнит. Ощущение диалога создаётся тем, что вы отправляете всю переписку заново при каждом запросе. Это же объясняет, почему длинный диалог дорожает.
Начинают с самой дорогой модели. Логика «возьму лучшую, чтобы точно работало» здесь не работает: на типовых задачах разница часто невелика, а цена отличается в разы — как сравнивать по делу.
Что делать с ошибками
Коды ответа различают четыре разные ситуации, и лечатся они по-разному.
Проблема с ключом. Неверный, отозванный или не передан. Проверьте заголовок авторизации.
Модель недоступна. Неверный идентификатор или маршрут в review. Сверьтесь с живой выдачей.
Превышен лимит частоты. Слишком много запросов подряд. Нужна пауза с увеличением интервала — что делать при отказе.
Отказ маршрута. Проблема на стороне вендора. Здесь помогает повтор и запасная модель — как устроены повторы и fallback.
Смешивать их в одну обработку «если ошибка — попробовать ещё раз» — плохая идея: повтор при неверном ключе бесполезен, а при превышении лимита без паузы делает хуже.
Что дальше
Порядок освоения, если первый запрос прошёл.
Промпт. Самый дешёвый рычаг и самый недоиспользуемый — как написать системный промпт.
Строгий формат. Как только ответ идёт в код, нужен разбираемый ответ, а не текст — как получить строгий JSON.
Свои данные. Модель не знает вашей предметной области; данные подаются в запрос — поиск по своим документам.
Проверка. Модель уверенно выдумывает, и ловится это проверками в вашем коде — почему и что делать.
Измерение. Как только появится желание что-то улучшить, понадобится выборка, иначе улучшения будут воображаемыми — как тестировать.
Порядок именно такой. Смена модели — последний шаг, а не первый.
Сколько это стоит
Чтобы снять тревогу на старте.
Короткий вопрос и короткий ответ — это тысячи токенов, а ставки указываются за миллион. То есть первые эксперименты обходятся в копейки, и их можно не считать.
Платные текстовые позиции доступны на приветственном бонусе: пополнять баланс, чтобы попробовать, не нужно. Пополнение от 100 ₽ понадобится только для нулевых позиций и генерации изображений — на них бонус не распространяется.
В каталоге на 4 сентября 2026 года 54 позиции в шестнадцати семействах, платные текстовые начинаются от 1 ₽ за миллион токенов. Оплата российской картой в рублях — какие вообще есть способы.
Как не сломать себе второй день
Три привычки, которые дешевле завести сразу, чем переделывать через месяц.
Не хардкодьте название модели. Вынесите его в конфигурацию с первой минуты. Позиции в каталоге появляются, меняют статус и отключаются — за сутки до этой статьи в каталоге было 46 позиций, сейчас 54. Смена модели должна быть правкой конфига, а не релизом.
Логируйте с первого запроса. Идентификатор запроса, модель из ответа, число токенов, стоимость, время. Не тела сообщений — этого достаточно, чтобы через неделю понять, куда уходят деньги и что именно сломалось.
Не оставляйте ключ без предела расхода. Отдельный ключ под эксперименты с собственным лимитом ограничивает ущерб суммой, а не вашей внимательностью. Ошибка в цикле обнаруживается по счёту, и лучше, чтобы счёт был маленьким.
И четвёртое, из области ожиданий: первый удачный ответ ничего не доказывает. Модель отвечает по-разному на один и тот же запрос, поэтому вывод «работает» можно делать после двадцати прогонов, а не после одного. Это же правило потом сэкономит недели на отладке промптов.
Чего мы не утверждаем
Не приводим код. Он зависит от языка и библиотеки; форма запроса стандартная и есть в документации.
Не сравниваем модели. Своих замеров мы не делали; выбирать надо на своих задачах.
Не обещаем доступности конкретной позиции. Статус читается перед запросом.
Цифры — на дату. 54 позиции и ставки от 1 ₽ — состояние на 4 сентября 2026 года.
Что держать в голове
От ключа до ответа — пятнадцать минут, и почти всё, что может пойти не так на первом шаге, читается заранее в открытой выдаче: статус протокола, ставка, условия доступа.
И главное для тех, кто только начинает: модель не помнит прошлое сообщение, не ходит в интернет и уверенно выдумывает. Это не недостатки конкретной позиции, а свойства инструмента — работа строится вокруг них.
Как мы проверяем факты и что храним из запросов — на странице о проекте и в llms.txt. Ключ за минуту, первый запрос на бонусе: keydealer.ru/login.
Частые вопросы
Как подключиться к API нейросети?
Нужны три вещи: ключ, адрес совместимого интерфейса и название модели. Дальше обычный HTTP-запрос — большинство библиотек для OpenAI работают без переписывания кода.
Нужно ли программировать, чтобы попробовать?
Для первого запроса достаточно одной команды в терминале. Код понадобится, когда дойдёт до встраивания в продукт.
Сколько стоит первый запрос?
Копейки. Короткий вопрос и короткий ответ — это тысячи токенов, а ставки указываются за миллион. Платные текстовые модели доступны на приветственном бонусе без пополнения.
Что делать, если приходит ошибка?
Смотреть на код ответа: он различает неверный ключ, недоступную модель, превышение лимита и отказ маршрута. Каждая из четырёх ситуаций лечится по-своему.
Какую модель выбрать для начала?
Любую недорогую с открытым чат-протоколом. Сравнивать имеет смысл потом, на своих задачах, а не до первого запроса.