Обзоры и сравнения моделей

Какие модели поддерживают вызов функций

Какие модели поддерживают вызов функций

Вопрос «какие модели поддерживают вызов функций» до недавнего времени не имел проверяемого ответа: вендоры заявляют поддержку в документации, а как оно ведёт себя на конкретном маршруте — выясняется на своих запросах. Теперь ответ есть в цифрах. В каталоге на 8 сентября 2026 года поле tools со значением verified стоит у 22 текстовых позиций из 44 — за сутки их стало вдвое с лишним больше. Это меняет выбор модели под агента: раньше приходилось оговаривать «проверьте сами», теперь половина каталога проверена запросом. Разбираем, у кого именно, что означают статусы и как выбрать позицию под свою задачу.

У каких моделей вызов функций проверен

Из живой выдачи GET /v1/models на 8 сентября 2026 года, поле capabilities.tools со значением verified.

СемействоПозиции
GPTgpt-6-astra, gpt-5-6-sol, gpt-5-6-terra, gpt-5-6-luna, gpt-5-5, gpt-5-4-mini
Geminigemini-3-flash, gemini-3-1-flash-lite, gemini-3-7-flash-tiered
Grokgrok-4-6, grok-4-5, grok-4-3, grok-build-0-1
NVIDIAnemotron-3-ultra, nemotron-3-super, nemotron-3-5-lightning
GLMglm-5-3, glm-4-6v
Claudeopus-4-7
Kimikimi-k3
DeepSeekdeepseek-v4-flash
GPT-OSSgpt-oss-20b

Ещё у 22 позиций значение unknown. У двенадцати поля нет вовсе — это модели генерации изображений и rerank, к которым вопрос неприменим.

Половина каталога с проверенным вызовом функций, половина непроверенная
22 позиции с проверенной поддержкой и 22 с непроверенной. Unknown — это «не проверяли», а не «не работает».

Что означает verified, а что unknown

Различие принципиальное, и именно оно делает таблицу выше полезной.

verified — поддержка проверена реальным запросом на этом маршруте, а не переписана из документации вендора. Рядом лежит отметка времени проверки в поле capabilities_verified_at.

unknown — проверка не проводилась. Это не «не поддерживает»: модель вполне может уметь. Но обещать это своему клиенту без собственного теста нельзя.

Поля нет — вопрос к этой позиции не относится.

Практическое следствие: unknown — приглашение проверить, а не запрет. Проверка занимает один запрос, и её результат стоит записать рядом со своей выборкой — как вести такие замеры.

Как читать остальные поля выдачи — подробный разбор.

Что смотреть кроме tools

Одного поля мало, если вы строите агента. Рядом лежат ещё три, и они отвечают на разные вопросы.

tools — модель вообще принимает описания инструментов и возвращает намерение вызвать.

forced_tool_choice — можно ли заставить её вызвать конкретный инструмент, а не выбирать самой. Нужно там, где шаг обязателен.

parallel_tool_calls — умеет ли предлагать несколько вызовов сразу. Экономит шаги в агентском цикле.

tool_result_messages — корректно ли принимает обратно результат выполнения. Без этого цикл не замыкается.

Для простого сценария «модель предложила — код выполнил» достаточно первого и последнего. Для многошагового агента стоит смотреть все четыре — механику разбирали в материале как модель вызывает ваши функции.

Сколько стоит модель с проверенными инструментами

Хорошая новость: дорого платить не обязательно.

Среди 22 позиций с проверенной поддержкой есть:

  • три бесплатных — модели NVIDIA тарифицируются по нулевой ставке после платного пополнения;
  • deepseek-v4-flash по 1 ₽ за миллион токенов — самая дешёвая платная позиция каталога;
  • gpt-oss-20b с нулевой ставкой;
  • и верхний край — gpt-6-astra по 60 ₽.

Разброс внутри списка стократный, и это ровно тот случай, когда стоит начинать снизу. Агентские сценарии обычно упираются не в силу модели, а в качество описаний инструментов — почему описания важнее выбора позиции.

Как перевести объём в рубли — методика, с поправкой на то, что описания инструментов уходят в модель при каждом обращении.

Как выбрать модель под агента

Порядок на вечер, в котором проверка поддержки — только первый шаг.

  1. Отфильтруйте по tools: verified. Двадцать две позиции — уже удобный список.
  2. Проверьте tool_result_messages. Без него многошаговый цикл не замкнётся.
  3. Возьмите две-три позиции разной цены. Дешёвую, среднюю, дорогую.
  4. Прогоните двадцать своих задач с реальными описаниями инструментов.
  5. Считайте не «справилась», а долю верных выборов инструмента. Именно здесь модели различаются, а не в качестве текста.
  6. Посмотрите на расход. Описания инструментов в каждом запросе — заметная статья.

Пятый пункт обычно и решает: разница между позициями проявляется в том, насколько уверенно модель выбирает нужный инструмент из похожих, а не в том, умеет ли она это в принципе.

Что менялось за последнюю неделю

Короткое наблюдение, объясняющее, почему цифру стоит перепроверять.

Третьего сентября поле tools слетело в unknown у шести позиций GPT разом — verified осталось у четырёх моделей во всём каталоге. Восьмого сентября проверка восстановилась и расширилась: теперь их 22.

Вывод отсюда практический: значения полей — это состояние на момент запроса, а не константа. Если ваш код выбирает модель по возможностям, читать их надо из живой выдачи, а не из конфига, записанного полгода назад — почему идентификаторы и настройки стоит выносить наружу.

Чем это отличается от строгого вывода JSON

Частый вопрос, потому что механизм под ними один.

Вызов функций возвращает намерение совершить действие: название функции и аргументы. Выполняет ваш код.

Строгий вывод возвращает данные в заданной схеме. Никакого действия не подразумевается.

Поля в каталоге раздельные: tools и json_output. На 8 сентября 2026 года json_output у всех текстовых позиций стоит в unknown — то есть проверка этой возможности пока не проводилась, в отличие от инструментов. Разбор самого механизма — как получить строгий формат ответа.

Практический приём: если вам нужны данные, а не действие, но json_output не проверен, задачу иногда проще описать как функцию — поддержка инструментов проверена шире.

Как проверить поддержку самостоятельно

Если нужная вам позиция стоит в unknown, проверка занимает один запрос. Порядок такой.

Опишите одну простую функцию. Например, «получить погоду по названию города»: понятное назначение, один обязательный аргумент строкой.

Задайте вопрос, который её требует. Не «какая погода» вообще, а конкретный город — так, чтобы вызов был очевидно уместен.

Посмотрите на ответ целиком. Модель должна вернуть структуру с названием функции и аргументом, а не текст про то, что она не умеет смотреть погоду.

Верните результат обратно. Это проверка tool_result_messages: положите в историю выдуманный ответ функции и посмотрите, использует ли модель его в финальном ответе.

Повторите пять раз. Один удачный вызов ничего не доказывает: ответы различаются между прогонами.

Результат стоит записать рядом со своей выборкой с датой — поля каталога меняются, и собственная проверка на конкретной задаче полезнее общего статуса. Если позиция уверенно проходит все пять прогонов, её можно использовать, не дожидаясь, пока верификатор до неё доберётся.

И обратный случай: verified в каталоге не гарантирует, что модель хорошо выберет нужный инструмент из ваших двадцати. Проверка подтверждает работу механизма, а качество выбора зависит от описаний и проверяется только на вашем наборе.

Чего мы не утверждаем

verified не означает гарантии на вашей задаче. Проверка подтверждает, что механизм работает на маршруте, а не что модель хорошо выбирает из ваших двадцати инструментов.

unknown не означает отсутствия поддержки. Это отсутствие проверки.

Не сравниваем модели по качеству работы с инструментами. Своих замеров мы не делали; мерить надо на своём наборе.

Цифры — на дату. 22 из 44 — состояние на 8 сентября 2026 года; актуальное всегда в живой выдаче.

Что нужно, чтобы проверить на своей задаче

Ключ заводится за минуту на keydealer.ru/login — почта и пароль, без документов и без зарубежной карты. Оплата российской картой в рублях, один ключ на 56 позиций в шестнадцати семействах: перебрать три модели из разных семейств — это правка строки в конфигурации, а не три интеграции.

Платные текстовые модели доступны сразу на приветственном бонусе, а три позиции NVIDIA с проверенной поддержкой инструментов тарифицируются по нулевой ставке после пополнения от 100 ₽. Ставки и статусы видны в GET /v1/models до регистрации.

Что держать в голове

Проверенная поддержка вызова функций теперь у половины текстового каталога, и среди этих позиций есть бесплатные и позиция по рублю за миллион. Дорогая модель под агента не обязательна.

И смотрите не только на tools: без tool_result_messages многошаговый цикл не замкнётся, а forced_tool_choice понадобится там, где шаг обязателен.

Как мы проверяем факты и почему у каждой цифры стоит дата — на странице о проекте и в llms.txt. Проверить своих агентов на нескольких моделях: keydealer.ru/login.

Частые вопросы

Какие модели поддерживают вызов функций?

В каталоге KeyDealer на 8 сентября 2026 года проверенная поддержка у 22 текстовых позиций из 44: вся линейка GPT, четыре Gemini, четыре Grok, Kimi K3, DeepSeek V4 Flash, три модели NVIDIA, GLM-5.3 и GLM-4.6V, Opus 4.7 и GPT-OSS 20B.

Что означает verified в поле tools?

Что поддержка проверена запросом, а не заявлена вендором. Значение unknown означает, что проверка не проводилась — это не отказ, но и не основание закладывать модель в обязательства.

Где посмотреть поддержку вызова функций?

В ответе GET /v1/models, блок capabilities, поля tools, forced_tool_choice, parallel_tool_calls и tool_result_messages.

Нужна ли дорогая модель для агента?

Нет. Среди позиций с проверенной поддержкой есть и бесплатные, и позиции по рублю за миллион токенов.

Чем вызов функций отличается от строгого вывода JSON?

Механизм один, назначение разное. Вызов функций возвращает намерение совершить действие, строгий вывод — данные в заданной схеме.

Можно ли переключаться между моделями без переписывания кода?

Да, если работаете через совместимый интерфейс. Идентификатор модели выносится в конфигурацию, и смена занимает минуту.

Источники