Доступ к ИИ из России

GigaChat 3.5 Reasoning: что меняет для выбора API

GigaChat 3.5 Reasoning: что меняет для выбора API

Сбер выпустил GigaChat 3.5 Reasoning — версию с режимом рассуждений, который пользователь включает отдельной кнопкой. Для тех, кто выбирает API под задачу, это меняет одну вещь: у отечественного маршрута появился класс моделей, который раньше был только у зарубежных. В нашем каталоге на 13 сентября 2026 года 53 позиции, российских среди них нет, и мы пишем об этом релизе не как продавец, а как сторона, которой этот вопрос задают каждую неделю.

Разберём, что заявлено, чем режим рассуждений отличается от обычного ответа в деньгах, и как вообще выбирать между отечественным и зарубежным маршрутом.

Что заявлено

По сообщению разработчика, модель доступна и пользователям, и разработчикам. Ключевое отличие — режим рассуждений, который включается отдельной кнопкой.

Названные сценарии: найти противоречия между пунктами договора, провести финансовые расчёты, разобраться в сложной ошибке в коде, спланировать поездку с несколькими ограничениями одновременно.

Отдельно отмечено, что модель научилась не только выстраивать последовательность действий, но и сама решать, когда обратиться к внешнему инструменту и когда пересмотреть предыдущий шаг. Это описание агентного поведения, а не просто более длинного ответа.

Что такое режим рассуждений на самом деле

Механика одинакова у всех семейств, и понимать её полезно независимо от вендора.

Обычный ответ: модель получает запрос и сразу генерирует текст. Режим рассуждения: перед ответом она генерирует дополнительные токены, в которых разбирает задачу, проверяет себя и отбрасывает неудачные ходы.

Отсюда два следствия, которые важнее маркетинга. Первое: на многошаговых задачах качество растёт заметно. Второе: вы платите за эти промежуточные токены, потому что оплачивается всё сгенерированное, а не только показанное.

Подробный разбор того, как устроены уровни глубины и когда они окупаются, — в статье уровни рассуждения в API.

Кнопка вместо автоматики: почему это важно

Деталь, которая выглядит интерфейсной, а на самом деле экономическая.

Когда глубину обдумывания выбирает модель, вы не управляете стоимостью запроса: простая задача может уйти в долгое рассуждение. Когда её включает пользователь, расход предсказуем.

Для продукта, где обращений тысячи в день, предсказуемость важнее среднего качества. Именно поэтому в зрелых интеграциях глубину рассуждения почти всегда задают явно, а не оставляют на усмотрение модели.

Как выбирать между отечественным и зарубежным маршрутом

Вопрос, который нам задают чаще всего. Честный ответ: он решается не сравнением качества, а четырьмя другими критериями.

КритерийКогда решает в пользу российской модели
Место обработки данныхЕсть требование хранить и обрабатывать в РФ
Договор и закрывающиеНужен прямой договор с российским юрлицом
Отраслевые требованияРегулятор требует конкретного поставщика
Русский язык в узкой предметной областиОтраслевая терминология, где модель обучали на русских данных
Цена за токенСчитается на своём профиле, общего ответа нет
Доступность конкретной возможностиЕсли нужна позиция, которой у отечественных нет

Первые три пункта перевешивают всё остальное, когда они есть. Если их нет, выбор делается прогоном своих задач, а не чтением анонсов.

Что есть у нас и чего нет

Говорим прямо, потому что иначе статья читается как реклама.

В каталоге на 13 сентября 2026 года 53 позиции, из них 38 доступны. Российских моделей среди них нет. Есть семейства Claude, GPT, Gemini, Grok, GLM, Qwen, Kimi, DeepSeek, Llama, Nemotron и открытые позиции.

Ставки на задачи того же класса, что назвал Сбер, рубли за миллион токенов одинаково на вход и на выход:

ЗадачаМодель₽ за миллион
Разбор договора на противоречияsonnet-4-612
Финансовые расчёты с проверкойopus-530
Разбор сложной ошибки в кодеopus-4-840
Планирование с ограничениямиgpt-5-6-sol40
Массовая рутина без рассужденияdeepseek-v4-flash1

Оплата российской картой в рублях, закрывающие документы от российского ИП. Требования к месту обработки данных это не закрывает — если у вас есть такое требование, оно решается не выбором шлюза.

Сколько стоит рассуждение в деньгах

Абстракция «платите за промежуточные токены» становится понятной на числах. Возьмём задачу, где обычный ответ занимает 500 токенов, а с рассуждением модель генерирует ещё 2 000 промежуточных.

Модель₽ за миллионБез рассужденияС рассуждением
deepseek-v4-flash10,00050,0025
qwen-3-6-flash30,00150,0075
sonnet-4-6120,0060,03
opus-5300,0150,075

Разница пятикратная на одной и той же задаче. На десяти тысячах обращений в месяц это 60 ₽ против 300 ₽ на sonnet-4-6 и 150 ₽ против 750 ₽ на opus-5 — суммы небольшие, но соотношение сохраняется на любом масштабе.

Практический вывод, не зависящий от вендора: рассуждение включают там, где ошибка дороже пяти лишних копеек, и выключают на рутине. Разбор того, как считать свой профиль, — в статье как считать токены.

Где рассуждение не помогает

Три класса задач, на которых глубина обдумывания не окупается.

Извлечение данных из текста. Модель либо видит поле, либо нет. Дополнительные рассуждения не создают информацию, которой в документе не было.

Классификация по понятным правилам. Если категорий пять и правила чёткие, рассуждение добавляет стоимость и время, а точность оставляет прежней.

Генерация по шаблону. Описание товара по характеристикам, письмо по структуре, ответ по базе знаний — здесь качество определяется контекстом, который вы дали, а не глубиной размышления.

Обратное тоже верно: там, где в задаче есть несколько взаимных ограничений и их нужно согласовать, рассуждение даёт заметный прирост. Это ровно те сценарии, которые перечислил разработчик в анонсе, и это честное описание применимости.

Что это значит для рынка

Три наблюдения без прогнозов.

Разрыв по классу моделей сокращается. Год назад режим рассуждений был отличительной чертой зарубежных флагманов, сейчас он появляется у отечественных.

Выбор смещается с «что вообще есть» на «что дешевле и удобнее». Это нормальная стадия зрелости рынка.

Сравнивать по анонсам бессмысленно. Любая лаборатория показывает замеры, сделанные ею самой. Методика сравнения на своих задачах разобрана в статье как сравнивать модели.

Что спросить у любого нового релиза

Полезная привычка, которая экономит недели. Когда выходит очередная модель, неважно чья, ответы нужны на пять вопросов, и ни один из них не про бенчмарки.

Как называется идентификатор и будет ли он жить. Подвижное имя вроде latest меняет поведение приложения в день обновления у вендора. В нашем каталоге по этой причине нет ни одного идентификатора со словами latest, newest или preview.

Какие протоколы открыты. Клиент, написанный под один формат, не переедет на другой бесплатно.

Что с лимитами частоты. Модель, которая отлично отвечает и держит десять запросов в минуту, не годится для пакетной обработки.

Что происходит при недоступности. Нужна заранее проверенная запасная позиция, а не поиск замены в момент аварии — как это устроить, разобрано в статье отказы маршрута и fallback.

Кто отвечает за ответ перед вашим клиентом. Ответ всегда один: вы. Модель не становится стороной вашего договора, чьей бы она ни была, и ссылка на её ошибку не работает ни в поддержке, ни в суде.

Что не меняется от появления новой модели

Соблазн после каждого анонса — переписать интеграцию под новинку. Обычно это худшее решение из возможных.

Качество вашего продукта определяется не моделью, а тем, что вы ей даёте: точностью инструкции, полнотой контекста, строгостью формата ответа и проверкой результата. Смена модели без этой работы даёт разброс в пределах погрешности, а стоит спринта.

Разумный порядок обратный: сначала выжать промпт и подачу контекста на текущей позиции, потом сравнить кандидатов на своих задачах, и только потом менять конфигурацию. Почему не стоит переписывать интеграцию под каждый релиз, разбирали в отдельном материале.

Чего мы не утверждаем

Мы не сравнивали GigaChat 3.5 Reasoning с моделями каталога на своих задачах и не публикуем оценок качества. Её у нас нет, замерить нечего.

Мы не пересказываем бенчмарки разработчика. Все опубликованные цифры любой лаборатории — её собственные замеры.

Мы не даём юридических рекомендаций по требованиям к обработке данных. Это вопрос к вашему юристу, а не к статье в блоге.

Что нужно, чтобы сравнить самому

Ключ заводится за минуту на keydealer.ru/login — почта и пароль, без документов и без зарубежной карты. Оплата российской картой в рублях.

Рабочий способ выбрать — взять три свои реальные задачи и прогнать их на позициях разного класса, сравнив расход и долю ответов, которые пришлось переписать. На приветственном бонусе это можно сделать без пополнения.

Что держать в голове

Режим рассуждений повышает качество на многошаговых задачах и повышает счёт, потому что промежуточные токены тоже оплачиваются.

Явное включение глубины даёт предсказуемый расход, и для продукта это важнее среднего качества.

Выбор между отечественным и зарубежным маршрутом решают требования к данным и договору, а не сравнение анонсов. Как мы проверяем факты и почему у каждой цифры стоит дата — на странице о проекте. Завести ключ: keydealer.ru/login.

Частые вопросы

Что нового в GigaChat 3.5 Reasoning?

Режим рассуждений: модель разбирает задачу по шагам, а не отвечает сразу. По описанию разработчика она сама решает, когда обратиться к внешнему инструменту и когда пересмотреть предыдущий шаг.

Как включается режим рассуждений?

Отдельной кнопкой на стороне пользователя. То есть глубина обдумывания задаётся явно, а не выбирается моделью за вас.

Какие задачи разработчик называет подходящими?

Поиск противоречий между пунктами договора, финансовые расчёты, разбор сложной ошибки в коде и планирование с несколькими ограничениями одновременно.

Есть ли GigaChat в каталоге KeyDealer?

Нет. В каталоге на 13 сентября 2026 года 53 позиции, российских моделей среди них нет. Мы пишем об этом релизе потому, что он меняет расклад при выборе маршрута, а не потому, что продаём эту модель.

Чем reasoning-режим отличается от обычного ответа?

Модель тратит дополнительные токены на обдумывание до ответа. Это повышает качество на многошаговых задачах и повышает стоимость запроса, потому что платят за все сгенерированные токены.

Когда российская модель предпочтительнее зарубежной?

Когда требования к месту обработки данных или к контрагенту важнее разницы в качестве. Это вопрос не технический, а регуляторный и договорный.

Источники