LLM API и интеграция

Календарь отключений моделей: что сломается до конца 2026

Календарь отключений моделей: что сломается до конца 2026

10 августа 2026 года OpenAI выключает gpt-5.2-chat-latest и gpt-5.3-chat-latest — объявление висит на странице deprecations с 8 мая, рекомендованная замена там же указана как gpt-5.6-sol. Дальше по календарю: 26 августа закрывается Assistants API, 23 октября уходят gpt-4-turbo, gpt-4o-2024-05-13, o1 и o3-mini, 11 декабря — оригинальный gpt-5-2025-08-07 вместе с o3 и o3-pro. У Anthropic в ближайшие месяцы не отключается ничего: 5 августа уже ушёл Opus 4.1, следующая дата в таблице — «не раньше 29 сентября» у Sonnet 4.5. В каталоге KeyDealer на 8 августа 2026 ни одна модель в августе не выключается.

Отключение модели — это не «стало чуть хуже». Это ошибка вместо ответа в проде, обычно в понедельник утром, обычно у того, кто зашил имя модели в код полгода назад и забыл. Ниже — календарь по трём вендорам, собранный с их собственных страниц, и то, что из этого касается вашего интегратора Telegram-бота или сценария n8n.

Что отключают 10 августа 2026

Две модели: gpt-5.2-chat-latest и gpt-5.3-chat-latest. Обе — «chat-latest», то есть плавающие алиасы на модель, которая стоит за ChatGPT. Их часто берут именно потому, что они плавающие: подписался на алиас и не думаешь про версии.

Ирония в том, что плавающий алиас тоже смертен. Страница отключений OpenAI указывает дату 10 августа 2026 и рекомендованную замену — gpt-5.6-sol. Объявлено 8 мая 2026 года, то есть предупреждение было за три месяца.

Что происходит после даты: запрос к выключенной модели не выполняется. Провайдер не подставляет вместо неё новую — имя модели остаётся частью вашего контракта, и решать, чем его заменить, должны вы. Автоподмена была бы хуже: счёт и качество ответов поменялись бы без вашего ведома.

Полный календарь отключений OpenAI до конца 2026

Всё с той же страницы deprecations, дата рядом с каждой строкой — дата выключения, а не объявления.

ДатаЧто выключаетсяЗамена по документации
10 августа 2026gpt-5.2-chat-latest, gpt-5.3-chat-latestgpt-5.6-sol
26 августа 2026Assistants APIResponses API и Conversations API
24 сентября 2026Sora 2, Sora 2 Pro и Videos APIне указана
23 октября 2026gpt-4-turbo, gpt-4-0613, gpt-4-1106-preview, gpt-4o-2024-05-13, gpt-3.5-turbo-0125, gpt-4.1-nano, o1, o1-pro, o3-mini, o4-mini, gpt-image-1линейка gpt-5.6 и gpt-image-2
30 ноября 2026Reusable prompts, платформа Evals, Agent Builderне указана
1 декабря 2026gpt-image-1-mini, gpt-image-1.5, chatgpt-image-latestgpt-image-2
11 декабря 2026gpt-5-2025-08-07, gpt-5-mini, gpt-5-nano, gpt-5-pro, o3, o3-proлинейка gpt-5.6
20 января 2027Легаси audio, realtime и transcription: gpt-4o-audio, gpt-4o-realtime, gpt-realtime, gpt-audio и их mini-версииgpt-audio-1.5, gpt-realtime-2.1

Две строки здесь заслуживают отдельного внимания, потому что это не модели, а инфраструктура.

26 августа закрывается Assistants API. Это конец целого способа писать код: треды, ассистенты, встроенный retrieval. Если ваш сервис построен на нём, замена — не одна строка с именем модели, а переезд на Responses и Conversations API. Осталось меньше трёх недель.

23 октября уходит gpt-4o-2024-05-13. Именно этот снапшот стоит в половине русскоязычных туториалов 2024–2025 года по подключению GPT к Telegram-боту. Скопированный оттуда код сейчас работает и молчит. В октябре он замолчит громко.

Когда отключают модели Claude и почему у них дата «не раньше»

Ни одна активная модель Claude не имеет назначенной даты отключения. Страница model deprecations даёт вместо неё нижнюю границу «не раньше такого-то числа», а компания обещает предупредить минимум за 60 дней до вывода публично выпущенной модели. Ближайшая граница — 29 сентября 2026 года у Sonnet 4.5.

Ближайшие границы:

МодельНе раньше
claude-sonnet-4-5-2025092929 сентября 2026
claude-haiku-4-5-2025100115 октября 2026
claude-opus-4-5-2025110124 ноября 2026
claude-opus-4-65 февраля 2027
claude-sonnet-4-617 февраля 2027
claude-opus-4-716 апреля 2027
claude-opus-4-828 мая 2027
claude-sonnet-530 июня 2027
claude-opus-524 июля 2027

Что уже произошло: claude-opus-4-1-20250805 вышел из строя 5 августа 2026 года, за три дня до публикации этой статьи, замена по документации — claude-opus-4-8. Раньше, 15 июня, ушли Sonnet 4 и Opus 4.

Разница в подходах практическая. У OpenAI вы получаете точную дату и планируете миграцию под неё. У Anthropic точной даты нет до самого объявления, зато есть гарантия, что после объявления у вас будет два месяца.

Почему запрос к Claude 4.7 может вернуться с ошибкой 400 из-за temperature

Отдельная строка на той же странице Anthropic, которая ломает больше интеграций, чем половина отключений: параметры temperature, top_p и top_k объявлены устаревшими для Claude Opus 4.7 и новее. Anthropic пишет прямо — на моделях 4.7 и новее эти параметры возвращают ошибку 400, если задано значение, отличное от дефолтного. Рекомендация вендора: не передавать их вообще и управлять поведением модели через промпт.

Почему это больно именно нашей аудитории. Шаблоны n8n, готовые обвязки для Telegram-ботов и большинство скопированных сниппетов подставляют temperature: 0.7 по умолчанию — просто потому, что так было принято в эпоху gpt-3.5. Код, который годами работал, на новой модели упирается в 400.

Честная оговорка про наш каталог: в ответе GET /v1/models у моделей KeyDealer подтверждён статус chat_completions, а поведение остальных возможностей помечено как unknown — мы не проверяли контролируемой пробой, как маршрут поступает с sampling-параметрами, и поэтому не утверждаем ни того, что они пройдут, ни того, что они вернут 400. Проверяется это за один запрос на вашем сценарии. Правило простое: если параметр вам не нужен для результата — не отправляйте его.

Какие модели Gemini уже выключены и что с остальными

У рабочих текстовых моделей Gemini дат отключения нет вовсе, а выключена уже вся линейка 2.0 Flash. Google формулирует осторожнее OpenAI: на странице отключений прямо сказано, что указанные даты — самые ранние возможные, а точную сообщат заранее.

Что там на сегодня:

  • вся линейка Gemini 2.0 Flash — gemini-2.0-flash, gemini-2.0-flash-001, gemini-2.0-flash-lite, gemini-2.0-flash-lite-001 — выключена 1 июня 2026 года;
  • gemini-2.5-flash-image — 2 октября 2026;
  • Imagen 4 в трёх вариантах — 17 августа 2026;
  • gemini-robotics-er-1.6-preview — 31 августа 2026;
  • text-embedding-004 — уже выключен 14 января 2026, у gemini-embedding-001 горизонт до 14 мая 2028.

А вот у рабочих текстовых моделей — gemini-2.5-flash, gemini-3-flash, gemini-3.5-flash, gemini-3.1-pro — даты отключения не объявлены. На август 2026 это самая спокойная линейка из трёх.

Когда отключают модели GLM и почему дат нет

Расписания отключений GLM в открытой документации не существует. Здесь честный пробел: на странице тарифов Z.ai опубликованы цены на актуальные модели — от бесплатных Flash до GLM-5.2 — а раздела с выводом из эксплуатации нет. Отдельной страницы отключений с датами, аналогичной трём предыдущим, в открытой документации мы не нашли.

Дело не в надёжности GLM. Просто спланировать миграцию по документации здесь нечем. Если GLM несёт у вас продовую нагрузку, единственный работающий способ узнать об изменении — периодически опрашивать список моделей и сравнивать со вчерашним. Именно так найдена половина фактов в этой статье.

Что из этого есть в каталоге KeyDealer

Каталог на 8 августа 2026 — это семейства Claude, GPT, Gemini, GLM, Grok и GPT-OSS; полный актуальный список всегда отдаёт GET /v1/models, описание контракта — в документации API.

Сверка со всеми тремя календарями выше:

  1. Ни одна модель каталога не выключается в августе 2026. Отключаемые 10 августа gpt-5.2-chat-latest и gpt-5.3-chat-latest в каталоге отсутствуют.
  2. Из списка OpenAI на 23 октября и 11 декабря в каталоге нет ничего: линейка GPT здесь начинается с 5.4.
  3. Ближайшая дата, которая вообще касается каталога, — Claude Haiku 4.5 с границей «не раньше 15 октября 2026». Это нижняя граница: назначенного отключения пока нет, и Anthropic предупредит минимум за 60 дней.
  4. Gemini в каталоге — 2.5 Flash и линейка 3.x, то есть ровно те, у которых дат отключения не объявлено.

Это не повод расслабиться: даты появляются без предупреждения именно в машиночитаемых списках, а не в новостях. Но на ближайшие два месяца в каталоге ломаться нечему.

Как проверить, что ваш код не сломается

Порядок на полчаса, который снимает большую часть риска.

  1. Выпишите все имена моделей, которые реально уходят в API из вашего кода. README тут не помощник — смотрите переменные окружения, шаблоны n8n и старые ветки.
  2. Проверьте каждое по странице отключений своего вендора: OpenAI, Anthropic, Google.
  3. Уберите имя модели из тела запроса в конфигурацию. Замена должна занимать одну правку, а не поиск по репозиторию.
  4. Уберите temperature, top_p и top_k, если они стоят там «по привычке» и не влияют на результат.
  5. Раз в неделю забирайте GET /v1/models и сравнивайте с прошлым снимком. Изменение в машиночитаемом списке приходит раньше любой новости.
  6. Держите под рукой запасную модель другого семейства. Смысл единого OpenAI-совместимого маршрута ровно в этом: переключение — это одна строка, а не новый SDK и новый договор.

Про шаг 5 стоит добавить: объём служебного контекста маршрута тоже меняется со временем, GET /v1/models публикует его оценку вместе с датой измерения, а измерить и ужать собственный контекст помогает KD Context.

Что из этого держать в голове

Все три вендора публикуют даты по-разному: OpenAI даёт точное число, Anthropic — нижнюю границу плюс 60 дней предупреждения, Google — «самое раннее возможное». Общего у них одно: дата появляется в документации и в машиночитаемом списке моделей раньше, чем в новостях. Кто читает списки, узнаёт за месяцы; кто читает ленты — в день падения.

Половина фактов в этой статье найдена именно так: сравнением сегодняшнего списка моделей со вчерашним.

Сколько всё это стоит в рублях после миграции — отдельный разбор: сколько стоит 1 млн токенов в рублях. Как мы проверяем факты и кто отвечает за них лично — на странице о проекте.

Запасную модель заводят заранее. В день отключения это уже не миграция, а тушение пожара с лежащим продом. Ключ к каталогу из шести семейств моделей с рублёвыми ставками выдаётся сразу: keydealer.ru/login.

Частые вопросы

Какие модели отключают 10 августа 2026?

OpenAI выключает gpt-5.2-chat-latest и gpt-5.3-chat-latest. Об отключении объявлено 8 мая 2026 года, рекомендованная замена в самой документации OpenAI — gpt-5.6-sol. Запросы к отключённой модели после этой даты не выполняются.

Что произойдёт с моим кодом, если модель отключили?

Запрос вернёт ошибку, а не ответ модели. Молчаливой подмены на новую версию не происходит: имя модели — часть контракта, и провайдер не решает за вас, чем её заменить. Поэтому имя модели в коде стоит держать в переменной окружения, а не в теле запроса.

Сколько предупреждают об отключении?

Anthropic обещает не менее 60 дней уведомления для публично выпущенных моделей. Google указывает, что даты в таблице — самые ранние возможные, точную дату сообщают заранее. OpenAI объявляет дату отключения на своей странице deprecations, разрыв между объявлением и отключением бывает и три месяца, и полтора года.

Отключаются ли модели в каталоге KeyDealer?

На 8 августа 2026 ни одна модель каталога не выключается в августе. Ближайший ориентир — Claude Haiku 4.5, у которого Anthropic указывает дату «не раньше 15 октября 2026». Актуальный список всегда отдаёт GET /v1/models.

Чем заменить gpt-4o-2024-05-13 после 23 октября 2026?

OpenAI выключает этот снапшот 23 октября 2026 года вместе с gpt-4-turbo, o1 и o3-mini. В качестве замены документация OpenAI указывает линейку gpt-5.6: gpt-5.6-sol для сложных задач, gpt-5.6-terra и gpt-5.6-luna для более простых и дешёвых сценариев.

Почему Claude возвращает ошибку 400 при параметре temperature?

Anthropic объявила temperature, top_p и top_k устаревшими для Claude Opus 4.7 и новее. На этих моделях недефолтное значение возвращает ошибку 400. Рекомендация вендора — не передавать эти параметры вообще и управлять поведением модели через промпт.

Источники