Релизы и изменения моделей

Claude Fable 5.1: что ломается при переходе с Fable 5

Claude Fable 5.1: что ломается при переходе с Fable 5

1 сентября 2026 года Anthropic выпустила Claude Fable 5.1. Вход и выход стоят столько же, сколько у Fable 5: 10 и 50 долларов за миллион токенов. Подешевело одно — чтение из кэша: 0,25 доллара за миллион вместо 1, то есть множитель 0,025 от базового входа вместо стандартных 0,1. Вендор оценивает экономию на типичной нагрузке в 25%, на агентной — до 45%. Но новостью для тех, кто уже вызывает Fable 5 из кода, будет не цена: три изменения ломающие. Принудительный вызов инструмента теперь отдаёт 400. Блоки рассуждений привязаны к модели, которая их произвела. А правка ранних сообщений диалога роняет следующий запрос. Ниже — что именно проверить в своей интеграции до того, как поменять строку с идентификатором модели.

Что изменилось в Claude Fable 5.1 по сравнению с Fable 5

Спецификация та же, поведение другое.

Все цены и даты ниже — из прайса Anthropic и таблицы отключений, проверено 3 сентября 2026 года.

СвойствоFable 5Fable 5.1
Идентификаторclaude-fable-5claude-fable-5-1
Дата выхода9 июня 20261 сентября 2026
Контекст1 млн токенов1 млн токенов
Максимум выхода128 тыс. токенов128 тыс. токенов
Вход / выход$10 / $50$10 / $50
Чтение из кэша$1$0,25
Запись в кэш, 5 мин / 1 час$12,50 / $20$12,50 / $20
Порог знанийянварь 2026июнь 2026
Отключениене раньше 09.06.2027не раньше 01.09.2027

Порог знаний сдвинулся на пять месяцев — с января на июнь 2026. Это заметно больше, чем разрыв между Fable 5 и вышедшим позже Opus 5, у которого порог май 2026. Мы писали в августе, что цена не индикатор свежести знаний: у самой дорогой модели линейки знания тогда были старее, чем у вдвое более дешёвой. С выходом 5.1 порядок восстановился.

Токенизатор не менялся — тот же, что появился с Opus 4.7. Если вы сравниваете счёт с моделями старше 4.7, помните про примерно 30% лишних токенов на том же тексте.

Сколько стоит Fable 5.1 и откуда берётся экономия в 25%

Экономия приходит целиком со стороны кэша, и только у тех, кто кэш использует.

Возьмём агента, который держит в системном префиксе 200 тысяч токенов документации и за сессию перечитывает их 50 раз.

Что считаемFable 5Fable 5.1
Запись префикса в кэш на 5 минут$2,50$2,50
50 чтений из кэша (10 млн токенов)$10,00$2,50
Итого за входную часть$12,50$5,00
Те же 10 млн токенов без кэша вообще$100,00$100,00

Входная часть сессии стоит 40% от прежней — экономия 7,50 доллара, или 652 рубля по курсу ЦБ на 3 сентября 2026 года (86,9963 ₽ за доллар). Запись в кэш не подешевела ни на цент, и это главное, что стоит удержать: выгода целиком в перечитывании.

Отсюда же следует, кому изменение не даст ничего. Разовый запрос без кэша стоит ровно столько же, сколько вчера. Короткий промпт тоже: минимальная длина кэшируемого блока осталась 512 токенов. Оценка «на 25% дешевле» из анонса Anthropic — средняя по типичной нагрузке. Свой счёт по ней не предскажешь. Верхняя граница в 45% относится к «highly agentic work»: формулировка вендора, конкретной методики за ней не опубликовано.

Рублёвые ставки каталога живут в отдельном материале — сколько стоит миллион токенов в рублях, дублировать таблицу здесь не будем.

Почему tool_choice возвращает 400 и чем его заменить

Fable 5.1 и Mythos 5.1 не поддерживают принудительный вызов инструмента: tool_choice со значением any или tool возвращает 400 invalid_request_error. Работают только auto и none. Это первое ломающее изменение и самое вероятное на практике.

Если в запросе стоит tool_choice: {"type": "any"} или {"type": "tool", "name": "..."}, API возвращает 400 invalid_request_error с текстом о том, что типы tool и any для этой модели не поддерживаются. Та же проверка применяется к эндпоинту подсчёта токенов. Значения auto (по умолчанию) и none работают как раньше.

Причина в архитектуре. У модели всегда включено адаптивное рассуждение, а принудительный вызов инструмента его пропускает: модель начинает писать ход мысли прямо в аргументы функции, и качество аргументов падает. Anthropic решила запретить конструкцию целиком — тихая деградация обошлась бы дороже явной ошибки.

Чем заменить, по убыванию надёжности:

  1. Строгие инструменты. Оставить tool_choice: {"type": "auto"} и выставить strict: true. Схему тогда держит валидатор, а модель по дороге думает.
  2. Структурированный вывод. Если схема нужна ради JSON и никакого инструмента за ней нет, перенесите её в structured outputs. Отдельный механизм, он остался на месте.
  3. Прямая инструкция в промпте. Написать словами, когда инструмент применяется: «используй инструмент get_weather, чтобы ответить». В документации сказано, что Fable 5.1 надёжно следует явным указаниям на инструмент.

Если у вас в коде принудительный вызов зашит в обёртку над SDK — это единственное место, которое обязательно надо тронуть перед миграцией. Остальное можно проверять постепенно.

Что происходит с блоками рассуждений при смене модели

Каждый блок рассуждений теперь помнит, какая модель его произвела, и читается только в одну сторону.

Fable 5.1 читает блоки более ранних моделей. Ни одна ранняя модель не читает блоки Fable 5.1. Практический смысл: диалог, который переезжает на 5.1 с Opus 5 или Fable 5, сохраняет всё накопленное рассуждение. Диалог, который уходит с 5.1 назад, теряет его на тех ходах, что выполняются на старой модели.

Опасность здесь тихая. Когда в запросе приходит блок, который целевая модель прочитать не может, API выбрасывает его до того, как модель его увидит. Выброшенные блоки не считаются во входных токенах и не оплачиваются — и по умолчанию об этом никак не сообщается. Узнать о выбросе можно только с бета-заголовком thinking-binding-controls-2026-08-01: тогда в ответе появляется массив верхнего уровня input_transformations.

Кого это касается в первую очередь: маршрутизаторы и схемы с fallback, которые переключают модель посреди диалога. Именно там качество может просесть без единого сообщения об ошибке — просто потому, что половина контекста рассуждений молча исчезла по дороге.

Почему правка ранних ходов ломает следующий запрос

Если между двумя запросами изменилось что угодно, что стоит раньше блока рассуждений — системный промпт, массив tools или любое раннее сообщение, — следующий запрос отдаёт 400 с сообщением о том, что блок привязан к другому диалогу. Третье ломающее изменение бьёт по самому распространённому приёму: сборке массива messages вручную.

Что ломает всё, что идёт следом:

  • правка, перестановка или удаление раннего хода при сохранении поздних;
  • вставка в ранний ход текста, который вы удаляете на следующем запросе, — напоминание, статусная строка, служебная пометка;
  • пересборка системного промпта или массива tools между запросами внутри одного диалога;
  • изображение или документ по ссылке, которая на следующем запросе отдаёт другие байты (проверка идёт по байтам, поэтому ротация подписанной ссылки на тот же файл безопасна).

Что безопасно: удаление подряд идущих блоков рассуждений с начала (от самых старых), серверное подрезание контекста и компакция, перенос меток cache_control и смена effort между запросами. Удаление блока откуда угодно, кроме начала, обнуляет все последующие.

Отдельная деталь про даты. Проверка обязательна для аккаунтов, созданных 31 августа 2026 года и позже. Для более ранних аккаунтов API фиксирует несовпадение, но реагирует только если в запросе явно выставлен thinking.block_binding.prefix_mismatch_behavior. То есть старый аккаунт может проехать миграцию без единой ошибки, а новый упадёт на том же коде. Разница не в коде — в дате регистрации. Из всей миграции это самая странная деталь: одна и та же интеграция ведёт себя по-разному в зависимости от того, когда завели аккаунт.

Правильная модель работы, которую вендор предлагает взамен: считать диалог append-only. Инструкции добавлять серединными системными сообщениями, инструменты менять через смену инструментов посреди диалога, историю подрезать серверными механизмами. Приятный побочный эффект — те же самые правила держат кэш промптов горячим.

Что изменилось в поведении без единой правки кода

Есть ещё семь отличий, которые проявятся сами, без ошибок и без предупреждений.

  • Параллельные вызовы инструментов стали менее предсказуемыми. Там, где Fable 5 отправляла пачку вызовов, 5.1 может отправить один за ход. Ответ не хуже, но лишние ходы стоят токенов, круговых поездок и времени. Лечится одной строкой в промпте про батчинг.
  • Меньше текста между вызовами инструментов. Особенно на высоком уровне усилий. Если ваш интерфейс показывал пользователю ход работы, он замолчит.
  • На низком усилии модель чаще отвечает по памяти, реже дёргая поиск и извлечение. Для задач, где нужна свежая информация, усилие надо поднимать.
  • Плотнее проза: длиннее предложения, меньше абзацных разрывов.
  • Меньше форматирования в чате — жирного, заголовков, списков. Анти-форматные правила, написанные для старых моделей, теперь могут выдавить структуру, которая тексту нужна.
  • Цитаты в пересказах чаще идут неразмеченными: модель воспроизводит куски источника, не помечая их как цитату. Для пересказа чужих документов это прямой риск.
  • Мелкие правки файлов чаще превращаются в перезапись целиком. Результат обычно тот же, но выходных токенов и времени уходит больше.

Ни одно из этих отличий не сломает запрос. Каждое способно сдвинуть счёт или пользовательский опыт, и заметить их можно только на своих задачах.

Что нового в Fable 5.1: усилие по ходу диалога и видимые статусы

Три добавления, все в бете, и все — про длинные агентные сессии.

Усилие внутри диалога. Уровень effort можно менять от сообщения к сообщению, не пересобирая запрос и не ломая блоки рассуждений. Дешёвый способ гонять рутину на низком усилии и поднимать его на трудных ходах.

Системные сообщения на один ход. Поле clear_at: "next_user_message" у сообщения с ролью system даёт тексту авторитет системного промпта на текущий ход, после чего сообщение перестаёт применяться. Оно остаётся в массиве и отправляется обратно дословно — ничего в истории не меняется, кэш продолжает совпадать, блоки рассуждений остаются валидными, а погашенное сообщение не стоит входных токенов. Это ровно замена той самой вставке-и-удалению, которая теперь ломает диалог.

Видимые статусы работы. Значение display: "updates" возвращает короткие заметки о ходе работы текстом, оставляя рассуждение скрытым. По умолчанию thinking.display стоит в omitted, и такие блоки приходят пустыми — из-за чего длинный агентный ход выглядит для пользователя молчанием.

Плюс content provenance: текст Fable 5.1 и Mythos 5.1 несёт статистический водяной знак Anthropic на всех площадках, где модель доступна, а файлы — подписанные метаданные C2PA. Мы разбирали механику в августе; здесь важно, что новая модель попадает под маркировку с первого дня.

Что из этого работает через каталог KeyDealer

Скидка на кэш через маршрут не доходит, и самой Fable 5.1 в каталоге пока нет. Дальше — что отдаёт живая выдача.

На 3 сентября 2026 года GET /v1/models отдаёт 46 позиций. Fable 5.1 среди них нет. Fable 5 есть — и она вернулась в выдачу именно 3 сентября, после двенадцати дней отсутствия, в статусе review: и по availability, и по всем трём протоколам. Запрос к позиции в review падает до резервирования баланса, денег не списывает и отдаёт model_under_review.

Остальные семь моделей Claude — Haiku 4.5, Sonnet 4.6, Sonnet 5, Opus 4.6, 4.7, 4.8 и Opus 5 — открыты, и у всех семи protocols.anthropic_messages стоит в available. Для темы статьи это существенно: три ломающих изменения живут в Messages API, а он у нас теперь открыт. В середине августа он стоял в review у всей линейки.

Что до скидки на кэш — она через маршрут не доезжает. У всех 41 текстовой позиции каталога prompt_cache.status равен unsupported. Это значит ровно то, что написано в самом поле: скидка за попадание в кэш не обещается и не применяется. Бюджет считайте по полной ставке входа. Кэширование держите в голове как свойство прямого API вендора — до нашего счёта оно не доходит.

Отключение Fable 5 никто не назначал: статус Active, дата не раньше 9 июня 2027 года. Все известные даты мы собираем в календаре отключений, туда эта строка и уходит.

Как проверить свою интеграцию до миграции

Шесть проверок, из которых обязательны две первые: принудительный вызов инструмента и правка истории. Порядок ниже экономит вечер.

  1. Грепните код по tool_choice. Если найдёте "any" или {"type": "tool"} — это гарантированная 400. Меняйте на auto плюс strict: true или на структурированный вывод.
  2. Найдите места, где вы правите историю. Пересборка системного промпта, вставка напоминаний в ранние ходы, перестановка сообщений. Всё это теперь запрещено внутри диалога.
  3. Прогоните сессию с prefix_mismatch_behavior: "drop_block" и залогируйте input_transformations. Пустой массив — интеграция чистая. Непустой — у вас есть список мест, которые надо чинить.
  4. Проверьте дату создания аккаунта. До 31 августа 2026 — проверка не применяется автоматически, и ошибка вылезет позже, при переезде на новый аккаунт.
  5. Посмотрите, кто у вас переключает модели посреди диалога, и добавьте бета-заголовок thinking-binding-controls-2026-08-01, чтобы выбросы блоков перестали быть тихими.
  6. Отдельно проверьте отказы. Модель может вернуть HTTP 200 со stop_reason: "refusal". Разрешённые цели fallback для Fable 5.1 — Opus 4.8 и Opus 5.

И про хранение данных, раз уж эта тема тянется за всей линейкой. В анонсе Anthropic обещает Enterprise Frontier Safeguards — приватность уровня нулевого хранения при том, что данные лежат в облаке самого клиента; раскатка по фазам «начиная позже этой осенью», а до тех пор нулевое хранение обещано «подходящим клиентам». В документации формулировка жёстче: Fable 5.1 и Mythos 5.1 — Covered Models с тридцатидневным хранением, и нулевое хранение недоступно, если Anthropic не разрешила его явно. Расхождение между анонсом и контрактом стоит держать в голове; что при этом уходит провайдеру в обычном режиме, мы разбирали отдельно.

Проверить, что каталог отдаёт прямо сейчас, можно одним запросом к GET /v1/models — ключ берётся на странице входа, и живая выдача всегда честнее любой статьи, включая эту.

Частые вопросы

Когда вышла Claude Fable 5.1?

1 сентября 2026 года. Идентификатор модели — claude-fable-5-1, контекст 1 млн токенов, выход до 128 тысяч. Отключение не раньше 1 сентября 2027 года.

Сколько стоит Fable 5.1?

10 долларов за миллион входных токенов и 50 за миллион выходных — ровно столько же, сколько Fable 5. Изменилась только цена чтения из кэша: 0,25 доллара за миллион вместо 1.

Почему tool_choice возвращает 400?

Fable 5.1 и Mythos 5.1 не поддерживают принудительный вызов инструмента. Значения any и tool у параметра tool_choice отдают invalid_request_error. Работают только auto и none.

Отключат ли Fable 5 после выхода 5.1?

Нет. У Fable 5 статус Active, отключение не раньше 9 июня 2027 года. Модель просто перестала быть последней в линейке.

Есть ли Fable 5.1 в каталоге KeyDealer?

На 3 сентября 2026 года нет. В каталоге из 46 позиций стоит Fable 5, и она в статусе review. Остальные семь моделей Claude открыты.

Работает ли скидка на кэш через посредника?

Нет. У всех позиций каталога поле prompt_cache.status равно unsupported, скидка за попадание в кэш не обещается и не применяется.

Чем Fable 5.1 отличается от Opus 5?

Ценой и назначением. Opus 5 стоит 5 и 25 долларов за миллион токенов, Fable 5.1 — 10 и 50. Anthropic советует начинать с Opus 5, а Fable 5.1 брать для тяжёлых рассуждений и длинных агентных задач.

Можно ли задать temperature у Fable 5.1?

Нет. Недефолтные значения temperature, top_p и top_k возвращают 400, как и у всех моделей Claude начиная с Opus 4.7. Предзаполнение ответа ассистента тоже отдаёт 400.

Что делать, если Fable 5.1 отказалась отвечать?

Отказ приходит как HTTP 200 со stop_reason refusal. Разрешённые цели fallback для Fable 5.1 — Opus 4.8 и Opus 5. За отказ, пришедший до генерации выхода, счёт не выставляется.

Источники