Релизы и изменения моделей
Claude Fable 5.1: что ломается при переходе с Fable 5
1 сентября 2026 года Anthropic выпустила Claude Fable 5.1. Вход и выход стоят столько же, сколько у Fable 5: 10 и 50 долларов за миллион токенов. Подешевело одно — чтение из кэша: 0,25 доллара за миллион вместо 1, то есть множитель 0,025 от базового входа вместо стандартных 0,1. Вендор оценивает экономию на типичной нагрузке в 25%, на агентной — до 45%. Но новостью для тех, кто уже вызывает Fable 5 из кода, будет не цена: три изменения ломающие. Принудительный вызов инструмента теперь отдаёт 400. Блоки рассуждений привязаны к модели, которая их произвела. А правка ранних сообщений диалога роняет следующий запрос. Ниже — что именно проверить в своей интеграции до того, как поменять строку с идентификатором модели.
Что изменилось в Claude Fable 5.1 по сравнению с Fable 5
Спецификация та же, поведение другое.
Все цены и даты ниже — из прайса Anthropic и таблицы отключений, проверено 3 сентября 2026 года.
| Свойство | Fable 5 | Fable 5.1 |
|---|---|---|
| Идентификатор | claude-fable-5 | claude-fable-5-1 |
| Дата выхода | 9 июня 2026 | 1 сентября 2026 |
| Контекст | 1 млн токенов | 1 млн токенов |
| Максимум выхода | 128 тыс. токенов | 128 тыс. токенов |
| Вход / выход | $10 / $50 | $10 / $50 |
| Чтение из кэша | $1 | $0,25 |
| Запись в кэш, 5 мин / 1 час | $12,50 / $20 | $12,50 / $20 |
| Порог знаний | январь 2026 | июнь 2026 |
| Отключение | не раньше 09.06.2027 | не раньше 01.09.2027 |
Порог знаний сдвинулся на пять месяцев — с января на июнь 2026. Это заметно больше, чем разрыв между Fable 5 и вышедшим позже Opus 5, у которого порог май 2026. Мы писали в августе, что цена не индикатор свежести знаний: у самой дорогой модели линейки знания тогда были старее, чем у вдвое более дешёвой. С выходом 5.1 порядок восстановился.
Токенизатор не менялся — тот же, что появился с Opus 4.7. Если вы сравниваете счёт с моделями старше 4.7, помните про примерно 30% лишних токенов на том же тексте.
Сколько стоит Fable 5.1 и откуда берётся экономия в 25%
Экономия приходит целиком со стороны кэша, и только у тех, кто кэш использует.
Возьмём агента, который держит в системном префиксе 200 тысяч токенов документации и за сессию перечитывает их 50 раз.
| Что считаем | Fable 5 | Fable 5.1 |
|---|---|---|
| Запись префикса в кэш на 5 минут | $2,50 | $2,50 |
| 50 чтений из кэша (10 млн токенов) | $10,00 | $2,50 |
| Итого за входную часть | $12,50 | $5,00 |
| Те же 10 млн токенов без кэша вообще | $100,00 | $100,00 |
Входная часть сессии стоит 40% от прежней — экономия 7,50 доллара, или 652 рубля по курсу ЦБ на 3 сентября 2026 года (86,9963 ₽ за доллар). Запись в кэш не подешевела ни на цент, и это главное, что стоит удержать: выгода целиком в перечитывании.
Отсюда же следует, кому изменение не даст ничего. Разовый запрос без кэша стоит ровно столько же, сколько вчера. Короткий промпт тоже: минимальная длина кэшируемого блока осталась 512 токенов. Оценка «на 25% дешевле» из анонса Anthropic — средняя по типичной нагрузке. Свой счёт по ней не предскажешь. Верхняя граница в 45% относится к «highly agentic work»: формулировка вендора, конкретной методики за ней не опубликовано.
Рублёвые ставки каталога живут в отдельном материале — сколько стоит миллион токенов в рублях, дублировать таблицу здесь не будем.
Почему tool_choice возвращает 400 и чем его заменить
Fable 5.1 и Mythos 5.1 не поддерживают принудительный вызов инструмента: tool_choice со значением any или tool возвращает 400 invalid_request_error. Работают только auto и none. Это первое ломающее изменение и самое вероятное на практике.
Если в запросе стоит tool_choice: {"type": "any"} или {"type": "tool", "name": "..."}, API возвращает 400 invalid_request_error с текстом о том, что типы tool и any для этой модели не поддерживаются. Та же проверка применяется к эндпоинту подсчёта токенов. Значения auto (по умолчанию) и none работают как раньше.
Причина в архитектуре. У модели всегда включено адаптивное рассуждение, а принудительный вызов инструмента его пропускает: модель начинает писать ход мысли прямо в аргументы функции, и качество аргументов падает. Anthropic решила запретить конструкцию целиком — тихая деградация обошлась бы дороже явной ошибки.
Чем заменить, по убыванию надёжности:
- Строгие инструменты. Оставить
tool_choice: {"type": "auto"}и выставитьstrict: true. Схему тогда держит валидатор, а модель по дороге думает. - Структурированный вывод. Если схема нужна ради JSON и никакого инструмента за ней нет, перенесите её в structured outputs. Отдельный механизм, он остался на месте.
- Прямая инструкция в промпте. Написать словами, когда инструмент применяется: «используй инструмент
get_weather, чтобы ответить». В документации сказано, что Fable 5.1 надёжно следует явным указаниям на инструмент.
Если у вас в коде принудительный вызов зашит в обёртку над SDK — это единственное место, которое обязательно надо тронуть перед миграцией. Остальное можно проверять постепенно.
Что происходит с блоками рассуждений при смене модели
Каждый блок рассуждений теперь помнит, какая модель его произвела, и читается только в одну сторону.
Fable 5.1 читает блоки более ранних моделей. Ни одна ранняя модель не читает блоки Fable 5.1. Практический смысл: диалог, который переезжает на 5.1 с Opus 5 или Fable 5, сохраняет всё накопленное рассуждение. Диалог, который уходит с 5.1 назад, теряет его на тех ходах, что выполняются на старой модели.
Опасность здесь тихая. Когда в запросе приходит блок, который целевая модель прочитать не может, API выбрасывает его до того, как модель его увидит. Выброшенные блоки не считаются во входных токенах и не оплачиваются — и по умолчанию об этом никак не сообщается. Узнать о выбросе можно только с бета-заголовком thinking-binding-controls-2026-08-01: тогда в ответе появляется массив верхнего уровня input_transformations.
Кого это касается в первую очередь: маршрутизаторы и схемы с fallback, которые переключают модель посреди диалога. Именно там качество может просесть без единого сообщения об ошибке — просто потому, что половина контекста рассуждений молча исчезла по дороге.
Почему правка ранних ходов ломает следующий запрос
Если между двумя запросами изменилось что угодно, что стоит раньше блока рассуждений — системный промпт, массив tools или любое раннее сообщение, — следующий запрос отдаёт 400 с сообщением о том, что блок привязан к другому диалогу. Третье ломающее изменение бьёт по самому распространённому приёму: сборке массива messages вручную.
Что ломает всё, что идёт следом:
- правка, перестановка или удаление раннего хода при сохранении поздних;
- вставка в ранний ход текста, который вы удаляете на следующем запросе, — напоминание, статусная строка, служебная пометка;
- пересборка системного промпта или массива
toolsмежду запросами внутри одного диалога; - изображение или документ по ссылке, которая на следующем запросе отдаёт другие байты (проверка идёт по байтам, поэтому ротация подписанной ссылки на тот же файл безопасна).
Что безопасно: удаление подряд идущих блоков рассуждений с начала (от самых старых), серверное подрезание контекста и компакция, перенос меток cache_control и смена effort между запросами. Удаление блока откуда угодно, кроме начала, обнуляет все последующие.
Отдельная деталь про даты. Проверка обязательна для аккаунтов, созданных 31 августа 2026 года и позже. Для более ранних аккаунтов API фиксирует несовпадение, но реагирует только если в запросе явно выставлен thinking.block_binding.prefix_mismatch_behavior. То есть старый аккаунт может проехать миграцию без единой ошибки, а новый упадёт на том же коде. Разница не в коде — в дате регистрации. Из всей миграции это самая странная деталь: одна и та же интеграция ведёт себя по-разному в зависимости от того, когда завели аккаунт.
Правильная модель работы, которую вендор предлагает взамен: считать диалог append-only. Инструкции добавлять серединными системными сообщениями, инструменты менять через смену инструментов посреди диалога, историю подрезать серверными механизмами. Приятный побочный эффект — те же самые правила держат кэш промптов горячим.
Что изменилось в поведении без единой правки кода
Есть ещё семь отличий, которые проявятся сами, без ошибок и без предупреждений.
- Параллельные вызовы инструментов стали менее предсказуемыми. Там, где Fable 5 отправляла пачку вызовов, 5.1 может отправить один за ход. Ответ не хуже, но лишние ходы стоят токенов, круговых поездок и времени. Лечится одной строкой в промпте про батчинг.
- Меньше текста между вызовами инструментов. Особенно на высоком уровне усилий. Если ваш интерфейс показывал пользователю ход работы, он замолчит.
- На низком усилии модель чаще отвечает по памяти, реже дёргая поиск и извлечение. Для задач, где нужна свежая информация, усилие надо поднимать.
- Плотнее проза: длиннее предложения, меньше абзацных разрывов.
- Меньше форматирования в чате — жирного, заголовков, списков. Анти-форматные правила, написанные для старых моделей, теперь могут выдавить структуру, которая тексту нужна.
- Цитаты в пересказах чаще идут неразмеченными: модель воспроизводит куски источника, не помечая их как цитату. Для пересказа чужих документов это прямой риск.
- Мелкие правки файлов чаще превращаются в перезапись целиком. Результат обычно тот же, но выходных токенов и времени уходит больше.
Ни одно из этих отличий не сломает запрос. Каждое способно сдвинуть счёт или пользовательский опыт, и заметить их можно только на своих задачах.
Что нового в Fable 5.1: усилие по ходу диалога и видимые статусы
Три добавления, все в бете, и все — про длинные агентные сессии.
Усилие внутри диалога. Уровень effort можно менять от сообщения к сообщению, не пересобирая запрос и не ломая блоки рассуждений. Дешёвый способ гонять рутину на низком усилии и поднимать его на трудных ходах.
Системные сообщения на один ход. Поле clear_at: "next_user_message" у сообщения с ролью system даёт тексту авторитет системного промпта на текущий ход, после чего сообщение перестаёт применяться. Оно остаётся в массиве и отправляется обратно дословно — ничего в истории не меняется, кэш продолжает совпадать, блоки рассуждений остаются валидными, а погашенное сообщение не стоит входных токенов. Это ровно замена той самой вставке-и-удалению, которая теперь ломает диалог.
Видимые статусы работы. Значение display: "updates" возвращает короткие заметки о ходе работы текстом, оставляя рассуждение скрытым. По умолчанию thinking.display стоит в omitted, и такие блоки приходят пустыми — из-за чего длинный агентный ход выглядит для пользователя молчанием.
Плюс content provenance: текст Fable 5.1 и Mythos 5.1 несёт статистический водяной знак Anthropic на всех площадках, где модель доступна, а файлы — подписанные метаданные C2PA. Мы разбирали механику в августе; здесь важно, что новая модель попадает под маркировку с первого дня.
Что из этого работает через каталог KeyDealer
Скидка на кэш через маршрут не доходит, и самой Fable 5.1 в каталоге пока нет. Дальше — что отдаёт живая выдача.
На 3 сентября 2026 года GET /v1/models отдаёт 46 позиций. Fable 5.1 среди них нет. Fable 5 есть — и она вернулась в выдачу именно 3 сентября, после двенадцати дней отсутствия, в статусе review: и по availability, и по всем трём протоколам. Запрос к позиции в review падает до резервирования баланса, денег не списывает и отдаёт model_under_review.
Остальные семь моделей Claude — Haiku 4.5, Sonnet 4.6, Sonnet 5, Opus 4.6, 4.7, 4.8 и Opus 5 — открыты, и у всех семи protocols.anthropic_messages стоит в available. Для темы статьи это существенно: три ломающих изменения живут в Messages API, а он у нас теперь открыт. В середине августа он стоял в review у всей линейки.
Что до скидки на кэш — она через маршрут не доезжает. У всех 41 текстовой позиции каталога prompt_cache.status равен unsupported. Это значит ровно то, что написано в самом поле: скидка за попадание в кэш не обещается и не применяется. Бюджет считайте по полной ставке входа. Кэширование держите в голове как свойство прямого API вендора — до нашего счёта оно не доходит.
Отключение Fable 5 никто не назначал: статус Active, дата не раньше 9 июня 2027 года. Все известные даты мы собираем в календаре отключений, туда эта строка и уходит.
Как проверить свою интеграцию до миграции
Шесть проверок, из которых обязательны две первые: принудительный вызов инструмента и правка истории. Порядок ниже экономит вечер.
- Грепните код по
tool_choice. Если найдёте"any"или{"type": "tool"}— это гарантированная 400. Меняйте наautoплюсstrict: trueили на структурированный вывод. - Найдите места, где вы правите историю. Пересборка системного промпта, вставка напоминаний в ранние ходы, перестановка сообщений. Всё это теперь запрещено внутри диалога.
- Прогоните сессию с
prefix_mismatch_behavior: "drop_block"и залогируйтеinput_transformations. Пустой массив — интеграция чистая. Непустой — у вас есть список мест, которые надо чинить. - Проверьте дату создания аккаунта. До 31 августа 2026 — проверка не применяется автоматически, и ошибка вылезет позже, при переезде на новый аккаунт.
- Посмотрите, кто у вас переключает модели посреди диалога, и добавьте бета-заголовок
thinking-binding-controls-2026-08-01, чтобы выбросы блоков перестали быть тихими. - Отдельно проверьте отказы. Модель может вернуть HTTP 200 со
stop_reason: "refusal". Разрешённые цели fallback для Fable 5.1 — Opus 4.8 и Opus 5.
И про хранение данных, раз уж эта тема тянется за всей линейкой. В анонсе Anthropic обещает Enterprise Frontier Safeguards — приватность уровня нулевого хранения при том, что данные лежат в облаке самого клиента; раскатка по фазам «начиная позже этой осенью», а до тех пор нулевое хранение обещано «подходящим клиентам». В документации формулировка жёстче: Fable 5.1 и Mythos 5.1 — Covered Models с тридцатидневным хранением, и нулевое хранение недоступно, если Anthropic не разрешила его явно. Расхождение между анонсом и контрактом стоит держать в голове; что при этом уходит провайдеру в обычном режиме, мы разбирали отдельно.
Проверить, что каталог отдаёт прямо сейчас, можно одним запросом к GET /v1/models — ключ берётся на странице входа, и живая выдача всегда честнее любой статьи, включая эту.
Частые вопросы
Когда вышла Claude Fable 5.1?
1 сентября 2026 года. Идентификатор модели — claude-fable-5-1, контекст 1 млн токенов, выход до 128 тысяч. Отключение не раньше 1 сентября 2027 года.
Сколько стоит Fable 5.1?
10 долларов за миллион входных токенов и 50 за миллион выходных — ровно столько же, сколько Fable 5. Изменилась только цена чтения из кэша: 0,25 доллара за миллион вместо 1.
Почему tool_choice возвращает 400?
Fable 5.1 и Mythos 5.1 не поддерживают принудительный вызов инструмента. Значения any и tool у параметра tool_choice отдают invalid_request_error. Работают только auto и none.
Отключат ли Fable 5 после выхода 5.1?
Нет. У Fable 5 статус Active, отключение не раньше 9 июня 2027 года. Модель просто перестала быть последней в линейке.
Есть ли Fable 5.1 в каталоге KeyDealer?
На 3 сентября 2026 года нет. В каталоге из 46 позиций стоит Fable 5, и она в статусе review. Остальные семь моделей Claude открыты.
Работает ли скидка на кэш через посредника?
Нет. У всех позиций каталога поле prompt_cache.status равно unsupported, скидка за попадание в кэш не обещается и не применяется.
Чем Fable 5.1 отличается от Opus 5?
Ценой и назначением. Opus 5 стоит 5 и 25 долларов за миллион токенов, Fable 5.1 — 10 и 50. Anthropic советует начинать с Opus 5, а Fable 5.1 брать для тяжёлых рассуждений и длинных агентных задач.
Можно ли задать temperature у Fable 5.1?
Нет. Недефолтные значения temperature, top_p и top_k возвращают 400, как и у всех моделей Claude начиная с Opus 4.7. Предзаполнение ответа ассистента тоже отдаёт 400.
Что делать, если Fable 5.1 отказалась отвечать?
Отказ приходит как HTTP 200 со stop_reason refusal. Разрешённые цели fallback для Fable 5.1 — Opus 4.8 и Opus 5. За отказ, пришедший до генерации выхода, счёт не выставляется.
Источники
- https://platform.claude.com/docs/en/models/fable-5-1/whats-new-fable-5-1
- https://platform.claude.com/docs/en/about-claude/pricing
- https://www.anthropic.com/claude-fable-and-mythos-5-1
- https://platform.claude.com/docs/en/about-claude/model-deprecations
- https://api.keydealer.ru/v1/models
- https://www.cbr.ru/scripts/XML_daily.asp