Мир ИИ

Бизнес нашёл потолок: Fable 5 берут только 6% токенов

Бизнес нашёл потолок: Fable 5 берут только 6% токенов

Индекс Ramp за август показал неожиданное: спустя месяц после выхода Claude Fable 5 собрала всего 6% токенов, купленных бизнесом у Anthropic, и 11,4% потраченных там денег. Это при том, что модель подавалась как сильнейшая на рынке. Для сравнения, флагман OpenAI GPT-5.6 Sol забирает 25% токенов и 23% расходов у своего вендора. Сам Anthropic при этом лидирует: за него платят 43,5% американских компаний, и доля выросла на 1,1 пункта за месяц. То есть проблема не в вендоре, а в цене конкретной модели — бизнес нащупал потолок готовности платить за прирост качества. В нашем каталоге Fable 5 стоит 180 ₽ за миллион, и дальше разбираем, как понять, ваш ли это случай.

Что показали цифры

Три числа, которые стоит держать вместе, потому что по отдельности каждое вводит в заблуждение.

ПоказательЗначение
Компаний США платят Anthropic43,5% (+1,1 п.п. за месяц)
Доля Fable 5 в токенах у Anthropic6%
Доля Fable 5 в деньгах у Anthropic11,4%
Доля GPT-5.6 Sol в токенах у OpenAI25%
Доля GPT-5.6 Sol в деньгах у OpenAI23%

Самое информативное здесь — не абсолютные доли, а соотношение между токенами и деньгами внутри каждого вендора.

У OpenAI флагман забирает 25% объёма и 23% денег: числа почти совпадают, значит модель стоит примерно как средняя по линейке. У Anthropic 6% против 11,4%: доля в деньгах почти вдвое выше доли в работе. Это прямое следствие цены — тот же объём обходится дороже.

Проще говоря: за Fable 5 платят непропорционально много относительно того, сколько ей поручают.

Почему это не про качество модели

Соблазн прочитать новость как «модель оказалась плохой» есть, и он ошибочный.

Anthropic одновременно растёт как вендор: 43,5% компаний и плюс 1,1 пункта за месяц. Люди не уходят от Anthropic — они внутри линейки выбирают модели подешевле.

Это разумное поведение, и мы к нему призывали задолго до этих цифр. Флагман нужен там, где задача действительно упирается в потолок возможностей: сложные многошаговые рассуждения, архитектурные решения, длинные исследовательские цепочки. Для классификации писем, извлечения полей из документов и переписывания текстов он избыточен ровно так же, как грузовик для поездки в магазин.

Где проходит граница

Практическая часть: как понять, попадает ли ваша задача в те 6%.

Признаки, что флагман оправдан. Задача плохо формализуется, у неё нет одного правильного ответа, цена ошибки высока, а объём запросов невелик. Типичный пример — разбор сложного случая, где ответ читает человек и принимает по нему решение.

Признаки, что он избыточен. Задача повторяется тысячи раз, ответ проверяется автоматически, формат жёсткий. Здесь разница между моделями съедается тем, что обе справляются, а разница в цене — нет.

Как проверить. Прогнать сотню своих реальных запросов через дорогую и дешёвую модель и сравнить результаты вручную. Это стоит рубли и занимает вечер. Любой другой способ выбора — гадание, включая чтение рейтингов и эту статью тоже.

В нашем каталоге разброс внутри линейки Claude такой: fable-5 — 180 ₽ за миллион в обе стороны, opus-5 — 30 ₽, opus-4-8 — 40 ₽, sonnet-5 — 30 ₽, haiku-4-5 — 8 ₽. Между верхней и нижней ставкой разница в 22,5 раза. Как разложить это в месячный бюджет — в разборе стоимости миллиона токенов в рублях.

Почему потолок появился именно сейчас

Стоит объяснить, откуда взялась граница, — раньше её не было.

Первые пару лет разница между поколениями моделей была очевидной: новая версия делала то, чего предыдущая не умела вовсе. Платить больше было легко, потому что альтернативы не существовало.

Сейчас ситуация другая. Разрыв между флагманом и моделью среднего уровня сузился до «лучше формулирует» и «реже ошибается на сложных случаях». На многих задачах его вообще не видно без вдумчивого сравнения. А цена при этом различается кратно: в нашем каталоге на 5 сентября 2026 года fable-5 стоит ровно в шесть раз дороже sonnet-5.

Когда прирост качества измеряется процентами, а цена — разами, арифметика перестаёт сходиться. Компании не стали экономнее — просто разница стала различима в счёте и неразличима в результате.

Второе обстоятельство — открытые веса. Пока нижнюю границу задавал самый дешёвый закрытый вендор, она держалась высоко. Сейчас её задают модели, которые можно скачать и развернуть у себя, и это давит на весь прайс снизу.

Чего в этих данных нет

Границы, без которых цифры легко перетолковать.

Это рынок США. Ramp считает по расходам американских компаний в своей системе. Переносить пропорции на другие рынки нельзя.

Это данные за июль. Модель вышла в июне, месяц — короткий срок для корпоративного внедрения. Часть компаний просто не успела дойти до оценки, и доля вполне может подрасти в следующих срезах.

Это не оценка качества. В данных нет ничего о том, насколько хорошо модель решает задачи. Только о том, сколько за неё платят.

Мы не проверяли методику Ramp. Приводим опубликованные цифры со ссылкой на источник.

Доля в токенах не равна доле в задачах. Дорогая модель обычно применяется к более коротким и ответственным запросам, поэтому по числу решённых задач её доля может быть выше, чем 6%.

Это не значит, что модель не окупается. Если каждый её ответ экономит час работы специалиста, 180 ₽ за миллион токенов — незаметная сумма. Данные Ramp говорят о среднем по рынку, а не о вашей экономике.

Что из этого следует для рынка

Небольшое наблюдение, выходящее за рамки одной модели.

Если бизнес действительно нащупал потолок цены, это меняет стимулы вендоров. Наращивать качество ценой удорожания перестаёт работать: рынок не берёт. Выигрывает тот, кто даёт сопоставимое качество дешевле.

Признаки этого уже видны. Anthropic на прошлой неделе отменила запланированное подорожание Sonnet 5, сделав вводную цену постоянной. Grok 4.6 вышел с индексом интеллекта наравне с GPT-5.6 Sol и оказался самой дешёвой моделью на фронтире. Открытые веса продолжают давить на нижнюю границу.

Всё это — движение в одну сторону: цена становится главным полем конкуренции, а не бенчмарки.

Что делать

Четыре шага, если новость показалась про вас.

  1. Посмотрите, какая модель съедает больше всего денег. Обычно это не та, которую вызывают чаще всего.
  2. Возьмите три самые дорогие задачи и попробуйте их на модели дешевле. Не на всех сразу — на трёх, иначе сравнение утонет в объёме и вы бросите его на середине.
  3. Сравнивайте результаты глазами, а не по метрике. Автоматическая оценка на малой выборке врёт сильнее, чем помогает.
  4. Оставьте флагман там, где он реально выиграл. Отказываться от него полностью так же неразумно, как использовать везде.
  5. Заведите отдельные ключи под дорогие сценарии. Тогда расход по ним виден отдельной строкой, а не растворяется в общей сумме.

Последний пункт стоит пояснить. Пока все задачи ходят через один ключ, вопрос «сколько мы тратим на флагман» требует разбора логов. С отдельным ключом ответ виден сразу, и решение о переезде принимается по цифре, а не по ощущению.

Что держать в голове

Fable 5 через месяц после выхода собрала 6% токенов и 11,4% денег у своего вендора, при том что сам вендор растёт. Бизнес не отказывается от Anthropic — он выбирает внутри линейки модели подешевле.

Вывод для вас практический: потолок готовности платить есть и у вашего проекта, просто вы его, возможно, ещё не считали. Считается он сотней запросов на своих данных, а не чтением рейтингов и не выбором самой сильной позиции в прайсе.

И последнее: отказ от флагмана не обязан быть окончательным. Модели дешевеют, а задачи усложняются — решение, принятое сегодня, стоит пересматривать раз в квартал, а не считать высеченным в камне.

Как мы проверяем цифры и почему у каждой стоит источник — на странице о проекте. Сравнить модели на своих задачах по одному ключу: keydealer.ru/login.

Частые вопросы

Что показывает индекс Ramp?

Долю компаний США, которые платят за подписки и токены разных вендоров ИИ, по данным корпоративных расходов. В июле 2026 года за Anthropic платили 43,5% компаний — на 1,1 процентного пункта больше, чем месяцем ранее.

Насколько популярна Fable 5?

Через месяц после выхода на неё пришлось 6% токенов, купленных у Anthropic, и 11,4% потраченных там денег. Для сравнения, флагман OpenAI GPT-5.6 Sol собирает 25% токенов и 23% расходов.

Почему доля денег вдвое выше доли токенов?

Потому что модель существенно дороже остальных. Тот же объём работы стоит больше, и в деньгах доля растёт быстрее, чем в токенах.

Что это значит для выбора модели?

Что рынок нащупал границу, за которой прирост качества не оправдывает цену. Проверять эту границу нужно на своих задачах, а не по чужим рейтингам.

Сколько Fable 5 стоит в каталоге KeyDealer?

180 рублей за миллион входных и выходных токенов — самая дорогая позиция каталога. Следующая, Opus 5, стоит 30 рублей.

Источники