Релизы и изменения моделей

Sakana Fugu Max и Ultra v2: оркестрация вместо модели

Sakana Fugu Max и Ultra v2: оркестрация вместо модели

11 сентября 2026 года Sakana AI выпустила Fugu Max и Fugu Ultra v2 — две модели, которые сами ничего не генерируют. Они разбирают запрос и раздают подзадачи пулу других моделей, включая открытые NVIDIA Nemotron. Fugu Max стоит $2 за миллион входных токенов и $6 за выходные: по выходу это на 40% дешевле Sonnet 5 и на 50% дешевле GPT-5.6 Terra — обе цены мы сверили с документацией вендоров. Fugu Ultra v2 ($5 / $30) на тесте визуального разбора данных Chartography набрал 48,3 против 27,3 у Opus 5 и 29,5 у Fable 5. Самое интересное в релизе — заявка Sakana: Ultra v2 собран без Fable 5.1, Fable 5 и GPT-6 Astra в пуле и всё равно держит фронтирный уровень. Моделей Sakana в каталоге KeyDealer нет, но сама идея — маршрутизировать задачу к самой дешёвой модели, которая её вытянет, — на рублёвом каталоге воспроизводится, и ниже мы считаем, сколько это даёт.

Что выпустила Sakana AI 11 сентября 2026 года

Две модели одной архитектуры под разные задачи. Об этом сказано в анонсе прямым текстом: Fugu Max и Fugu Ultra v2 — один оркестратор, настроенный на две противоположные цели.

МодельВопрос, на который она отвечаетВход, $/MВыход, $/M
Fugu MaxЛучший результат при минимальной цене26
Fugu Ultra v2Максимальное качество на сложных многошаговых задачах530

По курсу ЦБ на 11 сентября — 84,3508 ₽ за доллар — это 168,70 ₽ и 506,10 ₽ за миллион у Fugu Max, 421,75 ₽ и 2530,52 ₽ у Fugu Ultra v2. Курс мы берём с сайта ЦБ на дату публикации; он за три дня сполз с 86,47 до 84,35 ₽, так что долларовый прайс в рублях сегодня выглядит мягче, чем в понедельник.

Sakana AI — японская лаборатория, и эта линейка у неё не первая. По собственной хронологии в анонсе: апрель — бета, июнь — общая доступность и Fugu Ultra v1, июль — специализированная Fugu-Cyber и интерфейс для Claude Code, август — потребительский Sakana Chat и партнёрство с NVIDIA, и через него в пул начали заводить открытые модели Nemotron.

Что такое оркестрация моделей и чем она отличается от выбора модели

Оркестратор — это модель, которая принимает ваш запрос, но не отвечает на него сама. Она разбирает задачу на части, решает, какая модель из доступного пула справится с каждой частью дешевле всего, раздаёт подзадачи и собирает результат. Снаружи всё выглядит как обращение к одной модели: тот же OpenAI-совместимый запрос, то же поле model.

Тезис Sakana сформулирован жёстко: система, которая гоняет модель на триллионы параметров, чтобы достать значение из справочника, не умная, а расточительная. Отрасль десять лет двигалась по одной оси — модель побольше. А фронтир, который реально имеет значение, двумерный: качество по одной оси, цена по другой.

Разница с обычным выбором модели вот в чём. Когда вы сами решаете «эту задачу отдам в Haiku, а ту в Opus», решение принимается один раз на уровне типа запроса. Оркестратор принимает его на уровне подзадачи и внутри одного запроса — и делает это без вашего участия. Как это разводить руками, мы разбирали в материале про маршрутизацию между дешёвой и сильной моделью; там же граница, по которой проходит разделение.

Сколько стоит Fugu Max и насколько он дешевле Sonnet 5 и GPT-5.6 Terra

Sakana заявляет, что выход Fugu Max на 40–60% дешевле, чем у Sonnet 5, GPT-5.6 Terra и Kimi K3. Мы пересчитали по документации вендоров на 11 сентября 2026 года, и вилка получилась уже: 40–50%.

МодельВыход, $/MFugu Max дешевле наИсточник цены
Fugu Max6Анонс Sakana
Claude Sonnet 51040,0%platform.claude.com
GPT-5.6 Terra1250,0%developers.openai.com
Kimi K3не подтверждена

Третью строку честно оставляем пустой. Страница тарифов Moonshot отдаётся скриптом, из которого цена K3 не вычитывается, а брать её у перепродавца мы не будем — правило простое: цена берётся у того, кто модель сделал. Так что верхняя граница заявленной вилки на наших данных не проверяется. Нижняя — проверяется точно: 40,0% против Sonnet 5, ровно как обещано.

Рублёвые ставки, по которым считают в России, живут отдельно и от долларового прайса вендора не зависят напрямую — полная таблица цен за миллион токенов обновляется по каталогу.

Что Fugu Ultra v2 показал на бенчмарках

Лучший или совместно лучший результат на пяти тестах из восьми: GDP.pdf, Chartography, SWEFish, DeepSWE и Toolathon. В топ-2 — на семи из восьми. Все цифры ниже взяты из анонса Sakana от 11 сентября 2026 года; это замеры самой лаборатории, независимой проверки у нас нет.

ТестFugu Ultra v2Opus 5Fable 5
Chartography (визуальный разбор данных)48,327,329,5
DeepSWE (реальная разработка)74,3

Разрыв на Chartography — 21 пункт против Opus 5 и 18,8 против Fable 5, то есть в 1,77 и 1,64 раза. Если эти замеры воспроизводятся вне лаборатории, интереснее другое — где именно оркестратор отрывается. На задачах со сложной визуальной и структурированной информацией, где разбор естественно раскладывается на шаги. Ровно там, где раздача подзадач имеет смысл.

Fugu Max, по данным Sakana, берёт лучший общий счёт на шести тестах — Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench и внутреннем SWEFish — и расширяет фронт Парето на семи из десяти. Дата отсечения знаний Fugu Ultra v2 — 28 августа 2026 года.

Почему Fugu Ultra v2 собрали без Fable 5.1 и GPT-6 Astra

Sakana отдельно оговаривает: в пуле Fugu Ultra v2 нет ни Fable 5, ни Fable 5.1, ни GPT-6 Astra. Оговорка намеренная — в ней всё заявление и держится. Оркестратор показывает фронтирный результат, не опираясь на самые дорогие проприетарные модели.

Посчитаем, что это значит по деньгам. Fable 5.1 стоит $10 за миллион входных и $50 за выходные, GPT-6 Astra — столько же. Fugu Ultra v2 при $5 и $30 вдвое дешевле на входе и на 40% дешевле на выходе, чем любая из двух. А относительно Opus 5 ($5 / $25) картина другая: вход тот же, выход на 20% дороже. Оркестрация не бесплатна — дирижёр тоже тратит токены на разбор задачи и сборку ответа.

Защищает ли оркестрация от отключения модели

Частично — и это самая практичная часть релиза. Sakana пишет, что сменный пул моделей даёт устойчивость цепочки поставок по построению, и перечисляет риски прямо: привязка к вендору, отзыв доступа к API, геополитическая турбулентность, внезапное прекращение обслуживания.

Для российского разработчика это не абстракция. Мы ведём календарь отключений моделей именно потому, что дату вывода из эксплуатации назначает вендор. С вашим релизным циклом её никто не согласует. Логика оркестратора здесь простая: если контракт наружу — это имя дирижёра, а не имя конкретной модели, то уход любой позиции из пула перестаёт быть событием для вашего кода.

Оговорка обязательна: в этой схеме вы зависите уже от поставщика оркестратора. Риск не исчезает, он смещается на уровень выше. Что делать, когда падает не модель, а маршрут, мы разбирали в материале про коды отказов и переключение на запасной вариант.

Как собрать маршрутизацию по сложности на рублёвом каталоге

Развести запросы по сложности между дешёвой и сильной моделью можно на любом каталоге, где ставки разнесены, и на смешанном профиле счёт падает примерно вдвое — расчёт ниже. Моделей Sakana в каталоге KeyDealer на 11 сентября нет: GET /v1/models отдаёт семейства Claude, GPT, Gemini, GLM, Grok, GPT-OSS, DeepSeek, Kimi, Llama и NVIDIA. Но сам приём — отправлять задачу в самую дешёвую модель, которая её вытянет, — от наличия оркестратора не зависит. Разброс ставок у нас сильный: от 1 ₽ за миллион входных токенов у DeepSeek V4 Flash до 60 ₽ у GPT-6 Astra, то есть в шестьдесят раз. Шесть позиций доступны по нулевой ставке, и три из них — те самые открытые NVIDIA Nemotron, которые Sakana заводит в пул Fugu Max.

Считаем на месячном профиле 10 млн входных и 2 млн выходных токенов по ставкам каталога на 11 сентября:

Как ходят запросыСтоимость в месяцПротив чистого Opus 5
Всё в Opus 5 (30 ₽/M)360 ₽
Всё в Haiku 4.5 (8 ₽/M)96 ₽−73%
Всё в DeepSeek V4 Flash (1 ₽/M)12 ₽−97%
70% в Haiku 4.5, 30% в Opus 5175 ₽−51%

Последняя строка и есть рабочий сценарий: смешанный профиль срезает счёт вдвое, а сильная модель остаётся там, где она нужна. Ставки у нас одинаковы на вход и выход, поэтому арифметика прозрачная — умножить объём на ставку. Подробный разбор того, во что обходится постоянно работающий агент, лежит в отдельном материале про месячную стоимость агента.

Чего ручная схема не даёт: выбор модели под конкретную подзадачу внутри одного запроса. Это как раз то, что Sakana продаёт как продукт, и повторить это парой if не выйдет.

Чего мы не утверждаем

Все результаты бенчмарков в этой статье — публикация самой Sakana AI. Независимых воспроизведений на 11 сентября мы не видели, методики тестов в анонсе не раскрыты, а SWEFish — внутренний тест лаборатории, то есть сравнение на нём в принципе идёт на её поле. Технический отчёт Sakana обещает отдельно.

Цена Kimi K3 у вендора не подтвердилась — в сравнении она поэтому отсутствует. Возможности моделей Fugu мы не проверяли: их нет в нашем каталоге, а значит нет и статуса verified. Скидку за попадание в кэш промптов мы не обещаем ни по одной позиции каталога — на 11 сентября prompt_cache.status везде unsupported.

С чем остаться

Sakana проверяет гипотезу, которая идёт поперёк десятилетнего движения отрасли: дальше выигрывать будет не самая крупная модель, а система, знающая, какую машинерию включить под задачу. Если это подтвердится независимыми замерами, ценность отдельной модели начнёт сдвигаться к ценности доступа ко всему набору. Для тех, кто покупает доступ, а не обучает модели, это скорее хорошая новость.

Что можно сделать уже сегодня, не дожидаясь чужих подтверждений: посмотреть, какая доля ваших запросов реально требует флагмана. Обычно она меньше, чем кажется, и это единственная цифра в статье, которую вы посчитаете точнее нас — по собственному журналу.

Разброс ставок, на котором строится вся экономия, виден в живой выдаче GET /v1/models. Ключ для запросов к каталогу — на странице входа; стартовый баланс позволяет прогнать сравнение на своих задачах прежде, чем что-то менять в коде.

Частые вопросы

Что выпустила Sakana AI 11 сентября 2026 года?

Две модели-оркестратора: Fugu Max по 2 доллара за миллион входных токенов и 6 за миллион выходных, и Fugu Ultra v2 по 5 и 30 долларов. Обе не отвечают сами, а распределяют подзадачи по пулу открытых и специализированных моделей.

Кто такая Sakana AI?

Японская исследовательская лаборатория. Линейку оркестраторов Fugu она развивает с апреля 2026 года: бета в апреле, общая доступность и Fugu Ultra v1 в июне, специализированная Fugu-Cyber в июле, потребительский Sakana Chat и партнёрство с NVIDIA в августе.

Что такое оркестрация моделей?

Архитектура, в которой запрос принимает модель-дирижёр: она разбирает задачу, выбирает из пула ту модель, которая справится дешевле всего, и собирает ответ. Снаружи это выглядит как обращение к одной модели через обычный OpenAI-совместимый API.

Насколько Fugu Max дешевле Sonnet 5 и GPT-5.6 Terra?

По выходным токенам на 40% дешевле Sonnet 5 (6 долларов против 10) и на 50% дешевле GPT-5.6 Terra (6 против 12). Обе цены подтверждены документацией Anthropic и OpenAI на 11 сентября 2026 года.

Что Fugu Ultra v2 показал на бенчмарках?

По данным Sakana, лучший или совместно лучший результат на пяти тестах из восьми. На Chartography, тесте визуального разбора данных, — 48,3 против 27,3 у Opus 5 и 29,5 у Fable 5. На DeepSWE — 74,3.

Есть ли модели Sakana Fugu в каталоге KeyDealer?

На 11 сентября 2026 года нет. Актуальный список позиций всегда отдаёт GET /v1/models — в каталоге сейчас семейства Claude, GPT, Gemini, GLM, Grok, GPT-OSS, DeepSeek, Kimi, Llama и NVIDIA.

Можно ли собрать такую же экономию без модели-оркестратора?

Частично. Развести запросы по сложности между дешёвой и сильной моделью можно руками, и в каталоге KeyDealer ставки отличаются в 60 раз — от 1 ₽ за миллион у DeepSeek V4 Flash до 60 ₽ у GPT-6 Astra. Чего не даёт ручная схема — это автоматического выбора модели под конкретную подзадачу.

Чем оркестрация помогает при отключении модели?

Пул сменный: если одна модель уходит, дирижёр переключается на другую, а внешний контракт не меняется. Sakana прямо называет это защитой от отзыва доступа и внезапных отключений — Fugu Ultra v2 собран вообще без трёх самых дорогих проприетарных моделей в пуле.

Источники