Мир ИИ
Mojo открыли целиком: язык для инференса под Apache 2.0
18 августа Modular открыла исходники Mojo целиком: компилятор, инструментарий и всё необходимое для сборки языка выложены под лицензией Apache 2.0 с исключениями LLVM. За неделю до этого язык дошёл до версии 1.0 со стабильностью исходного кода. До сих пор Mojo развивался странным для отрасли образом: четыре года открытое сообщество вокруг закрытого компилятора. Для разработчика, который просто отправляет запросы к API и платит за токены, новость выглядит далёкой — язык программирования, компиляторы, ускорители. Но связь прямее, чем кажется, и она объясняет, почему цены на токены не могут падать бесконечно. Разбираем.
Что за язык и зачем он
Коротко о задаче, которую Mojo решает, потому что без неё непонятно, при чём тут цены.
Модели работают на ускорителях, и код, который на них выполняется, пишут не на Python. Python — язык, на котором описывают, что нужно сделать; сама работа происходит в низкоуровневых ядрах, написанных обычно на C++ и специализированных диалектах под конкретное железо.
Отсюда вечная проблема отрасли: исследователи пишут на Python, а производительность живёт в C++. Между ними пропасть, через которую всё приходится переносить руками, и каждый перенос — это время и ошибки.
Mojo задумывался как мост: синтаксис, близкий к Python, компиляция в эффективный код для ускорителей. Идея в том, чтобы человек, придумавший новый способ считать внимание в модели, мог сам написать быструю реализацию, не превращаясь в системного программиста.
Насколько это получилось — вопрос практики, и открытие исходников как раз делает ответ проверяемым.
Почему закрытый компилятор был проблемой
Деталь, которая объясняет, почему открытие — новость, а не формальность.
Язык программирования — это инфраструктура. На нём строят то, что должно работать годами. И решение строить на языке принимается не по красоте синтаксиса, а по ответу на вопрос «что будет, если разработчик языка передумает».
С закрытым компилятором ответ звучал плохо: если компания меняет условия, закрывается или её покупают, у вас нет ни возможности собрать язык самому, ни права его форкнуть. Весь код, написанный на нём, оказывается заложником.
Именно поэтому языки, претендующие на серьёзное применение, почти всегда открыты. Apache 2.0 с исключениями LLVM — стандартный для компиляторов набор: он не ограничивает коммерческое использование и снимает вопросы о правах на скомпилированные бинарники.
Мы разбирали похожую логику применительно к моделям в позиции вендоров по открытым весам: открытость важна не сама по себе, а как страховка от решений, принимаемых без вас.
Как это связано с ценой токена
Здесь и находится ответ на вопрос, зачем эта новость в блоге про доступ к моделям.
Стоимость одного запроса к модели складывается из вполне физических вещей: сколько вычислений нужно сделать, сколько энергии на это уйдёт, сколько времени займёт видеокарта. Ниже этой себестоимости цена не опустится ни у одного провайдера — можно демпинговать в убыток, но недолго.
Себестоимость снижается двумя способами. Первый — новое железо, и он медленный, дорогой и не зависит от программистов. Второй — эффективность кода: те же вычисления, выполненные лучше. Разница между наивной и оптимизированной реализацией одной и той же операции измеряется разами.
Инструменты, которые делают написание таких оптимизаций доступнее, работают именно на второй способ. Чем проще написать быстрое ядро, тем чаще их пишут, тем ниже себестоимость инференса, тем ниже пол под ценами.
Это тот самый пол, о который упирается конкуренция. Мы наблюдали, как он проявляется: DeepSeek на этой неделе ввёл тариф по часам суток вместо снижения цены — когда снижать больше нечего, начинают перераспределять нагрузку. Открытые веса давят на цену сверху, эффективность инференса поднимает возможности снизу.
Из чего складывается себестоимость запроса
Раз уж речь про пол цены, разберём его составляющие — это полезно и само по себе, независимо от новостей про языки.
Вычисления. Каждый выходной токен требует прохода по модели. Здесь и работает эффективность кода: одна и та же математика, выполненная лучше, даёт тот же ответ за меньшее время.
Память и её пропускная способность. Веса модели надо читать, и на генерации по одному токену узким местом оказывается не скорость счёта, а скорость доступа к памяти. Мы разбирали это, когда OpenAI показала ускоренный режим на железе Cerebras: выигрыш там достигается сдвигом именно этого ограничения.
Простой оборудования. Видеокарта стоит денег круглосуточно, а нагрузка неровная. Всё, что не занято, входит в себестоимость занятого. Отсюда и эксперименты вроде тарифа по часам.
Электричество и охлаждение. Составляющая, которая не уменьшается от оптимизаций кода пропорционально — она падает вместе с вычислениями, но у неё есть постоянная часть.
Полезное следствие для чтения новостей о ценах: когда провайдер снижает ставку вдвое, стоит спросить, какая из четырёх составляющих у него изменилась. Если ни одна — это скидка, а не удешевление, и она закончится. Ровно так мы четырежды за месяц ловили ложные тревоги, когда агрегатор показывал падение цены, которого у вендора не происходило.
Почему открытость инфраструктуры важнее открытости моделей
Небольшое наблюдение, которое стоит проговорить.
Про открытые веса пишут много, и мы тоже — Kimi K3, Qwen 3.8, DeepSeek, GLM. Внимание понятно: модель — это то, что видно.
Но модель без инфраструктуры бесполезна. Веса надо на чём-то запустить, а стек инференса — компиляторы, библиотеки, среды выполнения — куда менее заметен и куда более критичен. Закрытая модель на открытом стеке даёт больше свободы, чем открытая модель, которую можно запустить только на закрытом.
Практический смысл этого для читателя, который ничего не разворачивает у себя: чем более открыт стек, тем больше игроков могут предлагать инференс, тем сильнее конкуренция и тем ниже цены. Монополия на инструменты запуска сказывается на прайсе сильнее, чем монополия на конкретную модель, — потому что моделей много, а способов их запустить может оказаться мало.
Чего эта новость не означает
Отделим следствие от желаемого.
Токены не подешевеют завтра. Путь от языка к цене длинный: кто-то должен написать на нём ядра, кто-то внедрить их в стек инференса, кто-то раскатать в продакшен. Это годы, а не недели.
Это не замена Python. Речь про слой, где сегодня живёт C++, а не про то, на чём пишут прикладную логику.
Открытие исходников не гарантирует сообщества. Многие открытые проекты остаются проектами одной компании. Реальную самостоятельность языка покажет то, появятся ли значимые внешние участники.
Мы не оценивали язык технически. Мы не писали на нём и производительность не мерили; в статье описываем событие и его место в общей картине.
Что из этого практично сегодня
Три вещи, если вы не собираетесь писать ядра для ускорителей.
Понимание, откуда берётся пол цены. Когда провайдер объявляет ставку сильно ниже рынка, полезно помнить, что себестоимость никуда не делась. Либо это временная акция, либо экономия на чём-то другом.
Ожидания по динамике цен. Резких обвалов ждать не стоит — снижение идёт медленно, вслед за эффективностью и железом. Планировать бюджет на «через полгода будет вдвое дешевле» не надо.
Внимание к лицензиям инфраструктуры. Тот же вопрос, что и с моделями: на чём вы строите и что будет, если владелец передумает. Для языка ответ теперь хороший.
Как считать текущие расходы по строкам — в разборе стоимости миллиона токенов в рублях.
Что держать в голове
Mojo открыли целиком под Apache 2.0 после четырёх лет закрытой разработки компилятора. Для языка, претендующего на инфраструктурную роль, это условие, без которого на нём не строят.
Связь с вашим счётом непрямая, но реальная: инструменты, удешевляющие инференс, определяют пол, ниже которого цена за токен не опустится. Открытые веса давят сверху, эффективность вычислений поднимает снизу, и между ними и живут ставки, которые вы платите.
Как мы отделяем проверенное от предполагаемого — на странице о проекте. Сорок позиций каталога по одному ключу: keydealer.ru/login.
Частые вопросы
Что именно открыли?
Исходный код компилятора Mojo, инструментов и всего необходимого для сборки языка. Объявлено 18 августа 2026 года.
Под какой лицензией?
Apache 2.0 с исключениями LLVM. Такие исключения расширяют свободы при сборке и распространении бинарных файлов, скомпилированных из исходников.
Что было раньше?
Четыре года язык развивался с открытым сообществом, но с закрытым компилятором. Версия 1.0 вышла за неделю до открытия исходников.
Зачем язык, если есть Python?
Mojo создавался как язык, сохраняющий привычный синтаксис, но компилируемый в эффективный код для ускорителей. Задача — писать быстрые ядра для инференса, не спускаясь на уровень C++.
Как это касается тех, кто платит за токены?
Через себестоимость инференса. Дешевле выполнить запрос — ниже пол, ниже которого цена за токен не опустится ни у кого.