Мир ИИ

Tencent открыла Hy4: 770 млрд параметров в день релиза

Tencent открыла Hy4: 770 млрд параметров в день релиза

28 августа Tencent выпустила флагманскую Hy4 preview и одновременно открыла её веса: 770 млрд параметров всего, 49 млрд активных на токен, контекст свыше миллиона. Заявлены заметные результаты на профильных наборах для работы с терминалом и с кодом. Интереснее самих цифр другое — модель такого класса вышла с открытыми весами в день релиза, без паузы на проверку безопасности. Две недели назад Z.ai поступила противоположным образом: придержала веса GLM-5.3 примерно на две недели, объяснив это тем, что киберспособности выросли быстрее ожидаемого. Два подхода к одному вопросу с интервалом в две недели — вот что стоит разобрать.

Что за модель

Параметры компактно, с обычной оговоркой про заголовочные цифры.

СвойствоЗначение
Всего параметров770 млрд
Активных на токен49 млрд
Контекстсвыше 1 млн токенов
Архитектураразреженная Mixture-of-Experts
Весаоткрыты в день релиза

Сорок девять миллиардов активных из семисот семидесяти — около 6% модели на каждый токен. Считать вычислительную нагрузку надо по этому числу, а не по заголовочному; механику разбирали на примере Kimi K3.

Любопытное совпадение: у DeepSeek V4 Pro тоже 49 млрд активных при 1,6 трлн общих. Число активных параметров у крупных разреженных моделей сходится к близким значениям — вероятно, потому что оно определяется не амбициями, а тем, что помещается в разумный бюджет вычислений на токен.

Про заявленные результаты

Компания сообщает о 85,4 балла на наборе для работы с терминалом и о росте с 28,0 до 64,3 на наборе для программной инженерии. Второе — более чем двукратное улучшение между поколениями.

Три оговорки, без которых эти цифры вводят в заблуждение.

Это замеры разработчика. Независимых подтверждений на момент публикации мы не нашли, а сравнивать заявления разных вендоров между собой некорректно: методики отличаются.

Наборы узкие. Работа с терминалом и программная инженерия — конкретные задачи. Перенос результата на «модель стала лучше» неправомерен.

Двукратный рост на одном наборе — типичный признак целенаправленной настройки. Это не обвинение: оптимизировать под важные для себя задачи нормально. Просто такой прирост говорит о фокусе разработки, а не об общем скачке возможностей.

Единственная проверка, которая чего-то стоит, — прогнать свои задачи. Методику разбирали отдельно: полсотни реальных запросов, слепое сравнение, тройной повтор каждого. Занимает вечер и отвечает на вопрос, который не закроет ни один рейтинг.

Где к ней есть доступ

Полезно разобрать, потому что схема распространения у этого релиза шире обычной.

Модель доступна сразу по нескольким каналам: в собственных продуктах компании, через её облачную платформу и через сторонние площадки-посредники. Плюс веса выложены публично — то есть её можно развернуть самому.

Отдельно заявлен бесплатный период в собственных продуктах компании на две недели после запуска.

Что из этого следует практически. Одновременный выход по всем каналам сразу — признак того, что релиз готовился как продуктовый, а не как исследовательская публикация. Модель, которую выкладывают только весами и оставляют сообществу разбираться, и модель, которая в день выхода доступна в приложении, в облаке и у посредников, — это разные стратегии.

Для пользователя вторая удобнее: попробовать можно сразу, не разворачивая ничего. Но и оговорка та же, что мы делали про бесплатные позиции нашего каталога: бесплатный период на две недели — это приглашение попробовать, а не основание строить продукт.

Почему у крупных открытых моделей похожие числа

Наблюдение, которое накопилось за месяц разборов и которое стоит зафиксировать.

Мы писали о нескольких крупных разреженных моделях подряд, и картина складывается любопытная. Общее число параметров различается в разы: 320 млрд, 770 млрд, 975 млрд, 1,6 трлн, 2,8 трлн. А число активных на токен держится в узком диапазоне — от 18 до 49 млрд.

Причина в том, что эти два числа отвечают за разное. Общее число параметров определяет, сколько знаний модель может вместить, и упирается в бюджет обучения и в объём памяти для хранения. Число активных определяет стоимость и скорость одного токена, и упирается в то, сколько вычислений разумно потратить на каждый шаг генерации.

Второй бюджет ограничен гораздо жёстче первого: он оплачивается при каждом обращении, а не один раз при обучении.

Практический вывод для чтения анонсов: заголовочная цифра говорит о ёмкости, а не о том, во что вам обойдётся запрос. Две модели с разницей в общих параметрах в разы могут стоить примерно одинаково в пересчёте на токен — и наоборот, сопоставимые по заголовку модели могут заметно различаться по цене.

Открыть сразу или придержать

Здесь самое содержательное, и здесь нет однозначно правильного ответа.

Аргумент за паузу, как у Z.ai: опубликованные веса необратимы. Скачанное не отзывается, ограничение не добавляется задним числом. Пауза перед публикацией — единственный момент, когда у вендора вообще есть выбор. Если проверка показала неожиданный рост способностей в чувствительной области, отложить публикацию — разумная реакция.

Аргумент за одновременную публикацию: пауза даёт вендору контроль, но лишает сообщество возможности проверять. Пока веса закрыты, о модели известно только то, что говорит разработчик. Открытая модель проверяема независимо, и это само по себе механизм безопасности.

Обе позиции состоятельны, и обе высказаны за две недели двумя китайскими компаниями. Отрасль явно не выработала общего подхода, и наблюдать за тем, какой закрепится, стоит — от этого зависит, насколько быстро открытые веса будут доходить до тех, кто их разворачивает.

Отдельно отметим контекст: письмо 116 компаний о коллективных действиях в кибербезопасности вышло накануне. Одновременная публикация весов флагманской модели на следующий день — не то чтобы прямое возражение, но соседство красноречивое.

Стоит добавить и то, чего в этом релизе нет и что было бы полезнее бенчмарков: описания обучающих данных. Ни одна из крупных открытых моделей, которые мы разбирали за месяц, полного состава корпуса не публикует — общие формулировки есть, перечня источников с объёмами нет ни у кого. Для пользователя это означает, что вопрос о правах на сгенерированное остаётся открытым независимо от того, насколько свободна лицензия на сами веса.

Что это значит для цен

Практическая часть, ради которой мы вообще следим за открытыми весами.

Прямого влияния на ваш счёт нет: модели в нашем каталоге нет, и разворачивать 770 млрд параметров у себя большинство не будет.

Влияние идёт через нижнюю границу. Каждая сильная открытая модель делает менее осмысленным платить много за закрытую сопоставимого класса. Мы видим это в собственном каталоге: самые дешёвые позиции — 3 ₽ за миллион токенов — дёшевы именно потому, что рядом существуют открытые альтернативы.

Оговорка, которую делаем каждый раз: порог входа в самостоятельный запуск такой модели остаётся высоким. Даже с инструментами, снижающими требования к железу, речь о конфигурации стоимостью как автомобиль, а не о домашнем компьютере.

Чего мы не утверждаем

Мы не тестировали модель. Все характеристики и результаты — из публикаций разработчика.

Не проверяли бенчмарки. Приводим заявленные цифры со ссылкой, не подтверждая их.

Не знаем условий лицензии. Факт открытия весов опубликован; конкретные условия использования должен смотреть ваш юрист — разница между свободной лицензией и собственной лицензией вендора существенна.

Модели нет в нашем каталоге. На 28 августа там 38 позиций, и сроков появления мы не называем.

Сравнение с придержанными весами GLM-5.3 — наше наблюдение, а не позиция сторон. Ни одна из компаний не комментировала решение другой; мы лишь ставим рядом два подхода, случившиеся с интервалом в две недели.

Бесплатный период относится к продуктам вендора, а не к API. Условия доступа через посредников определяются ими, а не разработчиком модели.

Что держать в голове

Вышла крупная разреженная модель с открытыми весами, опубликованными в день релиза. Заявленные результаты сильные, но принадлежат разработчику.

Главное в этой новости — не параметры, а решение публиковать сразу. Отрасль сейчас проверяет два противоположных подхода к одному вопросу, и от того, какой закрепится, зависит, как быстро открытые модели будут доходить до пользователей.

Как мы отделяем проверенное от предполагаемого — на странице о проекте. Тридцать восемь позиций каталога по одному ключу: keydealer.ru/login.

Частые вопросы

Что за модель Hy4 preview?

Флагманская модель Tencent в разреженной архитектуре: 770 млрд параметров всего, 49 млрд активных на токен, контекст свыше миллиона токенов. Вышла 28 августа 2026 года.

Веса открыты?

Да, публикация состоялась одновременно с релизом — без паузы на проверку безопасности, которую делали другие вендоры.

Какие результаты заявлены?

Компания сообщает о 85,4 балла на Terminal Bench 2.1 и о росте с 28,0 до 64,3 на DeepSWE. Цифры принадлежат разработчику, независимых подтверждений мы не приводим.

Где к ней есть доступ?

В собственных продуктах Tencent, через её облако и через сторонние площадки-посредники. В каталоге KeyDealer модели нет.

Сколько активных параметров на токен?

Сорок девять миллиардов из 770, то есть около 6 процентов модели на каждый токен.

Источники