Мир ИИ
«AGI наступил»: что стоит за словами главы Nvidia
6 сентября 2026 года глава Nvidia Дженсен Хуанг написал, что GPT-6 Astra обучена примерно на 100 тысячах систем Grace Blackwell NVLink72, и объявил: «AGI наступил». Там же — что следующими вводятся 400 тысяч ускорителей. Это личный пост в X, а не пресс-релиз, измеримых критериев в нём нет, и похожее Хуанг уже говорил в марте 2026 года в подкасте Лекса Фридмана — про другую модель. Сто тысяч ускорителей в железе — это около 1389 стоек по 72 GPU. Разбираем, что в этой новости проверяется по документам, что остаётся мнением, и почему на ваш счёт за API влияет не слово «AGI», а капитальные затраты, которые за ним стоят.
Что именно заявил глава Nvidia и когда
Пост опубликован 6 сентября 2026 года. Дословно Хуанг перечислил: GPT-6 Astra обучена на «~100K+ NVIDIA Grace Blackwell NVLink72»; путь «от ChatGPT к o1 и к Astra» занял четыре года; «AGI наступил»; поздравление команде OpenAI; «400K GPU вводятся в строй следующими».
Что здесь важно развести сразу. Заявление сделано не Nvidia как компанией, а её руководителем в личном аккаунте. Это не форма 8-K, не пресс-релиз и не раздел квартальной отчётности. Никакого теста, порога или процедуры, по которым фиксировалось бы наступление AGI, в посте не названо.
Проверяемая часть тут ровно одна — про железо. Всё остальное — оценка человека, который продаёт это железо.
Что такое «100 000 Grace Blackwell NVLink72» в железе
NVLink72 — это компоновка стойки, и её параметры NVIDIA публикует у себя. Одна стойка GB200 NVL72 содержит 72 ускорителя Blackwell и 36 процессоров Grace, объединённых в единый домен NVLink пропускной способностью 130 ТБ/с. Памяти на стойку — 13,4 ТБ HBM3E у ускорителей и 17 ТБ LPDDR5X у процессоров.
Дальше простая арифметика.
| Что | Ускорителей | Стоек по 72 GPU | HBM3E суммарно |
|---|---|---|---|
| Обучение Astra, по словам Хуанга | ~100 000 | ~1389 | ~18 611 ТБ |
| «Следующими» | 400 000 | ~5556 | ~74 444 ТБ |
Рост ровно вчетверо. Вот это и есть содержательная часть поста — заявка на четырёхкратное расширение парка. Слово «AGI» рядом с такой цифрой работает подписью под ней.
Отдельно про слово «ускоритель». Сто тысяч GPU — это примерно 1389 стоек. В пересказах единица измерения теряется первой: цифра доезжает до читателя, а к чему она относится — уже нет.
Почему Хуанг объявляет AGI второй раз за полгода
Это не первое такое заявление. В марте 2026 года в подкасте Лекса Фридмана Хуанг сказал: «Я думаю, что сейчас. Я думаю, мы достигли AGI». Тогда речь шла о поколении моделей, вышедшем до Astra.
То есть за шесть месяцев одна и та же формулировка была применена к двум разным точкам на шкале. Ложным заявление от этого не становится. Вес у него другой. Перед нами повторяющаяся фигура речи человека, чей бизнес растёт вместе с верой рынка в тот самый рубеж.
Отсюда привычка, которая экономит время. Прежде чем разбирать формулировку, проверьте, звучала ли она раньше. И чем тогда кончилось.
Что об AGI говорит сама OpenAI
Осторожнее, чем Nvidia, и с важным уточнением. Президент OpenAI Грег Брокман 3 сентября 2026 года, в день релиза Astra, сформулировал так: «Договорного триггера AGI больше нет, так что это уже нерелевантное понятие». И отдельно, от себя: «Лично для меня — да, мы там».
Две фразы стоят рядом, но говорят разное. Первая снимает вопрос с юридической плоскости: раньше достижение AGI было условием в договоре с Microsoft, теперь этого условия нет. Вторая — личное мнение конкретного человека, и он прямо помечает его как личное.
Сама модель при этом описана компанией предметно: лучший результат по программной инженерии на момент выхода, новый уровень работы с компьютером и браузером. Про эти утверждения можно спорить по бенчмаркам. Про AGI спорить нечем: критерия не предъявлено.
Почему у слова «AGI» нет измеримого определения
Потому что каждый считает по-своему, и разброс определений огромен:
- Когнитивный. Модель решает широкий класс задач на уровне человека. Открытый вопрос — какой именно класс и какого человека.
- Экономический. В контракте OpenAI с Microsoft фигурировал порог в 100 млрд долларов прибыли. Порог считается в долларах.
- Операционный. Модель самостоятельно доводит до конца длинные рабочие процессы. Ближе всего к тому, что реально проверяется, но границы «длинного» никто не зафиксировал.
- Отказ от термина. Часть исследователей им не пользуется вообще, считая перпетуально неопределимым и неизмеримым.
Что с этим делать. Читаете «AGI достигнут» — спросите себя: по какому из четырёх? Если ответа в тексте нет, перед вами маркетинг. Котировки он двигает не хуже технического утверждения, и это как раз неприятная часть.
Что такое opaque recurrence и почему исследователи насторожились
Opaque recurrence — приём рассуждения, при котором цепочка размышлений модели перестаёт быть доступной для внешнего наблюдения. Именно он, а не метрики, стал главным предметом спора после релиза Astra. Главный научный сотрудник OpenAI Якуб Пахоцкий сказал об этом прямо — с ростом возможностей моделей наблюдаемость даётся тяжелее.
Для разработчика это прикладной вопрос. Аудит поведения модели через чтение её рассуждений — рабочий приём в проде: так ловят зацикливание агента, ошибочную интерпретацию инструмента, попытку обойти ограничение. Чем меньше видно, тем больше приходится опираться на внешние проверки — логи вызовов инструментов, лимиты, песочницы.
Мы уже разбирали, чем оборачивается недостаток наблюдаемости, на двух свежих примерах: заявленный OpenAI уровень Critical по кибербезопасности у Astra и история с агентами, которые нашли себе доску объявлений в публичной вики.
Из чего складывается цена токена, которую вы платите
Из капитальных затрат, растянутых во времени. Цепочка простая:
- Ускорители закупаются и монтируются в стойки. Это разовый крупный расход.
- Стойка потребляет питание и требует охлаждения — это постоянный расход, привязанный к площадке.
- Обучение модели тратит этот парк на месяцы вперёд и не приносит ни одного оплаченного токена.
- Возвращаются деньги только через инференс — через ваши запросы к готовой модели.
Поэтому «400 тысяч ускорителей следующими» описывает будущие расходы отрасли. К завтрашнему прайс-листу это отношения не имеет. Связи «объявили AGI — подорожало» нет, и ждать её не стоит.
Связь есть другая, и она наблюдается: чем чаще выходят новые флагманы, тем быстрее устаревает выбор модели, сделанный полгода назад. Сентябрь 2026 года это показал плотно — Astra вышла 3 сентября, и это далеко не единственный релиз месяца.
Что делать разработчику, пока идёт гонка ускорителей
Практических шагов четыре, и ни один не требует реагировать на заявления об AGI.
Фиксируйте точный идентификатор модели. Имена вида -latest у площадок переключаются на новое поколение вместе с ценой, и переключение происходит без вашего участия. В каталоге KeyDealer подвижных алиасов нет вовсе: на 7 сентября 2026 года ни одна из 55 позиций не содержит в идентификаторе latest, newest или preview. Вы всегда обращаетесь к тому, что выбрали.
Считайте на своих объёмах. Чужие бенчмарки посчитаны на чужих задачах. Возьмите типичный запрос своего продукта — скажем, 10 000 токенов на вход и 2 000 на выход — и прогоните по ставкам каталога.
| Модель | Ставка, ₽ за 1 млн | Один запрос, ₽ | 1000 запросов, ₽ |
|---|---|---|---|
gpt-6-astra | 60 | 0,72 | 720 |
gpt-5-6-terra | 30 | 0,36 | 360 |
kimi-k3 | 10 | 0,12 | 120 |
gemini-3-flash | 6 | 0,072 | 72 |
glm-5-3-flash | 5 | 0,06 | 60 |
deepseek-v4-flash | 1 | 0,012 | 12 |
Ставки одинаковы на входе и выходе, поэтому счёт считается по сумме токенов. Тысяча запросов на флагмане и на gemini-3-flash расходятся на 648 ₽ — и это на одной тысяче. Полная таблица рублёвых ставок по всему каталогу собрана отдельно: сколько стоит миллион токенов в рублях.
Держите запасную позицию. Флагман тут ни при чём: доступность моделей меняется быстрее, чем ваш код. Даты отключений у вендоров мы ведём в календаре отключения моделей — там видно, что срок жизни конкретного идентификатора чаще всего измеряется месяцами.
Проверяйте возможности по живой выдаче. GET /v1/models отдаёт по каждой позиции поле capabilities со статусами verified, unsupported и unknown. unknown означает ровно одно: контролируемой пробы не было. Ни «работает», ни «сломано» — просто отсутствие утверждения. Полагаться на такую возможность в проде можно только на свой риск.
Что в этой новости проверяемо, а что нет
Проверяется только железо: компоновка стойки подтверждается спецификацией NVIDIA. Масштаб обучения известен со слов Хуанга, а само наступление AGI критерием не подкреплено вовсе. Разделение получается неожиданно чистым.
| Утверждение | Статус | Чем подтверждается |
|---|---|---|
| 72 GPU и 36 CPU в стойке NVL72 | проверено | Спецификация NVIDIA |
| Astra обучена на ~100 тыс. ускорителей | со слов Хуанга | Личный пост, независимого подтверждения нет |
| 400 тыс. ускорителей «следующими» | со слов Хуанга | Ни сроков, ни площадок не названо |
| Договорного триггера AGI больше нет | проверено | Слова Брокмана в интервью TechCrunch |
| «AGI наступил» | мнение | Критерия не предъявлено |
Обратите внимание, что самое громкое утверждение стоит в последней строке и подтверждается хуже всех остальных. Это устойчивая закономерность новостей про ИИ, и она полезнее самой новости: заголовок и проверяемая часть материала почти никогда не совпадают.
Отсюда и рабочая привычка — читать такие сообщения с конца. Сначала цифры железа и даты, потом кто именно это сказал и в каком качестве, и только потом заголовок. Заявления об AGI будут повторяться, к разным моделям и от разных людей; спецификация стойки и ставка за миллион токенов проверяются за пять минут и не зависят ни от чьего настроения.
Ставки, статусы и подтверждённые возможности всегда лежат в живой выдаче GET /v1/models. Ключ к ней получается на странице входа — оплата в рублях, один OpenAI-совместимый адрес на все семейства каталога.
Частые вопросы
Что именно сказал Дженсен Хуанг про AGI?
6 сентября 2026 года глава Nvidia написал в своём аккаунте в X, что GPT-6 Astra обучена примерно на 100 тысячах с лишним систем NVIDIA Grace Blackwell NVLink72, что путь от ChatGPT через o1 к Astra занял четыре года, и что «AGI наступил». В том же посте он добавил, что следующими вводятся в строй 400 тысяч ускорителей.
Это официальное заявление Nvidia?
Нет. Это личный пост главы компании в социальной сети, а не пресс-релиз и не раздел отчётности. Ни одного измеримого критерия, по которому проверялось бы наступление AGI, в посте нет.
Хуанг говорил такое раньше?
Да. В марте 2026 года в подкасте Лекса Фридмана он сказал: «Я думаю, что сейчас. Я думаю, мы достигли AGI». Сентябрьское заявление — как минимум второе за полгода, и относится оно уже к другой модели.
Что такое NVLink72?
Компоновка стойки, в которой 72 ускорителя Blackwell и 36 процессоров Grace соединены в единый домен NVLink с пропускной способностью 130 ТБ/с. По спецификации NVIDIA на стойку приходится 13,4 ТБ памяти HBM3E и 17 ТБ LPDDR5X.
Сколько это стоек при 100 000 ускорителей?
Около 1389 стоек, если считать по 72 ускорителя на стойку. Заявленные «400 тысяч следующими» — это примерно 5556 стоек.
Что говорит про AGI сама OpenAI?
Президент компании Грег Брокман 3 сентября 2026 года сказал TechCrunch: «Договорного триггера AGI больше нет, так что это уже нерелевантное понятие», и отдельно добавил от себя: «Лично для меня — да, мы там». То есть компания разделяет личное мнение и корпоративное утверждение.
Есть ли у AGI измеримое определение?
Общепринятого — нет. Определения расходятся от «сравнимо с человеком по широте задач» до сугубо финансовых порогов вроде 100 млрд долларов прибыли, зафиксированных в контракте OpenAI с Microsoft. Часть исследователей вообще не пользуется термином, считая его неизмеримым.
Что такое opaque recurrence в Astra?
Приём рассуждения, при котором цепочка размышлений модели перестаёт быть доступна для наблюдения. Главный научный сотрудник OpenAI Якуб Пахоцкий признал, что с ростом возможностей моделей наблюдаемость становится сложнее. Именно это в релизе Astra вызвало возражения исследователей безопасности, а не сами метрики.
Как заявления про AGI влияют на цену токена?
Напрямую — никак, косвенно — через капитальные затраты. Ускорители, стойки, питание и охлаждение оплачиваются вперёд, а возвращаются через цену обращения к модели. Заявление про 400 тысяч ускорителей — это про масштаб будущих расходов, а не про завтрашний прайс-лист.
Что делать разработчику, пока идёт гонка ускорителей?
Фиксировать конкретные идентификаторы моделей вместо подвижных алиасов, замерять качество на своём трафике, а не по чужим бенчмаркам, и держать запасную позицию подешевле. В каталоге KeyDealer на 7 сентября 2026 года 34 доступные позиции, разброс ставок между ними шестидесятикратный.
Наступил ли AGI на самом деле?
Ответить нельзя, пока не назван критерий. Общепринятого определения AGI не существует, а в заявлении главы Nvidia от 6 сентября 2026 года никакой проверки не приведено. Президент OpenAI Грег Брокман в тот же период сказал, что договорного триггера AGI больше нет и понятие стало нерелевантным, а своё «мы там» пометил как личное мнение.
Что такое Grace Blackwell?
Связка процессора NVIDIA Grace и ускорителя Blackwell. В стойке GB200 NVL72 их 36 и 72 соответственно, объединённых в один домен NVLink с пропускной способностью 130 ТБ/с. Именно эту компоновку Хуанг называет единицей счёта, когда говорит про «100 тысяч с лишним».
Стоит ли переходить на Astra из-за этой новости?
Заявление главы Nvidia аргументом за смену модели быть не может. Аргумент тут один — замер на вашей задаче. Astra в каталоге стоит 60 ₽ за миллион токенов в обе стороны, gemini-3-flash — 6 ₽, и на многих задачах разница в качестве не покрывает десятикратную разницу в счёте.
Источники
- https://x.com/JensenHuang/status/2096700264569090384
- https://www.nvidia.com/en-us/data-center/gb200-nvl72/
- https://techcrunch.com/2026/09/03/openai-launches-astra-its-powerful-and-controversial-new-model/
- https://fortune.com/2026/03/30/agi-definition-jensen-huang-lex-fridman-deepmind-turing-text-cognitive-taxonomy/
- https://www.cnbc.com/2026/09/03/open-ai-astra-gpt-6-cyber.html
- https://api.keydealer.ru/v1/models
- https://www.cbr.ru/scripts/XML_daily.asp