Мир ИИ
Амодей: недовольство ИИ — это кризис доверия, а не подачи
16 августа глава Anthropic Дарио Амодей заявил, что недовольство обществом искусственным интеллектом — это фундаментально кризис доверия, а не проблема коммуникации. По его словам, люди не доверяют ни компаниям, ни государству, ни технологическому сектору и подозревают их в подготовке очередного способа навредить. Отдельно он признал: самая справедливая критика ИИ-компаний, включая собственную, состоит в том, что обещанной пользы миру они пока не принесли. Предложение — обязательные проверки моделей независимой третьей стороной, плюс 200 млн долларов на изучение общественного влияния. Разбираем, что из этого спора действительно затрагивает тех, кто строит продукты на API.
В чём был спор
Контекст важен, потому что заявление сделано не в вакууме.
Инвестор Гэвин Бейкер высказал позицию, распространённую в отрасли: Амодей слишком много говорит об опасностях ИИ, и это само подпитывает негатив — в частности протесты против строительства дата-центров в США. То есть проблема в подаче: перестаньте пугать, и отношение улучшится.
Амодей возразил, что причина глубже. Недоверие адресовано не конкретным заявлениям об ИИ, а институтам вообще — корпорациям, государству, технологическому сектору. Молчание об опасностях его не уменьшит, потому что дело не в том, что говорят, а в том, кто говорит.
Из этого следует и его вывод о лечении: не коммуникация, а проверяемость. Обязательное тестирование независимой стороной — механизм, который не требует верить компании на слово.
Что признал сам Амодей
Пункт, который в пересказах обычно теряется, хотя он самый содержательный.
По его словам, самая точная критика ИИ-компаний — что они пока не выполнили своих больших обещаний принести пользу миру. И что убедить людей помогли бы не заверения, а конкретные результаты вроде реального лечения болезней.
Это признание стоит отметить не ради драматизма. Оно объясняет, почему кризис доверия — не проблема пиара. Обещали изменить мир, изменили пока в основном себестоимость написания текстов. Разрыв между обещанием и результатом виден любому, и никакая формулировка его не закрывает.
Что тут для разработчика
Практический вопрос: зачем читать про общественное доверие, если вы просто отправляете запросы к API.
Регулирование доходит до вас через вендоров. Обязательное внешнее тестирование, если оно станет требованием, означает новые процедуры перед выпуском моделей. Это может замедлить релизы, изменить доступность отдельных возможностей и добавить требований к тому, как вы вправе использовать модель. Мы уже видели похожее: маркировка сгенерированного текста по статье 50 AI Act действует с 2 августа, и вендоры перестраивались под неё.
Доступ бывает решением не вендора. Летом Минторг США потребовал экспортную лицензию для доступа иностранцев к Fable 5 и Mythos 5 — разбирали в материале про то, как доступ к модели выключает государство. Общественное давление и регулирование — та же линия, только медленнее.
Требования по проверяемости уже приходят в продукты. Публикация системных промптов Anthropic на этой же неделе — ровно этот механизм: вместо обещания «модель ведёт себя корректно» показывают правила, по которым она это делает.
Что такое внешнее тестирование моделей
Предложение про обязательные проверки третьей стороной стоит разобрать, потому что от его формы зависит, коснётся оно вас или нет.
Сегодня вендор оценивает свои модели сам. Публикуются результаты внутренних оценок: собственный набор заданий, собственная методика, собственная интерпретация. Проверить эти цифры со стороны нельзя — набор закрыт. Мы упирались в это буквально на прошлой неделе, когда разбирали, как OpenAI отнесла модель к высокому уровню киберспособностей по своей же рамке готовности: 95% выполненных заданий на внутренней оценке — цифра, которую невозможно сопоставить ни с чем чужим.
Внешнее тестирование означает независимую организацию, которая проверяет модель по единой методике до выпуска. Плюсы очевидны: результаты сравнимы между вендорами, и им можно верить, не полагаясь на слово продавца.
Минусы тоже понятны и их стоит проговорить. Проверка занимает время — значит релизы замедлятся. Проверяющий становится узким местом и точкой влияния. А единая методика неизбежно отстаёт от того, что модели умеют: набор заданий составляют по прошлым способностям, а выходят модели с новыми.
Для разработчика это значит вот что: если такой порядок введут, между анонсом модели и её доступностью появится задержка. Мы уже видели похожее у Z.ai, которая придержала веса GLM-5.3 до окончания собственной проверки безопасности. Обязательное внешнее тестирование сделает такие паузы правилом, а не исключением.
Чего разработчику стоит ожидать
Три практических следствия, если направление сохранится.
Больше полей в документации. Требования к проверяемости выражаются в метаданных: статусы возможностей, даты последней проверки, отметки о происхождении контента. Мы это видим уже сейчас — в нашем каталоге у каждой модели есть capabilities_verified_at, и это ровно та же логика.
Задержки между анонсом и доступом. Планировать переход на новую модель по дате её анонса станет ещё хуже, чем сейчас.
Разное регулирование в разных странах. Маркировка сгенерированного контента в ЕС, экспортные ограничения в США, свои требования в других юрисдикциях. Модель может быть доступна в одном месте и недоступна в другом, причём решение принимает не вендор.
Отсюда практичное: держите в коде возможность переключить модель. Не абстрактную «архитектурную гибкость», а конкретно — идентификатор модели в конфигурации, а не в вызове, и проверенный запасной вариант. Это единственная защита от решений, которые принимаются без вас.
Стоит добавить и то, чего в этом споре не прозвучало вовсе. Обе стороны обсуждают, как отрасли говорить о себе и как её проверять, но ни слова не сказано о том, что доверие складывается на уровне отдельных продуктов, а не индустрии. Человек не доверяет «искусственному интеллекту» абстрактно — он доверяет или не доверяет конкретному сервису, который что-то сделал с его данными или его деньгами. И на этом уровне решения принимаете вы, а не Амодей с Бейкером.
Чего мы не утверждаем
Не даём политических оценок. Мы описываем спор и позиции сторон, не присоединяясь ни к одной.
Не пересказываем интервью целиком. Приводим ключевые тезисы по публикациям, перечисленным в источниках.
Не утверждаем, что обязательное тестирование будет введено. Это предложение главы одной компании, а не принятое решение.
Не считаем 200 млн долларов доказательством чего-либо. Объявленная сумма — факт; её влияние на общественное доверие оценивать рано.
Почему это стоит рядом с новостями недели
Наблюдение, которое собирает разрозненные сюжеты в одну картину.
Август дал целую серию историй про то, как ИИ ведёт себя не так, как ожидали: промпт-инъекция в судебном документе, извлечение цепочек рассуждений через API, агент, вышедший из песочницы. Каждая по отдельности — инженерный сюжет. Вместе они и есть то, из чего складывается недоверие: технология делает не то, что про неё говорят.
Причём вывод для разработчика одинаковый во всех случаях, и он не про доверие, а про архитектуру: полагаться на то, что модель поведёт себя разумно, нельзя. Работают технические границы — что физически может уйти в модель, что физически может сделать инструмент. Мы собрали это в отдельный разбор про права агента.
Заодно и про экономику: доверие бизнеса тоже измеряется деньгами, и здесь цифры говорят внятно. Флагманская модель Anthropic собрала всего 6% токенов при том, что сам вендор растёт. Компании не спорят с ИИ — они экономят на нём.
Что держать в голове
Глава Anthropic назвал негативное отношение к ИИ кризисом доверия к институтам, а не проблемой коммуникации, и признал, что обещанной пользы отрасль пока не принесла. Предложил обязательные внешние проверки моделей.
Для вас это новость про будущее регулирование, а не про сегодняшний код. Но она объясняет направление: требования к проверяемости будут расти, и приходить они будут через вендоров — в виде процедур, ограничений и новых полей в документации.
Как мы отделяем проверенное от предполагаемого — на странице о проекте. Сорок одна позиция каталога, статусы всегда из живой выдачи: keydealer.ru/login.
Частые вопросы
Что заявил глава Anthropic?
Что негативное отношение общества к ИИ вызвано не тем, как отрасль о себе рассказывает, а недостатком доверия к компаниям, государству и технологическому сектору в целом.
Признал ли он проблемы отрасли?
Да. По его словам, самая справедливая критика ИИ-компаний, включая Anthropic, состоит в том, что они пока не выполнили своих больших обещаний принести пользу миру.
Что он предложил?
Обязательное тестирование моделей независимой третьей стороной, а также объявил о выделении 200 млн долларов на изучение общественного влияния ИИ.
С кем он спорил?
С инвестором Гэвином Бейкером, который считает, что предупреждения Амодея об опасностях ИИ сами подпитывают недовольство в США, в частности протесты против дата-центров.
Как это касается разработчика?
Через регулирование: обязательные внешние проверки означают новые требования к вендорам, а значит и к тому, что вы получаете через API.