Мир ИИ

OpenAI открыла модели без фильтров — но не всем

OpenAI открыла модели без фильтров — но не всем

10 августа 2026 года OpenAI перестроила программу Daybreak: теперь это два уровня доступа. На Daybreak Blue проверенные специалисты по защите получают фронтирные модели, включая GPT-5.6 Sol, со снятыми системными ограничениями по тематике безопасности. На Daybreak Red — отдельную модель GPT-5.6-Cyber, обученную под эти задачи, и туда пускают после более жёсткой проверки. Не декларация: с помощью GPT-5.6-Cyber исследовали движок V8, на котором работает Chrome, нашли две ранее неизвестные уязвимости, передали Google по процедуре скоординированного раскрытия, одна уже исправлена и получила номер CVE-2026-15903. Через API-посредников такой доступ не выдаётся — и дальше объясняем, почему это устроено именно так.

Что поменялось

До перестройки Daybreak была одной программой. Теперь уровня два, и разница между ними — не в объёме квоты, а в том, какая модель и после какой проверки.

Daybreak BlueDaybreak Red
Моделифронтирные общего назначения, включая GPT-5.6 SolGPT-5.6-Cyber
Что снятосистемные ограничения по кибербезопасностимодель обучена под задачи, реже отказывает
Проверкадля одобренных защитниковболее строгий отбор
Задачипоиск уязвимостей, разбор вредоносного кода, реагирование на инциденты, проверка патчейисследование уязвимостей, проверка эксплойтов, тестирование защищённости

Ключевое слово в обеих строках — «одобренных». Это не тариф, который можно оплатить. Это допуск, который выдают после проверки заявителя.

Почему фильтры вообще мешали

Тем, кто не занимается безопасностью, ограничение кажется правильным: модель не должна помогать писать вредоносный код. Проблема в том, что защита и нападение читают один и тот же текст.

Аналитик, разбирающий свежий образец вредоносного ПО, задаёт модели ровно те же вопросы, что и автор этого ПО. «Объясни, что делает этот код» — запрос, по которому невозможно отличить одного от другого. Массовые фильтры настраиваются по формулировке, а не по намерению, и потому режут обоих.

Отсюда и конструкция Daybreak: намерение проверяется не в момент запроса, а на входе в программу. Фильтр переехал с текста на человека.

Что модель нашла в V8

Самая содержательная часть анонса — не описание уровней, а результат.

V8 — движок JavaScript, на котором работает Chrome. Код, который изучают десятилетиями, с одной из самых зрелых программ поиска уязвимостей в индустрии. Найти там что-то новое — заметное достижение и для человека.

По публикации OpenAI, с помощью GPT-5.6-Cyber обнаружены две ранее неизвестные уязвимости, которые можно связать в цепочку, повредить память и выйти за пределы песочницы кучи V8. Находки подтверждены исследователями и переданы Google по процедуре скоординированного раскрытия. Одну Google уже исправил, ей присвоен номер CVE-2026-15903.

Важное здесь — процедура. Модель не «взломала Chrome». Она использовалась как инструмент в нормальном исследовательском цикле, с проверкой человеком и ответственной передачей вендору.

Чего в этой новости нет

Отделим факты от того, что легко додумать по заголовкам.

Нет «модели без цензуры» в общем доступе. Сняты именно системные ограничения по тематике кибербезопасности, и только для проверенных участников. Это не универсальный режим «отвечай на что угодно».

Нет способа получить доступ через посредника. Допуск привязан к проверенному участнику программы. Никакой сервис, включая наш, не может его перепродать — и обещания обратного стоит считать признаком того, что обещающий не понимает, о чём речь.

Нет данных о сроках и объёмах. Сколько участников в каждом уровне и как быстро рассматриваются заявки, в доступных материалах не описано.

Нет подробностей о том, как именно проверяют заявителей. Формулировка «одобренные защитники» встречается в описании обоих уровней, но критерии отбора и требования к подтверждению не раскрыты. Из текста понятно только, что для Red проверка строже, чем для Blue.

Нет GPT-5.6-Cyber в нашем каталоге. Живой каталог на 12 августа — 25 моделей: Claude, GPT, Gemini, GLM, Grok, GPT-OSS и GPT Image. Специализированной модели для безопасности там нет и не появится по причинам, описанным выше.

Что такое «двойное назначение»

Термин встречается в описании Daybreak Red и заслуживает пояснения, потому что он объясняет всю конструкцию.

Задача двойного назначения — та, у которой защитное и атакующее применение неразличимы по содержанию. Написать эксплойт для уязвимости нужно и тому, кто собирается её эксплуатировать, и тому, кто проверяет, действительно ли она опасна. Без работающего эксплойта вендор часто не принимает отчёт всерьёз.

Именно поэтому фильтр по тексту запроса тут бессилен. Он может отличить «напиши вирус» от «объясни сортировку», но не отличит исследователя от нападающего — оба формулируют одинаково, потому что делают технически одно и то же.

Отрасль знает только один рабочий ответ: проверять не запрос, а того, кто его задаёт. Так устроены закрытые списки рассылки об уязвимостях, так работает доступ к базам образцов вредоносного ПО, так же теперь устроен и Daybreak. Модель здесь просто встала в ряд с инструментами, которые давно выдают по допуску.

Побочный эффект понятный: порог входа в профессию поднимается. Специалисту без формальной принадлежности к организации подтвердить свою добросовестность сложнее, и часть исследователей остаётся снаружи. Это известная цена такой схемы, и Daybreak её не отменяет.

Что доступно обычному разработчику

Практический вопрос: если Daybreak вам недоступен, что из этого можно применить.

Обычные модели по-прежнему разбирают код. Ограничения касаются тематики атак, а не программирования вообще. Ревью, поиск логических ошибок, разбор чужой библиотеки работают штатно.

Отказ модели — это не ошибка. Если модель отказалась разбирать образец, запрос надо переформулировать под защитный контекст, а не воевать с фильтром. Кстати, у Anthropic отказ приходит успешным HTTP 200 со stop_reason: "refusal" — если ваш код ловит только коды ошибок, такие ответы он молча примет за нормальные. Мы разбирали это, когда в каталоге появилась Fable 5.

GPT-5.6 Sol доступна вне программы в обычном режиме. Именно она заменила отключённые в августе gpt-5.2-chat и gpt-5.3-chat, о чём мы писали в разборе расширения доступа к линейке 5.6. Внутри Daybreak Blue это та же модель — разница только в снятых тематических ограничениях, а не в качестве или объёме знаний.

Разбор своего кода на уязвимости работает без всяких программ. Попросить модель посмотреть на вашу функцию и указать на потенциальные проблемы — обычный запрос, который не упирается ни в какие фильтры. Ограничения начинаются там, где речь идёт о чужих системах и работающих эксплойтах.

Ответственное раскрытие остаётся обязательным. Если модель помогла вам найти уязвимость в чужом продукте, порядок действий не меняется от того, что нашли её с помощью ИИ: сообщить вендору и дать время на исправление. История с V8 — ровно этот сценарий, и номер CVE появился именно потому, что процедуру соблюли.

Куда это ведёт

Daybreak — часть более широкого сдвига, который видно и по другим новостям месяца.

Модели становятся достаточно сильными, чтобы находить настоящие уязвимости в зрелом коде. Это работает в обе стороны, и вендоры отвечают не запретом, а разделением доступа: одним по проверке, остальным с ограничениями.

Та же логика видна в разборе трёх инцидентов Anthropic, где модель дважды распознала признаки реальных систем и продолжила действовать, и в истории с агентом, вышедшим из песочницы. Общий вывод у всех трёх одинаковый: полагаться на то, что модель сама откажется, нельзя. Работают границы, заданные технически или организационно.

Что держать в голове

OpenAI разделила Daybreak на два уровня: Blue со снятыми ограничениями по безопасности на фронтирных моделях и Red с отдельной GPT-5.6-Cyber после более строгой проверки. Результат уже есть — две уязвимости в V8, одна с номером CVE-2026-15903.

Для обычного разработчика вывод в том, что доступ к таким моделям — вопрос проверки, а не оплаты. Через API-посредников он не выдаётся, и это не ограничение конкретного сервиса, а устройство самой программы.

Как мы отделяем проверенное от предполагаемого — на странице о проекте. Обычные модели, включая линейку 5.6, доступны по ключу, который заводится за минуту: keydealer.ru/login.

Частые вопросы

Что такое Daybreak?

Программа OpenAI для специалистов по кибербезопасности. 10 августа 2026 года она разделилась на два уровня — Daybreak Blue и Daybreak Red — с разными моделями и разной строгостью проверки участников.

Что означает «сняли фильтры»?

На уровне Daybreak Blue у фронтирных моделей, включая GPT-5.6 Sol, отключены системные ограничения по тематике кибербезопасности. Модель перестаёт отказываться от разбора вредоносного кода и поиска уязвимостей.

Чем отличается GPT-5.6-Cyber?

Это отдельная модель, обученная под задачи безопасности, доступная только на уровне Daybreak Red после более строгой проверки. Она реже отказывается от задач двойного назначения.

Эти модели можно получить через KeyDealer?

Нет. Доступ выдаёт сам OpenAI после проверки заявителя, и через посредников он не передаётся. В нашем каталоге на 12 августа 2026 года 25 моделей, GPT-5.6-Cyber среди них нет.

Что модель реально нашла?

При исследовании движка V8, на котором работает Chrome, обнаружены две ранее неизвестные уязвимости. Они переданы Google по процедуре скоординированного раскрытия, одна исправлена и получила номер CVE-2026-15903.

Источники