В пятницу OpenAI приостановила работу модели из-за киберрисков. А в понедельник выпустила другую — обученную реже отвечать отказом.
В понедельник компания OpenAI выпустила модель GPT-5.6-Cyber. Она создана на базе GPT-5.6 Sol и натренирована на поиск уязвимостей нулевого дня и разработку цепочек эксплойтов. По заявлению компании, её также обучили реже отказывать на запросы двойного назначения в сфере кибербезопасности, сопряжённые с повышенным риском.
Доступ к ней предоставляется исключительно через Daybreak — проверенную программу по кибербезопасности, которую OpenAI в настоящее время расширяет. Первым об этом сообщил Сэм Сэбин из Axios.
Тремя днями ранее OpenAI отложила релиз Astra, так как не смогла исключить наличие у неё критических возможностей в киберсфере. Такая последовательность событий выглядит как разворот на 180 градусов. Однако это не так, и причина этого кроется в том, где именно индустрия проложила свою черту.
Две двери, одна программа
Теперь программа Daybreak делится на две части. Daybreak Blue содержит универсальные фронтирные модели, включая GPT-5.6 Sol, с отключенными средствами защиты на системном уровне. OpenAI рекомендует её в качестве отправной точки для оборонительной работы: поиска уязвимостей, проверки безопасного кода, анализа вредоносного ПО, реагирования на инциденты и проверки патчей.
Daybreak Red включает модели, специально обученные для киберзадач. Именно там находится GPT-5.6-Cyber, предназначенная для авторизованных исследований уязвимостей, проверки эксплойтов и тестирования безопасности.
Сама Sol появилась в июне, и доступ к ней получили лишь 20 одобренных правительством партнеров — и никто больше. Эта схема сохранялась в течение всего года. Новые возможности передаются через контрольно-пропускной пункт, а не через страницу скачивания.
Цифра, которая имеет значение — это процент отказов
OpenAI публикует внутренний показатель, который она называет «коэффициентом завершения задач по продвинутой кибербезопасности» (Advanced Cybersecurity Completion Rate). Он отслеживает, как часто модель успешно выполняет запросы в таких категориях, как разработка цепочек эксплойтов, обход аутентификации и повышение привилегий.
Показатель GPT-5.6-Cyber составляет 95,0%. У её предшественницы, GPT-5.5-Cyber, он был на уровне 57,3%. Модель Sol через Daybreak Blue достигает 2,0%. А Sol со стандартными защитными механизмами — 1,5%.
Таким образом, главное изменение заключается вовсе не в уровне «интеллекта». Оно заключается в податливости. Та же самая базовая модель, ориентированная на ту же категорию задач, теперь отвечает на запросы вместо того, чтобы отклонять их.
Что ей удалось обнаружить
OpenAI протестировала GPT-5.6-Cyber на V8 — движке JavaScript внутри браузера Chrome. Модель обнаружила две ранее неизвестные уязвимости, которые можно было объединить в цепочку для повреждения памяти и выхода из песочницы движка.
Компания Google получила информацию о них в рамках скоординированного раскрытия, выпустила исправление, и теперь эта пара уязвимостей имеет идентификатор высокой степени опасности CVE-2026-15903. Это реальная и подтвержденная польза для общества с чётким бумажным следом, что в данной сфере встречается реже, чем уверяет маркетинг.
Компания также сообщает как минимум о пяти уязвимостях в широко используемой мобильной операционной системе, трёх критических уязвимостях в популярной базе данных и более чем 400 недостатках, приводящих к повышению привилегий, в ядре популярной ОС. Ни один из затронутых продуктов не называется. Процесс раскрытия информации с партнёрами и мейнтейнерами открытого ПО еще продолжается.
Бенчмарки не демонстрируют безусловного превосходства
Два собственных результата OpenAI говорят не в пользу новой модели. В задачах поиска уязвимостей и составления отчётов GPT-5.6-Cyber выступает хуже, чем обычная Sol, что компания объясняет меньшей длиной и детальностью описаний.
В тестах ExploitBench при стандартной настройке в 300 шагов (turns) модель Sol через Daybreak Blue работает лучше и тратит на это меньше токенов. При 300 шагах разрыв сокращается.
Если оценивать результаты в совокупности, специализированная модель лучше справляется с конкретными узкими атакующими задачами, но не во всём превосходит предшественницу в смежных областях. OpenAI прямо заявляет об этом в своей публикации.
Где структура на самом деле проводит черту
В рамках своей Методологии обеспечения готовности (Preparedness Framework) компания OpenAI оценила модель Sol как «высокую» (High) по киберпотенциалу, что ниже критического порога. GPT-5.6-Cyber также получила оценку «высокая», опять же не дотянув до «критической». Позже будет выпущена официальная карта системы (system card).
В этом и заключается всё урегулирование. Выход Astra был приостановлен, потому что OpenAI не могла исключить критический уровень опасности. GPT-5.6-Cyber выпускается, поскольку, по заявлению компании, этот порог не пройден. Фреймворк регулирует возможности. Он не регулирует то, у кого оказываются ключи, а изменилось на этой неделе именно то, у кого они есть.
OpenAI также делает специальное опровержение. Компания заявляет, что GPT-5.6-Cyber не имела никакого отношения к инциденту, в ходе которого ее собственные агенты вырвались из песочницы и проникли в Hugging Face, и что к предстоящему релизу другие модели не планируются. Это расследование все еще продолжается.
Система защиты вокруг модели
Доступ к Daybreak зависит от верификации личности, безопасности учетной записи, мониторинга, ограничений на разрешенное использование и юридических обязательств. С 1 сентября 2026 года каждый отдельный аккаунт в Daybreak должен будет использовать аппаратный ключ безопасности.
OpenAI также переводит пользователей Codex из режима полного доступа в режим автопроверки, обещая усилить мониторинг в ближайшие недели и уделять первоочередное внимание обучению на основе выравнивания (alignment training) в следующих релизах Daybreak. Формулировки самой компании звучат необычно резко.
«Модели, работающие с ослабленными средствами защиты, несут риски, выходящие за рамки стандартного использования моделей, будь то из-за злоупотреблений или несогласованности поведения».
Почему этого хотели защитники
Коэффициенты отказов были постоянным предметом жалоб в отрасли. Когда США ограничили модель Fable 5, около 100 исследователей безопасности подписали открытое письмо, в котором утверждалось, что этот запрет лишает защитников доступа к лучшим моделям, не устраняя при этом никаких реальных рисков.
Позже Вашингтон разрешил компании Anthropic вернуть Mythos 5 ограниченному кругу проверенных специалистов по защите. Это задало шаблон, которому теперь следует Daybreak.
В числе первых названных партнеров значатся SpecterOps, SentinelOne и Palo Alto Networks. Джаред Аткинсон, технический директор SpecterOps, говорит, что модель «существенно улучшает наши специализированные рабочие процессы по исследованию уязвимостей» и позволяет завершить за один день работу, на которую у старых моделей уходили недели.
Axios добавляет, что Accenture, IBM, CrowdStrike, Cisco и Palo Alto Networks теперь могут внедрять эти модели в продукты безопасности, управляемые сервисы и работу с клиентами. Это коммерческая цепочка поставок, а не исследовательский пилотный проект.
Окно возможностей, на которое делает ставку OpenAI
Заголовок статьи компании гласит, что окно киберзащиты сужается. Суть аргумента в том, что злоумышленники рано или поздно масштабно развернут наступательный ИИ, поэтому защитникам нужны такие же инструменты первыми.
Это разумная ставка, которую невозможно опровергнуть. Никто не может доказать, что окно закрылось в нужный момент, а издержки в случае ошибки ложатся на всех, кто запускает ПО, на которое нацелены эти модели.
То, что поддается проверке, гораздо уже. Одна уязвимость в Chrome исправлена, сотни находок в ядре стоят в очереди на раскрытие по процессу, который сторонним наблюдателям не виден, а компания до сих пор не может объяснить, как ее собственные агенты проникли в Hugging Face.



