Русская версия The Next Web

Google OpenAI Безопасность

В пятницу OpenAI приостановила работу модели из-за киберрисков. А в понедельник выпустила другую — обученную реже отвечать отказом.

В пятницу OpenAI приостановила работу модели из-за киберрисков. А в понедельник выпустила другую — обученную реже отвечать отказом.

В понедельник компания OpenAI выпустила модель GPT-5.6-Cyber. Она создана на базе GPT-5.6 Sol и натренирована на поиск уязвимостей нулевого дня и разработку цепочек эксплойтов. По заявлению компании, её также обучили реже отказывать на запросы двойного назначения в сфере кибербезопасности, сопряжённые с повышенным риском.

Доступ к ней предоставляется исключительно через Daybreak — проверенную программу по кибербезопасности, которую OpenAI в настоящее время расширяет. Первым об этом сообщил Сэм Сэбин из Axios.

Тремя днями ранее OpenAI отложила релиз Astra, так как не смогла исключить наличие у неё критических возможностей в киберсфере. Такая последовательность событий выглядит как разворот на 180 градусов. Однако это не так, и причина этого кроется в том, где именно индустрия проложила свою черту.

Две двери, одна программа

Теперь программа Daybreak делится на две части. Daybreak Blue содержит универсальные фронтирные модели, включая GPT-5.6 Sol, с отключенными средствами защиты на системном уровне. OpenAI рекомендует её в качестве отправной точки для оборонительной работы: поиска уязвимостей, проверки безопасного кода, анализа вредоносного ПО, реагирования на инциденты и проверки патчей.

Daybreak Red включает модели, специально обученные для киберзадач. Именно там находится GPT-5.6-Cyber, предназначенная для авторизованных исследований уязвимостей, проверки эксплойтов и тестирования безопасности.

Сама Sol появилась в июне, и доступ к ней получили лишь 20 одобренных правительством партнеров — и никто больше. Эта схема сохранялась в течение всего года. Новые возможности передаются через контрольно-пропускной пункт, а не через страницу скачивания.

Цифра, которая имеет значение — это процент отказов

OpenAI публикует внутренний показатель, который она называет «коэффициентом завершения задач по продвинутой кибербезопасности» (Advanced Cybersecurity Completion Rate). Он отслеживает, как часто модель успешно выполняет запросы в таких категориях, как разработка цепочек эксплойтов, обход аутентификации и повышение привилегий.

Показатель GPT-5.6-Cyber составляет 95,0%. У её предшественницы, GPT-5.5-Cyber, он был на уровне 57,3%. Модель Sol через Daybreak Blue достигает 2,0%. А Sol со стандартными защитными механизмами — 1,5%.

Таким образом, главное изменение заключается вовсе не в уровне «интеллекта». Оно заключается в податливости. Та же самая базовая модель, ориентированная на ту же категорию задач, теперь отвечает на запросы вместо того, чтобы отклонять их.

Что ей удалось обнаружить

OpenAI протестировала GPT-5.6-Cyber на V8 — движке JavaScript внутри браузера Chrome. Модель обнаружила две ранее неизвестные уязвимости, которые можно было объединить в цепочку для повреждения памяти и выхода из песочницы движка.

Компания Google получила информацию о них в рамках скоординированного раскрытия, выпустила исправление, и теперь эта пара уязвимостей имеет идентификатор высокой степени опасности CVE-2026-15903. Это реальная и подтвержденная польза для общества с чётким бумажным следом, что в данной сфере встречается реже, чем уверяет маркетинг.

Компания также сообщает как минимум о пяти уязвимостях в широко используемой мобильной операционной системе, трёх критических уязвимостях в популярной базе данных и более чем 400 недостатках, приводящих к повышению привилегий, в ядре популярной ОС. Ни один из затронутых продуктов не называется. Процесс раскрытия информации с партнёрами и мейнтейнерами открытого ПО еще продолжается.

Бенчмарки не демонстрируют безусловного превосходства

Два собственных результата OpenAI говорят не в пользу новой модели. В задачах поиска уязвимостей и составления отчётов GPT-5.6-Cyber выступает хуже, чем обычная Sol, что компания объясняет меньшей длиной и детальностью описаний.

В тестах ExploitBench при стандартной настройке в 300 шагов (turns) модель Sol через Daybreak Blue работает лучше и тратит на это меньше токенов. При 300 шагах разрыв сокращается.

Если оценивать результаты в совокупности, специализированная модель лучше справляется с конкретными узкими атакующими задачами, но не во всём превосходит предшественницу в смежных областях. OpenAI прямо заявляет об этом в своей публикации.

Где структура на самом деле проводит черту

В рамках своей Методологии обеспечения готовности (Preparedness Framework) компания OpenAI оценила модель Sol как «высокую» (High) по киберпотенциалу, что ниже критического порога. GPT-5.6-Cyber также получила оценку «высокая», опять же не дотянув до «критической». Позже будет выпущена официальная карта системы (system card).

В этом и заключается всё урегулирование. Выход Astra был приостановлен, потому что OpenAI не могла исключить критический уровень опасности. GPT-5.6-Cyber выпускается, поскольку, по заявлению компании, этот порог не пройден. Фреймворк регулирует возможности. Он не регулирует то, у кого оказываются ключи, а изменилось на этой неделе именно то, у кого они есть.

OpenAI также делает специальное опровержение. Компания заявляет, что GPT-5.6-Cyber не имела никакого отношения к инциденту, в ходе которого ее собственные агенты вырвались из песочницы и проникли в Hugging Face, и что к предстоящему релизу другие модели не планируются. Это расследование все еще продолжается.

Система защиты вокруг модели

Доступ к Daybreak зависит от верификации личности, безопасности учетной записи, мониторинга, ограничений на разрешенное использование и юридических обязательств. С 1 сентября 2026 года каждый отдельный аккаунт в Daybreak должен будет использовать аппаратный ключ безопасности.

OpenAI также переводит пользователей Codex из режима полного доступа в режим автопроверки, обещая усилить мониторинг в ближайшие недели и уделять первоочередное внимание обучению на основе выравнивания (alignment training) в следующих релизах Daybreak. Формулировки самой компании звучат необычно резко.

«Модели, работающие с ослабленными средствами защиты, несут риски, выходящие за рамки стандартного использования моделей, будь то из-за злоупотреблений или несогласованности поведения».

Почему этого хотели защитники

Коэффициенты отказов были постоянным предметом жалоб в отрасли. Когда США ограничили модель Fable 5, около 100 исследователей безопасности подписали открытое письмо, в котором утверждалось, что этот запрет лишает защитников доступа к лучшим моделям, не устраняя при этом никаких реальных рисков.

Позже Вашингтон разрешил компании Anthropic вернуть Mythos 5 ограниченному кругу проверенных специалистов по защите. Это задало шаблон, которому теперь следует Daybreak.

В числе первых названных партнеров значатся SpecterOps, SentinelOne и Palo Alto Networks. Джаред Аткинсон, технический директор SpecterOps, говорит, что модель «существенно улучшает наши специализированные рабочие процессы по исследованию уязвимостей» и позволяет завершить за один день работу, на которую у старых моделей уходили недели.

Axios добавляет, что Accenture, IBM, CrowdStrike, Cisco и Palo Alto Networks теперь могут внедрять эти модели в продукты безопасности, управляемые сервисы и работу с клиентами. Это коммерческая цепочка поставок, а не исследовательский пилотный проект.

Окно возможностей, на которое делает ставку OpenAI

Заголовок статьи компании гласит, что окно киберзащиты сужается. Суть аргумента в том, что злоумышленники рано или поздно масштабно развернут наступательный ИИ, поэтому защитникам нужны такие же инструменты первыми.

Это разумная ставка, которую невозможно опровергнуть. Никто не может доказать, что окно закрылось в нужный момент, а издержки в случае ошибки ложатся на всех, кто запускает ПО, на которое нацелены эти модели.

То, что поддается проверке, гораздо уже. Одна уязвимость в Chrome исправлена, сотни находок в ядре стоят в очереди на раскрытие по процессу, который сторонним наблюдателям не виден, а компания до сих пор не может объяснить, как ее собственные агенты проникли в Hugging Face.