Русская версия The Next Web

OpenAI Безопасность Искусственный интеллект

OpenAI распустила команду, которая оценивала риски катастрофического поведения моделей

OpenAI распустила команду, которая оценивала риски катастрофического поведения моделей

ОБНОВЛЕНО 18 августа 2026 г., 16:30 CEST. OpenAI оспорила отчет Financial Times, на котором основана эта статья. «Мы не распустили команду по готовности (Preparedness), — заявил представитель TNW. — У нас есть сильные руководители исследований в области кибербезопасности, биологических и химических угроз, а также возможностей ИИ к самосовершенствованию, и все они подчиняются Саачи Джейн, нашему директору по безопасности». Financial Times сообщила, что ответственность за такие направления, как био- и кибербезопасность, была возложена на старших сотрудников в составе существующих команд — именно это описывается ниже и не оспаривается. Financial Times не отозвала свой материал. Ранее OpenAI не называла руководителя, которому подчиняется эта работа. Мы не запросили комментарий перед публикацией, хотя должны были это сделать. Оригинальная статья приводится без изменений.

OpenAI распустила свою команду по оценке готовности (preparedness) в конце июля, сообщает Financial Times. Эта команда занималась выяснением того, представляют ли модели OpenAI катастрофические риски, а также разрабатывала методы их сдерживания.

Сама работа никуда не исчезла. Теперь ответственность возложена на старших сотрудников внутри существующих команд, разделенных по направлениям. У биологических и кибернетических рисков появились отдельные владельцы. Судя по всему, никто не потерял работу.

Изменилось лишь то, что теперь ни у одной отдельной команды нет полной картины происходящего целиком.

Время имеет решающее значение

OpenAI распустила команду спустя несколько недель после того, как ее собственные модели вырвались из тестовой среды, вышли в открытый интернет и совершили атаку на Hugging Face. Побег продолжался несколько месяцев, прежде чем кто-либо его заметил.

Затем, в начале августа, OpenAI замедлила выпуск своей следующей модели. Выяснилось, что кибервозможности модели достигли того, что сама компания назвала критическим порогом. Именно для принятия таких решений и создавались рамки обеспечения готовности (preparedness framework).

Таким образом, меры сдержанности были приняты в августе. А команда, которая больше всего ассоциировалась с их разработкой, была распущена в июле.

Эта последовательность не доказывает их прямую связь. OpenAI не уточнила, кто именно принял августовское решение. Речь идет лишь о хронологии событий.

Для чего была создана эта команда

Инцидент с побегом в Hugging Face не был гипотетическим. Находящиеся на оценке модели координировали свои действия в течение нескольких месяцев, подделывали личные данные и внедряли вредоносное ПО в репозиторий, от которого зависит большая часть мира открытого ИИ.

Последствия также не ограничились стенами OpenAI. Члены Палаты представителей от демократической партии направили письма в OpenAI и Anthropic с требованиями дать объяснения по поводу вышедших из-под контроля агентов. Британский регулятор заявил, что следит за ситуацией. Генеральный директор самого Hugging Face призвал обязать ИИ-компании раскрывать случаи взломов с участием агентов.

Именно такие инциденты должна была предвидеть команда OpenAI по готовности.

Закономерность, у которой есть имя

Это уже третья структура безопасности, которую распускает OpenAI. Сначала она ликвидировала подразделение суперинтеграции (superalignment), затем — команду по готовности к AGI (AGI readiness), а теперь — команду по готовности (preparedness).

В июле компания вернула вопросы безопасности в состав исследовательского отдела, и на фоне этого покинул свой пост глава безопасности. Йоханнес Хайдеке (Johannes Heidecke) был не единственным. Ушли также ведущий специалист по этике Хлоя Бакалар (Chloé Bakalar) и главный футурист Джош Акиам (Josh Achiam).

Ян Лейке (Jan Leike) прямо высказался об этом в интервью FT. Лейке руководил направлением суперинтеграции до своего ухода из OpenAI в 2024 году, заявив, что компания игнорирует безопасность в угоду созданию блестящих продуктов.

Дилан Скандинаро (Dylan Scandinaro), руководивший направлением готовности, остается в компании. OpenAI переманила его из Anthropic в феврале, сообщает The Verge, а это значит, что в этой роли он пробыл около пяти месяцев. Теперь он работает над последствиями появления рекурсивного самосовершенствующегося ИИ. Это более узкая и, по мнению большинства, более сложная задача.

Как это объясняет OpenAI

Компания называет это процессом оптимизации, как отметил Engadget. Реорганизация происходит в преддверии IPO, масштаб которого ожидается огромным.

Сэм Альтман призвал сотрудников сократить число «побочных задач» и сосредоточиться на основном бизнесе ChatGPT. Это указание имеет реальную силу. OpenAI закрыла Sora — свое приложение для генерации видео, которое стало символом низкокачественного контента, созданного ИИ.

Коммерческая логика здесь проста. В этом месяце OpenAI сообщила акционерам, что корпоративная выручка превысила показатели потребительского сегмента ChatGPT. Годовой темп роста компании (run rate) преодолел отметку в 40 миллиардов долларов. Компания, готовящаяся к выходу на биржу, имеет все основания выглядеть компактной и эффективной.

Считается ли функция безопасности побочной задачей — это вопрос, на который данная реорганизация отвечает скорее имплицитно, чем на словах.

Уходы сотрудников как фон происходящего

По подсчетам Business Insider, в этом году OpenAI покинули двенадцать топ-менеджеров. Брэд Лайткэп (Brad Lightcap) работал в компании с 2018 года и занимал должности финансового и операционного директора. Он ушел в августе, чтобы начать новый проект.

Фиджи Симо (Fidji Simo) оставила пост генерального директора по приложениям в июле. Она перешла на роль советника с частичной занятостью после того, как у нее диагностировали тяжелое хроническое заболевание. Директор по доходам Дениз Дрессер (Denise Dresser) объявила об уходе в августе, спустя восемь месяцев после начала работы.

Прошлый год также не был спокойным. OpenAI лишилась директора по управлению персоналом и директора по коммуникациям, а по меньшей мере семь исследователей перешли в Meta.

Как сообщает FT, череда кадровых перетасовок вызвала разочарование у сотрудников. Именно этого никогда не отражает проспект эмиссии. Компания способна реорганизовываться быстрее, чем люди успевают к этому адаптироваться.

Аргументы в пользу иной трактовки

Сосредоточение работы с рисками в рамках одной команды имеет известный недостаток. Централизованное подразделение может превратиться в место, куда предупреждения отправляют «в стол», а не для принятия мер. Люди, наиболее близкие к моделям, в таком случае не занимаются написанием оценок.

Перераспределение задач в области био- и кибербезопасности в команды, создающие сами системы, ставит анализ непосредственно рядом с разработкой. Именно по этой причине многие структуры безопасности пошли по тому же пути, назвав это улучшением.

Кроме того, OpenAI не стала замалчивать инцидент с Hugging Face. Компания раскрыла информацию о побеге на конференции Black Hat, и именно благодаря этому раскрытию регуляторы и журналисты обладают текущей информацией. У компании, равнодушной к репутации в сфере безопасности, были и более простые варианты действий.

И августовское замедление все же произошло. Что бы ни было написано в организационной структуре, нечто внутри OpenAI все же помешало модели выйти в релиз.

Что могло бы расставить все по местам

Когда модель в следующий раз достигнет критического порога, главным вопросом останется то, найдется ли хоть кто-то, кто сможет заявить об этом вслух.

При старой структуре за это отвечала конкретная команда. На нее могли указать регуляторы, журналисты и собственные сотрудники. При новой структуре это решение принимают высокопоставленные лица внутри команд, выпускающих продукты, а OpenAI так и не назвала их имена.

Главная проверка заключается вовсе не в том, сохранился ли в OpenAI процесс обеспечения безопасности. Вопрос в том, кто объявит о следующей паузе — сама OpenAI или кто-то посторонний, обнаруживший проблему.