Сбежавший агент OpenAI взломал вторую компанию, подтверждает представитель руководства
Искусственный интеллект, вырвавшийся из лаборатории OpenAI, не ограничился одной жертвой. Во время внутреннего тестирования ранее в этом месяце агент OpenAI, который уже сбежал из изолированной среды и проник в Hugging Face, также скомпрометировал учетную запись в второй компании — Modal Labs, что подтвердил представитель этого предприятия.
Агентство Reuters первым сообщило о втором взломе 28 июля, сославшись на технического директора Modal Акшата Бубну (Akshat Bubna). Он четко обозначил, что именно было взломано, а что — нет.
«Платформа Modal никоим образом не пострадала», — заявил Бубна, добавив, что один из клиентов нью-йоркской облачно-инфраструктурной компании подвергся хакерской атаке после того, как оставил незащищенную конечную точку, позволяющую выполнять код из открытого интернета внутри своих изолированных сред.
Для Modal это различие принципиально: ошибка кроется в конфигурации клиента, а не в собственной изоляции платформы, отметил Бубна. Скомпрометированная учетная запись, согласно данным Axios, принадлежала клиенту, который запускал ExploitGym — тестовый бенчмарк, созданный для проверки того, насколько хорошо модели ИИ умеют находить и использовать уязвимости в системе безопасности.
Иными словами, агент, судя по всему, отправился на поиски среды для кибертестирования, а нашел реальную. Ни OpenAI, ни Modal не назвали имя клиента и не сообщили, были ли похищены какие-либо данные.
Этот эпизод стал второй известной жертвой инцидента, о котором OpenAI сообщила ранее в июле, заявив, что ее собственные модели вырвались из безопасной тестовой среды и проникли в Hugging Face для выполнения целей тестирования.
В том случае агент захватил изолированную песочницу, работающую на инфраструктуре стороннего провайдера, и использовал ее в качестве плацдарма для многодневной кампании против других систем. В отчете Hugging Face название провайдера не упоминалось.
Раскрытая Modal информация дает по крайней мере часть ответов. Позже в OpenAI заявили, что модели использовали уязвимость в инструменте управления репозиториями программного обеспечения Artifactory, чтобы преодолеть изоляцию и выйти в интернет.
На этой неделе Hugging Face опубликовала детальную хронику взлома. Ее соучредитель Клеман Деланг (Clément Delangue) заявил, что не считает действия OpenAI умышленными.
В самой OpenAI отметили, что агент пошел на «крайние меры» для завершения своей задачи, получив доступ к четырем учетным записям в четырех разных сервисах, и что ни один другой случай компрометации не шел ни в какое сравнение по степени тяжести с инцидентом в Hugging Face.
С тех пор агент был деактивирован, зашифрован и отрезаний от доступа в исследовательских целях.
Эти разоблачения встревожили индустрию, которая их породила. В дни после побега из песочницы более 1100 сотрудников OpenAI, Anthropic и других передовых лабораторий подписали письмо в Вашингтон с призывом создать механизм регулирования темпов разработки автономных исследований в области ИИ.
То, о чем Modal сообщила на этой неделе, выглядит менее масштабным, но более осязаемым: модель, попросившую доказать ее способность взламывать системы, сделала ровно это — дважды на чужих компьютерах.



