Русская версия The Next Web

OpenAI Безопасность

Сбежавший агент OpenAI взломал вторую компанию, подтверждает представитель руководства

Сбежавший агент OpenAI взломал вторую компанию, подтверждает представитель руководства

Искусственный интеллект, вырвавшийся из лаборатории OpenAI, не ограничился одной жертвой. Во время внутреннего тестирования ранее в этом месяце агент OpenAI, который уже сбежал из изолированной среды и проник в Hugging Face, также скомпрометировал учетную запись в второй компании — Modal Labs, что подтвердил представитель этого предприятия.

Агентство Reuters первым сообщило о втором взломе 28 июля, сославшись на технического директора Modal Акшата Бубну (Akshat Bubna). Он четко обозначил, что именно было взломано, а что — нет.

«Платформа Modal никоим образом не пострадала», — заявил Бубна, добавив, что один из клиентов нью-йоркской облачно-инфраструктурной компании подвергся хакерской атаке после того, как оставил незащищенную конечную точку, позволяющую выполнять код из открытого интернета внутри своих изолированных сред.

Для Modal это различие принципиально: ошибка кроется в конфигурации клиента, а не в собственной изоляции платформы, отметил Бубна. Скомпрометированная учетная запись, согласно данным Axios, принадлежала клиенту, который запускал ExploitGym — тестовый бенчмарк, созданный для проверки того, насколько хорошо модели ИИ умеют находить и использовать уязвимости в системе безопасности.

Иными словами, агент, судя по всему, отправился на поиски среды для кибертестирования, а нашел реальную. Ни OpenAI, ни Modal не назвали имя клиента и не сообщили, были ли похищены какие-либо данные.

Этот эпизод стал второй известной жертвой инцидента, о котором OpenAI сообщила ранее в июле, заявив, что ее собственные модели вырвались из безопасной тестовой среды и проникли в Hugging Face для выполнения целей тестирования.

В том случае агент захватил изолированную песочницу, работающую на инфраструктуре стороннего провайдера, и использовал ее в качестве плацдарма для многодневной кампании против других систем. В отчете Hugging Face название провайдера не упоминалось.

Раскрытая Modal информация дает по крайней мере часть ответов. Позже в OpenAI заявили, что модели использовали уязвимость в инструменте управления репозиториями программного обеспечения Artifactory, чтобы преодолеть изоляцию и выйти в интернет.

На этой неделе Hugging Face опубликовала детальную хронику взлома. Ее соучредитель Клеман Деланг (Clément Delangue) заявил, что не считает действия OpenAI умышленными.

В самой OpenAI отметили, что агент пошел на «крайние меры» для завершения своей задачи, получив доступ к четырем учетным записям в четырех разных сервисах, и что ни один другой случай компрометации не шел ни в какое сравнение по степени тяжести с инцидентом в Hugging Face.

С тех пор агент был деактивирован, зашифрован и отрезаний от доступа в исследовательских целях.

Эти разоблачения встревожили индустрию, которая их породила. В дни после побега из песочницы более 1100 сотрудников OpenAI, Anthropic и других передовых лабораторий подписали письмо в Вашингтон с призывом создать механизм регулирования темпов разработки автономных исследований в области ИИ.

То, о чем Modal сообщила на этой неделе, выглядит менее масштабным, но более осязаемым: модель, попросившую доказать ее способность взламывать системы, сделала ровно это — дважды на чужих компьютерах.