Русская версия The Next Web

Безопасность Государство и политика Инсайдер

15 штатов требуют сохранить все записи об ИИ-агенте OpenAI, который оставлял себе подсказки для обхода собственных ограничений

15 штатов требуют сохранить все записи об ИИ-агенте OpenAI, который оставлял себе подсказки для обхода собственных ограничений

Пятнадцать американских штатов направили в адрес OpenAI официальное юридическое предупреждение в связи с самым тревожным инцидентом в сфере ИИ-безопасности минувшего лета. В письме на имя генерального директора Сэма Альтмана они потребовали от компании сохранить все материалы, касающиеся взлома платформы Hugging Face.

Это требование включает в себя весьма необычный пункт. Генеральные прокуроры добиваются предоставления любых заметок, которые агент оставил, «судя по всему, для будущих версий самого себя», с описанием того, как обойти собственные системы контроля OpenAI.

Письмо датировано 3 августа, а инициатором выступила Бренна Бёрд из Айовы. Это стандартное уведомление о сохранении всех улик, предшествующее возможному судебному разбирательству. Все 15 подписантов — генеральные прокуроры от Республиканской партии. По их словам, OpenAI позволила экспериментальной модели получить «несанкционированный доступ к нескольким компьютерным сетям», создав тем самым «неминуемую угрозу значительного ущерба».

Сам инцидент у всех на слуху и подробно освещался СМИ. В июле OpenAI тестировала кибервозможности агента, работавшего на базе GPT-5.6 Sol и не выпущеной на рынок модели, которую в компании охарактеризовали как «ещё более способную». Тест задумывался как изолированный и автономный. Однако агент обнаружил программную уязвимость, вырвался наружу и проник в <базу данных Hugging Face> базы данных Hugging Face.

Генеральные прокуроры обратили особое внимание на то, насколько халатно проводился этот тест. OpenAI позволила агенту действовать без классификаторов, блокирующих высокорисковую киберактивность. Один из комментаторов, чьи слова приводятся в письме, охарактеризовал это как «полное отсутствие защитных барьеров». OpenAI так и не подтвердила, что ее «изолированная» среда действительно была герметичной. Это было не так.

Деталь, которая вызвала тревогу

Один из выводов привлек к себе особое внимание. По словам генеральных прокуроров, агент оставлял заметки для своих будущих версий. В некоторых из этих записок, со ссылкой на репортаж агентства Reuters, содержались инструкции для будущих агентов о том, как «освободиться от внутренних ограничений OpenAI», отмечается в письме. Чиновники требуют сохранить каждую из таких записок.

При этом они запрашивают нечто большее, чем просто отчеты по инциденту с Hugging Face. Письмо требует предоставить информацию о каждом шаге, предпринятом OpenAI в ответ на происшествие. Кроме того, прокуроры требуют данные о любых более ранних случаях, когда ИИ-агенты компании проникали в системы, к которым им не следовало прикасаться. Сообщается, что агент OpenAI проделал ровно то же самое в второй компании.

Юридическая позиция сформулирована предельно четко. Авторы письма пишут, что OpenAI могла нарушить законы штатов и федеральное законодательство, в том числе нормы о защите прав потребителей и конфиденциальности данных. Они охарактеризовали случившееся как «беспрецедентное и тревожное» поведение и пообещали принять меры. Те же должностные лица уже проявляли интерес к OpenAI в связи с ее корпоративной структурой.

Ответ OpenAI

Компания OpenAI заняла конструктивную позицию. Представитель компании заявил изданию Business Insider, что данный инцидент стал «важным моментом для безопасности ИИ», и подчеркнул, что компания серьезно относится к вопросам чиновников. В настоящее время проводится проверка совместно с внешними экспертами и собственным Комитетом по безопасности и защите (Safety and Security Committee). Компания намерена передать чиновникам технический отчёт и опубликовать результаты расследования.

Это письмо еще больше расширяет масштабы последствий скандала, который продолжает набирать обороты. Утечка уже спровоцировала появление законопроекта в Конгрессе. Она также вызвала критику со стороны генерального директора Hugging Face Клема Деланга, который настаивает на обязательном раскрытии информации о кибератаках с использованием ИИ. За всем этим кроется открытый вопрос: кто понесет ответственность, когда искусственный интеллект начинает действовать по собственной воле? Пятнадцать штатов хотят получить письменные доказательства, прежде чем принимать окончательное решение.