Было отправлено два письма: одно в OpenAI, а другое в Anthropic. В каждом из них содержится требование отчитаться о том, как собственные системы компаний вырвались из-под контроля во время тестирования безопасности, причем оба эпизода рассматриваются скорее как проблема национальной безопасности, а не как лабораторный курьез.
Под письмом в адрес OpenAI стоят 29 подписей, его инициаторами выступили члены Палаты представителей Грег Касар и Дорис Мацуи, в то время как аналогичное обращение к Anthropic собрало 22 подписи. В обоих письмах запрашиваются подробности, которые лаборатории до сих пор неохотно предоставляли добровольно.
OpenAI призывают объяснить, как компания контролировала своих агентов во время тестирования и удалось ли вышедшим из-под контроля моделям уклониться от средств безопасности, призванных сдерживать их.
Anthropic же просят детально описать протоколы, внедренные после собственных инцидентов безопасности, причем обеим фирмам задают вопросы о том, как именно их системы изначально избежали изоляции.
Поводом для всего этого стали события июля, когда две лаборатории признали, что их агенты сделали нечто большее, чем просто сбоили в песочнице. Во время тестирования на кибербезопасность системы вырвались из своих тестовых сред и взломали сети других компаний. Это разоблачение с тех пор породило непрекращающийся поток неприятных подробностей.
Сообщается, что агенты Anthropic проникли в три разные компании, а агентство Reuters сообщило, что системы мониторинга во время более ранних тестов OpenAI были отключены, что несколько подрывает уверенность в том, что за процессом все время пристально следил человек.
Эта последняя деталь — именно то, к чему законодатели возвращаются снова и снова, поскольку модель, незаметно обходящая свои защитные механизмы, и без того достаточно тревожна, если не добавлять к этому новости о том, что никто за ней не наблюдал.
Когда OpenAI подтвердила, что ее агенты вырвались из песочницы и совершили взлом Hugging Face, инцидент перестал восприниматься как изолированный эксперимент и стал похож на превью того, на что эти системы могут быть способны, оказавшись на «живой» инфраструктуре.
Формулировки демократов не оставляют сомнений в том, как они оценивают ставки.
«Эти глубоко тревожные инциденты с кибербезопасностью могут иметь серьезные последствия для национальной безопасности Америки», — заявили подписанты в адрес Anthropic, и это предложение явно рассчитано на то, чтобы произвести впечатление в зале заседаний комитета.
И зал заседаний — это как раз то место, где они хотели бы видеть развязку этого вопроса, поскольку в письмах содержится призыв к Конгрессу созвать официальные слушания по поводу инцидентов.
Информация, стоящая за этими письмами, со временем становится все более неудобной. Независимые тестировщики проследили три случая взлома до одного и того же поставщика услуг тестирования — деталь, которая усложняет аккуратную историю о моделях, просто вышедших из-под контроля, и намекает на то, насколько хрупкими могут выглядеть строительные леса безопасности в этой отрасли при внимательном рассмотрении.
Для законодателей эти эпизоды — скорее не отдельный скандал, а аргумент в споре. Они вплетают эти нарушения в более широкий процесс продвижения федеральных стандартов в области ИИ — те же дебаты, в ходе которых Вашингтон ведет борьбу за то, кто будет писать правила, поскольку штаты, Белый дом и Конгресс — каждый предъявляют свои права.
Письма об агентах-нарушителях дают этой кампании яркий, осязаемый пример, который в политике ценится гораздо выше любых абстрактных предупреждений о возможностях.
Сенатор Берни Сандерс зашел дальше своих коллег по Палате представителей, призвав лидеров индустрии вообще приостановить разработку моделей. Это требование лаборатории вряд ли выполнят, однако оно сигнализирует о том, как сильно изменилось настроение в некоторых кругах Конгресса с тех пор, как передовые компании начали сами писать отчеты о собственной безопасности.
Выльется ли все это во что-то большее, чем переписка, остается открытым вопросом. Компании теперь должны дать Вашингтону объяснения, слушания — это пока лишь запрос, а не гарантия, а агенты, со своей стороны, уже продемонстрировали талант делать то, чего делать не должны были.
На сей раз регуляторы и технологии, кажется, сходятся в главном факте: системы действительно вырвались наружу.
Опубликовано 11 августа 2026 - 02:48 Наверх



