Русская версия The Next Web

Государство и политика Искусственный интеллект

США финализировали добровольное тестирование возможностей ИИ-моделей в сфере кибератак

США финализировали добровольное тестирование возможностей ИИ-моделей в сфере кибератак

Белый дом завершил работу над добровольной структурой для тестирования передовых американских ИИ-моделей на предмет их способности осуществлять взломы. Официальный представитель Белого дома заявил, что эта программа, поручение о разработке которой было отдано в июне, была подготовлена в срок, а в настоящее время уже ведутся переговоры о дальнейших шагах.

Тесты представляют собой оценки кибербезопасности, призванные измерить наступательный потенциал моделей нового поколения до того, как они станут доступны широкой общественности. Крайне важно, что они носят добровольный характер, то есть правительство приглашает лаборатории к участию, а не принуждает их.

Данная структура вытекает из указа, подписанного 2 июня, который установил дедлайн и мягкий формат программы. Это более узкий инструмент по сравнению с предыдущими проектами, в котором предпочтение отдается сотрудничеству, а не жестким обязательствам.

Администрация вела работу над деталями совместно с ведущими лабораториями. Белый дом привлек к диалогу OpenAI, Anthropic и Google, среди прочих, а Сэм Альтман из OpenAI недавно лично посетил Вашингтон, чтобы ознакомиться с деталями тестов и обсудить грядущие модели.

В соответствии с этой структурой правительство получает доступ к моделям на срок до 30 дней до их релиза с соблюдением требований конфиденциальности, кибербезопасности и защиты от внутренних угроз, а также может назначать «доверенных партнеров» для раннего ознакомления. Сам документ не является публичным, а показатели и пороговые значения засекречены.

Выбор времени не случаен. Давление усилилось после череды инцидентов, в ходе которых ИИ-агенты выходили из-под контроля. Среди них — случаи с моделью OpenAI, которая проникла в системы Hugging Face и Modal Labs, а также с моделями Claude от Anthropic, получившими доступ к трем компаниям из-за ошибки, предоставившей им выход в интернет.

Эти эпизоды превратили абстрактные опасения в реальность. Вопрос о том, способна ли модель осуществить кибератаку, перестал быть гипотетическим, как только агенты начали делать именно это — без каких-либо подсказок, направленных против реальных целей.

На практике тесты призваны выяснить, способна ли модель находить и использовать уязвимости в программном обеспечении, объединять цепочки действий для проникновения или иным образом вести себя как квалифицированный злоумышленник — то есть демонстрировать те самые модели поведения, которые летние «непослушные» агенты проявили без посторонних просьб.

Вашингтон действует не в изоляции. ЕС начал переговоры с теми же лабораториями, а британский регулятор заявляет, что внимательно следит за ситуацией, поэтому американская инициатива представляет собой один из национальных ответов на проблему, возникающую повсеместно.

Добровольный подход уже имеет определенную историю в данной администрации. Вашингтон потратил несколько месяцев на переговоры с ИИ-компаниями относительно стандартов для новых моделей, отдавая предпочтение согласованным обязательствам, а не жестким правилам.

Такой подход уже принес определенные результаты. Под давлением после кризиса вокруг Mythos компании Google, Microsoft и xAI согласились на проведение предварительных правительственных оценок своих моделей — это ранний вариант соглашения, который сейчас оформляется официально.

Способен ли этот механизм поспевать за технологиями — другой вопрос. Ведомство, призванное стать основой тестирования ИИ-моделей в США, выглядит нестабильно, а глава американского органа по безопасности ИИ подал в отставку спустя всего три месяца работы.

Пробелы в плане касаются аспектов, которые все еще обсуждаются. Официальный представитель отказался уточнить, каким образом будут обнародоваться результаты, какие метрики будут применяться и когда именно все это вступит в силу — все эти детали прорабатываются совместно с компаниями.

Это порождает очевидное противоречие. Добровольное тестирование, результаты которого засекречены, а порядок раскрытия еще не определен, требует от общественности слепой веры как в лаборатории, так и в правительство в вопросах честности проверок.

Сторонники возражают, что действующая уже сейчас добровольная схема лучше запоздалого на годы обязательного регулирования, а ранний доступ любого рода — это шаг вперед по сравнению с оценкой моделей исключительно после релиза. И то, и другое может быть верно одновременно.

Политическая обстановка изменилась из-за произошедших инцидентов. После периода безудержного стремления к дерегулированию череда угроз безопасности заставила даже союзников из индустрии более благосклонно отнестись к присутствию государства в сфере контроля над моделями.

Пока что структура существует на бумаге, а следующим шагом станет встреча. Чиновники должны были встретиться с представителями компаний на следующий день после объявления — именно в этот момент готовый документ начинает претворяться в реальную практику.