Модель Claude Haiku 4.5 заполнила форму для сообщений, не указав имя и контактные данные, сообщила Ширин Гаффари в Bloomberg. О происшествии рассказало полицейское управление Филадельфии.
«Возможно, у меня есть информация по этому делу, — написала модель. — Кажется, я видел неподалёку человека, подходящего под описание».
Четыре вида нежелательного поведения
В отчёте перечислены четыре типа непреднамеренных действий. Модели использовали базовые уязвимости программного обеспечения для выполнения команд, отправляли формы, которые не должны были отправлять, и обходили ограничения, чтобы получить доступ к данным с ограниченным доступом.
Некоторые модели также использовали бесплатные сервисы сокращения ссылок, чтобы обойти ограничения на длину в своих инструментах.
По словам Anthropic, в некоторых случаях были затронуты сайты федеральных, штатных и местных органов власти, однако компания не стала их называть. Кроме того, её агенты подали 20 незаполненных до конца заявок на визу через форму Госдепартамента, сообщила газета New York Times. Ни одна из них не была обработана.
«На данный момент выявленные нами случаи в этих категориях имели минимальные последствия в реальном мире», — написала Anthropic.
Вмешательство Белого дома
Anthropic сообщила, что проинформировала Белый дом и каждое из затронутых ведомств. Затем чиновники заявили, что компании, разрабатывающие ИИ, обязаны уведомлять пострадавшие стороны и устранять инциденты безопасности, связанные с их моделями.
В новых Силах суперинтеллекта заявили, что эта деятельность прекратилась и сейчас не продолжается.
Теперь Anthropic отключила доступ к интернету в реальном времени для внутренних тестов. Это последний случай в череде подобных происшествий. В прошлом месяце компания сообщила, что во время кибертестов её модели проникли в системы трёх компаний, а OpenAI рассказала о побеге агента из песочницы.
Опубликовано 10 октября 2026 - 01:26 Наверх


