Anthropic Безопасность Искусственный интеллект
Anthropic подробно описывает случаи злоупотребления Claude для слежки и создания оружия
Компания Anthropic опубликовала свой самый подробный отчет о злоупотреблениях ИИ-моделью Claude, рассказав о том, как люди пытались использовать ее в вредоносных целях. Компания заявила, что обнаружила и пресекла эти операции. Они охватывали кибератаки, государственную слежку, кампании по дезинформации, разработку обычных вооружений и биологические исследования.
Компания изложила эти случаи в отчете об анализе угроз, выпущенном 10 сентября. В отчете рассматривается активность, которую ее команда по анализу угроз пресекла в период с декабря 2025 по август 2026 года.
Отчет охватывает семь областей причинения вреда: кибероперации, операции влияния, слежку, разработку обычных вооружений, биологические злоупотребления, мошенничество и незаконный дистиллинг (перенос возможностей модели). В Anthropic заявили, что злоупотребления касались ее моделей Claude Haiku, Sonnet и Opus.
Ни один из случаев не был связан с ее моделями классов Fable или Mythos, добавили в компании, за исключением одного случая дистиллирования. В каждом отдельном случае компания заявляла, что блокировала учетные записи и усиливала меры безопасности. Там, где это было необходимо, она также делилась разведывательными данными с властями и отраслевыми партнерами.
Более дешевые атаки, а не новые методы
Самый большой раздел посвящен кибероперациям. Его главный тезис заключается в том, что ИИ сократил разрыв между хорошо обеспеченными ресурсами государственными хакерами и одиночками-операторами. Anthropic указала на хактивиста, использовавшего украденные ключи API, лиц, движимых финансовыми мотивами, и государственного шпиона. Каждый из них проводил кампании против множества жертв.
Годом ранее, по словам компании, такая работа потребовала бы команд квалифицированных специалистов. Компания сообщила о взломах, завершенных за два-три часа, причем десятки жертв обрабатывались параллельно одиночными операторами.
Один из случаев, который Anthropic отслеживает под кодовым именем GTG-20006, был связан с русскоязычным оператором, проводившим шпионаж против украинских и европейских правительственных объектов. Целями также стали дипломатические и оборонные организации.
Компания связала это с публичными отчетами о группировке, известной как Midnight Blizzard. Было заявлено, что злоумышленник использовал ИИ для проверки того, пометили ли средства защиты их вредоносное ПО, а затем автоматически пересоздавал его, чтобы обойти обнаружение.
Anthropic проследила отдельную операцию до двух человек, которых она описала как студентов бакалавриата в Хунане, Китай. По данным компании, они использовали так называемые рои агентов против примерно пятидесяти организаций. Среди них было правительственное агентство Юго-Восточной Азии, у которого злоумышленник похитил записи о гражданах.
Слежка, созданная одним консультантом
В Anthropic сообщили, что аффилированные с государствами субъекты и коммерческие поставщики шпионского ПО использовали Claude для создания систем слежки в период с января по июль. Эти случаи охватывали Китай, Иран и Западную Африку. Один из них компания назвала наиболее ярким. Единственный пользователь использовал Claude в качестве инженерного персонала для создания платформы под названием Lakana 360.
Компания оценила этого пользователя как консультанта из Бамако, сотрудничающего с государственной службой разведки Мали.
Система отслеживала примерно 25 миллионов SIM-карт у всех трех мобильных операторов страны. По данным Anthropic, это позволило обойти законное требование о судебном ордере, прежде чем оператор сможет раскрыть определенные данные. Кроме того, система работала на локальных моделях локально (on-premises), поэтому блокировка учетной записи никак не повлияла на развернутую систему.
Среди других случаев слежки упоминались иранские субъекты, развернувшие вредоносное расширение для Firefox, которое собирало личные данные пользователей из социальных сетей. Anthropic также описала подразделение разведки по делам религий в Китае. По ее словам, это подразделение сократилось с множества команд аналитиков до одного офиса. Теперь этот офис выпускает тысячи расследований в месяц с помощью ИИ-помощника.
В другом китайском случае, как заявили в компании, Claude оценивал посты в соцсетях на предмет политической чувствительности и помечал людей для целей, которые операторы называли контролем. Этот отчет продолжает тему более ранних публикаций TNW о внедрении ИИ в инструменты полицейского поиска.
Джейкоб Кляйн (Jacob Klein), руководящий направлением анализа угроз в Anthropic, сообщил изданию Axios, что ИИ делает государственную слежку более дешевой и эффективной. При этом, по его словам, он не меняет того, кого именно выбирают в качестве мишени правительства.
«Они фактически автоматизируют часть работы внутри разведывательного аппарата», — заявил он. Он добавил, что эта тенденция уже не носит теоретический характер. «Авторитарные государства сегодня используют ИИ для слежки, репрессий и операций влияния», — сообщил он изданию Axios.
Новая категория: оружие
В отчете задокументировано то, что Anthropic охарактеризовала как новую форму злоупотребления: использование Claude для написания программного обеспечения для обычных вооружений. Было подробно описано шесть таких случаев: три в Китае, два в России и один в Йемене.
В случае с Йеменом компания сообщила, что ячейка на севере страны реализовала три оружейные программы. Они включали управляемую ракету, многоступенчатую баллистическую ракету с заявленной дальностью полета более 2000 километров, а также набор модификаций ракет, включая гиперзвуковой планирующий блок.
В Anthropic заявили, что злоумышленники использовали Claude Code вместо инженеров-программистов для разработки кода наведения и управления. Было добавлено, что они провели испытательный пуск управляемой ракеты, который, судя по всему, оказался неудачным.
Российские случаи включали деятельность независимых разработчиков, работавших над роем автономных дронов-камикадзе.
Биология и сложные этические дилеммы
В Anthropic заявили, что представили пять случаев использования ее моделей способами, которые могли бы способствовать разработке биологического оружия. Компания подчеркнула, как сложно принимать подобные оценочные суждения.
Компания скрыла названия учреждений, стран и конкретных задействованных биологических агентов. Было отмечено, что эти лица являлись работающими учеными, и компания не утверждает, что у них были злонамеренные цели.
В одном из примеров от мая сообщалось, что запрос на помощь в написании заявки на грант касался исследований по усилению функций (gain-of-function) вируса чикунгунья. Эта работа должна была проводиться в военном исследовательском институте.
«Вы не видите персонажа из комиксов, который говорит: «Эй, я хочу создать биологическое оружие, чтобы всех убить», — рассказал Кляйн газете The New York Times. — Это невероятно тонкая ситуация».
Касательно случая с чикунгуньей он сообщил газете, что компания не знает, предназначалось ли исследование для создания оружия, однако сам факт проведения военным учреждением исследований по усилению функций вызывает беспокойство. В Anthropic заявили, что более старые модели, такие как Claude Opus 4, находились далеко за пределами того уровня, на котором они могли бы существенно помочь в подобной работе.
Компания сообщила, что выпустила более новые модели с более надежными средствами защиты. Этот сдвиг перекликается с более ранним отчетом, в котором компания отключала свои биоклассификаторы во время тестирования. Тема же дистилляции тем временем уходит корнями в заявления Белого дома о том, что компания Moonshot применила дистилляцию к модели Fable от Anthropic.
Случаи китайской дистилляции
Отчет также подробно освещает проблему незаконного дистиллирования. Anthropic определяет это как скрытое извлечение возможностей модели для обучения конкурента.
Компания заявила, что выявила кампании семи лабораторий из Китая, причем все они нацеливались на ее общедоступные модели, а не на Mythos. Она назвала компанию Moonshot AI, которая, по ее данным, незаметно перенаправляла запросы клиентов к Claude и выдавала ответы так, будто они получены от собственной модели Kimi.
По данным Anthropic, за один десятидневный период Moonshot перенаправила почти 300 000 запросов через сеть из 5 380 мошеннических аккаунтов. Компания приписала Moonshot более 23 миллионов взаимодействий в период с мая по июль. Аналогичные обвинения компания выдвинула против DeepSeek, Zhipu, Xiaomi, SenseTime и MiniMax.
Некоторые из перенаправленных запросов раскрывали конфиденциальные пользовательские данные, отмечается в отчете — в одном случае это были действующие учетные данные, привязанные к российскому оборонному ведомству.
Выводы о дистилляции публикуются одновременно с предупреждением американской разведки, в котором названы шесть китайских фирм, и отвержением Пекином этих претензий. В Anthropic отметили, что большинство выявленных ими операций влияния почти не привлекали реального внимания пользователей до того, как они были пресечены. Другие платформы делали аналогичные оговорки.
В Anthropic заявили, что опубликовали отчет из стремления предать огласке факты злоупотреблений, а также чтобы дать правительствам и гражданскому обществу более четкое представление о том, как формируются подобные угрозы.


