Anthropic Европа Искусственный интеллект
Инструменты для удаления ИИ-водяных знаков появились сразу после их внедрения Anthropic
Стремление Anthropic маркировать текст, созданный искусственным интеллектом, вызвало незамедлительную ответную реакцию. По данным Business Insider, разработчики уже начали создавать инструменты для удаления этих меток.
Тибо Спирле и Агнес Эпплгейт сообщили, что один из таких инструментов для удаления стал вирусным на GitHub. Интерес к подобным разработкам растет.
Причиной стал сам водяной знак. Компания Anthropic начала маркировать результаты работы Claude по всему миру со 2 августа. В выбор слов модели внедряется статистический паттерн. Этот паттерн копируется вместе с текстом при вставке из буфера обмена. Компания утверждает, что метка незаметна для читателя. Однако некоторые пользователи были с этим не согласны и решили действовать.
Реакция оказалась громкой. Как сообщает Business Insider, интерес в Google Trends в США к запросу «удаление водяных знаков ИИ» вырос за неделю на 60 процентов. Некоторые подписчики Claude отменили подписку из-за этой функции. Другие занялись поиском обходных путей, а несколько разработчиков создали их.
«Неправильный ответ на реальную проблему»
Самый популярный инструмент появился быстро. Как сообщает Business Insider, парижский предприниматель Гийом Мейер выпустил проект с открытым исходным кодом под названием Watermarks Remover спустя всего несколько дней после объявления Anthropic.
Мейер основал инструмент электронной коммерции на базе ИИ Memo. Его утилита удаляет скрытые символы и метаданные, а затем переписывает текст. Это нарушает паттерн выбора слов, который содержит метку, но сохраняет первоначальный смысл.
По словам Мейера, на создание первой версии у него ушло около пяти часов. С тех пор проект собрал более 14 000 звезд на GitHub, что является примерным показателем интереса разработчиков. При этом утилита не дает гарантии полного исчезновения водяного знака.
Мейер сформулировал свою позицию очень аккуратно. «Я полностью поддерживаю атрибуцию контента, — заявил он в интервью Business Insider. — Но я против самой техники создания водяных знаков, и это очень существенное различие».
Его претензия заключается в том, что этот метод «рассматривает авторство как бинарное явление». Метка ставится независимо от того, написал ли Claude текст полностью или только помог его отредактировать. «Я думаю, это неправильный ответ на реальную проблему», — отметил он.
Он не единственный. Специалист по ИИ Сабрина Рамонов написала в X, что создала бесплатный инструмент для удаления меток Claude и ChatGPT, работающий прямо в браузере.
«ИИ-водяные знаки наказывают обычных пользователей, а не злоумышленников», — написала она. Согласно данным Business Insider, ее инструмент позволяет очищать скрытые метки в текстах, файлах PDF и Word, на веб-страницах, а также в изображениях и файлах данных.
Токийский разработчик Анш Анеджа рассказал, что создал инструмент для удаления меток Claude в день анонса. Он написал, что занялся этим после прочтения поста инвестора Пола Грэма.
Позже Анеджа выпустил локальную версию с открытым исходным кодом под названием MarkScrub. По его словам, предыдущая версия набрала от нуля до 8 500 пользователей всего за один день — цифру, которую Business Insider не смог подтвердить.
Anthropic отвергает подобные претензии. В своем блоге в публикации под названием Как работают текстовые водяные знаки Claude компания заявила, что метка «ничего не говорит о владении или авторстве и не изменяет права пользователя в соответствии с нашими условиями».
В компании также заявили, что водяной знак не содержит никакой идентифицирующей информации и его невозможно отследить до конкретного человека, организации или чата.
Компания представляет эту функцию как соблюдение требований закона, а не средство слежки. В Anthropic заявляют, что добавили водяной знак для выполнения обязательств в рамках Закона об искусственном интеллекте Европейского союза.
Закон требует от провайдеров маркировать сгенерированный ИИ текст в машиночитаемом формате. Как сообщает Mashable, в июле компания подписала кодекс прозрачности блока наряду примерно с 190 другими участниками.
Пока компания не может ограничить внедрение метки только территорией ЕС, поэтому она развертывает эту функцию по всему миру и распространяет ее на более старые модели.
Что касается технической стороны, в Anthropic поясняют, что водяной знак скрывается в малозначительных вариантах выбора слов. Когда для выражения мысли подходит несколько равнозначных слов, модель склоняется к одному из них. Это оставляет обнаруживаемый статистический след, сообщает Mashable.
По утверждению компании, это не требует дополнительных затрат, токенов или заметного снижения качества, однако на вопросы Business Insider об инструментах для удаления меток представители компании отвечать не стали.
В редакции уже освещали проблему, на которую опираются создатели средств удаления. Из-за особенностей разработки Anthropic даже слегка вычитанное электронное письмо может содержать метку, в то время как сильно переписанный черновик, созданный ИИ, может не содержать ее вовсе.
Почему это сложно остановить?
Исследователи отмечают, что появление инструментов удаления указывает на фундаментальное ограничение. «Всегда будут способы удалить водяной знак», — рассказал Business Insider Тибо Глоаген, исследователь из лаборатории безопасных, надежных и интеллектуальных систем ETH Zurich. В качестве примера он привел банальное перефразирование всего отрывка.
В Anthropic фактически согласны с этим доводом. В компании заявляли, что глубокое переписывание текста способно полностью стереть метку, после чего становится спорным вопрос о том, можно ли считать полученный текст созданным с помощью ИИ.
Кроме того, водяной знак оказывается слабым или полностью отсутствует в коротких отрывках, наборе фактов, точном коде и математических формулах, где возможности для вариаций минимальны.
Конрад Коллниг, доцент Лаборатории права и технологий Маастрихтского университета, сформулировал эту проблему прямо. «Как только инструмент обнаружения водяных знаков становится общедоступным, любой может проверить контент, сгенерированный ИИ… и создать инструменты для их удаления», — заявил он в интервью Business Insider.
Это имеет значение, поскольку Anthropic планирует выпустить публичный API для обнаружения меток вместе со своей следующей моделью, дата релиза которой пока не назначена.
Юридическая серая зона
Утилиты для удаления находятся в неопределенном правовом поле. ЕС требует от ИИ-компаний внедрять долговечные метки, но четко не регулирует правила для третьих лиц, которые пытаются их удалить, сообщает Business Insider.
Представитель Европейской комиссии заявил, что руководящие принципы союза требуют, чтобы системы маркировки провайдеров выдерживали стандартные изменения и намеренные атаки. Представитель добавил, что кодекс прозрачности определяет удаление, регенерацию, копирование и модификацию в качестве угроз, которые поставщики обязаны оценивать.
Тем не менее, эти требования распространяются на провайдеров, а не на рядовых граждан. Закон об ИИ прямо не запрещает третьим лицам пытаться удалить водяной знак, отмечает Дмитрий Русинов, старший преподаватель Университета Стратклайда.
Однако он добавил важную оговорку: если инструмент удаления использует ИИ для регенерации текста, его разработчик может быть обязан заново промаркировать этот новый результат.
По словам Коллнига, ни Закон об ИИ, ни условия использования Anthropic не запрещают людям создавать или распространять инструменты для удаления. Риски возникают в другой плоскости. Политика использования Anthropic запрещает выдавать результаты работы модели за контент, созданный человеком, поэтому пользователь, который удаляет метку с целью исказить происхождение работы ИИ, все равно может столкнуться с проблемами.
Другие компании, включая Google и OpenAI, также используют водяные знаки для изображений, и инструменты для их удаления уже существуют. Даже музыка, созданная ИИ, получила водяные знаки в рамках аналогичной борьбы за установление происхождения контента.
Иными словами, борьба, начатая Anthropic, хорошо знакома всей индустрии, а правила маркировки ЕС лишь усилили это противостояние.


