Водяной знак ИИ Anthropic уже породил инструменты для его удаления.
Усилия Anthropic по маркировке текста, написанного ИИ, вызвали немедленный ответ. Разработчики начали создавать инструменты для удаления этих меток, согласно Business Insider.
Тибо Спирле и Агнес Эпплгейт сообщили, что один из удалителей стал вирусным на GitHub. Интерес к инструментам растет.
Водяной знак является триггером. Anthropic начала маркировать вывод Claude по всему миру с 2 августа. Он встраивает статистический шаблон в выбор слов модели. Этот шаблон сопровождает скопированный и вставленный текст. Компания утверждает, что метка незаметна для читателя. Некоторые пользователи не согласились с этим и решили действовать.
Реакция была громкой. Интерес к запросу "удалитель водяных знаков ИИ" в Google Trends в США вырос на 60 процентов по сравнению с прошлой неделей, сообщила Business Insider. Некоторые подписчики Claude отменили подписку из-за этой функции. Другие начали искать обходные пути, и несколько разработчиков создали один.
«Неправильный ответ на реальную проблему»
Самый популярный инструмент появился быстро. Гийом Мейер, предприниматель из Парижа, выпустил проект с открытым исходным кодом под названием Watermarks Remover через несколько дней после объявления Anthropic, сообщила Business Insider.
Мейер основал инструмент для электронной коммерции AI Memo. Его удалитель удаляет скрытые символы и метаданные, а затем переписывает текст. Это нарушает шаблон выбора слов, который несет метку, сохраняя при этом смысл.
Первая версия заняла у него около пяти часов на создание, сказал Мейер. С тех пор она собрала более 14,000 звезд на GitHub, что является грубой мерой интереса разработчиков. Это не гарантирует, что водяной знак исчез.
Мейер осторожно сформулировал свое возражение. «Я полностью за атрибуцию контента», — сказал он Business Insider. «Я против техники водяных знаков, и это очень важное различие».
Его жалоба заключается в том, что метод «рассматривает авторство как бинарное». Он маркирует текст, независимо от того, написал ли его Claude полностью или только помог отредактировать. «Я думаю, что это неправильный ответ на реальную проблему», — сказал он.
Он не единственный. Сабрина Рамонов, преподаватель ИИ, написала в X, что создала бесплатный браузерный удалитель для меток Claude и ChatGPT.
«Водяные знаки ИИ наказывают обычных пользователей, а не плохих актеров», — написала она. Ее инструмент утверждает, что очищает скрытые метки из текста, PDF-файлов, документов Word, веб-страниц, изображений и файлов данных, сообщила Business Insider.
Анш Анея, разработчик из Токио, сказал, что создал удалитель, ориентированный на Claude, в день объявления. Он написал, что сделал это после прочтения поста инвестора Пола Грэма.
Позже Анея выпустил локальную версию с открытым исходным кодом под названием MarkScrub. Он сказал, что более ранняя версия за один день привлекла от нуля до 8,500 пользователей, что Business Insider не смог проверить.
Anthropic выступила против этого предположения. В блоге с заголовком «Как работает водяной знак текста Claude» компания заявила, что метка «не говорит ничего о праве собственности или авторстве и не изменяет права пользователя в соответствии с нашими условиями».
Она также заявила, что водяной знак не содержит идентифицирующей информации и не может быть прослежен до конкретного человека, организации или чата.
Компания рассматривает эту функцию как соблюдение норм, а не как слежку. Anthropic утверждает, что добавила водяной знак, чтобы выполнить свои обязательства в соответствии с Законом о ИИ Европейского Союза.
Закон требует от поставщиков маркировать текст, сгенерированный ИИ, в машиночитаемой форме. В июле она подписала кодекс прозрачности блока вместе с примерно 190 другими подписантами, сообщила Mashable.
Пока она не может ограничить метку только для ЕС. Поэтому она внедряет эту функцию по всему миру и расширяет ее на более старые модели.
Что касается механики, Anthropic утверждает, что метка основывается на выборе слов с низкими ставками. Когда несколько слов подходят одинаково хорошо, модель склоняется к одному из них. Это оставляет обнаруживаемый статистический след, сообщила Mashable.
Компания утверждает, что это не добавляет затрат, дополнительных токенов и не снижает качество, и не ответила на вопросы Business Insider о инструментах удаления.
Редакция освещала напряженность, на которую нацелились удалители. Собственный дизайн Anthropic означает, что слегка вычитанное электронное письмо может нести метку, в то время как сильно переписанный черновик ИИ может не иметь ни одной.
Почему это трудно остановить?
Исследователи говорят, что удалители указывают на базовое ограничение. «Всегда будут способы удалить водяной знак», — сказал Тибо Глоаген, исследователь лаборатории безопасных, надежных и интеллектуальных систем ETH Цюрих, в интервью Business Insider. Он привел пример простого перефразирования целого отрывка.
Anthropic фактически признает тот же момент. Сильное переписывание может полностью удалить метку, заявила компания, после чего становится спорным, является ли текст все еще значимо сгенерированным ИИ.
Водяной знак также слаб или отсутствует на коротких отрывках, твердых фактах, точном коде и математике, где мало места для вариаций.
Конрад Коллниг, доцент юридического и технологического факультета Университета Маастрихта, выразил проблему в резких терминах. «Когда инструмент обнаружения водяных знаков становится публичным, любой может проверить содержимое, сгенерированное ИИ... и может создать инструменты для удаления водяных знаков», — сказал он Business Insider.
Это важно, потому что Anthropic планирует выпустить публичный API для обнаружения вместе со своей следующей моделью, дата пока не установлена.
Юридическая серая зона
Удалители находятся в неурегулированном правовом пространстве. ЕС требует от компаний ИИ добавлять долговечные метки, но не устанавливает четких правил для третьих лиц, которые пытаются их удалить, сообщила Business Insider.
Представитель Европейской комиссии сказал, что руководство блока требует от систем маркировки поставщиков выдерживать общие изменения и преднамеренные атаки. Кодекс прозрачности называет удаление, регенерацию, копирование и модификацию угрозами, которые поставщики должны оценить, добавил представитель.
Однако это обязанности поставщиков, а не общественности. Закон о ИИ не запрещает третьим лицам пытаться удалить водяной знак, сказал Дмитрий Русинов, старший преподаватель Университета Стратклайда.
Он добавил оговорку: если инструмент удаления использует ИИ для регенерации текста, его собственный поставщик может быть обязан маркировать этот новый вывод.
Ни Закон о ИИ, ни условия Anthropic не кажутся запрещающими людям создавать или делиться инструментами удаления, сказал Коллниг. Риск лежит в другом месте. Политика использования Anthropic запрещает выдавать вывод модели за созданный человеком, поэтому пользователь, который удаляет метку, чтобы неправильно представить работу ИИ как свою собственную, все равно может столкнуться с проблемами.
Другие компании, включая Google и OpenAI, также ставят водяные знаки на изображения, и инструменты для их удаления уже существуют. Даже музыка ИИ была помечена в том же стремлении к происхождению.
Таким образом, борьба, которую начала Anthropic, — это то, что более широкая индустрия уже хорошо знает, и то, что правила маркировки ЕС только обострили.
Другие статьи
Водяной знак ИИ Anthropic уже породил инструменты для его удаления.
Дни спустя после того, как Anthropic начала маркировать текст Claude для ЕС, разработчики выпустили инструменты для его удаления. Один из них набрал более 14,000 звезд на GitHub.
