Этот проект на GitHub хочет удалить водяные знаки ИИ с вашего контента, и ситуация становится интересной.
Компании, занимающиеся искусственным интеллектом, все чаще ищут способы маркировать контент, созданный их моделями. Теперь кто-то создал инструмент с открытым исходным кодом, предназначенный для удаления некоторых из этих маркеров.
Проект на GitHub под названием watermarks-remover предназначен для удаления различных типов сигналов происхождения ИИ из текста и файлов. Согласно его документации, он может работать с невидимыми символами Unicode, статистическими водяными знаками текста и метаданными, встроенными в форматы, включая PNG, JPEG, SVG, PDF, DOCX, ODT, HTML и Markdown.
Это звучит просто, пока вы не посмотрите, как на самом деле работают некоторые из этих водяных знаков. Метаданные можно удалить относительно чисто. Статистический водяной знак, встроенный в способ выбора слов моделью ИИ, — это совершенно другая история. И именно здесь этот проект становится интересным.
Некоторые водяные знаки ИИ зарыты в том, как вы пишете
Проект разделяет свой подход на разные уровни. Один нацелен на сигналы, основанные на редактировании, такие как необычные символы Unicode, в то время как другой сосредоточен на статистических паттернах в сгенерированном тексте. Отдельный уровень очистки занимается информацией о происхождении файлов, такой как C2PA, EXIF, XMP и свойства документов.
Последняя версия 0.3.1 делает сторону переписывания текста более агрессивной. Вместо простого замены нескольких слов инструмент может изменять структуру предложений, выбор слов, переходы и другие паттерны в попытке нарушить статистическое водяное знакирование. Он также включает опции, предназначенные для того, чтобы переписанный текст звучал более естественно.
Однако есть очевидная загвоздка. Переписывание текста для удаления статистического водяного знака также может изменить сам текст. Документация проекта признает, что этот процесс может повлиять на тон, голос и точность, особенно когда большая часть оригинальной формулировки должна быть изменена.
Так что это не совсем цифровой эквивалент нажатия "удалить водяной знак" в редакторе изображений.
Разработчики не утверждают, что это обманет каждый детектор ИИ
На самом деле проект довольно ясно указывает на свои ограничения. Он описывает процесс переписывания как попытку из лучших побуждений и говорит, что не может гарантировать, что система обнаружения конкретного поставщика не сработает. Некоторые сигналы также могут остаться после процесса очистки.
Это важно, потому что не существует одного универсального водяного знака ИИ, скрытого в каждом сгенерированном контенте. Разные компании и системы могут использовать разные подходы, и сам проект делит эти сигналы на несколько категорий.
Репозиторий также говорит, что его цель — это конфиденциальность и исследование, а не помощь людям в ложном утверждении, что работа, созданная ИИ, была полностью написана человеком.
На данный момент watermarks-remover лучше всего понимать как знак того, в каком направлении движется индустрия ИИ. Компании ищут способы установить происхождение и идентифицировать материалы, созданные ИИ, в то время как разработчики уже исследуют, как эти сигналы можно удалить или нарушить.
Интересная часть заключается не в том, может ли этот конкретный проект на GitHub обмануть каждый детектор ИИ. Вероятно, он не может. Интересная часть заключается в том, что водяное знакирование ИИ уже становится игрой в кошки-мышки, и мы все еще находимся на очень ранней стадии этого процесса.
Другие статьи
Этот проект на GitHub хочет удалить водяные знаки ИИ с вашего контента, и ситуация становится интересной.
Открытый проект на GitHub предназначен для удаления невидимых символов, статистических водяных знаков и метаданных файлов, используемых для идентификации контента, созданного ИИ.
