Статья, написанная ИИ, не требует метки. Ваш отредактированный электронный адрес получает одну.
Начните с того, что такое знак, потому что это не печать на странице. Когда модель пишет, она выбирает каждое слово из набора разумных вариантов.
Водяной знак тихо делит эти варианты на две группы, используя секретный ключ, а затем подталкивает модель к одной из групп. Одно слово ничего не доказывает. На протяжении 500 или 1000 слов детектор, имеющий ключ, может увидеть шаблон.
Anthropic начала маркировать вывод Claude 2 августа, по всему миру, а не только в Европе. Она не опубликовала алгоритм и не выпустила детектор.
Она маркирует то, что коснулся Claude, а не то, что написал Claude.
Это та часть, которую большинство публикаций пропустило, и Anthropic заявляет об этом прямо в своей статье поддержки.
Обнаруженный знак означает, что контент «мог быть обработан Claude». Это не означает, что Claude его написал. Попросите модель вычитать, перевести или резюмировать ваше собственное письмо, и вывод все равно будет иметь знак.
Обратное также верно. Отсутствие знака не означает отсутствие ИИ. Короткие отрывки, сильное перефразирование, более старые модели и очищенные метаданные файлов все равно производят чистый текст, в создании которого машина все еще помогала.
Таким образом, сигнал имеет два направления сбоя одновременно, и компания говорит об этом открыто.
Закон освободил от исправления грамматики.
Вот где становится странно. Законодательство ЕС о ИИ не требует маркировки, когда система выполняет вспомогательную функцию для стандартного редактирования, и собственный пример Комиссии — это исправление грамматики.
Anthropic маркирует это независимо. Ars Technica назвала подход «уничтожить его с орбиты».
Причина структурная, а не идеологическая. Водяной знак, применяемый на уровне модели, не может отличить полный черновик от запятой. Он маркирует вывод, и вывод — это все, что он видит.
В результате знак попадает именно на тот контент, который закон был написан, чтобы оставить в покое.
И ярлык, который почти никто не должен показывать.
Теперь посмотрите на другую половину статьи 50, часть, которая регулирует, что издатели должны сообщать читателям. Она гораздо уже, чем предполагает большинство людей.
Роман, написанный ИИ, не нуждается в ярлыке. Маркетинговый текст, сгенерированный ИИ, не нуждается в ярлыке. Текст, который информирует общественность по вопросам общественного интереса, нуждается в нем, если только названный и ответственный человек-редактор не проверил его.
Сложите две половины вместе, и вы получите противоречие. Каждое нажатие клавиши получает водяной знак на уровне модели, в то время как полностью синтетическая статья может достичь читателей без ярлыка, потому что редактор на нее посмотрел.
ЕС строит эту машину уже некоторое время. Он уже ввел обязательные ярлыки для синтетического контента и наделил себя полномочиями проверять и штрафовать модели напрямую. Штраф здесь составляет до 15 миллионов евро или 3% от мирового годового оборота.
Возражения поступили в течение дня.
Инвестор Билл Гурли утверждал, что если только Anthropic может читать знак, она становится «судьей, присяжным и прокурором». Anthropic сообщила Business Insider, что выпустит бесплатный API для обнаружения, чтобы любой мог проверить.
Бывший исполнительный директор Microsoft Стивен Синофски поднял другую проблему. Проблема, написал он, заключается в «хранении данных и вашем праве на частные мысли, свободные от цифрового следа».
Саймон Смит, который управляет генеративным ИИ в агентстве здравоохранения Klick, спросил, будет ли теперь проверка грамматики отмечена как написанная ИИ. Ответ Anthropic — это тот, что выше: знак показывает обработку, а не авторство.
Программист Джон Крикетт задал более резкий вопрос о коде. Если сгенерированный ИИ код несет знак, усложняет ли это требование авторских прав, в котором автор должен показать человеческий вклад?
Аргументы за то, чтобы делать это все равно.
Возражения — это не вся история. Разработчик Донн Фелкер указал, что маркировка помогает моделям избегать обучения на собственном выводе, проблему, которую он назвал «змея, поедающая себя».
Аадит Шет из The Narrative Company представил дело читателя. Аудитории должны иметь возможность определить, отражают ли слова, которые они читают, мысли человека.
Собственное обоснование Комиссии еще шире. Она хочет, чтобы люди настраивали свое доверие, и называет мошенничество, выдачу себя за другого и обман потребителей рисками.
Anthropic формулирует это как соблюдение, а не как позицию. Она добавляет маркировку «для соблюдения Закона ЕС о ИИ, и другие лаборатории принимают аналогичные меры», — заявила компания. Она также говорит, что водяной знак не изменяет смысл, качество или читаемость ответов Claude.
Некоторые вопросы остаются открытыми. Ars Technica спросила компанию о сроках обнаружения, о любых тестах на ложные срабатывания и ложные отрицания, а также о том, как знаки соотносятся с исключением для стандартного редактирования.
Anthropic отправила заявление, которое не касалось этих вопросов. Уровень ложных срабатываний — это число, которое здесь имеет наибольшее значение, потому что оно определяет, сколько веса учитель или редактор должен придавать знаку.
Это не остановит никого, кто пытается.
Неудобная часть заключается в том, что знак ловит честных и пропускает преднамеренных. Вставьте текст с водяным знаком во вторую модель и попросите переписать, и сигнал, вероятно, исчезнет.
Файловая подлинность еще слабее. Скриншот удаляет его, как и любой компетентный редактор метаданных.
Стол видел этот провал раньше. Собственный детектор ИИ Meta пропустил обрезанные изображения, что примерно соответствует объему затраченных усилий.
Существует также тихая цена. Чтобы сохранить статистический сигнал нетронутым, модель иногда выбирает немного худшее слово, чем то, которое она выбрала бы в противном случае.
Anthropic — единственная, кто занимается текстом.
Это коммерческий риск, и он реален. OpenAI отказалась комментировать конкретно для TechRadar и вместо этого указала на страницу поддержки.
Эта страница подтверждает, что OpenAI маркирует изображения и аудио с использованием метаданных SynthID и C2PA. По тексту она говорит, что расширение подлинности на все модальности является целью, поскольку стандарты и инструменты «продолжают развиваться».
Google также использует SynthID. Ни одна из компаний не выпустила маркировку текста, и обе сталкиваются с одинаковыми требованиями для продажи генеративных систем в ЕС.
Существующие модели имеют время до 2 декабря, чтобы соответствовать требованиям. До тех пор одна лаборатория несет это бремя в одиночку.
Что закон вообще не затрагивает.
Статья 50 требует раскрытия информации о том, что вы говорите с машиной. Она ничего не говорит о том, что происходит с разговором после этого.
Исследователи Стэнфорда проверили политику конфиденциальности шести крупных американских разработчиков ИИ. Каждый из них использовал данные чата клиентов для обучения по умолчанию, и некоторые хранили их бесконечно.
Таким образом, закон теперь маркирует вывод и игнорирует ввод.
Что бы это разрешило.
Две вещи, и обе проверяемы. Первая — это API обнаружения, и в частности его уровень ложных срабатываний, потому что знак на проверенном эссе студента имеет такой же вес, как и на сфабрикованной новостной статье.
Вторая — это то, выпустит ли OpenAI или Google маркировку текста до 2 декабря или обнаружит, что стандарты все еще развиваются.
Ярлыки уже срабатывают неверно без всего этого. X поставил ярлык «Сделано с ИИ» на пост об отставке уходящего пресс-секретаря Белого дома в среду, а затем ярлык тихо исчез.
Otros artículos
Статья, написанная ИИ, не требует метки. Ваш отредактированный электронный адрес получает одну.
Водяной знак Claude помечает текст, который модель только вычитала, что исключается из Закона ЕС об ИИ. Тем временем полностью написанная ИИ статья может публиковаться без маркировки.
