Суд отклонил иск Google по закону DMCA против скрейпера SerpApi
Google создала одну из крупнейших компаний в мире, собирая данные с всего интернета без предварительного разрешения. На этой неделе суд сообщил Google, что она не может остановить других от сбора данных с Google.
20 июля федеральный судья отклонил иск Google против SerpApi. Эта компания собирает результаты поиска Google и перепродает их в виде структурированных данных. Google подала иск в декабре по Закону о цифровом тысячелетии об авторском праве, утверждая, что SerpApi обошла ее защиту от ботов, чтобы получить защищенный авторским правом материал.
Проблема, как установил суд, заключается в том, что результаты поиска не являются защищенным авторским правом материалом.
Почему дело развалилось
Положение DMCA, на которое ссылалась Google, Раздел 1201, защищает только технологии, которые охраняют защищенные авторским правом произведения. Защита Google, называемая SearchGuard, охраняет ее результаты поиска.
Судья Ивонн Гонсалес Роджерс постановила, что простые результаты, такие как URL-адреса, фрагменты и фактические индексные данные, являются общественными фактами, а не произведениями. Эти требования были отклонены без возможности повторной подачи.
«Google не заявила о правдоподобном нарушении DMCA», - написала она.
Судья не была мягка к методам SerpApi. Она согласилась с тем, что подделка отпечатков браузера, смена IP-адресов и решение CAPTCHA, чтобы обойти SearchGuard, считается обходом. Это просто не является незаконным, если барьер защищает произведение, защищенное авторским правом, с разрешения владельца.
В каком углу сейчас оказалась Google
У Google есть один узкий путь назад. Суд дал ей 21 день, чтобы повторно подать иск по меньшему требованию, касающемуся лицензированных фрагментов, которые иногда появляются в ее панелях знаний.
Для этого Google придется утверждать, что эти панели полны защищенного авторским правом контента, который она имеет право защищать. По словам Мередит Роуз, специалиста по DMCA в некоммерческой организации Public Knowledge, это опасное утверждение для Google.
Google не лицензирует все в панели знаний. Предположим, она утверждает, что сбор этих панелей воспроизводит защищенный авторским правом материал. Это затем приглашает правообладателей, чьи работы заполняют ее результаты и ее AI Обзоры, подать в суд на Google за тот же сбор, на который она жалуется.
«Они сами загнали себя в небольшой угол», - сказала Роуз изданию Ars Technica. Иными словами, чтобы выиграть небольшую битву, Google может быть вынуждена уступить в большой.
Google говорит, что все равно попытается. Представитель компании Хосе Кастаньеда заявил, что компания «рада видеть, что суд отклонил почти все юридические аргументы SerpApi» по поводу правомочности. Google планирует подать измененную жалобу.
Что на самом деле защищала Google
Данные поиска никогда не были столь ценными. Чат-бот не может обобщить интернет, если не может его найти, а Google не предлагает официального API для поиска. Это делает доступ через компании, такие как SerpApi, основным путем к индексу Google. Среди ее клиентов - Nvidia, Uber, Adobe и поисковая система AI Perplexity.
SerpApi представила отклонение как нечто большее, чем она сама. Google и Reddit «не владеют интернетом», - заявила она, обвинив обе компании в попытке «использовать DMCA для ограждения открытого интернета». Генеральный директор Julien Khaleghy отметил, что собственные расчеты убытков Google, примененные буквально, превысили бы всю экономику США.
Ирония не является тонкой, и критики не оставили это без внимания. Google потратила два десятилетия на сбор данных у издателей, чтобы построить поисевую империю, и теперь использует закон об авторском праве, чтобы остановить компанию, делающую что-то подобное Google.
Reddit наблюдает и подвергается риску
Google не была первой в этом. Reddit подала почти идентичный иск по DMCA в октябре против SerpApi и Perplexity, касающийся контента Reddit, который появляется в результатах Google. Reddit столкнулся с собственным слушанием по отклонению через несколько дней после проигрыша Google.
Решение суда по делу Google неудобно для Reddit. Reddit не является ни владельцем авторских прав, ни эксклюзивным лицензиатом контента, который появляется в результатах поиска, что является именно той лакуной, которая погубила дело Google. SerpApi предупредила, что Reddit хочет действовать как «сборщик пошлин», взимая плату за доступ к контенту, написанному его пользователями. Reddit уже некоторое время ужесточает контроль над своими данными. (Advance Publications, владеющая материнской компанией Ars Technica, является крупнейшим акционером Reddit.)
Более крупная борьба за открытый веб
Роуз поместила дело в более широкий контекст. Волна агрессивного сбора данных AI началась около 2023 года. Издатели с тех пор стремятся оградить свой контент, что является «новой оградой» в вебе, который в основном был открытым.
Эта реакция не только замедляет обучение AI. Она также разрушает анонимное сканирование, на которое тихо полагаются исследования, архивирование, журналистика и отчетность в области общественного здравоохранения. Инструменты, созданные для остановки сборщиков, ловят всех.
Ставки те же, что и в реформе AI-поиска Google и ее борьбе с регуляторами по поводу данных поиска. Кто получает возможность читать открытый веб в большом масштабе, и кто получает право взимать за это плату, решается по делу. Захват Google уже ослабевает в эпоху AI. У нее есть 21 день, чтобы решить, стоит ли эта борьба риска потерять гораздо больше.
Другие статьи
Суд отклонил иск Google по закону DMCA против скрейпера SerpApi
Судья отклонил иск Google по закону DMCA против скрейпера SerpApi, постановив, что результаты поиска являются общественными фактами. Повторная подача иска может раскрыть собственное скрейпинг Google.
