Русская версия The Next Web

Google Искусственный интеллект США

Google сканировала весь интернет, чтобы создать себя. Суд только что постановил, что другие могут сканировать Google.

Google сканировала весь интернет, чтобы создать себя. Суд только что постановил, что другие могут сканировать Google.

Google построила одну из крупнейших компаний в мире, сканируя весь интернет без предварительного разрешения. На этой неделе суд заявил Google, что она не может запретить другим сканировать саму Google.

20 июля федеральный судья отклонил иск Google против компании SerpApi. Эта фирма сканирует результаты поиска Google и перепродает их в виде структурированных данных. Google подала в суд в декабре в соответствии с Законом об авторском праве в цифровую эпоху (DMCA), утверждая, что SerpApi обошла средства защиты от ботов для извлечения материалов, защищенных авторским правом.

Проблема, как установил суд, заключается в том, что результаты поиска не являются материалами, защищенными авторским правом.

Почему дело развалилось

Положение DMCA, на которое ссылалась Google (Раздел 1201), защищает только технологии, охраняющие произведения, защищенные авторским правом. Барьер Google под названием SearchGuard охраняет ее результаты поиска.

Обычные результаты, такие как URL-адреса, сниппеты и фактические данные индекса, являются общедоступными фактами, а не произведениями, постановила судья Ивонн Гонсалес Роджерс. Эти претензии были отклонены без возможности их повторной подачи.

«Google не заявила о правдоподобном нарушении DMCA», — написала она.

Судья не была снисходительна к методам SerpApi. Она согласилась, что подделка цифровых отпечатков браузера, ротация IP-адресов и разгадывание капч для обхода SearchGuard считаются обходом защиты. Просто это не является незаконным, если барьер не защищает охраняемый авторским правом труд с разрешения владельца.

В каком тупике оказалась Google

У Google остался лишь один узкий путь для возврата дела. Суд дал компании 21 день на повторную подачу иска по более узкому требованию, охватывающему лицензированные сниппеты, которые иногда появляются в ее информационных панелях (knowledge panels).

Для этого Google пришлось бы утверждать, что эти панели полны защищенного авторским правом контента, защищать который она уполномочена. По словам Мередит Роуз, специалиста по DMCA из некоммерческой организации Public Knowledge, для Google это опасное заявление вслух.

Google не лицензирует все подряд в информационной панели. Предположим, она утверждает, что сборка таких панелей воспроизводит материалы, защищенные авторским правом. Тогда она призывает правообладателей, чьей работой наполнены ее результаты и обзоры ИИ (AI Overviews), подать в суд на саму Google за то же самое сканирование, на которое она жалуется.

«Они сами загнали себя в небольшой тупик», — рассказала Роуз изданию Ars Technica. Иными словами, чтобы выиграть мелкую битву, Google, возможно, придется проиграть крупную.

Google заявляет, что все равно попытается это сделать. Представитель компании Хосе Кастаньеда заявил, что компания «рада видеть, что суд отклонил почти все юридические аргументы SerpApi» касательно правомочности. Google планирует подать измененную жалобу.

Что на самом деле защищала Google

Поисковые данные еще никогда не были столь ценными. Чат-бот не может сделать краткую выжимку из интернета, если не может его найти, а Google не предоставляет официального API поиска. Это делает сторонний доступ через такие фирмы, как SerpApi, основным путем к индексу Google. Среди клиентов компании — Nvidia, Uber, Adobe и поисковая система с ИИ Perplexity.

SerpApi охарактеризовала отклонение иска как событие масштаба, выходящего за ее собственные рамки. Google и Reddit «не владеют интернетом», заявили там, обвинив обе компании в попытке «использовать DMCA как оружие для ограждения открытого интернета». Генеральный директор компании Жюльен Халеги отметил, что собственная математика ущерба Google, если применить ее буквально, превысит объем всей экономики США.

Ирония здесь очевидна, и критики не упустили возможности указать на нее. Google потратила два десятилетия на сканирование сайтов издателей, чтобы построить поисковую империю, а теперь использует закон об авторском праве, чтобы помешать другой компании делать нечто похожее по отношению к самой Google.

Reddit следит за ситуацией и уязвим

Google была не первой в этом деле. В октябре Reddit подала практически идентичный иск по DMCA против SerpApi и Perplexity из-за контента Reddit, который появляется в результатах Google. Слушания по отклонению иска самого Reddit прошли через несколько дней после проигрыша Google.

Решение по Google ставит Reddit в неловкое положение. Reddit не является ни владельцем авторских прав, ни эксклюзивным лицензиатом контента, который появляется в результатах поиска — именно этот пробел и потопил дело Google. SerpApi предупредила, что Reddit хочет действовать в роли «сборщика пошлин», взимая плату за доступ к контенту, созданному ее пользователями. Reddit уже некоторое время закручивает гайки в отношении своих данных. (Advance Publications, которой принадлежит материнская компания Ars Technica, является крупнейшим акционером Reddit.)

Более масштабная борьба за открытый интернет

Роуз описала это дело в более широком контексте. Волна агрессивного сбора данных с помощью ИИ началась примерно в 2023 году. С тех пор издатели бросились защищать свой контент стенами — происходит «огораживание» веба, который по большей части был открытым.

Такая реакция не только замедляет обучение ИИ. Она также нарушает работу анонимного краулинга, от которого тихо зависят исследования, архивирование, журналистика и отчетность в сфере общественного здравоохранения. Инструменты, созданные для остановки парсеров, задевают всех подряд.

Ставки те же самые, что фигурируют в глобальной перестройке поиска Google под влиянием ИИ и в ее спорах с регуляторами из-за поисковых данных. Кто имеет право читать общедоступный интернет в больших масштабах и кто имеет право взимать за это плату — решается в индивидуальном порядке по каждому делу. Хватка Google уже ослабевает в эпоху ИИ. У компании есть 21 день на то, чтобы решить, стоит ли эта борьба риска потерять гораздо больше.