
Сенатор Хоули сомневается, что Meta перешла границы, пиратствуя произведения авторов для ИИ
Сенатор Джош Хоули из Миссури обвинил компании по искусственному интеллекту, такие как Meta, в том, что они якобы присвоили более 200 терабайт опубликованных произведений авторов, не заплатив им ни цента, чтобы сделать ИИ умнее.
Подкомитет Сената по юстиции и контртерроризму провел слушание в среду для изучения того, как индустрия ИИ использует защищенные авторским правом произведения для обучения ИИ.
Слушание состоялось вскоре после того, как два федеральных судьи в Сан-Франциско постановили, что компании по ИИ, такие как Meta и Anthropic, могут использовать книги без разрешения для обучения систем ИИ.
Во время слушания профессор и юрист Бхамати Вишванатхан объяснила Хоули, как технологические компании получают большие объемы данных для обучения систем ИИ, добавив, что не все полученное является пиратскими работами.

Компании не покупают книги у авторов, таких как Дэвид Балдаччи, который выступал на слушании в среду. Вместо этого, они якобы крадут, или пиратят, лицензионный материал без оплаты авторам, пояснила Вишванатхан.
Попытки привлечь компании к уголовной ответственности уже были предприняты, но Вишванатхан сказала: "Это как игра в 'кротовую нору' — вы поймали одного, вы сбили его, он снова появляется в какой-то юрисдикции, над которой у вас нет контроля."
Вишванатхан сказала, что уголовная ответственность за нарушение авторских прав имеет два аспекта. Один аспект заключается в том, что вы должны делать это умышленно, а второй — что вы делаете это ради коммерческой выгоды. В случае с Meta компания якобы делает это ради коммерческой выгоды, отметила она.
Но для первого аспекта умышленного присвоения произведений, Вишванатхан сказала, что Meta, по ее словам, якобы знала, что делает — это незаконно.

"Они даже должны были спросить у самого [генерального директора Meta] Марка Цукерберга и сказать: 'Это нормально?' И он сказал: 'Да, это нормально'," — сказала она. "Он не только сделал это, зная, что это незаконно, он сделал это сознательно. Он сделал это умышленно, намеренно. И не имеет значения, знал ли он, какой закон нарушен — это не имеет значения. Чтобы это было умышленным, вы должны знать, что то, что вы делаете, неправильно, и это соответствует этому неправильному. Так что, фактически, это можно назвать умышленным нарушением авторских прав."
Затем Хоули начал допрашивать Максвелла Притта, который представляет нескольких авторов в юридических делах, связанных с предполагаемым кражей произведений, защищенных авторским правом.
Притт утверждал, что Meta загрузила более 200 терабайт авторских материалов из нескольких "незаконных преступных предприятий", которые Хоули назвал "теневыми библиотеками".
Адвокат также сказал, что Meta ничего не заплатила авторам за миллиарды произведений и книг. На вопрос о том, искала ли Meta возможность оплаты авторам, Притт ответил: "Нет."

"С самого начала они искали возможность лицензирования. Им было поручено двум сотрудникам работать частично над лицензированием, но они решили, что это займет слишком много времени, например, и вот тогда они обратились к пиратству," — заявил Притт. "В то время у них были публичные документы, показывающие, что тогда они рассматривали контингент в десятки, если не сотни миллионов, для лицензирования."
Во время слушания Хоули показал изображения текстовых сообщений между сотрудниками Meta и инженерами ИИ относительно того, стоит ли продолжать использовать опубликованные произведения.
Один инженер Meta, работающий над проектом ИИ, написал: "Я не думаю, что мы должны использовать пиратский материал. Мне действительно нужно провести черту." Он продолжил, что считает использование пиратского материала превышением этического порога команды.
Другой человек в том же чате ответил, что "проблема в пиратстве (и в том, что мы знаем и являемся соучастниками)".
И еще один сказал: "Мы хотим купить книги и быть хорошими людьми здесь...Однако, чтобы это произошло и чтобы плохие парни не победили, нам нужно представить дело - быстро - и пойти на некоторые уловки здесь и там."

Притт заявил, что "плохие парни" — это другие конкуренты по ИИ.
"Да, это, безусловно, один из многих документов, показывающий, что они знали, что это пиратские веб-сайты, содержащие материалы, защищенные авторским правом, и они воровали их бесплатно," — утверждал Притт.
Хоули поделился дополнительными сообщениями между сотрудниками Meta.
"Не уверен, что мы можем использовать IP-адреса Meta для загрузки контента через торрент, ахах," написал один. Другой ответил: "Я хочу начать смотреть на примеры, но мне кажется, что нам нужно получить ясность по поводу того, что разрешено и как <вставить смайлик>".
"Ахах, да, я думаю, что загружать через корпоративный ноутбук через торрент не кажется правильным <вставить улыбающийся смайлик>".
В другой беседе сотрудники сказали, что не могут использовать сервера Facebook, потому что загрузчик приведет к Facebook.

"Здесь сотрудники Meta говорят, что они знают, что они пиратствуют, они считают это этически неправильным, они считают это незаконным, и они активно избегают создания письменного следа," — сказал Хоули. "Они пытаются скрыть это. Для меня это не похоже на добросовестное использование."
Профессор Эдвард Ли сказал, что он согласен с подходом судьи окружного суда США Винса Чхабрии в случае Meta Platforms.
Чхабриа сказал авторам в своем решении в конце прошлого месяца, что они не представили достаточно доказательств того, что использование ИИ Meta погрозит рынку их произведений для достаточного основания уголовного дела об авторском праве.
"Это решение не говорит о том, что использование Meta защищенных авторским правом материалов для обучения своих языковых моделей законно," — цитирует Reuters слова Чхабрии. "Это лишь говорит о том, что эти истцы сделали неправильные аргументы и не смогли разработать документацию в поддержку правильного."
Ли сказал, что иск о распространении все еще актуален, и аспект пиратства может быть нарушением, а не добросовестным использованием.
"Я скажу так. Если это не нарушение, Конгресс должен предпринять какие-то действия," — сказал Хоули. "Я имею в виду, если ответ заключается в том, что крупнейшая корпорация в мире, стоимостью триллионы долларов, может прийти и взять произведение индивидуального автора...обманывать, скрывать, извлекать прибыль и наш закон ничего не делает с этим, нам нужно изменить закон."

Помимо решения Чхабрии в пользу Meta, в конце прошлого месяца было вынесено решение в пользу Anthropic. Судья окружного суда США Уильям Алсуп ссылался на "добросовестное использование" книг писателей Андреа Бартц, Чарльза Грейбера и Кирка Уоллеса Джонсона для обучения своей крупной языковой модели Клод.
Однако Алсуп частично поддержал авторов, сказав, что копирование и хранение Anthropic более 7 миллионов пиратских книг в "центральной библиотеке" нарушает авторские права авторов и не является добросовестным использованием. Судья назначил судебное заседание в декабре для определения суммы, которую Anthropic должен заплатить за нарушение.
Добросовестное использование является ключевой юридической защитой для технологических компаний, и решение Алсупа является первым, касающимся этого в контексте генеративного ИИ.
Компании по ИИ утверждают, что их системы добросовестно используют защищенный авторским правом материал для создания нового, трансформационного контента, и то, что их вынуждают платить правообладателям за их работы, может ограничить развивающуюся индустрию ИИ.
Anthropic и другие крупные компании по ИИ, включая OpenAI и Meta Platforms, были обвинены в том, что они загружают пиратские цифровые копии миллионов книг для обучения своих систем.
Согласно законодательству об авторском праве США, умышленное нарушение авторского права может оправдать уплату статутных ущербов до $150 000 за произведение.
Владельцы авторских прав говорят, что компании по ИИ незаконно копируют их работы, чтобы создавать конкурирующий контент, угрожающий их средствам к существованию.
Но другие, например, директор по искусственному интеллекту в Белом доме Дэвид Сакс, настаивают на концепции добросовестного использования для обучения ИИ, потому что без этого США могут проиграть в гонке за ИИ.
"Очень важно, чтобы мы пришли к разумному определению добросовестного использования, подобному тому, которое судья предложил в этом случае Anthropic, потому что иначе мы проиграем гонку за ИИ Китаю," — сказал Сакс в интервью с The Wall Street Journal 1 июля.
Сотрудничество FOX Business' Пилар Ариас внесло свой вклад в этот отчет.
