Вы, наверное, уже знаете, что модели искусственного интеллекта, лежащие в основе Chatgpt, Gemini, Claude и других чат-ботов, обучены на, казалось бы, бесконечных базах данных опубликованных работ, содержащих сотни миллионов книг, онлайн-статей, научных публикаций и практически всего, что можно найти в интернете. Большинство опубликованных авторов, не зная об этом и без их согласия, внесли свой вклад в разработку тех же инструментов искусственного интеллекта, которые угрожают подорвать их средства к существованию. Это кажется незаконным, правда?
Реальность не так проста.
«Я думаю, что одна из проблем в этой области права и в этой области технологий заключается в том, что происходит очень многое, — сказала изданию TechCrunch юрист с опытом работы в области интеллектуальной собственности, авторского права и технологий Кэти Геллис. — Это очень сложно, и есть много необдуманных чувств по поводу того, что происходит, как за, так и против».
В прошлом году, одним из первых решений такого рода, судья Уильям Олсап постановил, что Anthropic должна выплатить группе писателей 1,5 миллиарда долларов в качестве компенсации за нарушение авторских прав, чьи работы были использованы для обучения моделей искусственного интеллекта компании. На первый взгляд, это казалось моральной победой в пользу авторов, но судья Олсап фактически постановил, что обучение искусственного интеллекта в Anthropic было законным. Олсап наказал Anthropic за пиратство этих книг из нелегальных онлайн-библиотек.
«Как и любой читатель, стремящийся стать писателем, модели обработки естественного языка (LLM) компании Anthropic обучаются на произведениях не для того, чтобы опережать и копировать их или вытеснять, а чтобы сделать крутой поворот и создать что-то другое», — написал судья, сравнивая способ, которым LLM поглощает триллионы слов, с изучением литературы писателем.
Геллис считает, что решение более выгодно для компаний, занимающихся искусственным интеллектом. Какой штраф в размере 1,5 миллиарда долларов для компании, которая прогнозирует выручку около 200 миллиардов долларов в год к 2028 году?
“Я думаю, это в целом хорошая новость для обучения ИИ, что он рассмотрел, что происходит, и действительно подумал, что это аналогично прочтению произведения, защищенного авторским правом, а не копированию произведения, защищенного авторским правом”, — сказал Геллис. “Закон об авторском праве основывается на копировании, но не на использовании произведения, восприятии произведения, потреблении произведения, чтении произведения”.
Закон об авторском праве не обновлялся с 1976 года, а это значит, что судьям приходится выяснять, как интерпретировать положения, принятые 50 лет назад, при рассмотрении юридических вопросов, которые могут определить будущее индустрии ИИ.
“Все сейчас очень обеспокоены, потому что закон повсюду, и всё из-за этого вопроса”, — сказал Джейсон Хендерсон, старший адвокат и основатель практики интеллектуальной собственности и СМИ в JWL International, в интервью TechCrunch. “Они знают, что модель ИИ была обучена на таком огромном количестве материалов, а закон не успел за этим вопросом”.
Эти вопросы часто зависят от закона о добросовестном использовании — а именно, является ли использование произведения, защищенного авторским правом, “трансформативным” настолько, чтобы считаться юридически допустимым.
Добросовестное использование — это исключение из закона об авторском праве, которое позволяет использовать защищенные авторским правом материалы без явного разрешения, защищая возможность комментировать и вносить изменения в произведения, защищенные авторским правом, посредством критики, пародии, образования и другими способами. Судьи учитывают конкретные факторы, принимая решение о том, является ли что-то добросовестным использованием, включая цель и характер работы, объем использованного и его влияние на рынок.
“Авторское право всегда связано с защитой и развитием рынка”, — отметил Хендерсон. “Суды как бы повсюду в своих рассуждениях [в делах об ИИ]. Обычно побеждает то, что если вы тренируетесь на чьей-то собственности, потому что ваша цель — напрямую конкурировать, то суды будут недовольны этим… Если то, что вы делаете, не будет конкурировать, то суды склонны находить способы, чтобы это было нормально”.
Хендерсон ссылается на случай, в котором медиа- и технологическая компания Thomson Reuters подала в суд на исследовательскую фирму Ross Intelligence за копирование её контента с целью создания конкурирующей юридической платформы на основе искусственного интеллекта.
«Использование Ross не является преобразующим, поскольку оно не имеет „дальнейшей цели или иного характера“, чем у Thomson Reuters», — написал судья Стефанос Бибас в прошлом году.
В этом случае судья Бибас решил, что нецелесообразно использовать контент Reuters для создания новой платформы, которая будет напрямую конкурировать с ним. Хотя авторы потенциально могут утверждать, что чат-боты конкурируют с ними, используя их работы для создания новых синтетических книг, этот аргумент ещё не возобладал в суде.
Когда речь заходит об отношениях между искусственным интеллектом и авторским правом, Геллис считает полезным уточнить, о чём мы на самом деле говорим — то, как мы думаем об авторском праве в контексте обучения ИИ, сильно отличается от того, как мы думаем об авторском праве на контент, созданный ИИ.
В одном случае, Thaler v. Perlmutter, суд постановил, что если работа создана на 100% с помощью ИИ, она не может быть защищена авторским правом, что открывает совершенно новую проблему — как мы можем однозначно доказать, была ли работа создана с использованием ИИ, и если да, то как мы узнаем, какой процент её был создан или с помощью ИИ?
«Если вы пишете свой роман в [Microsoft] Word и запускаете проверку орфографии, нам кажется вполне приемлемым говорить, что Word не владеет вашим романом», — сказала Геллис. «[ИИ] заставляет нас рассмотреть множество решений, которые мы некоторое время игнорировали».
Большинство компаний, занимающихся искусственным интеллектом, всё ещё участвуют в судебных разбирательствах по этим вопросам, а это значит, что у нас не будет окончательного решения этих проблем в ближайшее время.
“То, что вы видите, — это то, что первоначальные вступительные залпы оказывают влияние, и это влияние может быть сведено на нет, если другие суды примут иные решения, и потребуется более поздние стадии судебных разбирательств, чтобы выяснить, какое из них возобладает, — сказал Геллис. — Но тем временем все эти решения формируют всё происходящее. Было бы глупостью со стороны компаний, занимающихся искусственным интеллектом, игнорировать их.”
Читайте также другие новости на нашем сайте: Главная страница
Источник: techcrunch.com




