Законно ли обучать модели ИИ на основе книг, защищенных авторским правом? Это сложный вопрос.
Вы, вероятно, уже знаете, что модели искусственного интеллекта, лежащие в основе ChatGPT, Gemini, Claude и других чат-ботов, обучаются на, казалось бы, бесконечных базах данных опубликованных работ, содержащих сотни миллионов книг, онлайн-статей, научных работ и, по сути, всего, что можно найти в интернете. Большинство авторов, без своего ведома или согласия, внесли свой вклад в разработку тех же инструментов ИИ, которые угрожают подорвать их средства к существованию. Это кажется незаконным, не так ли?
На самом деле все не так просто.
«Я думаю, что одна из проблем всей этой области права и всей этой области технологий заключается в том, что происходит очень много всего», — сказала Кэти Геллис, юрист, специализирующаяся на интеллектуальной собственности, авторском праве и технологиях, в интервью TechCrunch. «Это очень сложная область, и по поводу происходящего существует множество противоречивых мнений, как за, так и против».
В прошлом году, в одном из первых подобных решений, судья Уильям Алсуп обязал компанию Anthropic выплатить колоссальную сумму в 1,5 миллиарда долларов в качестве компенсации за нарушение авторских прав группе писателей, чьи произведения использовались для обучения моделей искусственного интеллекта компании. На первый взгляд, это казалось моральной победой в пользу авторов, но судья Алсуп фактически постановил, что обучение ИИ компанией Anthropic было законным. Алсуп наказал Anthropic за пиратское распространение этих книг из нелегальных онлайн-библиотек.
«Как и любой читатель, стремящийся стать писателем, студенты магистратуры Anthropic, обучающиеся на произведениях, не стремились мчаться вперед, копировать или заменять их, а хотели резко изменить направление и создать нечто иное», — написал судья, сравнивая процесс освоения триллионов слов студентом магистратуры с изучением литературы писателем.
Геллис считает, что это решение более выгодно для компаний, занимающихся искусственным интеллектом. Что такое штраф в 1,5 миллиарда долларов для компании, прогнозирующей годовой доход около 200 миллиардов долларов к 2028 году?
«Я думаю, что в целом это хорошая новость для обучения ИИ, что он проанализировал происходящее и, по сути, сравнил это с чтением произведения, защищенного авторским правом, а не с его копированием», — сказал Геллис. «Закон об авторском праве основан на копировании, но не на использовании произведения, его восприятии, потреблении, чтении».
Закон об авторском праве не обновлялся с 1976 года, а это значит, что судьям приходится разбираться в толковании правил 50-летней давности при решении юридических вопросов, которые потенциально могут определить будущее индустрии искусственного интеллекта.
«Сейчас все очень обеспокоены, потому что законодательство совершенно несогласовано, и все это из-за этого вопроса», — сказал TechCrunch Джейсон Хендерсон, старший юрист и основатель практики интеллектуальной собственности и СМИ в JWL International. «Они знают, что модель ИИ обучена на очень большом количестве данных, и законодательство еще не успело отреагировать на этот вопрос».
Эти вопросы часто зависят от законодательства о добросовестном использовании — а именно, является ли использование произведения, защищенного авторским правом, достаточно «трансформативным», чтобы считаться юридически допустимым.
Добросовестное использование — это исключение из закона об авторском праве, которое позволяет использовать материалы, защищенные авторским правом, без явного разрешения, защищая возможность комментировать и дорабатывать произведения, защищенные авторским правом, посредством критики, пародии, образования и другими способами. При решении вопроса о добросовестном использовании судьи учитывают конкретные факторы, включая цель и характер произведения, объем использованного материала и его влияние на рынок.
«Авторское право всегда направлено на защиту и развитие рынка», — отметил Хендерсон. «В делах, касающихся ИИ, суды придерживаются весьма противоречивых позиций. Чаще всего выигрывают те, кто использует чужую интеллектуальную собственность для обучения программ, стремясь напрямую конкурировать с ней, — в этом случае суды будут неодобрительно относиться к таким действиям… Если же ваши действия не направлены на конкуренцию, суды, как правило, находят способы, как это можно оправдать».
Хендерсон ссылается на случай, когда медиа- и технологическая компания Thomson Reuters подала в суд на исследовательскую фирму Ross Intelligence за копирование ее контента с целью создания конкурирующей юридической платформы на основе искусственного интеллекта.
«Использование Россом данных не носит трансформирующего характера, поскольку оно не имеет „дальнейшей цели или иного характера“, чем использование данных компанией Thomson Reuters», — написал судья Стефанос Бибас в прошлом году.
В этом случае судья Бибас постановил, что использование контента Reuters для создания новой платформы, напрямую конкурирующей с ним, не является добросовестным использованием. Хотя авторы потенциально могут утверждать, что чат-боты конкурируют с ними, используя их работы для создания новых, синтетических книг, этот аргумент пока не получил поддержки в суде.
Когда речь заходит о взаимосвязи между ИИ и авторским правом, Геллис считает полезным уточнить, о чем именно идет речь: наше понимание авторского права в контексте обучения ИИ существенно отличается от понимания защиты авторских прав на контент, созданный ИИ.
В одном из дел, Талер против Перлмуттера, суд постановил, что если произведение на 100% создано с помощью ИИ, оно не подлежит защите авторским правом, что открывает целый ряд новых проблем: как мы можем однозначно доказать, было ли произведение создано с использованием ИИ, и если да, то как мы можем узнать, какой процент его был создан или обработан с помощью ИИ?
«Если вы пишете свой роман в [Microsoft] Word и запускаете проверку орфографии, мы вполне можем сказать, что Word не является владельцем вашего романа», — сказал Геллис. «[Искусственный интеллект] заставляет нас пересмотреть множество решений, которые мы какое-то время игнорировали».
Большинство компаний, занимающихся разработкой ИИ, все еще находятся в процессе судебных разбирательств по этим вопросам, а это значит, что окончательного решения этих проблем в ближайшее время не предвидится.
«Вы видите, что первоначальные решения оказывают влияние, и это влияние может быть нивелировано, если другие суды примут иные решения, и только последующие судебные разбирательства покажут, какое из них окажется окончательным», — сказал Геллис. «Но тем временем все эти решения формируют все происходящее. Было бы глупо со стороны компаний, занимающихся искусственным интеллектом, игнорировать их».
Источник: techcrunch.com
Похожие записи
Оцените материал:
Похожие записи
Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
