Требования защиты авторских прав для поставщиков и развертывателей по EU AI Act
Первые победы Бигтеха в США в судебных разбирательствах о нарушении авторских прав при обучении ИИ показывают сложность правового регулирования использования защищённых материалов для обучения ИИ. Хотя обе компании добились частичных побед, остаётся неясным, как будут развиваться дальнейшие судебные процессы и какое влияние они окажут на будущее ИИ-технологий.
В ЕС попытались установить обязательства для поставщиков ИИ-систем и моделей общего назначения (GPAI), а также для развертывателей, использующих такие технологии, с помощью AI Act.
Так, AI Act предусматривает, что системы ИИ, использующие данные, защищённые авторским правом, должны обеспечивать:
- соответствие требованиям Директивы ЕС об авторских правах (Directive 2019/790).
- легальный доступ к используемым данным. Например, обучение моделей на текстах или изображениях, защищённых авторским правом, возможно только при наличии соответствующей лицензии или использовании исключения (например, для исследований).
Требования для поставщиков (providers) GPAI:
▪️Политика соблюдения авторских прав + чёткое описание, как компания соблюдает оговорки об отказе от TDM (art. 53(1)(c) AI Act).
▪️Резюме источников обучения: публикация подробного, но понятного описания использованных наборов данных, включая:
- названия крупных датасетов;
- категории источников (например, новостные сайты, открытые базы);
- объяснение происхождения и цели данных (статья 53(1)(d)).
▪️Техническая документация: описание архитектуры модели, процессов обучения, тестирования и рисков нарушения IP.
▪️Соблюдение «opt-out»: если сайт запретил TDM (например, в robots.txt или специальных уведомлениях), эти данные нельзя использовать.
Помним, что даже если обучение проводилось в США — при выходе GPAI на рынок ЕС необходимо соблюдать нормы ЕС (см. recital 106 AI Act).
Требования к развертывателям (deployers):
▪️Проверять, соблюдены ли IP-права в ИИ-системе, которую вы внедряете;
▪️Не использовать GPAI, нарушающие нормы AI Act;
▪️Документировать цели и объем использования ИИ;
▪️Понимать, создаёт ли ваша система производные работы (derivative works), и при необходимости запрашивать лицензии.
Однако дебаты по General-Purpose AI Code of Practice все еще продолжаются при изначальной цели принять его в мае, что провоцирует слухи вплоть до отмены положений AI Act. Но можно извлечь пользу и смотреть требования + проект резюме источников данных на будущее. Также идут дебаты о том, что AI Act создает «лазейку» в авторском праве, позволяющую использовать защищённые произведения без разрешения в коммерческом ИИ.
Из судебной практики: в деле Kneschke v. LAION, суд в Гамбурге признал, что создание датасета LAION на основе изображений в интернете подпадает под исключение для научных исследований (ст. 60d UrhG), если TDM opt-out не был чётко зафиксирован.
Почитать:
Междисциплинарного исследование - Copyright Law and Generative AI Training - Technological and Legal Foundations /Tim W. Dornis, Sebastian Stober
Development of Generative Artificial Intelligence from a Copyright Perspective|EUIPO
#LawAndDisorder
@pattern_ai
Первые победы Бигтеха в США в судебных разбирательствах о нарушении авторских прав при обучении ИИ показывают сложность правового регулирования использования защищённых материалов для обучения ИИ. Хотя обе компании добились частичных побед, остаётся неясным, как будут развиваться дальнейшие судебные процессы и какое влияние они окажут на будущее ИИ-технологий.
В ЕС попытались установить обязательства для поставщиков ИИ-систем и моделей общего назначения (GPAI), а также для развертывателей, использующих такие технологии, с помощью AI Act.
Так, AI Act предусматривает, что системы ИИ, использующие данные, защищённые авторским правом, должны обеспечивать:
- соответствие требованиям Директивы ЕС об авторских правах (Directive 2019/790).
- легальный доступ к используемым данным. Например, обучение моделей на текстах или изображениях, защищённых авторским правом, возможно только при наличии соответствующей лицензии или использовании исключения (например, для исследований).
Требования для поставщиков (providers) GPAI:
▪️Политика соблюдения авторских прав + чёткое описание, как компания соблюдает оговорки об отказе от TDM (art. 53(1)(c) AI Act).
▪️Резюме источников обучения: публикация подробного, но понятного описания использованных наборов данных, включая:
- названия крупных датасетов;
- категории источников (например, новостные сайты, открытые базы);
- объяснение происхождения и цели данных (статья 53(1)(d)).
▪️Техническая документация: описание архитектуры модели, процессов обучения, тестирования и рисков нарушения IP.
▪️Соблюдение «opt-out»: если сайт запретил TDM (например, в robots.txt или специальных уведомлениях), эти данные нельзя использовать.
Помним, что даже если обучение проводилось в США — при выходе GPAI на рынок ЕС необходимо соблюдать нормы ЕС (см. recital 106 AI Act).
Требования к развертывателям (deployers):
▪️Проверять, соблюдены ли IP-права в ИИ-системе, которую вы внедряете;
▪️Не использовать GPAI, нарушающие нормы AI Act;
▪️Документировать цели и объем использования ИИ;
▪️Понимать, создаёт ли ваша система производные работы (derivative works), и при необходимости запрашивать лицензии.
Однако дебаты по General-Purpose AI Code of Practice все еще продолжаются при изначальной цели принять его в мае, что провоцирует слухи вплоть до отмены положений AI Act. Но можно извлечь пользу и смотреть требования + проект резюме источников данных на будущее. Также идут дебаты о том, что AI Act создает «лазейку» в авторском праве, позволяющую использовать защищённые произведения без разрешения в коммерческом ИИ.
Из судебной практики: в деле Kneschke v. LAION, суд в Гамбурге признал, что создание датасета LAION на основе изображений в интернете подпадает под исключение для научных исследований (ст. 60d UrhG), если TDM opt-out не был чётко зафиксирован.
Почитать:
Междисциплинарного исследование - Copyright Law and Generative AI Training - Technological and Legal Foundations /Tim W. Dornis, Sebastian Stober
Development of Generative Artificial Intelligence from a Copyright Perspective|EUIPO
#LawAndDisorder
@pattern_ai