Опубликовано решение мюнхенского суда по делу GEMA против Suno
Земельный суд Мюнхена в значительной части удовлетворил требования GEMA к Suno в отношении шести музыкальных произведений, включая «Rasputin», «Daddy Cool», «Big in Japan», «Forever Young» и припев «Mambo №5» (все пропели, пока читали?). Предметом защиты в деле являлись музыкальные композиции, а не тексты песен как самостоятельные произведения (за это уже OpenAI получил на орехи).
Суд выделил три основные категории нарушения:
(1) Копии, созданные в США при подготовке обучающего набора данных и обучении модели. Suno загружала полные музыкальные записи, преобразовывала и обрабатывала их, а также создавала резервные и обучающие копии.
(2) Копии, предположительно воспроизведенные в параметрах модели, хранившихся в Германии. Суд сделал вывод, что произведения были «меморизированы» моделями Suno v3.5 и v4. Поскольку при помощи моделей можно было генерировать узнаваемые версии произведений, суд признал веса моделей материальной фиксацией - то есть воспроизведением - охраняемого музыкального содержания.
(3) Нарушающие авторские права результаты генерации и сообщение произведений для всеобщего сведения в Германии. Сгенерированные песни воспроизводили узнаваемые охраняемые элементы оригинальных произведений.
Непосредственным нарушителем был признан не только пользователь, но и Suno, поскольку компания выбирала обучающие данные, проектировала и обучала модели и контролировала систему генерации.
Суд установил, что Suno получала записи с YouTube при помощи технологий stream-ripping, обходивших механизм YouTube Rolling Cipher - техническую меру, предназначенную для предотвращения прямого скачивания.
Для проверки работы Suno и сходства результатов генерации с оригинальными произведениями сотрудники и юристы GEMA вводили:
- полный оригинальный текст песни;
- название оригинальной песни;
- описание жанра, соответствующее оригиналу.
Запросы повторялись от 4 до 176 раз для каждого произведения, после чего выбирались результаты, наиболее наглядно демонстрировавшие сходство. Например, для «Atemlos» идентичный запрос вводился 176 раз, а для «Big in Japan» - 124 раза. И если вы скажете, что такой подход к доказыванию нарушения является допустимым - я не соглашусь, потому что пользователи так с платформой не контактируют и вероятность получить оригинальное музыкальное произведение для них намного ниже чем для представителей GEMA, которые пытались джейлбрейкнуть систему ИИ.
Суд неожиданно смог провести различие между обычным усвоением информации моделью ИИ при обучении, например, закономерностей, тенденций и корреляций, и включением охраняемого выразительного содержания в обученные параметры модели.
Понятие запоминания (меморизации) было определено широко. Произведение не обязательно должно было сохраняться в виде точного аудиофайла или воспроизводиться нота в ноту. Достаточно, чтобы модель восприняла нечто большее, чем абстрактную информацию, и чтобы хотя бы часть охраняемого содержания могла воспроизводиться через обученные параметры.
Но по сути параметры (веса) это и есть некая абстрактная информация, которая представляет собой результат извлечения закономерностей моделью и не важно, что в процессе взаимодействия с моделью пользователь может получить результат генерации, содержащий элементы, охраняемые авторским или смежным правом, так как результат генерации не может быть доказательством воспроизведения в форме меморизации.
Мюнхенский суд использует более широкое понятие: меморизация материала не обязана быть полной, точной, стабильно извлекаемой или локализованной в конкретных параметрах. Это делает рассуждение опасно циклическим:
- результат сходен, потому что произведение запомнено;
- запоминание доказано, потому что результат сходен;
- параметры являются копией, потому что запоминание установлено.