Безопасность ИИ

Sony Music и Warner Music Group подали в суд на Anthropic за использование песен для обучения Claude

Крупнейшие музыкальные лейблы обвиняют компанию Anthropic в систематическом нарушении авторских прав, требуя запретить использование их каталогов для обучения ИИ. Иск бросает вызов самой основе современной индустрии генеративных моделей.

Иллюстрация к новости: Sony Music и Warner Music Group подали в суд на Anthropic за использование песен для обучения Claude

Sony Music и Warner Music Group подали в суд Нью-Йорка иск к Anthropic, разработчику модели ИИ Claude. Лейблы обвиняют компанию в интеллектуальном пиратстве, утверждая, что для обучения Claude незаконно использовали песни, защищенные авторским правом. Иск атакует ключевую практику - обучение моделей на общедоступных данных из интернета, где часто содержится защищенный контент. Истцы требуют денежной компенсации и судебного запрета на дальнейшее использование их каталогов.

По утверждению Sony Music и Warner Music Group, Anthropic копировала и использовала лирику и музыкальные композиции без разрешения, лицензии или выплаты роялти. Лейблы считают, что способность Claude генерировать тексты песен, близкие к оригиналам, - прямое доказательство обучения на их материалах. Особенность иска - в фокусе на музыкальной индустрии и в агрессивной формулировке, обвиняющей в преднамеренном пиратстве, а не просто в спорном добросовестном использовании. Музыкальные правообладатели все громче заявляют о своих правах в эпоху генеративного ИИ.

Для отрасли ИИ этот иск - угроза фундаментальным принципам разработки. Большие языковые модели обучаются на массивах данных, собранных из открытого интернета. Эти данные почти неизбежно содержат материалы, защищенные авторским правом: статьи, книги, код, изображения и музыку. До сих пор многие разработчики опирались на доктрину добросовестного использования в американском законодательстве, считая использование данных для обучения трансформативным. Иск Sony и Warner оспаривает эту позицию, утверждая, что генерация текстов песен моделью подрывает коммерческую ценность оригиналов. Успех истцов может заставить индустрию пересмотреть подходы к сбору данных и увеличить затраты на их легализацию.

Последствия для пользователей и разработчиков могут быть двоякими. Ужесточение правил может замедлить темпы инноваций и сделать мощные модели менее доступными для небольших компаний без ресурсов на лицензирование огромных датасетов. С другой стороны, это может подтолкнуть отрасль к более этичным практикам, стимулировать развитие моделей, обученных на лицензированных или синтетических данных, ускорить создание механизмов атрибуции и компенсации для создателей. Исход дела может установить важный юридический прецедент, который определит границы допустимого в обучении ИИ. В долгосрочной перспективе давление креативных индустрий, вероятно, приведет к новым бизнес-моделям, где правообладатели и разработчики ИИ будут вынуждены договариваться о партнерстве.

Вопросы читателей по теме

Все вопросы

Что такое галлюцинация в работе нейросети?

спрашивает Павел, Казань 308 просм.

Дмитрий Волков: Да, это она. Языковая модель - авторегрессионный предсказатель следующего токена: она обучена продолжать текст статистически правдоподобно, а не сверяться с базой проверенных фактов. Если в промпте или в контексте, который вы ей передали, точного значения характеристики нет, модель всё равно достраивает связный ответ, потому что это её единственная задача - выдать вероятное продолжение. Отличить такой…

Что такое дипфейк простыми словами?

спрашивает Николай, Новосибирск 389 просм.

Марина Соколова: Дипфейк - это не обычный монтаж, а видео или запись голоса, которую создала нейросеть, обучившись копировать конкретного человека. Программе показывают много фотографий и записей голоса этого человека, она запоминает черты лица, мимику, манеру говорить, а затем накладывает это на другое видео или сочиняет новую речь, которую человек никогда не произносил. Раньше такое умели делать только…

Можно ли доверять нейросетям?

спрашивает Ирина, Пермь 510 просм.

Сергей Орлов: Доверие здесь стоит делить не на "да" и "нет", а по типу задачи и цене ошибки. Языковая модель не хранит базу проверенных фактов, а предсказывает наиболее вероятное продолжение текста, поэтому она одинаково уверенным тоном пишет и правду, и выдумку - интонация ответа вообще ничего не говорит о его точности. Для черновиков, идей, структуры текста, брейншторма…

Что такое дипфейки?

спрашивает Екатерина, Новосибирск 510 просм.

Марина Соколова: Дипфейк - это видео, фото или аудиозапись, где нейросеть подменяет лицо, мимику или голос человека на синтетические, обученные так, чтобы выглядеть настоящими. Для этого сети показывают десятки или сотни фотографий и записей голоса конкретного человека, она учится воспроизводить его черты и интонации, а затем накладывает это на исходное видео или генерирует новую речь с нуля.…