Безопасность ИИ

Авторы против ИИ: правовая неопределенность обучения на книгах без разрешения

Использование защищенных авторским правом книг для обучения ИИ-моделей без согласия авторов создает серьезный правовой конфликт, ставя под вопрос законность практики, которая одновременно использует и угрожает творческой индустрии.

Иллюстрация к новости: Авторы против ИИ: правовая неопределенность обучения на книгах без разрешения

Текст многих авторов, сами того не зная, использовали для обучения языковых моделей. Практика, при которой творения писателей становятся сырьем для алгоритмов, вызывает вопросы. Но правовой статус такого использования неоднозначен.

Проблема в природе обучения ИИ. Чтобы модель генерировала связный текст, нужны огромные массивы качественных данных. Книги - подходящий материал. Разработчики используют крупные коллекции текстов, часто защищенных копирайтом. По имеющимся сведениям, авторов часто не уведомляют и не спрашивают согласия. Их интеллектуальная собственность может стать основой для технологии, которая теоретически способна создавать конкурирующий контент.

Юридически ситуация сложна. В некоторых странах компании апеллируют к доктрине, допускающей ограниченное использование материалов без разрешения для определенных целей, таких как обучение. Разработчики утверждают, что обучение моделей - это создание новой технологии. Авторы и их адвокаты видят в этом извлечение выгоды из чужого труда. В Европе подход строже, но полной ясности нет.

Для отрасли ИИ конфликт означает растущие правовые риски. Уже поданы коллективные иски от авторов и медиакомпаний против ряда технологических гигантов. Исход этих процессов может изменить правила. Если суды встанут на сторону авторов, это может привести к необходимости лицензировать огромные массивы данных, что увеличит стоимость разработки. Альтернатива - создание легальных наборов данных или соглашения с правообладателями. Для самих авторов ситуация противоречива. ИИ-инструменты дают новые возможности, но одновременно создают поток автоматизированного контента, который может влиять на рынок профессионального письма.

Конфликт указывает на необходимость новых правовых и этических рамок. Подход, при котором обучение идет впереди правового урегулирования, выглядит неустойчивым. Требуется баланс между технологическим прогрессом и защитой прав создателей. Возможные пути включают системы большей прозрачности или механизмы компенсации. Без урегулирования неопределенность будет сковывать как разработчиков ИИ, опасающихся исков, так и авторов, чьи работы используются без четких правил.

Вопросы читателей по теме

Все вопросы

Что такое галлюцинация в работе нейросети?

спрашивает Павел, Казань 308 просм.

Дмитрий Волков: Да, это она. Языковая модель - авторегрессионный предсказатель следующего токена: она обучена продолжать текст статистически правдоподобно, а не сверяться с базой проверенных фактов. Если в промпте или в контексте, который вы ей передали, точного значения характеристики нет, модель всё равно достраивает связный ответ, потому что это её единственная задача - выдать вероятное продолжение. Отличить такой…

Что такое дипфейк простыми словами?

спрашивает Николай, Новосибирск 389 просм.

Марина Соколова: Дипфейк - это не обычный монтаж, а видео или запись голоса, которую создала нейросеть, обучившись копировать конкретного человека. Программе показывают много фотографий и записей голоса этого человека, она запоминает черты лица, мимику, манеру говорить, а затем накладывает это на другое видео или сочиняет новую речь, которую человек никогда не произносил. Раньше такое умели делать только…

Можно ли доверять нейросетям?

спрашивает Ирина, Пермь 510 просм.

Сергей Орлов: Доверие здесь стоит делить не на "да" и "нет", а по типу задачи и цене ошибки. Языковая модель не хранит базу проверенных фактов, а предсказывает наиболее вероятное продолжение текста, поэтому она одинаково уверенным тоном пишет и правду, и выдумку - интонация ответа вообще ничего не говорит о его точности. Для черновиков, идей, структуры текста, брейншторма…

Что такое дипфейки?

спрашивает Екатерина, Новосибирск 510 просм.

Марина Соколова: Дипфейк - это видео, фото или аудиозапись, где нейросеть подменяет лицо, мимику или голос человека на синтетические, обученные так, чтобы выглядеть настоящими. Для этого сети показывают десятки или сотни фотографий и записей голоса конкретного человека, она учится воспроизводить его черты и интонации, а затем накладывает это на исходное видео или генерирует новую речь с нуля.…