Безопасность ИИ

Великобритания обязала Google дать издателям право отказаться от AI Overviews

Британский регулятор потребовал от Google создать инструмент, позволяющий веб-издателям блокировать использование их контента в генеративных ответах поисковой системы. Это первый в мире законодательный прецедент, напрямую ограничивающий использование материалов для обучения и ответов ИИ без явного согласия правообладателей.

Иллюстрация к новости: Великобритания обязала Google дать издателям право отказаться от AI Overviews

Великобритания создала правовой прецедент, касающийся технологических платформ, генеративного искусственного интеллекта и авторских прав. Регулятор Competition and Markets Authority (CMA) обязал Google разработать инструмент для массового отказа владельцев сайтов от использования их контента в новых генеративных функциях поиска, известных как AI Overviews. Это позволит издателям блокировать сканирование и обработку своих материалов языковыми моделями Google для формирования сводных ответов в поисковой выдаче. Решение принято в рамках расследования CMA о состоянии конкуренции на рынках цифровой рекламы и поисковых услуг.

Требование регулятора является ответом на давление медиаиндустрии и законодателей. Издатели выражают опасения, что генеративные ответы ИИ, которые синтезируют информацию с различных сайтов, могут сократить трафик на исходные источники и подорвать их доходы, в частности от рекламы. До этого момента у правообладателей не существовало массового механизма, позволяющего запретить использование их текстов для обучения коммерческих систем искусственного интеллекта или для формирования таких ответов. Инструмент Google предоставит возможность отказа на уровне всего домена или его отдельных разделов через использование файлов типа robots.txt. По сообщениям TechCrunch, функцию сначала испытают в Великобритании, а затем возможно ее распространение на другие регионы.

Это событие устанавливает принцип, согласно которому контент нельзя произвольно использовать для коммерческого обучения генеративных моделей без предоставления владельцам возможности выбора. Это формирует юридический прецедент, который может оказать влияние на подходы к регулированию в Европейском союзе и США. Фактически признается, что данные для обучения ИИ являются не бесплатным ресурсом, а активом, права на который необходимо учитывать. Решение затрагивает бизнес-модель Google, которая исторически строилась на индексировании всего открытого веба без необходимости индивидуальных соглашений с каждым издателем.

Последствия для пользователей и компаний могут быть разными. Это шаг к более этичному развитию искусственного интеллекта, где создатели контента получают больше контроля над использованием своих материалов. Однако если значительное число издателей воспользуется этим инструментом отказа, это может ограничить базу знаний для обучения моделей и потенциально повлиять на качество генеративных ответов в поисковых системах. Для разработчиков ИИ это сигнал к необходимости более прозрачной работы с данными, что может стимулировать развитие различных лицензионных моделей. Решение может способствовать переходу от неограниченного сбора данных к более регулируемым договоренностям между создателями контента и компаниями, развивающими технологии искусственного интеллекта.

Вопросы читателей по теме

Все вопросы

Что такое галлюцинация в работе нейросети?

спрашивает Павел, Казань 308 просм.

Дмитрий Волков: Да, это она. Языковая модель - авторегрессионный предсказатель следующего токена: она обучена продолжать текст статистически правдоподобно, а не сверяться с базой проверенных фактов. Если в промпте или в контексте, который вы ей передали, точного значения характеристики нет, модель всё равно достраивает связный ответ, потому что это её единственная задача - выдать вероятное продолжение. Отличить такой…

Что такое дипфейк простыми словами?

спрашивает Николай, Новосибирск 389 просм.

Марина Соколова: Дипфейк - это не обычный монтаж, а видео или запись голоса, которую создала нейросеть, обучившись копировать конкретного человека. Программе показывают много фотографий и записей голоса этого человека, она запоминает черты лица, мимику, манеру говорить, а затем накладывает это на другое видео или сочиняет новую речь, которую человек никогда не произносил. Раньше такое умели делать только…

Можно ли доверять нейросетям?

спрашивает Ирина, Пермь 510 просм.

Сергей Орлов: Доверие здесь стоит делить не на "да" и "нет", а по типу задачи и цене ошибки. Языковая модель не хранит базу проверенных фактов, а предсказывает наиболее вероятное продолжение текста, поэтому она одинаково уверенным тоном пишет и правду, и выдумку - интонация ответа вообще ничего не говорит о его точности. Для черновиков, идей, структуры текста, брейншторма…

Что такое дипфейки?

спрашивает Екатерина, Новосибирск 510 просм.

Марина Соколова: Дипфейк - это видео, фото или аудиозапись, где нейросеть подменяет лицо, мимику или голос человека на синтетические, обученные так, чтобы выглядеть настоящими. Для этого сети показывают десятки или сотни фотографий и записей голоса конкретного человека, она учится воспроизводить его черты и интонации, а затем накладывает это на исходное видео или генерирует новую речь с нуля.…