Content-Review.com

Anthropic заплатит 1,5 миллиарда за обучение ИИ

История с выплатами компенсаций издателям книг от Anthropic за нарушение авторских прав получила свой финал. Федеральный суд США утвердил мировое соглашение компании с авторами и издателями. Anthropic выплатит 1,5 миллиарда долларов правообладателям примерно 500 тысяч книг – в среднем по 3 тысячи за произведение.

К иску привело то, как Anthropic собирала библиотеку для обучения Claude. Суд разделил два способа: книги, которые компания законно купила и оцифровала, использовать было можно. А вот миллионы файлов, скачанных с пиратских Library Genesis и Pirate Library Mirror, – нельзя. Само обучение модели на защищенных текстах суд счел допустимым добросовестным использованием, но признал незаконным получение и хранение пиратской коллекции.

Хоть история с Anthropic и стала прецендентом, вопрос для всей индустрии о том, какие данные можно использовать для обучения ИИ без нарушений, пока еще не закрыт. Продолжается череда исков о нарушении авторских прав против Google, Midjourney и OpenAI – правообладатели пытаются оспорить саму практику обучения ИИ на защищенных произведениях. Последний пример – коллективный иск к Google от группы издателей и авторов, которые утверждают, что компания без разрешения использовала их книги и статьи для обучения Gemini.

Однако все же на Западе бигтех уже постепенно договаривается с издателями и СМИ, чтобы платить за доступ к качественным данным. Чего не скажешь о России, где трафик ИИ-ботов на сайты медиа растут, но деньги за использование контента их владельцам пока никто системно не платит: СМИ и магазины должны защищаться сами, внедряя paywall, авторизацию, лимиты запросов и антискрапинг.

//