Первородный грех Claude: как пиратские книги легли в основу ИИ - SG Tech
, автор: Морозов Дмитрий

Первородный грех Claude: как пиратские книги легли в основу ИИ

Источник фото: Ньюс Корп

Компания, которая обещала миру этичный ИИ, тайком кормила свою нейросеть контрафактными книгами. Писатели подали в суд, но осадок остался: технологии не могут быть безопасными, если создаются на краденом.

Коллективный иск писателей против Anthropic вскрыл неприглядную подоплёку создания знаменитой языковой модели. Для обучения Claude использовался набор данных Books3, содержащий более ста тысяч книг, скопированных без разрешения авторов. В открытом доступе этот массив существовал давно, но именно причастность именитой компании, публично подчёркивающей свою этическую миссию, привлекла особое внимание.

В числе истцов — признанные литераторы, в том числе автор бестселлера «The Good Nurse». Они настаивают, что использование их произведений для тренировки коммерческого продукта не оправдать никакими исследовательскими амбициями. Компания, зарабатывающая на Claude, обязана платить тем, кто создаёт контент, а не заимствовать его в обход закона и совести. Вместо этого IТ-корпорация выбрала простейший путь: забрать чужое и сделать вид, что не заметила происхождения данных.

Особенно пикантно выглядит позиция Anthropic, десятилетиями выстраивающая образ безопасного и подконтрольного ИИ. Этический фасад трещит по швам, когда выясняется, что под капотом — тысячи пиратских файлов. Этот случай обнажает системную проблему индустрии: технологические компании привыкли всё принимать как должное, включая интеллектуальную собственность создателей. Если уж «этичный» лидер рынка идёт на такое, остальные вряд ли чище.

Показательно, что судебные иски не только о компенсациях, но и о принципе. Если суд признает вину, потребуется в корне пересматривать методы набора данных для больших моделей. Возможно, это станет первым шагом к честной конкуренции между разработчиками и авторами. Но пока писателям приходится вручную отстаивать то, что должно быть защищено законом, а не корпоративной политикой удобных «незамечаний». Репутация Anthropic разбивается о простой вопрос: можно ли доверять ИИ, который создан на украденном фундаменте, и не переносит ли модель это «первородное» пренебрежение к правилам на свои решения.