Сегодня 30 ноября 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Meta✴ обвинили в использовании пиратских копий книг для обучения ИИ

Юристы Meta предостерегали компанию от использования пиратских копий книг для обучения искусственного интеллекта, но это всё равно было сделано, гласит поданный против компании иск по авторским правам, поданный ещё минувшим летом, сообщает Reuters.

 Источник изображения: Lukas / pixabay.com

Источник изображения: Lukas / pixabay.com

Накануне были объединены иски против Meta, поданные комиком Сарой Сильверман (Sarah Silverman), лауреатом Пулитцеровской премии Майклом Шейбоном (Michael Chabon) и рядом других авторов, которые утверждают, что компания без разрешения использовала их произведения для обучения большой языковой модели Llama. В документах приводятся журналы переписки на одном из серверов Discord, один из участников которой, работающий в Meta исследователь Тим Деттмерс (Tim Dettmers), описывает свою дискуссию с юридическим отделом компании о том, будет ли законным обучение ИИ на электронных копиях книг.

Адвокаты Meta заявили ему, что «данные нельзя использовать [для обучения модели], или модели нельзя будет публиковать, если они обучены на этих данных». Но в компании признали, что всё-таки использовали эти данные для обучения первой версии Llama. Собеседники Деттмерса, впрочем, уверяют, что использование защищённой авторским правом литературы должно «подпадать под добросовестное использование» — действующую в США правовую доктрину, которая в определённых случаях допускает использование защищённых авторским правом произведений без согласия их авторов.

В этом году в адрес технологических компаний было подано множество исков со стороны различных авторов, которые обвиняют разработчиков ИИ в незаконном использовании произведений, защищённых авторским правом. Их победа может создать угрозу для зарождающейся отрасли генеративного ИИ, поскольку из-за необходимости выплаты отчислений стоимость разработки моделей вырастет. Прошедший предварительное одобрение европейский «Закон об ИИ» предписывает разработчикам раскрывать данные, которые они используют для обучения своих моделей.

В феврале Meta представила первую версию большой языковой модели Llama и раскрыла массив использованных для её обучения данных, в том числе блок, объём которого, по некоторым сведениям, содержит 196 640 книг. Минувшим летом была представлена вторая версия Llama, и Meta уже не стала раскрывать, какие данные были использованы для её обучения. Компании, управляющие сервисами с аудиторией менее 700 млн пользователей в месяц, могут использовать Llama 2 бесплатно.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Новая статья: Goodnight Universe — колыбельная для крошки. Рецензия 59 мин.
Новая статья: Gamesblender № 754: кризис на рынке памяти, Pioner не для российского Steam и 20-летие Xbox 360 2 ч.
«Мы просто поражены приёмом»: авторы олдскульного хоррора Tormented Souls 2 продали свыше 100 тыс. его копий и занялись первым DLC 8 ч.
Роскомнадзор увидел в Roblox угрозу детям — на платформе нашли неподобающий контент 9 ч.
Asus предупредила об очередной критической уязвимости в маршрутизаторах с AiCloud 10 ч.
Infinix проведёт в декабре турнир по PUBG Mobile, для участия в котором нужно быть студентом вуза или ссуза России 10 ч.
Президент Signal призвала не спешить с внедрением ИИ в мессенджерах 11 ч.
ИИ-модель DeepseekMath-V2 достигла уровня золотой медали на Международной математической олимпиаде 12 ч.
Практическое использование ИИ в работе остаётся весьма неравномерным 17 ч.
Новая статья: PowerWash Simulator 2 — опять работать. Рецензия 29-11 00:01
Micron инвестирует $9,6 млрд в завод по производству памяти HBM в Японии 30 мин.
Первый в мире частный научный спутник успешно выведен в космос — он будет изучать звёзды в ультрафиолете 7 ч.
Главы технологических компаний наперебой заговорили о ЦОД в космосе 8 ч.
В 2027 году Intel может наладить выпуск процессоров Apple M по техпроцессу 18A-P 9 ч.
Samsung выпустила внешние SSD T7 Resurrected с ударопрочным корпусом из вторсырья и скоростью до 1050 Мбайт/с 9 ч.
Битва за Северную Европу: Digital Realty и Equinix борются за покупку скандинавского оператора ЦОД atNorth за €4,5 млрд 10 ч.
Asustor представила десктопные NAS Lockerstor Gen2+ с двумя портами 5GbE и чипом Intel Jasper Lake 10 ч.
MGX-сервер MSI CG480-S6053 получил чипы AMD EPYC Turin и восемь слотов PCIe 5.0 x16 для FHFL-карт двойной ширины 11 ч.
OpenAI не выйдет на прибыльность до 2030 года, но потребует $207 млрд на развитие 11 ч.
Благодаря Google и ИИ акции MediaTek показали лучшую неделю с 2002 года 11 ч.