Сегодня 11 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Марк Цукерберг лично разрешил обучать ИИ-модели Llama на пиратских материалах

Гендиректор Meta✴ Марк Цукерберг (Mark Zuckerberg) лично разрешил подразделению Meta✴, ответственному за разработку моделей искусственного интеллекта Llama, использовать для их обучения массив данных, содержащий полученные незаконным путём книги и статьи. Об этом стало известно из документов, опубликованных в рамках судебного процесса писателя Ричарда Кадри (Richard Kadrey) против Meta✴.

 Источник изображения: Tingey Injury / unsplash.com

Источник изображения: Tingey Injury / unsplash.com

Данный процесс — лишь одно из ряда дел, в рамках которых разрабатывающие системы ИИ технологические гиганты обвиняются в обучении моделей на защищённых авторским правом материалах без разрешения авторов. Ответчики традиционно уверяют, что их действия отвечают норме о добросовестном использовании контента — эта доктрина позволяет пренебрегать авторским правом для создания новых произведений и продуктов, если они в значительной мере отличаются от оригинала. Многие правообладатели с такой позицией не согласны.

В новой порции рассекреченных документов (PDF) приводятся показания представителей Meta✴: выяснилось, что Марк Цукерберг лично одобрил использование компанией массива LibGen для обучения Llama. Проект LibGen, позиционирующий себя как агрегатор ссылок, в действительности предоставляет доступ к защищённым авторским правом работам, которыми управляют крупные издатели. В его отношении неоднократно подавались судебные иски, с него взыскивались десятки миллионов долларов за нарушения авторских прав, и в итоге проект был вынужден закрыться. Цукерберг, говорится в документах, одобрил использование LibGen для обучения как минимум одной модели Llama вопреки опасениям, которые выражали рядовые сотрудники и члены руководства Meta✴. Приводится внутренняя служебная записка, в которой отмечается, что работа с LibGen получила одобрение после «эскалации до MZ» — под этой аббревиатурой, очевидно, подразумевался глава компании.

 Источник изображения: Igor Omilaev / unsplash.com

Источник изображения: Igor Omilaev / unsplash.com

Сторона истца 8 января подала в суд заявление, в котором содержатся новые обвинения. В частности, утверждается, что Meta✴ могла попытаться скрыть это деяние и удалить сведения об использовании материалов LibGen — это предположительно сделал инженер Meta✴ Николай Башлыков (Nikolay Bashlykov), который написал скрипт, удаливший из книг в обучающем массиве информацию об авторских правах. Meta✴ также якобы удалила сведения об авторских правах и соответствующие метаданные из статей научных журналов в данном массиве. Более того, Meta✴ нарушила авторские права, скачав массив LibGen через протокол BitTorrent — в этот момент компания не только скачивала, но и одновременно «раздавала» эти данные, фактически распространяя пиратские материалы, утверждает сторона истца. Глава отдела генеративного ИИ в Meta✴ Ахмад Аль-Дахле (Ahmad Al-Dahle) дал разрешение скачивать данные LibGen через BitTorrent, хотя инженер Башлыков указывал, что это «может быть юридически недопустимо».

Дело ещё далеко до завершения. Пока оно касается только ранних моделей Llama, а не последних выпусков. И если Meta✴ убедит суд в добросовестном использовании материалов, он может встать на сторону компании — в 2023 году несколько истцов так и не смогли доказать факта нарушения авторских прав, и их иски к Meta✴ были отклонены.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Вдохновлённая Disco Elysium фэнтезийная ролевая игра Esoteric Ebb получит официальный текстовый перевод на русский язык 6 ч.
Новая статья: Ace Combat 8: Wings of Theve — одна из лучших игр серии. Рецензия 19 ч.
«Это будет монументально»: амбициозный боевик Squadron 42 во вселенной Star Citizen получил новый трейлер, 15 скриншотов и страницу в Steam 23 ч.
Microsoft выпустила ИИ, который выбирает варианты и не разговаривает — в тестах он оказался в 35 раз быстрее GPT-6 Sol 10-10 18:00
Трамп обещал отделить американский TikTok от Китая, но связи с ByteDance сохранились 10-10 16:56
Стартап из 14 человек подтолкнул Цукерберга к запуску Muse, несмотря на проблемы с безопасностью 10-10 16:08
Стартовые продажи Gears of War: E-Day составили скромные 230 тысяч копий — игроки предпочли знакомиться с шутером через Game Pass 10-10 15:31
Гонка ИИ превратилась в ценовую войну — OpenAI догоняет Anthropic 10-10 13:59
Google тестирует новую Gemini 4 Carbon — сотрудники сравнивают её с Claude Opus 5.5 10-10 10:56
Anthropic и OpenAI готовятся к первой крупной катастрофе по вине ИИ 10-10 10:47
«Яндекс» предупредила о полной остановке работы ЦОД во Владимире из-за атаки БПЛА 5 ч.
Китайцы задавили GoPro на её же поле — DJI и Insta360 захватили 93 % рынка умных камер 11 ч.
Nvidia собирается поглотить американского разработчика открытых ИИ-моделей Reflection AI 13 ч.
Let's Encrypt с февраля 2027 года перейдёт на 64-дневные сертификаты 18 ч.
ASML повысила цены на весь ассортимент комплектующих для литографического оборудования 10-10 17:43
С аппаратных криптокошельков Ledger украли криптовалюту на $86 млн — и пока непонятно, как 10-10 17:32
«Настоящая золотая лихорадка» — ИИ-бум перерос в ожесточённую борьбу за вычислительные мощности 10-10 15:55
Американская Synopsys хочет привлечь китайский ИИ к проектированию китайских чипов — чтобы соблюсти санкции 10-10 15:41
Аналитики ожидают обрушения спроса на ноутбуки в 2027 году из-за роста цен 10-10 15:29
Стоимость современных серверов с поставкой в Россию удвоилась за год 10-10 15:22