Сегодня 18 мая 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ИИ-компании заплатят «Википедии», чтобы она не разорилась из-за скрапинга

Соучредитель «Википедии» Джимми Уэйлс (Jimmy Wales) сообщил, что онлайн-энциклопедия совместно с крупными технологическими компаниями занимается подготовкой сделок по лицензированию контента для обучения ИИ, аналогичных соглашению с Google, чтобы возместить рост расходов, связанных со скрапингом.

 Источник изображения: Oberon Copeland @veryinformed.com/unsplash.com

Источник изображения: Oberon Copeland @veryinformed.com/unsplash.com

Уэйлс заявил на саммите Reuters Next в Нью-Йорке, что использование технологическими компаниями контента «Википедии» для обучения больших языковых моделей приводит к резкому росту расходов, которые ложатся на некоммерческого оператора сайта. «ИИ-боты, сканирующие «Википедию», обрабатывают весь сайт. Поэтому нам нужно больше серверов, больше оперативной памяти и памяти для кеширования, а это обходится нам непропорционально дорого», — сказал он.

Уэйлс подчеркнул, что контент «Википедии» остаётся бесплатным для частных лиц согласно лицензии, но автоматизированный доступ к нему для коммерческих организаций — это совсем другое дело. Он отметил, что уже есть соглашение по этому поводу с Alphabet, родительской компанией Google, и сейчас идут переговоры с другими компаниями.

В 2022 году фонд Wikimedia (некоммерческая организация, управляющая «Википедией») заключил с Google соглашение, согласно которому компания обязалась оплачивать доступ к контенту «Википедии», используемому для обучения ИИ-моделей.

Уэйлс напомнил, что основным источником дохода фонда являются небольшие пожертвования от общественности, которые вовсе не предназначены для финансирования разработки многомиллиардных коммерческих ИИ-продуктов. «Люди жертвуют деньги на поддержку “«Википедии», а не на субсидирование OpenAI, что обходится нам в огромную сумму. Это несправедливо», — заявил он.

Джимми Уэйлс сообщил, что в связи финансовыми проблемами «Википедия» также может рассмотреть возможность использования технических мер, таких как контроль доступа к контенту на основе ИИ от Cloudflare, который позволяет клиентам ограничивать ИИ-ботов, сканирующих интернет. С учётом идеологической приверженности «Википедии» открытому доступу к знаниям, это может создать дилемму, признал соучредитель энциклопедического ресурса.

Ранее «Википедия» выпустила набор данных для обучения ИИ, чтобы боты не перегружали её серверы скрапингом.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Глава Take-Two раскрыл изначальные планы Rockstar на GTA VI — игра должна была выйти ещё весной 2025 года 60 мин.
Apple научит Siri автоматически удалять переписку ради приватности пользователей 4 ч.
В Forza Horizon 6 уже сыграли миллион человек, хотя игра ещё даже официально не вышла 4 ч.
Genmoji в iOS 27 будет предлагать сгенерировать эмодзи на основе пользовательских фото и истории ввода на клавиатуре 6 ч.
Китайские компании превзошли американских конкурентов в сфере генерации видео при помощи ИИ 7 ч.
ИИ-функции Google Gemini Intelligence появятся лишь на нескольких производительных Android-смартфонах 16 ч.
Мейнфреймы тоже «поржавеют»: для IBM z готовится поддержка Rust в ядре Linux 21 ч.
Microsoft расширила поддержку технологии Advanced Shader Delivery на видеокарты AMD 23 ч.
Konami ограничит доступ к своим игровым серверам для пользователей из России и Белоруссии 17-05 11:59
Тесты подтвердили: Claude Mythos превосходит конкурентов в поиске уязвимостей, но имеет другие слабые места 17-05 07:21
Honor представила Notebook X14 2026 — конкурент MacBook Neo на ангстремном чипе Intel Wildcat Lake 17 мин.
Смартфоны и соцсети отняли у людей живое общение и обвалили рождаемость в большинстве стран мира 20 мин.
«Ростелеком» запустит выпуск умных телевизоров на российской ОС «Аврора ТВ» с ИИ 34 мин.
Британский ИИ-стартап Fractile привлёк $220 млн на ускорение разработки ИИ-ускорителей 3 ч.
VoltaGrid привлекла $1 млрд от Blackstone и Halliburton на развитие систем электрогенерации для ЦОД и купила Propell 3 ч.
10 Пбайт в 2U-шасси: Dell и Kixoa анонсировали сервер хранения PowerEdge R7725xd на платформе AMD 4 ч.
SpaceX Dragon доставил на МКС очередную партию грузов и оборудования 5 ч.
Квартальная прибыль CXMT взлетела почти в 18 раз на фоне высокого спроса на память 6 ч.
Новая статья: Обзор Intel Core Ultra 7 270K Plus — лучший Arrow Lake за полцены 13 ч.
Правительство Южной Кореи будет пытаться не допустить забастовку сотрудников Samsung 13 ч.