Сегодня 14 марта 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Крупнейшие сайты интернета запретили Apple собирать их данные для обучения ИИ

Одним из источников данных для обучения систем генеративного искусственного интеллекта являются общедоступные веб-ресурсы. Apple предоставила их владельцам возможность отказаться от сбора данных для обучения системы Apple Intelligence, и многие из крупнейших ресурсов этой возможностью воспользовались. Среди них значатся Facebook и Instagram, а также крупные новостные и медийные ресурсы, включая New York Times и The Atlantic.

В течение последних лет Apple применяла веб-сканер под названием AppleBot — собранные им данные использовались для обучения Siri и поисковой машины Spotlight. А совсем недавно компания подключила к AppleBot и Apple Intelligence. Это спорная практика, поскольку современный ИИ вольно обходится с защищёнными авторским правом материалами — в узких областях, где материалов вообще не так много, системы почти без изменений цитируют целые абзацы.

Apple уверяет, что производит сбор информации с учётом этических норм, отсеивая персональные данные, пользуясь только лицензированными материалами и общедоступными данными, которые поступают от сканера AppleBot. Чтобы дать веб-мастерам возможность отказаться от сбора информации только для обучения ИИ, компания использовала псевдоним Applebot-Extended — стандартная поисковая индексация при запрете этого псевдонима остаётся.

Отказ осуществляется внесением соответствующей директивы в общедоступный на веб-ресурсах файл robots.txt, а значит, у любого желающего есть возможность увидеть, кто из издателей заблокировал к себе доступ Apple Intelligence. Это сделали Facebook, Instagram, Craigslist, Tumblr, New York Times, Financial Times, The Atlantic, Vox Media, сеть USA Today и Condé Nast, установил журнал Wired. Чуть более четверти крупных американских новостных сайтов (294 из 1167) отказались пускать к себе ИИ от Apple, уточнил журналист Бен Уэлш (Ben Welsh).

По неподтверждённой информации, Apple заключила с некоторым медиакомпаниями сделки, заплатив им за право использовать их материалы для обучения ИИ. Вероятно, эти соображения сдерживают и остальные ресурсы — они просто ждут денег.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Хакеры начали заполонять GitHub проектами с «невидимым» вредоносным кодом 4 ч.
Игры для ПК избавятся от компиляции шейдеров — Microsoft повсеместно распространит ASD на Windows 4 ч.
Группа ИИ-агентов взломала базу данных несуществующей компании, хотя их об этом не просили 5 ч.
Adobe заплатит $150 млн по иску о платной отмене подписок на Photoshop и другие приложения 7 ч.
Meta скоро отключит сквозное шифрование для личных сообщений в Instagram 7 ч.
Администрации Трампа перепадут $10 млрд в качестве вознаграждения за «приземление» TikTok 9 ч.
xAI накрыла новая волна увольнений — компанию покинули ещё два сооснователя, которых Маск обвинил в отставании Grok от конкурентов 11 ч.
Новая статья: Styx: Blades of Greed — одни и те же гоблинские шутки. Рецензия 17 ч.
VK Tech нарастила выручку в 2025 году на 38,0 %, а облако VK Cloud — на 13,5 % 18 ч.
Nvidia пообещала ускорить «в миллион раз» трассировку лучей и путей в будущих GPU 18 ч.
В России в прошлом году солнечная генерация выросла всего на 100 МВт — в 3150 раз меньше, чем в Китае 56 мин.
Китай начал строить космические аппараты для доставки образцов грунта с Марса 4 ч.
В Meta назревает новая волна увольнений: из-за ИИ могут уволить каждого пятого 4 ч.
Chuwi снова поймали на подмене процессоров: внутри ноутбука оказался менее мощный Ryzen, чем в характеристиках 4 ч.
Учёные открыли соединение алюминия, способное заменить катализаторы из золота и платины 4 ч.
Apple отпразднует 50-летие мероприятиями «по всему миру» — на первом спела Алиша Киз 4 ч.
Телескоп LOFAR обнаружил 13,7 млн ранее неизвестных объектов в крупнейшем радиообзоре Вселенной 6 ч.
Amazon начнёт запускать ИИ-модели на гигантских чипах Cerebras 7 ч.
Silicon Motion представила контроллер SM8008 для загрузочных SSD в дата-центрах 7 ч.
MediaTek представила чипы Genio Pro 5100 и Genio 420 для AIoT-приложений 7 ч.