Сегодня 09 апреля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Крупнейшие сайты интернета запретили Apple собирать их данные для обучения ИИ

Одним из источников данных для обучения систем генеративного искусственного интеллекта являются общедоступные веб-ресурсы. Apple предоставила их владельцам возможность отказаться от сбора данных для обучения системы Apple Intelligence, и многие из крупнейших ресурсов этой возможностью воспользовались. Среди них значатся Facebook и Instagram, а также крупные новостные и медийные ресурсы, включая New York Times и The Atlantic.

В течение последних лет Apple применяла веб-сканер под названием AppleBot — собранные им данные использовались для обучения Siri и поисковой машины Spotlight. А совсем недавно компания подключила к AppleBot и Apple Intelligence. Это спорная практика, поскольку современный ИИ вольно обходится с защищёнными авторским правом материалами — в узких областях, где материалов вообще не так много, системы почти без изменений цитируют целые абзацы.

Apple уверяет, что производит сбор информации с учётом этических норм, отсеивая персональные данные, пользуясь только лицензированными материалами и общедоступными данными, которые поступают от сканера AppleBot. Чтобы дать веб-мастерам возможность отказаться от сбора информации только для обучения ИИ, компания использовала псевдоним Applebot-Extended — стандартная поисковая индексация при запрете этого псевдонима остаётся.

Отказ осуществляется внесением соответствующей директивы в общедоступный на веб-ресурсах файл robots.txt, а значит, у любого желающего есть возможность увидеть, кто из издателей заблокировал к себе доступ Apple Intelligence. Это сделали Facebook, Instagram, Craigslist, Tumblr, New York Times, Financial Times, The Atlantic, Vox Media, сеть USA Today и Condé Nast, установил журнал Wired. Чуть более четверти крупных американских новостных сайтов (294 из 1167) отказались пускать к себе ИИ от Apple, уточнил журналист Бен Уэлш (Ben Welsh).

По неподтверждённой информации, Apple заключила с некоторым медиакомпаниями сделки, заплатив им за право использовать их материалы для обучения ИИ. Вероятно, эти соображения сдерживают и остальные ресурсы — они просто ждут денег.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
В Steam вышла «печатная» королевская битва Final Sentence — в России купить игру можно, но из-за Роскомнадзора она может не работать 15 мин.
«Умирайте, адаптируйтесь, развивайтесь»: стремительный роглайт-слешер Morbid Metal вышел в раннем доступе и заслужил похвалу игроков 2 ч.
«Ждал чего-то подобного 20 лет»: первый геймплейный трейлер ролевого боевика Alkahest порадовал фанатов Dark Messiah of Might and Magic 3 ч.
«Знает рецепт Gemini и не тратит ни доллара впустую»: стартап экс-сотрудников DeepMind будет развивать визуальный ИИ 3 ч.
Новый геймплейный трейлер подтвердил дату выхода Thick as Thieves — амбициозного стелс-экшена от создателя Deus Ex и System Shock 4 ч.
Nvidia вывела из беты динамический генератор кадров и режим MFG 6X в DLSS 4.5 4 ч.
Перед погружением в ранний доступ Subnautica 2 всё-таки получит официальный перевод на русский 4 ч.
Max стал вторым мессенджером в России по посещаемости, по-прежнему уступая Telegram 5 ч.
Создатели Heroes of Might & Magic: Olden Era, Replaced и This is the Police будут помогать друг другу делать игры — студии открыли холдинг Nova Assembly 5 ч.
OpenAI заморозила проект Stargate UK из-за взлетевших цен на электроэнергию 6 ч.
Asus представила ROG Equalizer — кабель 12V-2x6 с усиленной защитой от плавления, который некоторые получат бесплатно 9 мин.
Samsung по-тихому подняла цены на старшие версии Galaxy Z Fold 7 2 ч.
Crimson Desert начала запускаться на некоторых видеокартах Intel, но FSR лучше не включать 2 ч.
Китайские учёные научили животных «питаться» светом — клетки млекопитающих наделили способностью к фотосинтезу 2 ч.
Глава Amazon назвал оправданными $200 млрд инвестиций в ИИ 3 ч.
«Ростех» разработает двигатель для сверхлёгкой ракеты «Воронеж» — в современной России аналогов ему нет 4 ч.
Google выбрала процессоры Intel Xeon для обучения нейросетей 4 ч.
Умелец вчетверо расширил накопитель MacBook Neo с помощью комплектующих от iPhone 4 ч.
У Cloud.ru уже 29 тыс. серверов и 56 МВт мощностей в девяти ЦОД 4 ч.
OpenAI приостановила проект Stargate в Великобритании из-за дорогой электроэнергию и неподходящих законов 5 ч.