Сегодня 19 июня 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Поискового робота OpenAI теперь можно не пускать к себе на сайт

OpenAI сообщила, что администраторы веб-сайтов теперь могут целенаправленно частично или полностью запретить её поисковому роботу GPTBot посещать их ресурсы, указав в служебном файле robots.txt соответствующие директивы.

 Источник изображения: Mariia Shalabaieva / unsplash.com

Источник изображения: Mariia Shalabaieva / unsplash.com

«Веб-страницы, проиндексированные при помощи [робота со значением строки] user-agent GPTBot, потенциально могут использоваться для улучшения будущих моделей и фильтруются с целью удаления источников, требующих платного доступа, известных сбором информации для идентификации личности или содержащих текст, нарушающий наши политики», — говорится в справочном разделе на сайте OpenAI. Для источников, не соответствующих исключающим критериям, «открытие доступа GPTBot к вашему сайту может помочь моделям стать более точными и улучшить их общие возможности и безопасность».

На практике блокировка GPTBot доступа к сайтам — важный шаг, который поможет пользователям интернета отказаться от включения своих персональных данных в массивы информации для обучения больших языковых моделей. В прошлом году платформа DeviantArt внедрила тег NoAI — работы с этой пометкой исключаются из массива обучающих данных ChatGPT.

Обучение ИИ зачастую производится с использованием больших массивов данных, которые собираются в интернете, и разработчики нейросетей пока не раскрывают, какая именно информация для этого используется — непонятно даже, присутствуют ли в списке ресурсов соцсети. Тем временем администрации Reddit и Twitter напрямую выступили против включения их данных в массивы для обучения ИИ — пришлось сделать доступ к API платным.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
В Elden Ring Nightreign без предупреждения добавили хардкорную версию одного из финальных боссов, и это только начало 4 ч.
Telegram временно запретили в Малайзии за отказ сотрудничать с властями 4 ч.
Входить в Facebook можно будет с помощью ключей доступа 4 ч.
Capcom анонсировала игровую презентацию Capcom Spotlight — покажут Resident Evil Requiem, Pragmata и не только 7 ч.
«Весёлая, простая и красивая»: Midjourney запустила V1 — свою первую ИИ-модель для генерации видео по изображениям 8 ч.
OpenAI перестанет работать с ИИ-стартапом Scale AI из-за его сближения с Meta 8 ч.
Google интегрирует в YouTube Shorts свою новую ИИ-модель генерации видео Veo 3 9 ч.
В переговорах OpenAI и Microsoft сохраняется несколько важных противоречий 10 ч.
OpenAI вскрыла тёмные личности в ИИ, отвечающие за ложь, сарказм и токсичные ответы 17 ч.
ИИ-поисковик Google научился понимать голосовые запросы, но доступна функция не всем 18 ч.
Беспилотные такси в городах России появятся не раньше 2030 года 34 мин.
Здесь ЦОД с ИИ, здесь Grok'ом пахнет: экоактивисты подали в суд на xAI за использование газовых турбин для суперкомпьютера Colossus 36 мин.
Космический шедевр — создано самое детальное и самое многоцветное изображение галактики 2 ч.
Разработку российского электромобиля e-Neva заморозили 3 ч.
«Билайн» выходит на орбиту: оператор подключится к спутникам «российского Starlink» 4 ч.
Bloom Energy: к 2030 году более четверти ЦОД в США обзаведутся собственными электростанциями 4 ч.
Учёные MIT научили 3D-принтеры печатать из стекла — и для этого не нужен жар печи 4 ч.
«Лаборатория Касперского» спасла от ликвидации свою компанию в Великобритании 4 ч.
Антирекорд SpaceX: корабль Starship зрелищно взорвался, даже не оторвавшись от земли 6 ч.
Honor выпустит самый тонкий и лёгкий складной смартфон в мире раньше, чем Samsung 6 ч.