Сегодня 25 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

У ИИ-поисковиков обнаружилось пристрастие к «менее популярным» источникам

В прошлом году Google развернула в поисковой машине функцию обзоров от искусственного интеллекта — не слишком удачный поначалу эксперимент показал, насколько результаты работы этого сервиса отличаются от традиционной выдачи со ссылками, которую поисковые службы показывали десятилетиями. Поисковые системы на базе ИИ вообще склонны ссылаться на менее популярные сайты и ресурсы, которые не попали бы в первую сотню ссылок «органической» выдачи Google, установили учёные.

 Источник изображения: sarah b / unsplash.com

Источник изображения: sarah b / unsplash.com

Немецкие учёные сравнили результаты традиционного поиска Google с его же «Обзорами от ИИ» и ответами чат-бота Gemini-2.5-Flash; в качестве дополнительных источников они использовали поисковую службу OpenAI GPT-4o и дополнительный режим модели GPT-4o, при котором веб-поиск подключается лишь по необходимости, если модель не обнаруживает ответа в собственной базе знаний. Массив тестовых запросов учёные собрали из трёх источников: WildChat — запросы, которые пользователи отправляли в ChatGPT; AllSides — запросы на политические темы; а также запросы, связанные с сотней самых популярных товаров на Amazon.

В целом системы поиска на основе генеративного ИИ чаще цитировали ресурсы, которые, как правило, не появлялись в первой десятке традиционной поисковой выдачи, показала статистика рейтинга Tranco. Цитируемые ИИ источники с меньшей вероятностью, чем ресурсы из выдачи традиционного поиска Google, оказывались в первой тысяче, а то и в первом миллионе рейтинга Tranco. Среди собственных предпочтений Gemini оказалось множество непопулярных сайтов: по всем результатам медианный источник информации чат-бота не попадал в первую тысячу Tranco. Цитируемые поисковыми системами на базе ИИ источники, как правило, не появлялись даже близко к верхушке выдачи Google: 53 % источников из «обзоров от ИИ» в Google не попали в первую десятку, а 40 % — в первую сотню результатов из традиционной выдачи.

 Источник изображения: BoliviaInteligente / unsplash.com

Источник изображения: BoliviaInteligente / unsplash.com

Значительной оказалась разница в качестве источников: системы ИИ чаще обращались к корпоративным ресурсам и энциклопедиям, но почти никогда не ссылались на соцсети. Анализ ответов, который провела большая языковая модель, показал, что ИИ охватил то же количество идентифицируемых понятий, что и первая десятка ресурсов в традиционной выдаче — результаты были столь же подробными, разнообразными и актуальными. С другой стороны, ИИ проявил склонность сжимать информацию, то есть не упоминать второстепенных и неоднозначных аспектов, которые сохраняются в традиционном поиске.

Важным достоинством поисковых систем с ИИ оказалась способность объединять информацию из заложенной при обучении базой знаний с данными цитируемых сайтов. Модель GPT-4o, например, часто вообще не обращалась к внешним источникам, ограничиваясь собственными знаниями — это же оказалось и её слабым местом: иногда она запрашивала подробности у пользователя вместо того, чтобы самостоятельно обратиться к веб-поиску. Учёные не стали делать выводов о качестве работы поисковых системы с ИИ, но призвали выработать новые методы оценки качества их работы с учётом разнообразия, охвата понятий и способности моделей объединять собственные знания с данными внешних источников.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Легендарная Gothic вышла на iPhone и iPad — с адаптированным управлением и двумя режимами графики 6 мин.
Слава ветерана GTA не помогла: студия Build a Rocket Boy в ответе за провальный боевик MindsEye стала банкротом 36 мин.
Microsoft перезапустила Copilot как суперприложение с чатом, агентами и вайб-кодингом — ИИ должен повторить успех Office 47 мин.
«Это очень много вырытых могил»: разработчики Graveyard Keeper 2 похвастались продажами за три дня с релиза 2 ч.
F-Droid готовит крупнейшее обновление за 10 лет — открытая альтернатива «Play Маркету» бросит вызов новым ограничениям Google 3 ч.
Ubisoft в деталях рассказала об Echoes of Central Park — самом мрачном дополнении к The Division 2, которое выйдет в начале ноября 4 ч.
В «Google Фото» появились фильтры «Настроение», возможность скрыть данные фото и не только 5 ч.
Продажи в японских букинистических магазинах выросли впятеро — из-за ИИ 5 ч.
Авторитетный инсайдер рассказал, как Ubisoft чуть не сделала ответвление The Legend of Zelda про главного злодея всей серии 5 ч.
У Bitget украли криптовалюту на $351,6 млн — криптобиржа пообещала клиентам всё вернуть 5 ч.
Ангстремный техпроцесс Intel 14A заинтересовал Amazon, Apple, AMD, Google, Tesla, Microsoft, Nvidia и Qualcomm 45 мин.
Память DDR5 для ноутбуков подорожала в шесть раз за год — и пока не думает останавливаться 2 ч.
Быстрая доставка с неба оказалась слишком шумной: жители Техаса жалуются на дроны Amazon 2 ч.
Oracle может начать платить за ЦОД, которого ещё нет — Project Jupiter в Нью-Мексико задерживается 2 ч.
Intel догнала TSMC в гонке нанометров — Intel 14A будет отличаться от TSMC A14 не более чем на 5 % 2 ч.
ABB готовит ЦОДы к мегаваттным ИИ-стойкам — компания представила систему питания Infinitus стандарта 800 В DC 3 ч.
Австралиийский штат Виктория предложил обязать ЦОД самостоятельно обеспечить себя возобновляемой энергией 4 ч.
Akashi Data Center собралась построить в Казахстане ЦОД мощностью 100 МВт 5 ч.
Huawei сократила отставание от Apple до трёх поколений — новый Kirin 9050 Pro оказался быстрее 3-нм процессора iPhone 15 Pro 5 ч.
Tesla наконец готова массово выпускать электрические грузовики Semi — запущен «грузовой автозавод» в Неваде 6 ч.