Сегодня 14 ноября 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Нельзя дважды лизнуть барсука»: Google AI Overviews наделил смыслом абсурдные идиомы и вымышленные фразеологизмы

Функция AI Overviews, встроенная в поисковую систему Google и использующая генеративный ИИ (GenAI) для кратких ответов на запросы, уверенно интерпретирует вымышленные идиомы. Пользователи обнаружили, что достаточно ввести произвольную фразу и добавить слово «meaning» (англ. — значение), чтобы получить уверенное объяснение смысла этой фразы, независимо от её реальности. Система при этом не только интерпретирует бессмысленные конструкции как устойчивые выражения, но и указывает предполагаемое происхождение, иногда даже снабжая ответ гиперссылками, усиливающими эффект достоверности.

 Источник изображения: Shutter Speed / Unsplash

Источник изображения: Shutter Speed / Unsplash

В результате в интернете начали появляться примеры очевидных вымыслов, обработанных AI Overviews как подлинные фразеологизмы. Так, фраза «a loose dog won’t surf» (англ. — свободная собака не будет сёрфить) была истолкована как «шутливый способ выразить сомнение в осуществимости какого-либо события». Конструкция «wired is as wired does» (англ. — проводной — это то, что делают провода) ИИ объяснил как высказывание о том, что поведение человека определяется его природой, подобно тому как функции компьютера зависят от его схем. Даже фраза «never throw a poodle at a pig» (англ. — никогда не бросайте пуделя на свинью) была описана как пословица с библейским происхождением. Все эти объяснения звучали правдоподобно и были изложены AI Overviews с полной уверенностью.

На странице AI Overviews внизу размещено уведомление о том, что в её основе используется «экспериментальный» генеративный ИИ. Такие ИИ-модели представляют собой вероятностные алгоритмы, в которых каждое последующее слово выбирается на основе максимально возможной предсказуемости, опираясь на данные обучения. Это позволяет создавать связные тексты, но не гарантирует фактологическую точность. Именно поэтому система оказывается способной логично объяснить, что могла бы означать фраза, даже если она лишена реального смысла. Однако это свойство приводит к созданию правдоподобных, но полностью вымышленных интерпретаций.

Как пояснил Цзян Сяо (Ziang Xiao), специалист в области компьютерных наук из Университета Джонса Хопкинса (JHU), предсказание слов в таких ИИ-моделях строится исключительно на статистике. Однако даже логически уместное слово не гарантирует достоверности ответа. Кроме того, генеративные ИИ-модели, по данным научных наблюдений, склонны угождать пользователю, адаптируя ответы к предполагаемым ожиданиям. Если система «видит» в запросе указание на то, что фраза вроде «you can’t lick a badger twice» (англ. — нельзя дважды лизнуть барсука) должна быть осмысленной, она интерпретирует её как таковую. Это поведение наблюдалось в исследовании под руководством Сяо в прошлом году.

Сяо подчёркивает, что такие сбои особенно вероятны в контекстах, где информации в обучающих данных недостаточно — это касается редких тем и языков с ограниченным числом текстов. Кроме того, ошибка может быть усилена каскадным распространением, поскольку поисковая система представляет собой сложный многоуровневый механизм. При этом ИИ редко признаёт своё незнание, поэтому, если ИИ сталкивается с ложной предпосылкой, он с высокой вероятностью выдаёт вымышленный, но правдоподобно звучащий ответ.

Представитель Google Мэганн Фарнсворт (Meghann Farnsworth) объяснила, что при поиске, основанном на абсурдных или несостоятельных предпосылках, система старается найти наиболее релевантный контент на основе ограниченных доступных данных. Это справедливо как для традиционного поиска, так и для AI Overviews, которая может активироваться в попытке предоставить полезный контекст. Тем не менее AI Overviews не срабатывает по каждому запросу. Как отметил когнитивист Гэри Маркус (Gary Marcus), система даёт непоследовательные результаты, поскольку GenAI зависит от конкретных примеров в обучающих выборках и не склоннен к абстрактному мышлению.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
NVIDIA вновь впереди всех в новом раунде MLPerf Training v5.1 7 ч.
Новая статья: В шаговой доступности: как быстро найти бесплатный Wi-Fi в России 9 ч.
Google научила NotebookLM проводить «глубокие исследования», работать с Microsoft Word и «Google Таблицами» 9 ч.
В браузере Firefox появится прозрачное «Окно с ИИ» с чат-ботом и умным помощником 9 ч.
Google представила геймерского ИИ-агента SIMA 2 — он умеет проходить незнакомые игры 11 ч.
AMD выпустила драйвер Radeon с поддержкой Ryzen 5 7500X3D, а также игр Call of Duty: Black Ops 7, Anno 117: Pax Romana и ARC Raiders 12 ч.
«Улыбка до ушей»: Amazon порадовала фанатов официальным трейлером второго сезона «Фоллаут» 12 ч.
Google грозит новый штраф в ЕС — на этот раз из-за неправильной борьбы со спамом 14 ч.
ИИ Google пробежится по рождественским распродажам за пользователя — сам выберет, сам закажет… и сам воспользуется? 14 ч.
Власти Франции полностью сняли с главы Telegram Павла Дурова запрет на выезд из страны 14 ч.
Доля AMD на рынке настольных процессоров выросла до 33,6 %, по данным Mercury Research 4 ч.
Tesla отзывает более 10 000 домашних аккумуляторов Powerwall 2 — они могут спалить дом из-за дефектных элементов 10 ч.
Baidu анонсировала суверенные ИИ-ускорители Kunlun M100 и M300 для инференса и обучения 11 ч.
Вышла глобальная версия смартфона OnePlus 15 – цена от $900 12 ч.
Steam Machine превратится в «Куб-Компаньон» из игр Portal — Dbrand представила скин для грядущей приставки 12 ч.
Google инвестирует €5,5 млрд в дата-центры в Германии 14 ч.
Ретро-консоль Analogue 3D с поддержкой 4K и картриджей Nintendo 64 наконец поступит в продажу на следующей неделе 14 ч.
Меж болот и прерий: Meta начала строительство юбилейного 30-го дата-центра за $1 млрд 15 ч.
DJI выпустила селфи-дрон Neo 2 за €239 на глобальный рынок, но не в США 15 ч.
1024 ядра, 6 ГГц и 48 Тбайт DDR5-17600: Tachyum обновила характеристики несуществующего процессора Prodigy 16 ч.