Сегодня 06 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

«Нельзя дважды лизнуть барсука»: Google AI Overviews наделил смыслом абсурдные идиомы и вымышленные фразеологизмы

Функция AI Overviews, встроенная в поисковую систему Google и использующая генеративный ИИ (GenAI) для кратких ответов на запросы, уверенно интерпретирует вымышленные идиомы. Пользователи обнаружили, что достаточно ввести произвольную фразу и добавить слово «meaning» (англ. — значение), чтобы получить уверенное объяснение смысла этой фразы, независимо от её реальности. Система при этом не только интерпретирует бессмысленные конструкции как устойчивые выражения, но и указывает предполагаемое происхождение, иногда даже снабжая ответ гиперссылками, усиливающими эффект достоверности.

 Источник изображения: Shutter Speed / Unsplash

Источник изображения: Shutter Speed / Unsplash

В результате в интернете начали появляться примеры очевидных вымыслов, обработанных AI Overviews как подлинные фразеологизмы. Так, фраза «a loose dog won’t surf» (англ. — свободная собака не будет сёрфить) была истолкована как «шутливый способ выразить сомнение в осуществимости какого-либо события». Конструкция «wired is as wired does» (англ. — проводной — это то, что делают провода) ИИ объяснил как высказывание о том, что поведение человека определяется его природой, подобно тому как функции компьютера зависят от его схем. Даже фраза «never throw a poodle at a pig» (англ. — никогда не бросайте пуделя на свинью) была описана как пословица с библейским происхождением. Все эти объяснения звучали правдоподобно и были изложены AI Overviews с полной уверенностью.

На странице AI Overviews внизу размещено уведомление о том, что в её основе используется «экспериментальный» генеративный ИИ. Такие ИИ-модели представляют собой вероятностные алгоритмы, в которых каждое последующее слово выбирается на основе максимально возможной предсказуемости, опираясь на данные обучения. Это позволяет создавать связные тексты, но не гарантирует фактологическую точность. Именно поэтому система оказывается способной логично объяснить, что могла бы означать фраза, даже если она лишена реального смысла. Однако это свойство приводит к созданию правдоподобных, но полностью вымышленных интерпретаций.

Как пояснил Цзян Сяо (Ziang Xiao), специалист в области компьютерных наук из Университета Джонса Хопкинса (JHU), предсказание слов в таких ИИ-моделях строится исключительно на статистике. Однако даже логически уместное слово не гарантирует достоверности ответа. Кроме того, генеративные ИИ-модели, по данным научных наблюдений, склонны угождать пользователю, адаптируя ответы к предполагаемым ожиданиям. Если система «видит» в запросе указание на то, что фраза вроде «you can’t lick a badger twice» (англ. — нельзя дважды лизнуть барсука) должна быть осмысленной, она интерпретирует её как таковую. Это поведение наблюдалось в исследовании под руководством Сяо в прошлом году.

Сяо подчёркивает, что такие сбои особенно вероятны в контекстах, где информации в обучающих данных недостаточно — это касается редких тем и языков с ограниченным числом текстов. Кроме того, ошибка может быть усилена каскадным распространением, поскольку поисковая система представляет собой сложный многоуровневый механизм. При этом ИИ редко признаёт своё незнание, поэтому, если ИИ сталкивается с ложной предпосылкой, он с высокой вероятностью выдаёт вымышленный, но правдоподобно звучащий ответ.

Представитель Google Мэганн Фарнсворт (Meghann Farnsworth) объяснила, что при поиске, основанном на абсурдных или несостоятельных предпосылках, система старается найти наиболее релевантный контент на основе ограниченных доступных данных. Это справедливо как для традиционного поиска, так и для AI Overviews, которая может активироваться в попытке предоставить полезный контекст. Тем не менее AI Overviews не срабатывает по каждому запросу. Как отметил когнитивист Гэри Маркус (Gary Marcus), система даёт непоследовательные результаты, поскольку GenAI зависит от конкретных примеров в обучающих выборках и не склоннен к абстрактному мышлению.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Тактический экшен, масштабные операции и публичное тестирование: Ubisoft раскрыла подробности новой Ghost Recon в честь 25-летия серии 17 мин.
Смерть игр на дисках не навредит Capcom — более 90 % продаж и так приходится на «цифру» 2 ч.
Adobe выпустила плагин, который добавляет 70 инструментов компании в ChatGPT 3 ч.
«Я просто хотел попасть в игру»: актёр озвучки GTA V пробовался более чем на 60 ролей в GTA VI, но Rockstar его проигнорировала 4 ч.
«Экстраординарно жестокая» игра Machine Party от создателя Buckshot Roulette показала «сумасшедшие» продажи за неделю 4 ч.
ИИ в «Google Картах» научился заказывать еду для пользователя и искать отели 5 ч.
Расширенный показ GTA VI пройдёт 27 августа в онлайн-кинотеатре Netflix 5 ч.
Администраторы каналов в WhatsApp скоро смогут маркировать ИИ-контент 5 ч.
«Бесцеремонные клептоманы»: News Corp. обрушилась на ИИ-компании за использование чужого контента без разрешения 6 ч.
Тысячи серверов оказались под угрозой взлома из-за ошибок в BMC 7 ч.
HBM4 и Grok загрузили 4-нм линии Samsung до предела на весь 2027 год — клиентов переводят на 5 нм 2 ч.
Астрономы показали самые детальные в истории снимки поверхности Солнца — с загадочными «мазками Ван Гога» 2 ч.
Apple неожиданно повысила выплаты по трейд-ин — некоторые устройства подорожали почти на 30 % 3 ч.
Nothing намекнула на выпуск шести смартфонов в следующем году — «вдвое больше» чем в этом 3 ч.
Богатым будет тяжелее: Caviar утяжелила смарт-очки Ray-Ban золотом, серебром и крокодиловой кожей 3 ч.
Представлен игровой 31,5-дюймовый изогнутый монитор AOC Gaming CQ32G4ZA с тремя режимами: 1440p@260 Гц, 1080p@360 Гц и 720p@500 Гц 4 ч.
SK hynix и Sandisk представили первые спецификации HBF 4 ч.
Marvell представила контроллеры и коммутаторы Structera CXL/PCIe 6.0 для ИИ-систем 5 ч.
Etched привлекла рекордные $300 млн в раунде C при оценке $10,3 млрд 5 ч.
ИИ подвёл Nothing: рекламу наушников CMF Clip Pro раскритиковали за сгенерированные изображения 5 ч.