Сегодня 03 марта 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ИИ Gemini оказался совсем не так хорош в обработке больших объёмов данных, как заявляла Google

Новые исследования ставят под сомнение заявления Google о возможностях больших языковых моделей моделей Gemini по обработке больших объёмов данных, показывая, что их эффективность в анализе длинных текстов и видео значительно ниже заявленной.

 Источник изображения: Google

Источник изображения: Google

Недавние исследования выявили существенные недостатки в работе флагманских генеративных моделей искусственного интеллекта Google Gemini 1.5 Pro и 1.5 Flash, пишет издание TechCrunch. Google неоднократно подчёркивала способность Gemini обрабатывать огромные объёмы данных благодаря большому контекстному окну, утверждая, что модели могут анализировать документы объёмом в сотни страниц и искать информацию в видеозаписях. Однако два независимых исследования показали, что на практике эти модели справляются с такими задачами гораздо хуже.

Учёные из Массачусетского университета в Амхерсте (UMass Amherst), Института Аллена по искусственному интеллекту (Allen Institute for AI) и Принстона (Princeton University) тестировали Gemini на способность отвечать на вопросы о содержании художественных книг. Представленная для теста книга содержала около 260 000 слов (около 520 страниц). Результаты оказались неутешительными. Gemini 1.5 Pro правильно ответил только в 46,7 % случаев, а Gemini 1.5 Flash лишь в 20 % случаев. Далее усреднив результаты, выяснилось, что ни одна из моделей не смогла достичь точности ответов на вопросы выше случайной.

Маржена Карпинска (Marzena Karpinska), соавтор исследования, отметила: «Хотя такие модели, как Gemini 1.5 Pro, технически могут обрабатывать длинные контексты, мы видели много случаев, указывающих на то, что модели на самом деле не понимают содержание».

Второе исследование, проведённое учёными из Калифорнийского университета в Санта-Барбаре, фокусировалось на способности Gemini 1.5 Flash анализировать видеоконтент, а точнее слайды с изображениями. Результаты также оказались неудовлетворительными — из 25 изображений ИИ дал правильные ответы только в половине случаев, а при увеличении количества картинок точность ответов понизилась до 30 %, что ставит под сомнение эффективность модели в работе с мультимедийными данными.

Правда отмечается, что ни одно из исследований не прошло процесс рецензирования, и к тому же не тестировались самые последние версии моделей с контекстом в 2 миллиона токенов. Тем не менее, полученные результаты вызывают серьёзные вопросы в отношении реальных возможностей генеративных моделей ИИ в целом, и о том, насколько обоснованы маркетинговые заявления технологических гигантов.

Данные исследования появились на фоне растущего скептицизма в отношении генеративного ИИ. Так, недавние опросы международной консалтинговой компании Boston Consulting Group показали, что около половины опрошенных руководителей высшего звена не ожидают существенного повышения производительности от использования генеративного ИИ и обеспокоены возможными ошибками и проблемами с безопасностью данных.

Эксперты же призывают к разработке более объективных критериев оценки возможностей ИИ и к большему вниманию и независимой критике. Google пока не прокомментировал результаты этих исследований.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Издатель Terminator: Survivors и Styx: Blades of Greed под угрозой банкротства отложил шоу Nacon Connect 2026, чтобы показать игры «в наилучшем виде» 7 ч.
Nvidia выпустила драйвер 595.71 WHQL на замену неудачному 595.59 WHQL 9 ч.
Nintendo анонсировала презентацию инди-игр Indie World Showcase — фанаты ждут Hollow Knight: Silksong 9 ч.
В Великобритании Sony обвинили в завышении цен для пользователей PlayStation — сумма иска составила $2,7 млрд 10 ч.
В России снизился уровень цифровой грамотности — люди не успевают адаптироваться к новым технологиям 10 ч.
Дату выхода и цену Starfield на PS5 подтвердил надёжный инсайдер 11 ч.
Бесплатные выходные, новые дополнения и обновления: Paradox с размахом отметит 11-летие Cities: Skylines 11 ч.
Marathon / Slay the Spire 2 / Planet of Lana 2 / Esoteric Ebb / Календарь релизов 2 – 8 марта 12 ч.
Российский рынок видеопиратства сократился на 5,5 % по итогам 2025 года 14 ч.
Бутерброд раздора: спор о торговой марке вынудил Take-Two впервые за 18 лет обновить данные о продажах GTA: Vice City Stories 14 ч.
Vivo показала камерофон X300 Ultra и пообещала сделать его доступным за пределами Китая 3 ч.
Новая статья: Обзор Samsung Galaxy Z TriFold: тройной складной смартфон по цене квартиры в Воркуте 4 ч.
288-ядерные Xeon Clearwater Forest хороши для телекома, говорят Intel и Ericsson 5 ч.
ASML расширит ассортимент продукции: к литографам добавится оборудование для передовой упаковки чипов 9 ч.
Apple представила новый iPad Air с чипом M4, 12 Гбайт ОЗУ и ценой от $599 9 ч.
Apple представила iPhone 17e на чипе A19, с поддержкой MagSafe, розовым цветом и ценой от $599 10 ч.
Qualcomm представила свой первый чип с поддержкой Wi-Fi 8 и пообещала запустить сети 6G к 2029 году 10 ч.
Intel показала 18-ангстремные Xeon 6+ с 288 ядрами и пообещала их выпустить до июля 12 ч.
Подводно-наземный кабель WorldLink свяжет Ближний Восток с Европой в обход Красного моря 12 ч.
AMD представила мобильные Ryzen AI Pro 400 для корпоративных ноутбуков и мобильных рабочих станций 12 ч.