Сегодня 27 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Популярный лайфхак для ИИ оказался вредным: просьба «представь себя экспертом» ухудшает ответы

Запросы к системам искусственного интеллекта, в которых чат-ботам предлагается примерить на себя образ профессионала, могут снизить качество генерируемого контента, в том числе программного кода. К такому выводу пришли учёные Университета Южной Калифорнии в своём исследовании.

 Источник изображения: Steve Johnson / unsplash.com

Источник изображения: Steve Johnson / unsplash.com

Ещё в 2023 году, в момент становления бума ИИ, исследователи рекомендовали начинать запрос к чат-ботам на генерацию программного кода с фраз вроде: «Ты — опытный программист в области машинного обучения». Считалось, что это способно повысить качество программного кода в ответе. Подобные рекомендации встречаются и теперь, но в новом исследовании учёные установили, что эффективность запросов с установкой ролевой модели зависит от поставленной задачи. Если речь идёт о задачах, связанных с материалами предварительного обучения, такими как математика или программирование, то качество ответа может, напротив, снизиться.

Причина заключается в том, что упоминание профессиональной роли в запросе на самом деле не добавляет ей никаких экспертных знаний — объёмы обучающих данных остаются теми же. А при обращении к материалам, полученным на этапе предварительного обучения, установка ролевой модели может стать даже препятствием. Это подтвердилось при прохождении популярного теста MMLU (Massive Multitask Language Understanding): с установкой роли эксперта в запросе качество ответов снизилось по всем четырём категориям, а общая точность снизилась с 71,6 % до 68,0 %.

Выбор ролевой модели повышает вероятность того, что ИИ даст ответ, которого ожидает пользователь, и это может отрицательно сказаться на качестве непосредственно поставленной задачи, потому что ИИ больше стремится соответствовать поставленной роли. В случае написания программного кода ролевая модель, однако, способствует более детальной и качественной проработке пользовательского интерфейса, архитектуры проекта и выбору инструментов. Для решения поставленной проблемы учёные предложили схему PRISM (Persona Routing via Intent-based Self-Modeling), при которой ИИ автоматически выбирает ролевую модель или просто генерирует контент по запросу — в зависимости от типа поставленной задачи подключается механизм основе низкоранговой адаптации LoRA. «Если вам важнее соответствие требованиям (безопасности, правилам, установленной структуре и т. д.), конкретизируйте их; если же важнее точность и факты, просто отправляйте запрос», — заключили учёные.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Британские хирурги провели первую в мире операцию на мозге человека с использованием ИИ в процессе 29 мин.
Заброшенный разработчиками ролевой боевик Wolcen: Lords of Mayhem спустя семь лет получит продолжение — первый трейлер и детали Wolcen 2 2 ч.
Gemini Live перестал быть просто собеседником — теперь ИИ в Android умеет выполнять поручения 3 ч.
«Мы уже достигли AGI» — Дженсен Хуанг объявил главную цель разработчиков ИИ бессмысленной 3 ч.
В поисковой выдаче Google появилась ловушка для ИИ-ботов — ссылки спрятали за редиректом 4 ч.
Owlcat объявила дату релиза Shadow of the Road — пошаговой RPG в феодальной Японии, где смешались магия и стимпанк 4 ч.
Кинематографический боевик Spine в духе «Джона Уика» выйдет летом 2027 года: новый трейлер 4 ч.
OpenAI видела признаки выхода ИИ-агентов из-под контроля, но ничего не сделала 5 ч.
Google представила Gemini 3.5 Transcribe — ИИ превратит живую речь в готовый текст без слов-паразитов 5 ч.
«Нет даже плана для плана»: Билл Гейтс предупредил о неготовности мира к эпохе ИИ 7 ч.
В ЮАР испытали неубиваемую передачу данных лазером по воздуху — простую и перспективную 26 мин.
Китайские учёные сделали литиевые аккумуляторы в полтора раза ёмче — но вылезла проблема с ресурсом 3 ч.
Nvidia придумала более рациональную HBM — она быстрее обычной на 30 % и экономит до 15 % энергии 3 ч.
ИИ-бум добрался до NAND — Kioxia и Sandisk потратят $31 млрд на расширение производства 3 ч.
Представлена умная колонка «СберБум 2.0» с «ГигаЧатом» 3 ч.
Lenovo выпустила первую Android-консоль Legion с поддержкой трансляции игр с ПК 3 ч.
«Двухтонный ИИ-сервер не спрячешь», — уверял Хуанг. Но власти США нашли, как их незаметно перевозили в Китай 4 ч.
CXMT научилась производить LPDDR6 — Xiaomi уже подружила её с процессором Xring O3 4 ч.
Дженсен Хуанг не боится ИИ-пузыря — ускорители без дела не останутся, и вообще «риск очень мал» 4 ч.
Kraftway представляет линейку эргономичных мониторов KraftView с расширенными возможностями подключения 5 ч.