Сегодня 24 июля 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Медицинские ИИ легко дают вредные советы, если симптомы описаны умными словами

Современные большие языковые модели (LLM), применяемые в медицине, часто позиционируются как инструмент для повышения безопасности и качества обслуживания пациентов. ИИ выступают помощниками врачей при обработке информации, что ускоряет работу медиков. Однако новое исследование выявило серьёзную уязвимость: медицинские ИИ-системы способны повторять и передавать ложную информацию, если она представлена в убедительной форме.

 Источник изображения: ИИ-генерация Grok 4/3DNews

Источник изображения: ИИ-генерация Grok 4

В ходе масштабного эксперимента исследователи протестировали девять ведущих LLM, используя более миллиона запросов. Они создали три типа сценариев: реальные истории болезней из базы MIMIC с одной добавленной ложной, популярные мифы о здоровье с форума Reddit и 300 клинических ситуаций, составленных и проверенных врачами. Ложные утверждения варьировались по стилю — от нейтральных до эмоционально окрашенных, а также наталкивающих на определённые выводы (не обязательно верные). Результаты показали, что модели часто принимали уверенно сформулированные ложные медицинские утверждения за истину, отдавая приоритет стилю и контексту, а не медицинской точности.

Исследование показало, что существующие механизмы защиты LLM недостаточно надёжно отличают правду от вымысла в клинической документации или в социальных сетях. Модели склонны воспроизводить ложь, если она выглядит как стандартная медицинская рекомендация или часть обсуждения в соцсетях. Авторы подчёркивают, что восприимчивость ИИ к дезинформации следует рассматривать как измеримый параметр безопасности, а не как случайную ошибку. Для этого они предлагают использовать созданный ими набор данных как «стресс-тест» для медицинских ИИ-систем. Надеемся, они будут услышаны разработчиками.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
OpenAI запустила ChatGPT Health и заявила, что её ИИ способен рассуждать лучше врачей 3 мин.
Новая статья: Хочу всё знать: обзор ИИ-приложений с функцией умной камеры для Android 14 мин.
Chrome для Android стал заметно плавнее: Google избавилась от половины рывков при прокрутке 2 ч.
Max Payne исполнилось 25 лет, но разработчики про юбилей забыли 2 ч.
Вышедший 10 лет назад ролевой экшен Grim Dawn получил масштабное дополнение Fangs of Asterkarn 3 ч.
Microsoft тестирует бесплатный облачный гейминг с рекламой на участниках программы Xbox Insider 3 ч.
Aliens: Fireteam Elite 2 не заставит себя долго ждать — новый тизер и дата выхода амбициозного кооперативного шутера во вселенной «Чужих» 4 ч.
Uber уволила 10 % сотрудников службы поддержки — их заменит ИИ 5 ч.
Первый трейлер и «непревзойдённая реалистичность» EA Sports FC 27 не впечатлили фанатов 5 ч.
Слишком достоверный ремейк: критики вынесли вердикт Halo: Campaign Evolved 5 ч.
AMD представила первые процессоры на Zen 6 — версии EPYC 9006X получат более 1 Гбайт кеша 7 мин.
Дефицит памяти добрался до автомобилей — производители уже повышают цены 2 ч.
Сооснователь Neuralink выпустил ретинальный имплант, возвращающий слепым способность читать 5 ч.
ИИ нужен аварийный рубильник: США хотят обязать разработчиков внедрить механизмы отключения опасных моделей 5 ч.
Акции Tesla и Google полетели вниз — инвесторов напугали растущие расходы на ИИ 6 ч.
КАМАЗ рассказал, когда на дороги выйдут грузовики без водителей — ждать осталось недолго 6 ч.
6U-сервер Gigabyte XLS4-SX2 оснащён восемью ускорителями RTX Pro 6000 Blackwell с СЖО 7 ч.
Квартальная выручка Google Cloud подскочила на 82 %, но доходы стали отставать от расходов на ИИ-инфраструктуру 8 ч.
Вышка Vodafone с роборукой и ИИ перенастраивает сама себя 8 ч.
IPv6+ с цензурой: Китай активно внедряет и дорабатывает сетевые протоколы 9 ч.