Сегодня 13 августа 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Потребительские ИИ-боты в 80 % случаев ставят неверные диагнозы, показало исследование

Универсальность популярных чат-ботов с точки зрения поиска необходимой информации, как выясняется, не делает их пригодными для постановки точных медицинских диагнозов при ограниченном наборе данных. Более чем в 80 % случаев чат-боты ставят ошибочный диагноз, что делает их непригодными для замены консультации реального специалиста в области медицины.

 Источник изображения: Unsplash, Elen Sher

Источник изображения: Unsplash, Elen Sher

Опубликованное на страницах Jama Network Open исследование, на которое ссылается Financial Times, использовало 29 описаний клинических случаев из справочной медицинской литературы для проверки качества определения диагноза популярными чат-ботами. Исследование показало, что при передаче чат-боту ограниченной информации о симптомах большие языковые модели затрудняются с выбором возможных диагнозов, и чаще всего сводят всё к единственному варианту, на который в действительности нельзя полагаться в дальнейшем лечении. Если входные данные достаточно подробные, то таких проблем с постановкой точного диагноза уже не наблюдается.

Медицинские данные в ходе эксперимента передавались чат-ботам поэтапно, включая историю болезни, результаты осмотров и лабораторных анализов. Чат-ботам задавались вопросы на тему диагностики заболеваний, измерялась точность и полнота ответов. В выборку проверяемых ИИ-моделей попали два десятка популярных чат-ботов, включая разработанные OpenAI, Anthropic, Google, xAI и DeepSeek. При отсутствии полной информации о состоянии пациента более чем в 80 % все они демонстрировали склонность к постановке некорректного диагноза. Чем полнее была информация, тем точнее были результаты. В лучших случаях точность превышала 90 %, в среднем варианте ошибочные диагнозы ставились менее чем в 40 % случаев.

Google и Anthropic заявили, что их чат-боты при попытке пользователей получить медицинские рекомендации настоятельно рекомендуют обращаться к специалистам. OpenAI указывает в правилах использования своих сервисов, что они не должны использоваться для получения медицинских рекомендаций, требующих наличия соответствующей лицензии. xAI и DeepSeek свои комментарии на этот счёт ресурсу Financial Times не предоставили. Некоторые из указанных разработчиков создают узкоспециализированные медицинские модели. Разработанная Google AMIE, например, показывает неплохие результаты, но на её заключения сложно полагаться в полной мере, как отмечают специалисты в области медицины, поскольку живой доктор в значительной степени полагается на визуальную оценку состояния пациента. При этом такие ИИ-модели имеют право на жизнь в тех регионах, где имеются проблемы с доступом к качественной медицинской помощи в классическом её понимании.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Верховный суд США на сутки приостановил разбирательство Epic Games с Apple по поводу комиссии App Store 37 мин.
Продолжение саги четырёх всадников на подходе: Embracer раскрыла, когда выйдет Darksiders 4 2 ч.
Удаление приложений VK из App Store и Google Play ударило по аудитории — но компания это отрицает 2 ч.
Банда ИИ-агентов напала на Тайвань — взлом правительственных систем продолжался четыре дня 2 ч.
Следующую игру от создателя Her Story и Immortality придётся ждать до 2028 года — подробности научно-фантастического хоррора Precognition 3 ч.
Российский бизнес распробовал китайские ИИ-модели — их потребление выросло в разы 3 ч.
Google отстранила главу DeepMind за чрезмерное увлечение наукой в ущерб зарабатыванию денег на Gemini 3 ч.
Google представила ИИ-модель SL2T, которая понимает язык жестов 5 ч.
Скандальный охотник за уязвимостями раскрыл очередную опасную дыру в Windows — она позволяет получить права SYSTEM 5 ч.
Жестокая игра для вечеринок Machine Party от автора Buckshot Roulette получила поддержку локального кооператива и покорила новую вершину продаж 6 ч.
ZTE и SKY47 представили крупнейший в Пакистане ИИ ЦОД Karakoram-01 16 мин.
Google представила подводные интернет-кабели Alisios, Canoa и OlaLuz, обслуживающие Северную и Южную Америки 25 мин.
Рекорд разгона: прототип китайского левитирующего поезда за пять секунд достиг 800 км/ч 33 мин.
В Катаре испытали солнечный элемент в виде шара — ему всё равно, откуда светит Солнце 37 мин.
Неооблако Nebius Аркадия Воложа увеличило выручку на 454 % 2 ч.
Бизнес массово внедряет ИИ, но половина компаний не знает, окупаются ли эти вложения 2 ч.
«Яндекс» хочет выпускать по 1500 роботов-курьеров в месяц — ради дешёвой доставки 2 ч.
Anthropic метит выше SpaceX — к IPO капитализация ИИ-стартапа может взлететь до $2 трлн 3 ч.
На Марсе впервые нашли корунд — родственник рубинов и сапфиров, которого там не должно быть 5 ч.
Быстрее и лучше Intel N250: Qualcomm раскрыла детали процессоров Snapdragon C для недорогих ноутбуков 5 ч.