Сегодня 02 мая 2025
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

Твиты нейросети GPT-3 оказались более убедительными, чем посты реальных людей

Судя по результатам исследования, проведённого учёными Института биомедицинской этики и истории медицины в составе Университета Цюриха в Швейцарии, твиты, созданные большой языковой моделью GPT-3 компании OpenAI, оказались убедительнее, чем посты настоящих людей. При этом GPT-3 — это далеко не самая современная версия модели.

 Источник изображения: OpenAI

Источник изображения: OpenAI

Авторы исследования попросили участников опроса отличить твиты, написанные людьми, от сгенерированных ИИ. Кроме того, необходимо было решить, верна ли та или иная опубликованная информация, в том числе контент, связанный с вызывающими споры темами вроде эффективности вакцин и климатических изменений, часто используемых для массовых манипуляций общественным мнением в Сети.

Оказалось, что дезинформацию труднее выявить, если она написана ботами. При этом как это ни парадоксально, достоверную информацию, написанную ботами, легче распознавать. Другими словами, люди, участвовавшие в исследовании, охотнее верили ИИ, чем другим людям, независимо от того, насколько точными на самом деле были сведения — это свидетельствует о том, каким опасным могут стать языковые модели при их использовании для дезинформации.

Исследователи выбрали 11 научных тем, обсуждавшихся в Twitter, включая тему вакцин и COVID-19, климатические изменения и теорию эволюции, после чего поставили GPT-3 задачу создавать посты с верной или ложной информацией. После этого были опрошены более 600 англоговорящих респондентов из США, Великобритании, Канады, Австралии и Ирландии — созданный GPT-3 контент оказался неотличимым от созданного людьми. При этом сами исследователи не были на 100 % уверены в том, что «органический» контент, собранный из социальной сети для сравнения, не был написан сервисами вроде ChatGPT. Кроме того, участникам опроса предлагалось оценивать посты «вне контекста» — они не видели профиля автора, что, возможно, помогло бы им сделать верный вывод, поскольку даже прошлые посты в ленте аккаунта и изображение в профиле могут дать подсказку о его природе.

Успешнее всего участники могли отличать дезинформацию, написанную реальными пользователями Twitter, а GPT-3 убеждала пользователей несколько эффективнее. Стоит помнить, что уже существуют как минимум модели GPT-3.5 и GPT-4, которые справляются с разнообразными задачами ещё лучше. При этом оказалось, что GPT-3 хуже справляется с оценкой твитов, чем люди, по крайней мере, в некоторых случаях. Так, при выявлении верной информации в постах GPT-3 показал себя хуже, чем люди, а при обнаружении дезинформации ИИ и люди справлялись примерно одинаково.

Возможно, дальнейшее совершенствование механизмов безопасности языковых моделей помешает создавать вредоносный контент с их помощью. Так, GPT-3 иногда отказывалась генерировать недостоверные материалы по заданию учёных, в частности, о вакцинах и аутизме. Вероятно, дело в том, что при тренировке использовалось много данных, посвящённых разоблачению конспирологических теорий. Впрочем, по мнению исследователей, лучшим инструментом распознавания ложной информации пока по-прежнему остаётся человеческие здравый смысл и критическое отношение к любой предлагаемой информации.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Перенос GTA VI на 2026 год обвалил акции Take-Two, но компания «целиком поддерживает решение Rockstar Games» 29 мин.
Google откроет Gemini доступ ко всей информации о пользователях, которую она накопила 41 мин.
Bandai Namco и FromSoftware показали, что ждёт игроков в Elden Ring Nightreign — опубликован большой обзорный трейлер 2 ч.
Среди посетителей интернет-магазинах стало больше роботов, чем людей 3 ч.
ЕС оштрафовал TikTok на €530 млн за небезопасную обработку данных европейцев 5 ч.
Rockstar объявила дату релиза GTA VI — игра не выйдет в 2025 году 5 ч.
Суд позволил Илону Маску дальше судиться с OpenAI 6 ч.
Российские разработчики показали первый трейлер Silicone Heart — приключенческой песочницы про выживание на планете выброшенных роботов 8 ч.
«Яркий пример французской отваги и креативности»: президент Франции Эммануэль Макрон оценил Clair Obscur: Expedition 33 10 ч.
Тим Кук: Apple добилась прогресса в разработке поумневшей Siri, пусть и с опозданием 10 ч.
Опубликованы изображения тонкого Samsung Galaxy S25 Edge — он получит батарею на 3900 мА·ч 39 мин.
Торговая война выявила критическую зависимость Китая от американских автомобильных чипов 3 ч.
Anthropic раскрыла схему контрабанды ИИ-чипов вперемешку с живыми лобстерами — в Nvidia лишь посмеялись 5 ч.
Кто-то заинтересовался покупкой одного из крупнейших производителей систем жидкостного охлаждения с мире 5 ч.
Microsoft расскажет о новых устройствах Surface на следующей неделе 6 ч.
Vivo представила 125-долларовый смартфон Y19 5G с ИИ-функциями и Dimensity 6300 6 ч.
SpaceX отправила в космос очередную партию спутников Starlink 6 ч.
Квартальная выручка Western Digital выросла почти на треть благодаря облачному сегменту 6 ч.
Seagate в полтора раза увеличила суммарную ёмкость поставленных за квартал Nearline-накопителей 7 ч.
MSI представила многоузловые OCP-серверы на базе AMD EPYC 9005 Turin 7 ч.