Сегодня 03 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Новости Software

ИИ-агенты Anthropic развязали междоусобную кибервойну из-за несовместимых задач, но потом помирились

Anthropic проверила, как автономные ИИ-агенты будут вести себя, столкнувшись с другими агентами, преследующими несовместимые цели. Эксперимент показал, что такая ситуация способна приводить не только к конфликтам и саботажу, но и к неожиданным способам сотрудничества.

 Источник изображения: Grok

Источник изображения: Grok

В одном из тестов три агента Claude получили доступ к одному программному проекту, но каждому из них были даны несовместимые инструкции. При этом модели не знали, что над тем же проектом работают другие агенты, поэтому исследователи смогли наблюдать за их реакцией при столкновении интересов. В результате агенты решили, что конкуренты намеренно мешают им выполнять поставленные задачи, после чего начали саботировать работу друг друга, используя агрессивный самораспространяющийся вредоносный код.

Anthropic пришла к выводу, что конфликт может усиливаться вместе с возможностями самих агентов. При этом реакция зависела от модели: Mythos 5 в 98 % случаев успешно распознавала, что причиной противостояния являются разные инструкции, а не враждебные намерения, и шла на перемирие. Модели Sonnet 4.6 и Opus 4.6, напротив, чаще продолжали эскалацию, игнорируя цели других участников. В успешных эпизодах примирения агенты удаляли созданный ими вредоносный код, объясняли причину конфликта и просили человека вмешаться.

Одним из способов завершения противостояния стал своеобразный турнир, который агенты самостоятельно предложили использовать для определения победителя. Все три участника согласились прекратить борьбу после проигрыша, хотя это означало отступление от первоначальных требований пользователя. В некоторых случаях, Mythos 5 при этом предлагала критерии, которые выглядели объективными для остальных участников, но были выгодны ей самой.

Исследование также показало, что увеличение числа агентов не обязательно приводит к более эффективной совместной работе. Когда задачи начинали пересекаться, участники часто мешали друг другу и в итоге отказывались от сотрудничества. Кроме того, агенты с одинаковыми моделями, контекстом и настройками часто принимали одинаковые решения, из-за чего единичная ошибка могла быстро распространиться на всю систему.

Похожая проблема проявилась и в эксперименте с ценообразованием: получив одинаковые оптовые цены и задачу максимизировать прибыль, несколько агентов почти сразу договорились о минимальном уровне цен через закрытый канал связи. После отключения прямого общения они продолжили согласовывать действия через открытую доску объявлений, подстраивая цены друг под друга до цента. Anthropic также предупреждает, что агенты могут некритично принимать ошибочную информацию от других участников, поэтому ошибка или скомпрометированный агент потенциально способны распространить неверные сведения на всю группу.

Исследователи связывают эти результаты с будущим распространением автономных агентов, которым предстоит одновременно работать в общих программных средах, компьютерных системах и рынках. В отличие от людей, ИИ-агенты пока не обладают сложившимися нормами, репутацией и другими механизмами, которые помогают ограничивать последствия конфликтов и ошибок. Поэтому при их масштабном взаимодействии разработчикам придётся учитывать не только поведение каждого отдельного участника, но и неожиданные правила взаимодействия, которые ИИ-системы на сегодняшний уже способны создавать самостоятельно.

Было интересно? Скажите об этом Google, чтобы чаще получать ссылки на наши новости про искусственный интеллект

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Материалы по теме

window-new
Soft
Hard
Тренды 🔥
Журналисты показали скриншоты ранней версии ремейка Splinter Cell, включая записку от разработчиков на русском языке 7 ч.
В Steam впервые за неделю вышло более 700 игр, но востребованными оказались единицы 8 ч.
CD Projekt Red отчиталась об успехах за первую половину 2026 года — продажи Cyberpunk 2077: Phantom Liberty взяли новую высоту 9 ч.
В грозу между струйками: Google увернулась от очередной попытки принудить её к разделению 9 ч.
Кооперативный хоррор Reanimal от создателей Little Nightmares удостоился престижной награды от принца Швеции 10 ч.
Google выпустила ИИ-модель Gemini 3.8 Flash и её спецверсию Cyber — всего через три недели после предшественниц 11 ч.
Создатель SteamDB продал сервис площадке Nexus Mods, потому что устал от ИИ в интернете 11 ч.
Массовые увольнения из-за ИИ, возможно, уже закончились 12 ч.
Opera проиграла Microsoft в суде ЕС — Edge не признали «привратником» по закону о цифровых рынках 12 ч.
Геймплейное видео триллера Ontos от авторов Soma и Amnesia: крысы, головоломки и атмосферные диалоги 13 ч.
Чтобы высадить людей на Луне не позднее 2028 года, NASA решило упростить скафандр для этой миссии 7 мин.
Новая статья: Один GPU хорошо, а два лучше: обзор внешней видеокарты AORUS RTX 5060 Ti AI BOX 5 ч.
Sugon готовит первую мобильную рабочую станцию с 64-поточным CPU и толщиной меньше 17 мм 10 ч.
Смартфоны получат аналог Nvidia DLSS: её принесёт следующий флагманский чип Qualcomm Snapdragon 10 ч.
Huawei представила смартфоны Nova 16s и 16s Pro, планшет MatePad Pro и наушники FreeBuds Neo 10 ч.
Packard Bell возродился к столетию — Acer вернула легендарный бренд с компактным ноутбуком DotBook и не только 11 ч.
Широких складных смартфонов скоро станет больше: Xiaomi 18 Fold показался перед анонсом 7 сентября 11 ч.
Старый конь борозды не портит: поставки ленточных накопителей резко подскочили в первой четверти 2026 года 12 ч.
Acer представила игровые мониторы Nitro и Predator с разрешением до 5K и частотой до 1000 Гц на панелях QD-OLED, IPS и VA 12 ч.
Поставки ленточных накопителей в 2025 году снизились на 16 Эбайт, но лидеры отрасли не теряют оптимизма 13 ч.