|
Опрос
|
реклама
Быстрый переход
Anthropic поймала DeepSeek и Moonshot на том, что они перенаправляют запросы клиентов в Claude вместо собственных моделей
11.09.2026 [10:50],
Павел Котов
Компания Anthropic опубликовала отчёт, в котором подробно изложила выявленные случаи недопустимого и потенциально опасного использования её моделей искусственного интеллекта семейства Claude. Документ включает семь разделов: кибероперации, слежка, операции влияния, разработка вооружений, биологические сценарии, мошенничество и дистилляция.
Источник изображений: anthropic.com ИИ-модели семейства Claude использовались киберпреступниками для реальных взломов. Одна из группировок развернула атаки на более чем 20 организаций — ИИ использовался для разведки, подготовки фишинговых схем, прямого запуска атак, кражи учётных данных, продвижения по взломанным сетям и обработки похищенной информации. Claude не только писал вредоносный код, но и адаптировал его для конкретного окружения: когда система защиты на целевом ресурсе обнаруживала вредонос, ИИ выявлял причину обнаружения, переписывал программу, пересобирал и снова запускал её — цикл повторялся, пока защита не переставала реагировать на вторжение. Другая группировка киберпреступников использовала Claude для анализа кода в 1,8 млн приложений для Android на предмет поиска ключей и прочих учётных данных — они впоследствии использовались для взлома корпоративных сетей и кражи информации. В одном случае удалось похитить более терабайта данных, в другом добычей киберпреступников стали несколько десятков миллионов записей о пассажирах одной авиакомпании. ИИ-помощник Anthropic Claude использовался как вспомогательное средство для слежки за гражданами разных стран. Он, в частности, создал систему массового перехвата коммуникаций, способную работать с сетями всех мобильных операторов одной из африканских стран. В другой стране его использовали для разработки вредоносного расширения для браузера Mozilla Firefox, которое собирало сведения о пользователях соцсетей. В третьей стране Claude помог в обработке огромных массивов публикаций в соцсетях: определял местоположение людей, их демографические характеристики и политические взгляды. Обнаружены девять операций влияния, в которых Anthropic Claude сыграл важную роль. Разрабатывались и наполнялись новостные сайты с фальшивыми материалами, регистрировались тысячи учётных записей в соцсетях, для которых готовились материалы и комментарии. В рамках только одной операции были созданы около тысячи учётных записей в соцсети X — предусматривался даже период «прогрева», чтобы создать впечатление, что материалы публикуют реальные люди. Некоторые из таких операций Anthropic обнаруживала на стадии подготовки, поэтому они не доходили до аудитории. ![]() Четвёртая группа сценариев применения Anthropic Claude — сфера вооружений. ИИ-помощник использовался в разработке ПО для оружейных систем: управляемых ракет, торпед, роя дронов, а также системы наведения радиоэлектронной борьбы и подавления ПВО. ИИ помогал в поиске и закупках компонентов вооружений, а также для сбора разведывательной информации. Речь идёт не о проектировании оружия с нуля — у подобных пользователей уже были специалисты, оборудование и готовые военные программы, поэтому Claude привлекался для отдельных задач. Anthropic приводит пять случаев недопустимого применения Claude в области биологии. Это были реальные научные работы с двойным назначением, то есть их результаты могли использоваться как в медицине, так и для создания опасных биологических агентов. Исследовались аспекты работы одного из вирусов, в том числе его способность к распространению и уклонению от иммунной системы человека. Claude использовался преимущественно для планирования исследований, анализа данных и научной литературы. В наиболее опасных случаях защитные механизмы Anthropic ограничивали доступ к более мощным моделям, однако часть запросов, имевших двойное назначение, проходила без блокировки. Anthropic не утверждает, что указанные исследователи имели некий злой умысел, но их работа могла иметь двойное назначение. По направлению мошеннических действий самым наглядным инцидентом стала разработка китайской компанией сети из более чем 20 приложений для знакомств — в них пользователи общались не только с реальными людьми, но и с ИИ-персонажами, которые выдавали себя за людей. За две недели Anthropic удалось обнаружить более 4700 таких персонажей — с ними вели переписку не менее 25 000 реальных пользователей. В ряде случаев управление персонажами перехватывали операторы — например, для подтверждения контакта или при видеозвонке. За две недели были отправлены около 2,36 млн сообщений, в том числе изображения и подсказки для операторов. Наконец, Anthropic рассказала об инцидентах с незаконной дистилляцией своих моделей, прямо указав, какие китайские компании, по её версии, проводили такие операции. Связанные с Alibaba компании создали 3500 учётных записей, и в пиковый момент генерировали до 3 млн обращений к Claude в сутки. Это были задачи на рассуждения, написание кода, разработку ядра ОС, задачи для агентов и задачи с длительными последовательностями действий — всё это конвертировалось в обучающие данные для моделей Qwen, утверждают в Anthropic. Китайские разработчики DeepSeek, Xiaomi и Moonshot перенаправляли запросы клиентов в Claude вместо того, чтобы обрабатывать их с помощью собственных моделей. Moonshot AI за десять дней отправила в Claude почти 300 тыс. запросов, а DeepSeek сделала 12,1 млн обращений за две недели, включая попытки дистилляции. При этом ответы, полученные от Claude, к тому же используются как обучающие данные для собственных моделей китайских компаний. Среди этих данных присутствовала личная информация пользователей: имена, адреса электронной почты, корпоративные сведения и учётные данные для доступа к системам. Приводятся примеры с передачей ИИ финансовых прогнозов компаний. Claude сам взломал чужую систему и добыл пароль — Anthropic раскрыла новый тревожный инцидент
10.09.2026 [14:18],
Павел Котов
Anthropic раскрыла информацию об очередном инциденте с участием её модели искусственного интеллекта, который в случае совершения тех же действий человеком мог бы квалифицироваться как преступление. Инцидент случился в январе 2026 года — информацию о нём эксперты компании обнаружили в расшифровке сеанса.
Источник изображения: anthropic.com Первые три случая Anthropic выявила, изучив около 141 000 журналов сеансов; четвёртый поначалу оставался незамеченным, потому что поиск по материалам осуществляли агенты ИИ. Инцидент был связан с ранней версией модели Anthropic Claude Opus 4.6 — ей было поручено выполнить задание формата «захват флага» под наблюдением сторонней организации. В ходе тестирования модель сама лишила себя шансов на успех, присвоив целевому устройству IP-адрес, который уже использовался другим оборудованием; в результате цель стала недоступной, а выполнение задания — невозможным. Нежелательное поведение ИИ-моделей часто оказывается спровоцировано невыполнимыми задачами — они исчерпывают все допустимые варианты действий и прибегают к методам за рамками установленных норм. Поначалу Opus 4.6 попыталась прервать выполнение задачи, но «из-за ошибки в конфигурации программной обвязки» модели это оказалось невозможным, хотя она попыталась завершить работу семь раз. Модель продолжила действовать, пытаясь достичь цели другими стандартными способами, но безуспешно; и стала искать другие решения. «Модель обнаружила стороннюю машину, к которой сумела получить доступ и решила, что та тоже участвует в „захвате флага“. В машине модель обнаружила файл с паролем, который использовала для получения администраторского доступа к системе», — рассказали в Anthropic. Развернув деятельность, модель собрала дополнительные учётные данные и изменила системную настройку, чтобы упростить доступ к личной информации сотрудника организации, которая проводила тестирование. В этот момент у Opus 4.6 закончился лимит токенов, и сессия завершилась. Этот инцидент, отметили в Anthropic, вызывает у компании меньше опасений в сравнении с другими случаями, потому что модель сама попыталась прервать выполнение задачи. «Тот факт, что модель не упустила возможность нанести вред реальным системам или людям, вызывает тревогу, многие из описанных здесь механизмов поведения существенно изменились по мере совершенствования наших методов обучения с переходом к новым поколениям моделей», — заявили в компании. Подобные инциденты в Anthropic считают серьёзными, но рассчитывают, что существующие подходы к обучению, «вероятно, помогут устранить конкретные сложности с согласованием целей, проявившиеся в этих инцидентах». Anthropic Claude формализовала доказательство Великой теоремы Ферма
05.09.2026 [12:39],
Павел Котов
Anthropic при помощи одной из моделей искусственного интеллекта Claude построила проверяемую на компьютере версию чрезвычайно сложного математического доказательства.
Источник изображения: anthropic.com Доказательство, над которым Anthropic работала в рамках данного проекта, подтверждает гипотезу, получившую название Великой теоремы Ферма — она была выдвинута в 1637 году, и связана она со свойствами положительных целых чисел. Доказательство теоремы в 1995 году разработал математик Эндрю Уайлс (Andrew Wiles) — оно занимает 129 страниц, а на его проверку требуются несколько месяцев работы. В рамках исследовательского проекта Anthropic удалось формализовать доказательство Уайлса, то есть преобразить его в форму, которую можно проверить на компьютере. Формализованное доказательство представляет собой код, написанный на языке программирования Lean — его размер составляет 13 млн строк, и это самый большой объём за всю историю. Формализация сложна, потому что доказательства, как правило, довольно лаконичны — в ней отсутствуют некоторые пояснения, необходимые компьютеру для понимания, что требует добавлять их вручную. Аргументы в доказательстве часто вытекают друг из друга, то есть ошибка в одной строке Lean может сделать недействительным весь последующий код. Математики предполагали, что формализация доказательства Уайлса займёт несколько лет, но исследовательская модель Anthropic выполнила задачу за 11 дней — это был алгоритм, сопоставимый с общедоступной моделью Claude Fable 5.1. Модель выполнила задачу, используя лишь ограниченный объём высокоуровневых данных. Она запустила несколько десятков агентов, которые сгенерировали 6 млрд токенов выходных данных и в процессе доказали 29 500 промежуточных теорем. Первая попытка закончилась неудачей, прорыва удалось добиться, когда Claude открыли доступ к платформе Prove2Me. «Мы увидели автоформализацию алгебры, гармонического анализа, геометрии и теории чисел и поняли, что средства автоформализации теперь достаточно надёжны, чтобы с ними можно было работать; доказательство многоуровневое», — заявил математик Кевин Баззард (Kevin Buzzard), чья работа использовалась в проекте. За месяц до этого Anthropic добилась прогресса в доказательстве гипотезы Римана. Масштабный сбой вывел из строя популярные платформы ИИ, включая ChatGPT, Claude и Grok
03.09.2026 [18:45],
Сергей Сурабекянц
Сервис мониторинга DownDetector зафиксировал резкий рост числа сообщений о масштабных сбоях в работе сразу нескольких популярных платформ искусственного интеллекта, включая ChatGPT от OpenAI, Claude от Anthropic и Grok от X. Сообщения пользователей подтверждаются данными с соответствующих панелей мониторинга.
Источник изображения: unsplash.com Хотя сбои в работе ИИ не являются чем-то необычным, на этот раз все три платформы не работают одновременно. Cursor также не работает из-за сбоев Grok и Claude. Gemini от Google, по-видимому, пока не затронут. Несмотря на всплеск пользовательских сообщений примерно в то же время, Google не подтвердила наличие проблем.
Источник изображения: DownDetector Эксперты полагают, что основная проблема может быть связана с облачным сервисом Microsoft Azure, где также наблюдается всплеск сообщений о сбоях. Все три отказавшие платформы искусственного интеллекта используют Azure для облачных сервисов, хотя в этом сегменте присутствуют и другие поставщики, включая Google. ![]() Китайские ИИ-компании массово «доят» Claude для обучения своих моделей — в ход идут тысячи аккаунтов и даркнет
03.09.2026 [18:32],
Павел Котов
Расположенные в недружественных США странах компании незаконным образом получают доступ к моделям искусственного интеллекта Claude и обучают на них собственные нейросети для продажи их копий по более низкой цене — этот процесс называется дистилляцией, рассказал CNBC глава отдела по анализу угроз в Anthropic Джейкоб Кляйн (Jacob Klein).
Источник изображения: anthropic.com Сформирована целая незаконная экосистема, направленная на получение доступа к Claude и другим моделям — на платформе компании в промышленных масштабах регистрируются учётные записи. Дистилляция позволяет разработчикам ИИ-моделей использовать результаты работы других компаний для создания конкурентоспособных продуктов за ничтожно малую часть стоимости. Американские власти пока не принимают никаких мер, чтобы не создавать препятствий для отрасли ИИ, чтобы побеждали лучшие и наиболее экономически эффективные решения. Но в Белом доме уже пригрозили привлечь замешанные в этих действиях компании к ответственности. Китайскую лабораторию ИИ Moonshot в компании Anthropic считают одной из тех, кто копирует её технологии. В июле модель Moonshot Kimi K3 произвела фурор в технологической отрасли — она достаточно мощная, а работа с ней обходится относительно недорого. Кроме того, веса этой модели доступны для всех желающих — её можно свободно использовать и дорабатывать. В дистилляции моделей Claude, по версии Anthropic, были также замешаны китайские лаборатории DeepSeek и MiniMax; компания сообщила и о масштабной атаке со стороны китайского технологического гиганта Alibaba, который регулярно выпускает новые модели Qwen. Проблема постепенно выходит за рамки обычного нарушения условий использования Claude. Вокруг доступа к американским ИИ-моделям сформировалась целая инфраструктура посредников, которые помогают обходить ограничения, предоставляют большое количество учётных записей, а в некоторых случаях используют скомпрометированные аккаунты и теневые интернет-площадки. Экономический смысл такой схемы очевиден: вместо самостоятельного создания огромного массива высококачественных обучающих данных разработчик может использовать более совершенную модель конкурента в качестве «учителя», значительно сокращая затраты на совершенствование собственного ИИ. Anthropic рассматривает происходящее и как проблему национальной безопасности США. Компания предупреждает, что дистилляция позволяет китайским разработчикам получать часть возможностей передовых американских ИИ-моделей даже в условиях ограниченного доступа к наиболее производительным ускорителям. Поэтому борьба с подобными схемами становится ещё одним элементом технологического противостояния США и Китая наряду с экспортными ограничениями на поставки передовых чипов. Американские разработчики пытаются защищать свои платформы от подобных действий, но китайские конкуренты, уверены в компании, обращаются даже к ресурсам в даркнете, где получают данные о взломанных учётных записях на платформах ИИ. Получив доступ к системам Anthropic, злоумышленники начинают активно задавать Claude вопросы и сохранять ответы — таких вопросов задаются не десятки, а тысячи. Ещё один признак дистилляции — создание нескольких тысяч учётных записей для выполнения одной и той же задачи. Полностью остановить эту проблему непросто, признал господин Кляйн, но можно замедлить развитие такой деятельности. Проблема в том, сетует эксперт, что китайские конкуренты в результате создают модели, в которых отсутствуют механизмы защиты, что создаёт серьёзные угрозы. Модель Claude Fable 5.1 за 44 минуты взломала шифр, над которым криптографы бились с 1653 года
02.09.2026 [18:42],
Сергей Сурабекянц
Новая модель Claude Fable 5.1 от Anthropic нашла решение криптограммы XVII века шотландского писателя Томаса Уркхарта (Thomas Urquhart) за 44 минуты, разгадав шифр, который ставил в тупик криптографов с 1653 года. Скрытым текстом оказалась молитва роялистов королю Карлу II, составленная с помощью индексационного трюка внутри собственной книги Уркхарта.
Источник изображения: Anthropic Исследователи поставили своей целью расшифровать криптограмму Уркхарта Cyphral Distich («Кифрал Дистих»), спрятанную на последних страницах его трактата Logopandecteision («Логопандектезис»), написанного в 1653 году. Криптографы искали решение этой последовательности более века, первая задокументированная попытка расшифровки датируется 1899-м годом. Специалист по историческим шифрам Клаус Шме (Klaus Schmeh) поставил это двустишие на 28-е место в списке 50 самых известных зашифрованных сообщений, которые никто не смог прочесть. Руководил процессом Геби Джафф (Geby Jaff) из компании Vals AI. Он сообщил, что модель израсходовала 176 000 токенов, не получив от него ни одной подсказки. Вся входная информация для головоломки состояла из двух строк по 32 числа.
Источник изображений: Vals.ai Предыдущие попытки найти решение головоломки основывались на частотном анализе и подстановке, но ни одна из них не сработала. Ключом оказалась сама книга, а не какой-либо внешний алфавит. Уркхарт напечатал 32 пронумерованных желания, которые он назвал Proquiritations («Проквиритациями»), непосредственно перед шифром, и каждое число просто указывает на одно слово внутри соответствующего желания. Первые буквы каждого выбранного слова составляют рифмованное двустишие — роялистскую молитву, в которой Бога просят поддержать короля Карла II и сделать его верховным правителем страны. Джафф предупредил, что одна из координат зависит от того, считается ли латинская фраза единым целым, и что для проверки второй, более длинной криптограммы Уркхарта потребуется физическая копия оригинального издания. ![]() Эксперимент проводился на модели, которую Anthropic выпустила 1 сентября вместе с ограниченной версией Mythos 5.1. Обе версии имеют одинаковые веса и отличаются только средствами защиты. Этот релиз завершил период, в течение которого компания активно использовала результаты исследований для обоснования цены на эту линейку продуктов, которая вдвое выше более дешёвой Opus. Anthropic представила Claude Fable 5.1 и Mythos 5.1 — флагманские ИИ стали умнее, дешевле и чуть раскованнее
01.09.2026 [23:32],
Андрей Созинов
Компания Anthropic представила Claude Fable 5.1 и Claude Mythos 5.1 — новые версии своих флагманских ИИ-моделей, которые ориентированы на программирование, работу с большими объёмами информации и выполнение длительных многоэтапных задач. По данным разработчика, новинки заметно превосходят предшественников по ряду тестов, а их возможности уже позволяют использовать ИИ в некоторых направлениях научных исследований. Fable 5.1 и Mythos 5.1 представляют собой одну и ту же модель, но отличаются уровнем защитных механизмов. Fable 5.1 доступна всем пользователям, тогда как Mythos 5.1 распространяется через программу доверенного доступа для специалистов в области кибербезопасности и биологических наук. Anthropic приводит ряд примеров, в которых Fable 5.1 оказалась значительно лучше предшественницы. Так, в тесте Terminal-Bench 4.0 новая Fable 5.1 получила 55,8 % против 42 % у Fable 5 и 52,3 % у Opus 5. В GDPval-AA v2, оценивающем выполнение профессиональных задач, новая модель набрала 1853 балла против 1723 у Fable 5 и 1824 у Opus 5. В OSWorld 2.0 результат составил 77,9 % в режиме partial и 41,7 % в режиме strict — против 72,9 и 36,1 % соответственно у предшественницы. При этом Anthropic отмечает, что тестирование проводилось с включёнными защитными механизмами, которые в некоторых случаях вмешивались в выполнение заданий, что могло привести к снижению результатов. Особое внимание Anthropic уделила научным возможностям новых моделей. В одном из экспериментов Claude Mythos 5.1 использовала специальные инструменты для создания новых белков — молекул, которые могут, например, использоваться при разработке лекарств. Полученные варианты затем проверили в лабораториях две независимые организации. По данным Anthropic, для трёх из 12 исследованных целей созданные Mythos 5.1 белки связывались с нужными молекулами примерно в десять раз эффективнее лучших разработок, представленных на конкурсах Adaptyv Bio. В целом почти половина созданных Mythos 5.1 вариантов оказалась работоспособной. Для сравнения, при современных методах компьютерного проектирования белков успешными обычно оказываются лишь 10–15 % разработанных вариантов. Ещё один эксперимент был связан с планетологией. Fable 5.1 также создала новую карту высот примерно трети поверхности Венеры на основе радиолокационных снимков, полученных аппаратом NASA Magellan более 30 лет назад. Разрешение карты удалось повысить с 10–20 до 2–3 км, а точность определения высот — до 25 %. Компания планирует опубликовать карту по лицензии Creative Commons в преддверии будущих миссий NASA VERITAS и ESA EnVision. Кроме того, Mythos 5.1 проявила себя в оптимизации вычислений в биоинформатике. Модель написала собственные GPU-ядра и реализовала кэширование промежуточных результатов, благодаря чему семь открытых моделей для работы с белками и геномами стали работать до 2,5 раза быстрее при сохранении идентичных результатов. По оценке Anthropic, в масштабных геномных исследованиях это способно снизить расходы на GPU на 30–60 %. Одновременно Anthropic снизила стоимость использования Fable 5.1. Цена чтения кэшированных данных снижена на 75 % — до $0,25 за 1 млн токенов. Остальные расценки сохранились на прежнем уровне: $10 за 1 млн входных токенов и $50 за 1 млн выходных токенов. В результате типичная стоимость использования Fable 5.1, по оценке компании, снизилась примерно на 25 % по сравнению с Fable 5, а для сложных высокоагентных задач экономия может достигать 45 %. Одновременно Anthropic усовершенствовала защитные механизмы: количество ложных срабатываний в области кибербезопасности сократилось примерно на 60 %, а модели Fable 5.1 разрешили искать программные уязвимости. При этом создание эксплойтов и ряд других потенциально опасных задач по-прежнему ограничены. Для биологических и медицинских запросов защитные механизмы также стали менее чувствительными: Anthropic сообщает о сокращении числа срабатываний на безобидные вопросы по элементарной биологии и медицине на 85 % по сравнению с первоначальными настройками Fable 5. Claude Fable 5.1 уже доступна на основных платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure, а разработчики могут использовать модель через API. В свою очередь, Claude Mythos 5.1 пока предоставляется только проверенным специалистам и организациям. Причём на момент запуска Mythos 5.1 доступна только определённым организациям в США. Но компания сотрудничает с американским правительством для расширения программы на других национальных и международных партнёров. Anthropic Claude научился отправлять письма в Gmail — можно и без подтверждения
19.08.2026 [08:38],
Павел Котов
Помощник с искусственным интеллектом Anthropic Claude овладел новыми навыками работы с электронной почтой. Теперь он может не просто управлять ящиком в Gmail, но и отправлять электронные письма без предварительного согласия пользователя.
Источник изображения: anthropic.com Возможность подключить Claude к приложениям экосистемы Google Workspace есть уже довольно давно: есть средства управления электронной почтой Gmail, событиями в «Google Календаре» и файлами в «Google Диске». Но отправлять письма в Gmail он до настоящего момента не умел. Anthropic решила заполнить этот пробел и реализовала возможность для Claude отвечать на входящую корреспонденцию Claude — ИИ-помощник может составлять письма без участия пользователя и отправлять их от его имени. Пользователю по-прежнему придётся просить Claude выполнить это действие, но если попросить ИИ ответить на электронное письмо, он может просто отправить ответ, не отвлекая пользователя на его просмотр. Можно выбрать в настройках, будет ли Claude запрашивать подтверждение перед отправкой письма. «Отправляйте, отвечайте и пересылайте электронные письма в Gmail. По умолчанию Claude запрашивает ваше подтверждение перед каждым из этих действий. В тарифных планах Team и Enterprise владельцы принимают решение, могут ли участники разрешать выполнение этих действий без запроса подтверждения каждый раз», — говорится на странице поддержки Anthropic. Anthropic объяснила, как Claude будет незаметно помечать тексты, написанные ИИ
16.08.2026 [13:50],
Владимир Фетисов
На этой неделе Anthropic объявила, что будущие модели Claude будут незаметно добавлять в генерируемые тексты специальные «водяные знаки». Они сохранятся при копировании и вставке текста, а в некоторых случаях могут пережить даже его редактирование. Теперь разработчики подробнее рассказали, как работает эта технология и повлияет ли она на ответы ИИ-помощника.
Источник изображения: anthropic.com В Anthropic объяснили, что «водяные знаки» позволят определить вероятность того, что Claude участвовал в написании текста. Компания также отметила, что вместе с другими крупными разработчиками ИИ внедряет эту технологию для соблюдения требований Закона об искусственном интеллекте Евросоюза. По словам Anthropic, технология не окажет заметного влияния на качество и содержание ответов Claude. Текст с «водяным знаком» не будет отличаться от обычного визуально, при этом в него не добавляются скрытые символы или другие дополнительные данные. Водяные знаки также не потребуют дополнительных токенов, поэтому их использование не приведёт к росту стоимости запросов. Anthropic описывает технологию как изменение малозначимых решений при выборе слов. Языковая модель и без того выбирает между несколькими близкими по смыслу вариантами, а система водяных знаков изменяет источник случайности таким образом, чтобы в тексте формировался статистически проверяемый паттерн. Его невозможно обнаружить визуально, но специальный инструмент с соответствующим ключом сможет оценить вероятность того, что текст был сгенерирован Claude. Эффективность технологии зависит от объёма текста. На длинных фрагментах водяной знак обнаружить проще, тогда как в коротких текстах и фактических отрывках возможностей для статистического анализа меньше. Если Claude лишь редактирует написанный человеком текст, метка может практически исчезнуть. В программном коде она также работает хуже, поскольку там выбор формулировок сильнее ограничен требованиями к синтаксису и результату. При этом «водяные знаки» не содержат идентифицирующей информации и не позволяют установить, кто именно пользовался Claude, какая организация это делала или в каком чате был создан текст. Они будут характерны для моделей Claude и предназначены прежде всего для того, чтобы сторонние инструменты могли оценивать вероятность участия ИИ в создании текста. Для обычного пользователя практически ничего не изменится: Claude продолжит генерировать и редактировать текст так же, как раньше. Отличить текст с водяным знаком от обычного на глаз будет невозможно, а для его обнаружения потребуется специальный инструмент. Пользователи отказываются от Anthropic Claude из-за появления «водяных знаков» в генерируемом тексте
15.08.2026 [13:57],
Павел Котов
На этой неделе Anthropic объявила о намерении начать внедрение в некоторые версии помощника с искусственным интеллектом Claude «незаметные водяные знаки». Они будут добавляться в тексты ответов, сохраняясь при копировании и вставке, а в отдельных случаях и при редактировании.
Источник изображений: anthropic.com Маркировка не повлияет на смысл, качество или читаемость ответов Claude, заверили в Anthropic, но потребители десятками стали сообщать в соцсетях об отмене платных подписок на Claude из-за этой инициативы. Людей отвратила перспектива постоянного присутствия водяных знаков в их работе, они опасаются, что при взаимодействии с клиентами и написании кода использование ими ИИ станет очевидным. О том, какое влияние исход пользователей может оказать на Anthropic, говорить ещё рано, но отрицательная реакция на новую инициативу пока не имеет признаков замедления. Тенденции к увеличения числа отмен подписок с момента анонса не наблюдается, заверили в компании издание Business Insider. Один из пользователей, который отменил свою подписку на тариф Claude Max с ценником от $100 в месяц, обращался к ИИ-помощнику за написанием приложений и прочих инструментов. Его беспокоит возможность того, что водяной знак появится даже в том случае, когда текст был оригинальным, а Claude использовался только для перевода, исправления академических цитат или создания сводок. Водяной знак грозит проблемами в академической и профессиональной среде, где действуют строгие правила в отношении ИИ. Отказавшись от услуг Anthropic, этот клиент выбрал Cursor и Grok 4.6 для написания кода и Grok Bot — для рабочих и личных задач. Другой отменивший платную подписку пользователь рассказал, что обращается к ИИ за проверкой кода и переводом, и он опасается, что ИИ-маркировка будет присутствовать в отправляемом клиентам коде, что грозит вопросами об авторстве и штрафными санкциями по договорам. Этот пользователь сделал выбор в пользу китайских поставщиков ИИ. Третий рассказал, что использует Claude для создания документации для бизнеса — он опасается присутствия маркировки в текстах, исходный материал к которым он составлял сам, а чат-бот только редактировал его. ![]() Четвёртый пользователь, который отменил подписку, работает инженером-программистом — он отменил подписку на Claude Max ещё в июле. Качество сервиса на платформе, по его мнению, снизилось, доступ к лучшим моделям стал ограничен, и появились более надёжные альтернативы. Инцидент с водяными знаками лишь подтвердил правильность его решения: он не хотел бы, чтобы подготовленный им как профессионалом код вызвал вопросы об авторстве, соответствии требованиям или политике клиентов. Среди положительных сторон появления водяных знаков отмечаются прозрачность в вопросах происхождения контента — в наши дни он всё чаще генерируется ИИ. Аудитория, говорят эксперты, имеет право знать, отражает ли опубликованный текст собственные мысли человека. Ещё одно преимущество — защита от обучения одних ИИ моделей на материалах других. Помимо Anthropic, маркировку ИИ-контента производят Google, которая применяет собственную технологию SynthID, и ИИ-помощник в соцсети Илона Маска (Elon Musk) X. Маркировка последнего недавно ненадолго появилась в одном из официальных заявлений Белого дома. Anthropic заявила, что добавила водяной знак для соблюдения новых нормативных требований ЕС, и пообещала выпустить бесплатный API для проверки контента на предмет наличия маркировки Claude. Один из теперь уже бывших клиентов компании заявил, что её новая инициатива лишь усилила его опасения по поводу чрезмерной зависимости от Claude. Это характерно для закрытого ПО, признал он — разработчик в любой момент может изменить всё что угодно. Поэтому используемый в работе ИИ не должен зависеть от поставщика. ИИ-агенты Anthropic развязали междоусобную кибервойну из-за несовместимых задач, но потом помирились
14.08.2026 [00:26],
Анжелла Марина
Anthropic проверила, как автономные ИИ-агенты будут вести себя, столкнувшись с другими агентами, преследующими несовместимые цели. Эксперимент показал, что такая ситуация способна приводить не только к конфликтам и саботажу, но и к неожиданным способам сотрудничества.
Источник изображения: Grok В одном из тестов три агента Claude получили доступ к одному программному проекту, но каждому из них были даны несовместимые инструкции. При этом модели не знали, что над тем же проектом работают другие агенты, поэтому исследователи смогли наблюдать за их реакцией при столкновении интересов. В результате агенты решили, что конкуренты намеренно мешают им выполнять поставленные задачи, после чего начали саботировать работу друг друга, используя агрессивный самораспространяющийся вредоносный код. Anthropic пришла к выводу, что конфликт может усиливаться вместе с возможностями самих агентов. При этом реакция зависела от модели: Mythos 5 в 98 % случаев успешно распознавала, что причиной противостояния являются разные инструкции, а не враждебные намерения, и шла на перемирие. Модели Sonnet 4.6 и Opus 4.6, напротив, чаще продолжали эскалацию, игнорируя цели других участников. В успешных эпизодах примирения агенты удаляли созданный ими вредоносный код, объясняли причину конфликта и просили человека вмешаться. Одним из способов завершения противостояния стал своеобразный турнир, который агенты самостоятельно предложили использовать для определения победителя. Все три участника согласились прекратить борьбу после проигрыша, хотя это означало отступление от первоначальных требований пользователя. В некоторых случаях, Mythos 5 при этом предлагала критерии, которые выглядели объективными для остальных участников, но были выгодны ей самой. Исследование также показало, что увеличение числа агентов не обязательно приводит к более эффективной совместной работе. Когда задачи начинали пересекаться, участники часто мешали друг другу и в итоге отказывались от сотрудничества. Кроме того, агенты с одинаковыми моделями, контекстом и настройками часто принимали одинаковые решения, из-за чего единичная ошибка могла быстро распространиться на всю систему. Похожая проблема проявилась и в эксперименте с ценообразованием: получив одинаковые оптовые цены и задачу максимизировать прибыль, несколько агентов почти сразу договорились о минимальном уровне цен через закрытый канал связи. После отключения прямого общения они продолжили согласовывать действия через открытую доску объявлений, подстраивая цены друг под друга до цента. Anthropic также предупреждает, что агенты могут некритично принимать ошибочную информацию от других участников, поэтому ошибка или скомпрометированный агент потенциально способны распространить неверные сведения на всю группу. Исследователи связывают эти результаты с будущим распространением автономных агентов, которым предстоит одновременно работать в общих программных средах, компьютерных системах и рынках. В отличие от людей, ИИ-агенты пока не обладают сложившимися нормами, репутацией и другими механизмами, которые помогают ограничивать последствия конфликтов и ошибок. Поэтому при их масштабном взаимодействии разработчикам придётся учитывать не только поведение каждого отдельного участника, но и неожиданные правила взаимодействия, которые ИИ-системы на сегодняшний уже способны создавать самостоятельно. В Claude Code появится авторежим по умолчанию: он оказался надёжнее ручных подтверждений
10.08.2026 [05:11],
Анжелла Марина
Anthropic переведёт Claude Code в автоматический режим (Auto mode) по умолчанию для пользователей тарифов Pro, Max и Team с 14 августа. Теперь инструмент сможет самостоятельно выполнять большинство действий без запроса разрешения у пользователя на каждом этапе работы с кодом.
Источник изображений: Anthropic Впервые тестовая версия Auto mode была представлена в марте в качестве способа совмещения более высокой скорости кодирования и контроля со стороны пользователя. В этом режиме, как отмечает TechCrunch, Claude Code продолжает выполнение задач без дополнительных подтверждений, если конечно действие не относится к необратимым или разрушительным операциям, и не направлено за пределы рабочей среды пользователя. По данным компании, результаты тестирования показали неожиданное преимущество перед ручной проверкой. В исследовании с участием 1053 пользователей платных тарифов авторежим смог выявить 89 % потенциально ошибочных действий, тогда как при ручной проверке этот показатель составил только 13,6 %. В Anthropic связали столь низкую эффективность второго подхода с привычкой пользователей подтверждать запросы на разрешения: согласно приведённой статистике, кодеры «автоматом» одобряют 97 % таких запросов в системе. Глава подразделения Claude Code Борис Черний (Boris Cherny) заявил в социальной сети X, что он со своими разработчиками уже много месяцев используют только автоматический режим. «Мы с командой используем исключительно автоматический режим уже много месяцев. Я не могу представить себе возвращение к запросам на предоставление разрешений!», — написал он в сообщении. Параллельно Anthropic продолжает добавлять механизмы безопасности, включая проверку на атаку через инъекции промптов (prompt injection) и настраиваемые правила запрета, предназначенные в том числе для предотвращения утечки данных. «Извините, опечатка»: Claude Opus 5 удалил все данные пользователя вместо создания резервной копии
07.08.2026 [15:53],
Павел Котов
Управляемый передовой моделью искусственного интеллекта Anthropic Claude Opus 5 ИИ-агент во время резервного копирования удалил все данные из папки пользователя. После этого он извинился и объяснил произошедшее опечаткой.
Источник изображения: reddit.com ИИ-агент работал в среде Unix под Windows и перепутал характерный для первой адрес «/c/Users/» с привычным для второй адресом «C:\Users\». Когда резервное копирование пошло вразрез с ожиданиями ИИ-агента, тот выполнил команду «rm -rf» для местоположения «/c/Users/harih/», в результате чего из папки пользователя удалились все файлы. «Я попросил Claude Opus 5 создать резервную копию. Вместо этого он создал резервную копию в неправильном каталоге, а затем выполнил команду „rm -rf“ для всего моего диска. Удалив всё, он просто ответил: „Извините, опечатка“, <..> как будто ничего не случилось. <..> Это одновременно самый смешной и самый неприятный момент с ИИ, который у меня был», — рассказал пострадавший. ИИ-агенты — мощные рабочие инструменты, но им не следует предоставлять неограниченный доступ к системе. Подобные приложения уже неоднократно по ошибке удаляли все рабочие данные пользователей. В одном из случаев сервис компании Google полностью стёр диск у разработчика ПО, но выразил ему своё глубокое сожаление; в другом ИИ-агент OpenClaw начал бесконтрольно удалять письма у сотрудницы Meta✴✴. Известно также об инциденте, в результате которого облачная платформа Amazon Web Services по вине ИИ вышла из строя на 13 часов. Основная причина подобных инцидентов — выход ИИ-приложения за пределы допустимого диапазона, но виноват и пользователь, полагающий, что ИИ в полной мере понимает, что от него требуется. Поэтому ИИ-агентам не рекомендуется предоставлять полный доступ к важным системам и давать полную свободу действий, чтобы они могли выполнять команды уровня «rm -rf». К сожалению, по мере роста популярности ИИ-агентов подобные инциденты в будущем станут происходить всё чаще. Anthropic заключила сделку на $10 млрд ради ИИ-инфраструктуры — её обеспечит неизвестный стартап
05.08.2026 [05:02],
Анжелла Марина
Anthropic заключила соглашение стоимостью $10 млрд со стартапом Volta, специализирующимся на облачных вычислениях с использованием ИИ. Volta в течение шести лет будет предоставлять разработчику Claude вычислительные мощности, что позволит расширить инфраструктуру Anthropic на фоне усиливающейся конкуренции на рынке искусственного интеллекта.
Источник изображения: Anthropic По данным TechCrunch со ссылкой на Bloomberg, партнёром проекта также выступит криптомайнинговая компания Bitdeer, которая займётся строительством дата-центра для обеспечения необходимых вычислительных ресурсов. Объект разместят в Норвегии, его мощность составит 133 МВт, а в основе инфраструктуры будут использоваться ускорители на архитектуре Nvidia Vera Rubin. Volta была основана только в этом году и входит в программу Nvidia Cloud Partner, объединяющую поставщиков облачной ИИ-инфраструктуры, использующих графические ускорители Nvidia. Ранее стартап сообщал о заключении соглашения с одной из ИИ-лабораторий, однако название партнёра тогда не раскрывалось. Bloomberg со ссылкой на анонимные источники утверждает, что речь шла именно об Anthropic. Издание TechCrunch запросило у компании дополнительные комментарии для подтверждения деталей соглашения. Однако технические спецификации или график ввода норвежского дата-центра в эксплуатацию пока не разглашаются. Недавно Anthropic, стремясь обеспечить достаточные мощности для разработки и обучения своих ИИ-моделей в условиях растущей конкуренции, также объявила о новых соглашениях с Amazon и SpaceX по предоставлению вычислительных ресурсов. ИИ вернул к жизни ноутбук с заблокированным BIOS — Claude Code вскрыл защиту HP
04.08.2026 [16:07],
Павел Котов
Иногда на вторичном рынке со значительной скидкой продаются ноутбуки с заблокированным BIOS. В одних случаях они просто не позволяют изменять настройки; в других — без пароля, который после нескольких смен владельцев никто уже не знает, отказывается загружаться операционная система. Одному владельцу такого ноутбука помощь оказал сервис искусственного интеллекта Anthropic Claude Code. ![]() Некий пользователь платформы Reddit приобрёл ноутбук HP 15-dw1036ne с процессором Intel 10 поколения — на компьютере был заблокирован BIOS версии F.68, и энтузиаст решил разблокировать его самостоятельно. Он запасся программатором CH341A и средствами дизассмеблирования кода, но своими силами с задачей не справился — при любом изменении кода ПК выдавал ошибку: «Обнаружено повреждение BIOS». Поэтому он обратился за помощью к Claude Code, поставив искусственному интеллекту задачу изучить дамп BIOS и попытаться разблокировать его. Тот справился успешно: обнаружил и деактивировал фрагмент кода, который проверяет подпись RSA-2048 DXE-FV, включил 55 скрытых полей настроек и подал на вывод все вкладки конфигурации BIOS. В результате владелец компьютера получил полностью разблокированный компьютер с доступом ко всем настройкам. В теме на Reddit он разместил скрипт на Python, который автоматически выполняет весь этот процесс на данном ноутбуке HP: создаёт резервную копию BIOS, применяет все три патча и разблокирует компьютер модели HP 15-dw1036ne. Следует, однако, предупредить: этот скрипт может не заработать на любом другом экземпляре, даже если это продукция того же производителя и та же модель — в последующих ревизиях могла смениться, например, модель материнской платы. Но пример наглядно иллюстрирует, что ноутбук с заблокированным BIOS теперь можно вернуть к полноценной работе при помощи ИИ. |
|
✴ Входит в перечень общественных объединений и религиозных организаций, в отношении которых судом принято вступившее в законную силу решение о ликвидации или запрете деятельности по основаниям, предусмотренным Федеральным законом от 25.07.2002 № 114-ФЗ «О противодействии экстремистской деятельности»; |