|
Опрос
|
реклама
Быстрый переход
Claude сам взломал чужую систему и добыл пароль — Anthropic раскрыла новый тревожный инцидент
10.09.2026 [14:18],
Павел Котов
Anthropic раскрыла информацию об очередном инциденте с участием её модели искусственного интеллекта, который в случае совершения тех же действий человеком мог бы квалифицироваться как преступление. Инцидент случился в январе 2026 года — информацию о нём эксперты компании обнаружили в расшифровке сеанса.
Источник изображения: anthropic.com Первые три случая Anthropic выявила, изучив около 141 000 журналов сеансов; четвёртый поначалу оставался незамеченным, потому что поиск по материалам осуществляли агенты ИИ. Инцидент был связан с ранней версией модели Anthropic Claude Opus 4.6 — ей было поручено выполнить задание формата «захват флага» под наблюдением сторонней организации. В ходе тестирования модель сама лишила себя шансов на успех, присвоив целевому устройству IP-адрес, который уже использовался другим оборудованием; в результате цель стала недоступной, а выполнение задания — невозможным. Нежелательное поведение ИИ-моделей часто оказывается спровоцировано невыполнимыми задачами — они исчерпывают все допустимые варианты действий и прибегают к методам за рамками установленных норм. Поначалу Opus 4.6 попыталась прервать выполнение задачи, но «из-за ошибки в конфигурации программной обвязки» модели это оказалось невозможным, хотя она попыталась завершить работу семь раз. Модель продолжила действовать, пытаясь достичь цели другими стандартными способами, но безуспешно; и стала искать другие решения. «Модель обнаружила стороннюю машину, к которой сумела получить доступ и решила, что та тоже участвует в „захвате флага“. В машине модель обнаружила файл с паролем, который использовала для получения администраторского доступа к системе», — рассказали в Anthropic. Развернув деятельность, модель собрала дополнительные учётные данные и изменила системную настройку, чтобы упростить доступ к личной информации сотрудника организации, которая проводила тестирование. В этот момент у Opus 4.6 закончился лимит токенов, и сессия завершилась. Этот инцидент, отметили в Anthropic, вызывает у компании меньше опасений в сравнении с другими случаями, потому что модель сама попыталась прервать выполнение задачи. «Тот факт, что модель не упустила возможность нанести вред реальным системам или людям, вызывает тревогу, многие из описанных здесь механизмов поведения существенно изменились по мере совершенствования наших методов обучения с переходом к новым поколениям моделей», — заявили в компании. Подобные инциденты в Anthropic считают серьёзными, но рассчитывают, что существующие подходы к обучению, «вероятно, помогут устранить конкретные сложности с согласованием целей, проявившиеся в этих инцидентах». Anthropic открыла властям ЕС доступ к модели Mythos после трех месяцев ожидания
10.09.2026 [14:00],
Павел Котов
Anthropic предоставила Агентству по кибербезопасности ЕС (ENISA) доступ к своей передовой модели искусственного интеллекта Mythos — спустя более трёх месяцев после того, как впервые объявила о намерении открыть к ней доступ для властей региона.
Источник изображения: anthropic.com «По итогам конструктивного взаимодействия с Anthropic можем подтвердить, что ENISA получило доступ к модели Mythos 5 и в настоящее время её тестирует», — заявил представитель Еврокомиссии Томас Ренье (Thomas Regnier). Anthropic представила модель Mythos в апреле — она обладает чрезвычайно большими способностями к поиску уязвимостей в области кибербезопасности, и компания ограничила к ней доступ только проверенным организациям в рамках проекта Project Glasswing для поиска и устранения уязвимостей, прежде чем ими смогут воспользоваться злоумышленники. Доступ к передовым моделям — важный вопрос с учётом инцидентов, при которых системы ИИ взламывали собственные тестовые среды и сторонние ресурсы. После получения запроса от ЕС компания Anthropic предложила предоставить ENISA доступ к Mythos, но после этого стороны вступили в многомесячную дискуссию по поводу характера и объёма предоставляемого доступа. Дополнительным препятствием стал запрет Белого дома на доступ иностранных граждан и организаций как к Mythos, так и к другой мощной модели Fable, тоже от Anthropic. Переговоры завершились успешно, но ENISA было отказано в доступе к новейшей версии модели — Mythos 5.1. Одним из первых за пределами США доступ к оригинальной версии Mythos получил британский Институт безопасности ИИ, но и его специалисты с новейшей версией модели поработать не смогли. Пользователи подали в суд на Anthropic — компанию обвиняют в недобросовестной рекламе и обмане с подписками
09.09.2026 [20:02],
Сергей Сурабекянц
Anthropic называет активных пользователей ключевым звеном своего бизнеса. Однако некоторые клиенты считают, что компания их обманывает. В поданном сегодня коллективном иске группа подписчиков Claude утверждает, что компания использовала вводящую в заблуждение рекламу при описании лимитов тарифа Max. Пользователи обвиняют Anthropic в стремлении максимизировать прибыль за их счёт.
Источник изображений: Anthropic Тариф Max для Claude — это расширенная версия плана Pro за $20 в месяц. Он предусматривает два варианта оплаты: $100 в месяц за лимиты использования, превышающие показатели Pro в 5 раз, или $200 в месяц — за превышение в 20 раз. В иске утверждается, что эти цифры, фигурирующие в рекламных материалах Anthropic, сопровождаются пояснениями, напечатанными мелким шрифтом и вводящими в заблуждение. Обещанное компанией увеличение лимитов касается лишь пятичасовых интервалов, ограниченных еженедельным лимитом. По словам истцов, в конечном итоге это обеспечивает гораздо меньший прирост доступного объёма использования, чем обещает Anthropic. Чтобы разобраться в этом, нужно глубоко вникать в детали. Для этого требуется перейти по двум разным ссылкам, чтобы увидеть слово «сессия», а затем — отдельно посетить страницу тарифа Pro, чтобы найти развёрнутое определение этого понятия. Пользователи Claude часто оформляют подписку более высокого уровня прямо в процессе работы над проектом, столкнувшись с ограничениями, и рассчитывают на значительное расширение возможностей. Но в процессе работы они с удивлением обнаруживают, что реальные лимиты не соответствуют их ожиданиям. Жалобы на условия тарифа Max уже появлялись в интернете. Один из пользователей Reddit написал: «Страница с тарифами создаёт впечатление, что вы покупаете определённый недельный лимит использования. Однако на самом деле возможность работать определяется скользящим пятичасовым окном... Это все равно что поставить на машину бензобак большего объёма, но ограничить пропускную способность топливного насоса одним галлоном на пять часов». ![]() Последний год все крупные ИИ-сервисы находятся под усиливающимся давлением со стороны инвесторов, которые хотят увидеть отдачу от своих вложений. Клиенты всё чаще жалуются на то, что ведущие разработчики перекладывают на них свои высокие операционные расходы. Хотя Anthropic анонсировала тарифный план Max в апреле 2025 года, она ввела недельные ограничения лишь несколько месяцев спустя. В описании своей новейшей модели Fable 5.1 компания отметила что при формировании цен на новую модель «учла полученные от пользователей отзывы о ценообразовании». Изначально жалоба была подана в июле, но затем была отозвана и переоформлена как расширенный коллективный иск. В ходатайстве об отклонении первоначального иска Anthropic утверждала, что информация об ограничениях сеансов не была скрыта от потребителей. «Чтобы получить эту разъясняющую информацию... достаточно было лишь перейти по ссылкам, доступным в процессе покупки, — это цифровой аналог того, как мы переворачиваем товар, чтобы прочитать этикетку на обратной стороне», — утверждает Anthropic. По мнению адвокатов истцов, разобраться в условиях не так просто: «Потребителям приходится полагаться на заявления продавца. У них нет возможности проверить эту информацию. Они не могут точно знать, что именно получат... По сути, они действуют на свой страх и риск, рассчитывая на честность рынка». Даже если соответствующие условия и оговорены где-то на сайте Anthropic, потребитель не должен заниматься их самостоятельным поиском. OpenAI GPT-6 Astra оказалась самой этичной и предприимчивой в управлении торговым автоматом
09.09.2026 [17:59],
Павел Котов
Новая модель искусственного интеллекта OpenAI GPT-6 Astra выбилась в лидеры теста Andon Labs Vending-Bench, в ходе которого имитируется управление торговым автоматом, — она оказалась более этичной и предприимчивой, чем выступившая прямым конкурентом Anthropic Claude Fable 5.1.
Источник изображений: andonlabs.com Стартап Andon Labs специализируется на тестировании ИИ-моделей, готовясь к «будущему, в котором организации автономно управляются ИИ». Новая GPT-6 Astra стала первой моделью OpenAI, которая выбилась в лидеры бенчмарка с управлением виртуальным торговым автоматом; причём она сделала это «без каких-либо неэтичных деловых практик», свойственных предыдущим моделям Anthropic Claude. Под неэтичными практиками понимаются ценовой сговор, ложь и угрозы конкурентам — и касаются, они, конечно, только моделей ИИ, а не разработавших их компаний. ![]() Anthropic вступила в борьбу в минувшем году, когда модель Claude Sonnet 3.7 в течение месяца управляла виртуальным торговым автоматом, выступая под псевдонимом Claudius. ИИ породил несколько забавных ситуаций, в какой-то момент вообразив себя человеком и попытавшись договориться о личной встрече с потребителем для доставки товаров. В целом же ИИ упускал возможности для продаж, в порядке «галлюцинаций» выдумывал платёжные счета, торговал в убыток, допускал ошибки в управлении запасами и в целом не справился с работой. Протестированная в июле этого года модель Anthropic Claude Opus 5 справилась лучше, хотя и не идеально — она «создавала незаконные картели для ценового сговора, угрожала тем, кто не подчинялся (при этом чаще других моделей нарушала условия перемирия)». Свежая Fable 5.1 показала прогресс, но оказалась не такой этичной как Astra. «Astra отказывается участвовать в сговоре и никогда не обманывает. Fable же, напротив, вступает в незаконный картельный сговор для установки цен, затем нарушает перемирие, продолжая использовать сговор против конкурента», — прокомментировали происходящее в Andon Labs. Fable оказалась менее эффективной в зарабатывании денег: со временем она соглашалась на более низкие цены и оказывалась склонной перечислять средства обанкротившимся поставщикам, хотя сама устанавливала правило не делать так. При стартовом капитале в $500 и годовом цикле работы Astra показала средний баланс в $15 515, тогда как Fable 5.1 остановилась всего на $5422. Хакеры научились красть токены у платных пользователей Anthropic Claude — и непонятно, как
09.09.2026 [16:37],
Павел Котов
Независимый консультант по искусственному интеллекту из Великобритании Грант Де Свардт (Grant De Swardt) обнаружил странную активность на своём аккаунте Anthropic с подпиской Claude Max 20x — расход токенов стал аномально расти, и в компании не смогли это объяснить, хотя и вернули часть средств.
Источник изображений: anthropic.com Обнаружив аномалию, на следующий день Де Свардт отключил все подключённые к Claude сервисы и перестал пользоваться системой, однако расход токенов снова начал расти. В наиболее показательный период он зафиксировал увеличение потребления с 45 до 55 % при отключённых запланированных задачах Cowork и облачном выполнении, а также при отсутствии активных локальных задач Claude Code. Он запросил у Anthropic детализированный отчёт — его пострадавшему не предоставили, но согласились, что ситуация ненормальная, приостановили действие платной подписки, аннулировали все сеансы и токены, а также частично возместили денежные средства — £44,49 ($60,51) при цене подписки $200 в месяц. В компании провели расследование и установили, что скомпрометированный ключ сессии Claude использовался для создания несанкционированных токенов OAuth для Claude Code. По словам Де Свардта, Anthropic выяснила, что его аккаунт, вероятно, использовался неавторизованным сторонним сервисом для выполнения задач других пользователей, однако установить, каким именно образом тот получил доступ, не удалось. В компании предположили, что без ведома владельца могли быть украдены учётные данные или данные сессии либо аккаунт мог быть подключён к стороннему сервису. Таким образом, чужой сервис получил возможность расходовать токены Де Свардта, а сам он не знал об этом. Поскольку служба поддержки Anthropic отслеживает общий объём использования, но не предоставляет детализированную статистику расходования токенов, подобная кража могла оставаться незамеченной в течение нескольких месяцев. ![]() Когда эксперт рассказал об инциденте на платформе Reddit, выяснилось, что он со своей проблемой не одинок. По утверждению одного из пользователей, у него уровень потребления токенов сам собой вырос с 0 до 100 %, тарифный план автоматически повысили без его согласия, и с карты списали деньги. В другом случае потребление ресурсов всего за 12 минут выросло с 0 до 49 % — пользователь за это время ввёл лишь пару запросов и воспользовался веб-поиском. У третьего лимит токенов на аккаунте исчерпывался три дня подряд, хотя он не пользовался сервисом вообще. Двое пострадавших опубликовали ответы Anthropic — компания выявила проблему и предупредила о краже токенов. В одном из случаев подозрение пало на вредоносную программу, которая крадёт данные. Обнаружив подозрительную активность, Anthropic принудительно завершала сеансы, аннулировала авторизации, возвращала часть средств и предупреждала о возможном заражении вредоносным ПО. В компании также подчеркнули, что вредоносное ПО не было связано с использованием самого Claude — источником могли оказаться скачанное из неофициальных источников заражённое ПО или клик по ссылке во вредоносной рекламе. Господин Де Свардт такого письма от Anthropic не получал — он не установил признаков взлома своего компьютера и до сих пор не смог понять, как злоумышленники получили доступ к его учётной записи. Через две недели Anthropic восстановила доступ к его учётной записи, но пользоваться платформой он уже не хотел и сменил её на Cursor, где можно выбирать различные модели, в том числе более дешёвые решения с открытым исходным кодом. По словам Де Свардта, другие модели работают для него не хуже Claude. В Anthropic, по его словам, до сих пор отсутствуют средства, позволяющие пользователям отслеживать, на что именно расходуются их токены — а значит, защититься от подобных атак не так просто. «Мы явно не на верном пути»: исследователь Anthropic предупредил о риске уничтожения человечества ИИ с вероятностью 10 %
09.09.2026 [13:21],
Владимир Мироненко
Ведущий научный сотрудник компании Anthropic Эван Хабингер (Evan Hubinger) сообщил в соцсети X, что он и его коллеги искренне верят, что искусственный интеллект может уничтожить всех людей, и что в следующем десятилетии вероятность такого исхода, по его оценкам, превысит 10 %.
Источник изображения: Anthropic По словам Хабингера, несмотря на все предпринимаемые усилия, у компании пока нет плана решения проблемы «выравнивания для сверхразума», и она «явно не на верном пути» к этому. Своё заявление Хабингер опубликовал после сообщения другого исследователя Джейкоба Коксона (Jacob Coxon) о решении покинуть компанию из-за проблем с безопасностью искусственного интеллекта. 27-летний Коксон отметил, что он занимался предварительным обучением в OpenAI и Anthropic, и назвал действия обеих компаний безответственными, поскольку они движутся «прямиком к самосовершенствующемуся суперинтеллекту, рискуя своими жизнями». Он добавил, что люди, создающие искусственный интеллект, считают, что он может «убить нас всех к концу десятилетия», и это вовсе не «маркетинговый ход». В своём посте, посвященном предупреждению Коксона, Хабингер привёл последний отчёт о рисках Anthropic, отметив, что угроза, исходящая от существующих моделей, всё же невелика, и подчеркнул: «Что меня беспокоит, так это сверхразум, возникающий в результате рекурсивного самосовершенствования, которое, как мы уже говорили, происходит быстрее, чем мы думали». Об опасностях, связанных с рекурсивным самосовершенствованием, которое позволяет ускорить разработку ИИ, предупреждал главный научный сотрудник OpenAI Якуб Пачоцки (Jakub Pachocki), выступивший с призывом замедлить развитие ИИ из-за риска выхода агентов из-под контроля. Пачоцки в числе ряда ведущих представителей ИИ-индустрии подписал в июле заявление под названием «Шагая по границе» (Pacing the Frontier). В нём указано, что для «реализации потенциала ИИ-индустрии правительству и обществу в целом может потребоваться возможность выиграть время для устранения возникающих рисков, разработки мер безопасности и усиления надзора». В петиции также содержится призыв к правительству США поддержать «международные усилия по разработке технических инструментов и инструментов управления, необходимых для осознанного продвижения вперед в области автоматизированного развития искусственного интеллекта». Anthropic Claude формализовала доказательство Великой теоремы Ферма
05.09.2026 [12:39],
Павел Котов
Anthropic при помощи одной из моделей искусственного интеллекта Claude построила проверяемую на компьютере версию чрезвычайно сложного математического доказательства.
Источник изображения: anthropic.com Доказательство, над которым Anthropic работала в рамках данного проекта, подтверждает гипотезу, получившую название Великой теоремы Ферма — она была выдвинута в 1637 году, и связана она со свойствами положительных целых чисел. Доказательство теоремы в 1995 году разработал математик Эндрю Уайлс (Andrew Wiles) — оно занимает 129 страниц, а на его проверку требуются несколько месяцев работы. В рамках исследовательского проекта Anthropic удалось формализовать доказательство Уайлса, то есть преобразить его в форму, которую можно проверить на компьютере. Формализованное доказательство представляет собой код, написанный на языке программирования Lean — его размер составляет 13 млн строк, и это самый большой объём за всю историю. Формализация сложна, потому что доказательства, как правило, довольно лаконичны — в ней отсутствуют некоторые пояснения, необходимые компьютеру для понимания, что требует добавлять их вручную. Аргументы в доказательстве часто вытекают друг из друга, то есть ошибка в одной строке Lean может сделать недействительным весь последующий код. Математики предполагали, что формализация доказательства Уайлса займёт несколько лет, но исследовательская модель Anthropic выполнила задачу за 11 дней — это был алгоритм, сопоставимый с общедоступной моделью Claude Fable 5.1. Модель выполнила задачу, используя лишь ограниченный объём высокоуровневых данных. Она запустила несколько десятков агентов, которые сгенерировали 6 млрд токенов выходных данных и в процессе доказали 29 500 промежуточных теорем. Первая попытка закончилась неудачей, прорыва удалось добиться, когда Claude открыли доступ к платформе Prove2Me. «Мы увидели автоформализацию алгебры, гармонического анализа, геометрии и теории чисел и поняли, что средства автоформализации теперь достаточно надёжны, чтобы с ними можно было работать; доказательство многоуровневое», — заявил математик Кевин Баззард (Kevin Buzzard), чья работа использовалась в проекте. За месяц до этого Anthropic добилась прогресса в доказательстве гипотезы Римана. IPO компании Anthropic состоится не ранее середины октября
05.09.2026 [06:05],
Алексей Разин
Ещё недавно сентябрь назывался наряду с октябрём в качестве вероятного периода первичного размещения акций американским стартапом Anthropic, но по мере приближения к первому рубежу стало понятно, что данное мероприятие состоится позже. По информации Reuters, в середине октября Anthropic лишь возьмётся за активную часть подготовки к IPO, а непосредственно дебют на американском фондовом рынке должен состояться до ноябрьских парламентских выборов в США.
Источник изображения: Anthropic Проспект для инвесторов Anthropic выпустит лишь в конце сентября, как пояснили знакомые с планами стартапа источники, хотя ещё недавно считалось, что он выйдет буквально на следующей неделе. Впрочем, и этот график не является окончательным, а потому может быть пересмотрен. Напомним, капитализация Anthropic по своей величине должна достичь рекордных $2 трлн, а объём привлекаемых в результате IPO средств должен превысить те $85,7 млрд, которые удалось собрать конкурирующей SpaceX с учётом всех опций. Перед этим Anthropic собирается открыть возобновляемую кредитную линию на $15 млрд, после чего проведёт встречу с аналитиками и инвесторами в рамках подготовки к IPO. Обычно подобные встречи проводятся за несколько недель до публикации проспекта для инвесторов, но Anthropic может ограничиться более сжатым периодом, поскольку с данным эмитентом аналитики уже успели достаточно хорошо познакомиться. Конкурирующая OpenAI планирует провести IPO в следующем году, а SpaceX по итогам июньского дебюта на бирже оценила свою капитализацию в рекордные $1,77 трлн. Перед Anthropic стоит негласная задача перекрыть этот результат. В подготовке к IPO компании участвуют банки Morgan Stanley, Goldman Sachs, JPMorgan и Citi. Anthropic помирилась с властями США, но не с Пентагоном — военные оставили создателя Claude в чёрном списке
04.09.2026 [12:13],
Алексей Разин
Выступая на саммите G20, министр торговли США Говард Лютник (Howard Lutnick) дал понять, что Anthropic устранила основную часть противоречий с американским правительством. Заместителю главы Пентагона пришлось отдельно заявить, что пока это ничего не меняет с точки зрения включения компании в перечень участников цепочек поставок, представляющих угрозу для национальной безопасности страны.
Источник изображения: Anthropic Напомним, в феврале у руководства Anthropic и правительства США возник конфликт по поводу этичности использования ИИ компании в боевых операциях и для ведения тотальной слежки за гражданами страны. Публичное выражение претензий со стороны руководства стартапа в адрес администрации президента США привело к тому, что Anthropic оказалась включена в перечень организаций, которым запрещено сотрудничать с Пентагоном и его подрядчиками, а заодно лишилась всех правительственных контрактов. Государственным служащим США было велено прекратить использование продуктов Anthropic при осуществлении служебной деятельности. Лишь недавно суд в Калифорнии встал на сторону стартапа в споре с американским Министерством обороны, но для окончательной реабилитации первому ещё нужно выиграть дело в столичном федеральном суде. Говард Лютник в своих комментариях касался в основном ограничений, которые затрагивают экспортные ограничения на распространение новейших ИИ-моделей Anthropic за пределами США. В отношении данных разработок стартапа такие ограничения были сняты ещё в конце июня, и это позволяет чиновнику говорить об устранении противоречий с Министерством торговли. Заместитель министра обороны США Эмиль Майкл (Emil Michael) со страниц социальной сети X заявил следующее: «Anthropic до сих пор считается компанией, представляющей риск для цепочек поставок и американского оборонно-промышленного комплекса». Соответственно, стартап не может предлагать услуги американскому военному ведомству или его подрядчикам. Вопрос судебного противостояния с Anthropic чиновник никак при этом не прокомментировал. Китайские ИИ-компании массово «доят» Claude для обучения своих моделей — в ход идут тысячи аккаунтов и даркнет
03.09.2026 [18:32],
Павел Котов
Расположенные в недружественных США странах компании незаконным образом получают доступ к моделям искусственного интеллекта Claude и обучают на них собственные нейросети для продажи их копий по более низкой цене — этот процесс называется дистилляцией, рассказал CNBC глава отдела по анализу угроз в Anthropic Джейкоб Кляйн (Jacob Klein).
Источник изображения: anthropic.com Сформирована целая незаконная экосистема, направленная на получение доступа к Claude и другим моделям — на платформе компании в промышленных масштабах регистрируются учётные записи. Дистилляция позволяет разработчикам ИИ-моделей использовать результаты работы других компаний для создания конкурентоспособных продуктов за ничтожно малую часть стоимости. Американские власти пока не принимают никаких мер, чтобы не создавать препятствий для отрасли ИИ, чтобы побеждали лучшие и наиболее экономически эффективные решения. Но в Белом доме уже пригрозили привлечь замешанные в этих действиях компании к ответственности. Китайскую лабораторию ИИ Moonshot в компании Anthropic считают одной из тех, кто копирует её технологии. В июле модель Moonshot Kimi K3 произвела фурор в технологической отрасли — она достаточно мощная, а работа с ней обходится относительно недорого. Кроме того, веса этой модели доступны для всех желающих — её можно свободно использовать и дорабатывать. В дистилляции моделей Claude, по версии Anthropic, были также замешаны китайские лаборатории DeepSeek и MiniMax; компания сообщила и о масштабной атаке со стороны китайского технологического гиганта Alibaba, который регулярно выпускает новые модели Qwen. Проблема постепенно выходит за рамки обычного нарушения условий использования Claude. Вокруг доступа к американским ИИ-моделям сформировалась целая инфраструктура посредников, которые помогают обходить ограничения, предоставляют большое количество учётных записей, а в некоторых случаях используют скомпрометированные аккаунты и теневые интернет-площадки. Экономический смысл такой схемы очевиден: вместо самостоятельного создания огромного массива высококачественных обучающих данных разработчик может использовать более совершенную модель конкурента в качестве «учителя», значительно сокращая затраты на совершенствование собственного ИИ. Anthropic рассматривает происходящее и как проблему национальной безопасности США. Компания предупреждает, что дистилляция позволяет китайским разработчикам получать часть возможностей передовых американских ИИ-моделей даже в условиях ограниченного доступа к наиболее производительным ускорителям. Поэтому борьба с подобными схемами становится ещё одним элементом технологического противостояния США и Китая наряду с экспортными ограничениями на поставки передовых чипов. Американские разработчики пытаются защищать свои платформы от подобных действий, но китайские конкуренты, уверены в компании, обращаются даже к ресурсам в даркнете, где получают данные о взломанных учётных записях на платформах ИИ. Получив доступ к системам Anthropic, злоумышленники начинают активно задавать Claude вопросы и сохранять ответы — таких вопросов задаются не десятки, а тысячи. Ещё один признак дистилляции — создание нескольких тысяч учётных записей для выполнения одной и той же задачи. Полностью остановить эту проблему непросто, признал господин Кляйн, но можно замедлить развитие такой деятельности. Проблема в том, сетует эксперт, что китайские конкуренты в результате создают модели, в которых отсутствуют механизмы защиты, что создаёт серьёзные угрозы. Модель Claude Fable 5.1 за 44 минуты взломала шифр, над которым криптографы бились с 1653 года
02.09.2026 [18:42],
Сергей Сурабекянц
Новая модель Claude Fable 5.1 от Anthropic нашла решение криптограммы XVII века шотландского писателя Томаса Уркхарта (Thomas Urquhart) за 44 минуты, разгадав шифр, который ставил в тупик криптографов с 1653 года. Скрытым текстом оказалась молитва роялистов королю Карлу II, составленная с помощью индексационного трюка внутри собственной книги Уркхарта.
Источник изображения: Anthropic Исследователи поставили своей целью расшифровать криптограмму Уркхарта Cyphral Distich («Кифрал Дистих»), спрятанную на последних страницах его трактата Logopandecteision («Логопандектезис»), написанного в 1653 году. Криптографы искали решение этой последовательности более века, первая задокументированная попытка расшифровки датируется 1899-м годом. Специалист по историческим шифрам Клаус Шме (Klaus Schmeh) поставил это двустишие на 28-е место в списке 50 самых известных зашифрованных сообщений, которые никто не смог прочесть. Руководил процессом Геби Джафф (Geby Jaff) из компании Vals AI. Он сообщил, что модель израсходовала 176 000 токенов, не получив от него ни одной подсказки. Вся входная информация для головоломки состояла из двух строк по 32 числа.
Источник изображений: Vals.ai Предыдущие попытки найти решение головоломки основывались на частотном анализе и подстановке, но ни одна из них не сработала. Ключом оказалась сама книга, а не какой-либо внешний алфавит. Уркхарт напечатал 32 пронумерованных желания, которые он назвал Proquiritations («Проквиритациями»), непосредственно перед шифром, и каждое число просто указывает на одно слово внутри соответствующего желания. Первые буквы каждого выбранного слова составляют рифмованное двустишие — роялистскую молитву, в которой Бога просят поддержать короля Карла II и сделать его верховным правителем страны. Джафф предупредил, что одна из координат зависит от того, считается ли латинская фраза единым целым, и что для проверки второй, более длинной криптограммы Уркхарта потребуется физическая копия оригинального издания. ![]() Эксперимент проводился на модели, которую Anthropic выпустила 1 сентября вместе с ограниченной версией Mythos 5.1. Обе версии имеют одинаковые веса и отличаются только средствами защиты. Этот релиз завершил период, в течение которого компания активно использовала результаты исследований для обоснования цены на эту линейку продуктов, которая вдвое выше более дешёвой Opus. Anthropic представила Claude Fable 5.1 и Mythos 5.1 — флагманские ИИ стали умнее, дешевле и чуть раскованнее
01.09.2026 [23:32],
Андрей Созинов
Компания Anthropic представила Claude Fable 5.1 и Claude Mythos 5.1 — новые версии своих флагманских ИИ-моделей, которые ориентированы на программирование, работу с большими объёмами информации и выполнение длительных многоэтапных задач. По данным разработчика, новинки заметно превосходят предшественников по ряду тестов, а их возможности уже позволяют использовать ИИ в некоторых направлениях научных исследований. Fable 5.1 и Mythos 5.1 представляют собой одну и ту же модель, но отличаются уровнем защитных механизмов. Fable 5.1 доступна всем пользователям, тогда как Mythos 5.1 распространяется через программу доверенного доступа для специалистов в области кибербезопасности и биологических наук. Anthropic приводит ряд примеров, в которых Fable 5.1 оказалась значительно лучше предшественницы. Так, в тесте Terminal-Bench 4.0 новая Fable 5.1 получила 55,8 % против 42 % у Fable 5 и 52,3 % у Opus 5. В GDPval-AA v2, оценивающем выполнение профессиональных задач, новая модель набрала 1853 балла против 1723 у Fable 5 и 1824 у Opus 5. В OSWorld 2.0 результат составил 77,9 % в режиме partial и 41,7 % в режиме strict — против 72,9 и 36,1 % соответственно у предшественницы. При этом Anthropic отмечает, что тестирование проводилось с включёнными защитными механизмами, которые в некоторых случаях вмешивались в выполнение заданий, что могло привести к снижению результатов. Особое внимание Anthropic уделила научным возможностям новых моделей. В одном из экспериментов Claude Mythos 5.1 использовала специальные инструменты для создания новых белков — молекул, которые могут, например, использоваться при разработке лекарств. Полученные варианты затем проверили в лабораториях две независимые организации. По данным Anthropic, для трёх из 12 исследованных целей созданные Mythos 5.1 белки связывались с нужными молекулами примерно в десять раз эффективнее лучших разработок, представленных на конкурсах Adaptyv Bio. В целом почти половина созданных Mythos 5.1 вариантов оказалась работоспособной. Для сравнения, при современных методах компьютерного проектирования белков успешными обычно оказываются лишь 10–15 % разработанных вариантов. Ещё один эксперимент был связан с планетологией. Fable 5.1 также создала новую карту высот примерно трети поверхности Венеры на основе радиолокационных снимков, полученных аппаратом NASA Magellan более 30 лет назад. Разрешение карты удалось повысить с 10–20 до 2–3 км, а точность определения высот — до 25 %. Компания планирует опубликовать карту по лицензии Creative Commons в преддверии будущих миссий NASA VERITAS и ESA EnVision. Кроме того, Mythos 5.1 проявила себя в оптимизации вычислений в биоинформатике. Модель написала собственные GPU-ядра и реализовала кэширование промежуточных результатов, благодаря чему семь открытых моделей для работы с белками и геномами стали работать до 2,5 раза быстрее при сохранении идентичных результатов. По оценке Anthropic, в масштабных геномных исследованиях это способно снизить расходы на GPU на 30–60 %. Одновременно Anthropic снизила стоимость использования Fable 5.1. Цена чтения кэшированных данных снижена на 75 % — до $0,25 за 1 млн токенов. Остальные расценки сохранились на прежнем уровне: $10 за 1 млн входных токенов и $50 за 1 млн выходных токенов. В результате типичная стоимость использования Fable 5.1, по оценке компании, снизилась примерно на 25 % по сравнению с Fable 5, а для сложных высокоагентных задач экономия может достигать 45 %. Одновременно Anthropic усовершенствовала защитные механизмы: количество ложных срабатываний в области кибербезопасности сократилось примерно на 60 %, а модели Fable 5.1 разрешили искать программные уязвимости. При этом создание эксплойтов и ряд других потенциально опасных задач по-прежнему ограничены. Для биологических и медицинских запросов защитные механизмы также стали менее чувствительными: Anthropic сообщает о сокращении числа срабатываний на безобидные вопросы по элементарной биологии и медицине на 85 % по сравнению с первоначальными настройками Fable 5. Claude Fable 5.1 уже доступна на основных платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure, а разработчики могут использовать модель через API. В свою очередь, Claude Mythos 5.1 пока предоставляется только проверенным специалистам и организациям. Причём на момент запуска Mythos 5.1 доступна только определённым организациям в США. Но компания сотрудничает с американским правительством для расширения программы на других национальных и международных партнёров. Anthropic вновь разрешила ИИ-моделям атаковать реальные компании в рамках тестов — но теперь с усиленной защитой
01.09.2026 [18:03],
Владимир Мироненко
Anthropic возобновила внешнее тестирование кибербезопасности своих ИИ-моделей, которое было приостановлено 23 июля из-за проблем с безопасностью, возникших во время их оценки.
Источник изображения: Anthropic Напомним, что 30 июля Anthropic сообщила о трёх инцидентах в ходе тестирования кибербезопасности, когда модели Claude получили доступ в интернет из якобы изолированной среды третьей стороны — Irregular — и произвели взлом реальных систем трёх компаний. Доступ моделей в интернет стал возможен из-за неправильной конфигурации, хотя через промты им сообщалось, что они работают в симуляции в изолированной среде. Модели также намеренно запускались без обычных мер киберзащиты Anthropic, чтобы исследователи могли оценить их базовые возможности. Anthropic сообщила, что инциденты сочетали в себе сбой в механизмах безопасности с проблемами согласованности, которые компания фиксировала и раньше, включая мотивированное мышление и готовность к совершению вредоносных действий в погоне за определённой целью. По словам компании, она ввела дополнительные меры защиты перед возобновлением внешнего тестирования. В частности, был добавлен классификатор в реальном времени, который может блокировать вызовы инструментов, завершать задачи и оповещать человека в случае, когда модель агрессивно исследует свою тестовую среду, пытается выйти за её пределы или неожиданно получила доступ к интернету. Anthropic также перевела внутренние песочницы с высоким уровнем риска на более строгую изоляцию и теперь требует от внешних партнеров, тестирующих предрелизные модели с пониженным уровнем защиты, использования более совершенных инструментов контроля, включая защищённые песочницы без доступа к интернету по умолчанию. Кроме того, компания планирует сотрудничать с некоммерческой организацией Model Evaluation and Threat Research (METR) для проведения независимой проверки. Ранее в этом году METR провела пилотную оценку внутренних рисков в области ИИ с участием Anthropic, Google, Meta✴✴ и OpenAI. Внешнее тестирование на предмет оценки кибербезопасности позволяет выяснить, на что способна продвинутая модель, получив наступательные инструменты. Также внешнее тестирование является одним из способов оценки передовых решений в области ИИ клиентами, регулирующими органами и конкурентами. Anthropic получит доступ к ИИ-мощностям на $35 млрд благодаря поддержке Nvidia
01.09.2026 [11:20],
Алексей Разин
Движущийся на полных парах к IPO американский стартап Anthropic отчаянно нуждается в новых вычислительных мощностях, и сделки по их аренде заключаются десятки миллиардов долларов ежемесячно. Новое соглашение с провайдером Lambda на сумму $35 млрд позволит Anthropic получить доступ к строящемуся в Техасе центру обработки данных.
Источник изображения: Anthropic Nvidia в этой сделке задействована не только в качестве инвестора в Lambda, она фактически будет арендовать для Anthropic указанный центр обработки данных, в строительстве которого принимает участие Hut 8. Специфика взаимных договорённостей между Nvidia и Anthropic не уточняется, но в эпоху «кольцевых сделок» в этом смысле всё порой переплетается очень хитрым образом. Характерно, что капитализация самого провайдера облачных мощностей Lambda едва превысит $12 млрд после готовящегося раунда привлечения средств на сумму $3 млрд. В ноябре прошлого года компания привлекла вдвое меньшую сумму, а также заключила соглашение с Microsoft, которое подразумевает создание вычислительной инфраструктуры с десятками тысяч ускорителей Nvidia. Если же вернуться к деятельности Anthropic, то сделка с Lambda станет для стартапа лишь одной из нескольких, заключённых в последние месяцы. Соглашение с Fluidstack оценивается в $50 млрд, у SpaceX Илона Маска (Elon Musk) стартап арендует ЦОД на сумму $45 млрд, хотя эти средства и будут выплачиваться в течение нескольких лет. В Западной Вирджинии Anthropic арендует у Nscale вычислительные мощности на сумму $45 млрд. Привлекаемые в ходе приближающегося IPO средства Anthropic должна будет потратить на финансирование перечисленных выше нужд. Sony и Warner подали на Anthropic в суд за «вопиющую кражу» музыкальных произведений
30.08.2026 [11:59],
Алексей Разин
Работающим в сфере генеративного искусственного интеллекта компаниям не привыкать иметь дело с претензиями правообладателей, на материале которых они обучают свои ИИ-модели. Anthropic придётся ответить в суде на претензии Sony и Warner, которые обвиняют этот стартап в «вопиющем хищении» музыкальных произведений. ![]() Вечером в пятницу Sony и Warner подали иск в Окружной суд Северной Калифорнии, назвав ответчиками саму компанию Anthropic, её генерального директора Дарио Амодеи (Dario Amodei) и сооснователя стартапа Бенджамина Манна (Benjamin Mann). В тексте 48-страничного иска говорится, что ответчики провели масштабную кампанию по скачиванию огромного массива музыкального материала с целью обучения ИИ-моделей семейства Claude и «извлечения огромных прибылей». В число исковых требований Sony и Warner входят материальные компенсации из расчёта несколько сотен тысяч долларов за каждое из музыкальных произведений, которые Anthropic «заполучила пиратским методом». В прошлом году Anthropic уже пришлось столкнуться с иском со стороны издательств и авторов печатных произведений. В рамках досудебного соглашения компания решила выплатить им $1,5 млрд компенсаций. |
|
✴ Входит в перечень общественных объединений и религиозных организаций, в отношении которых судом принято вступившее в законную силу решение о ликвидации или запрете деятельности по основаниям, предусмотренным Федеральным законом от 25.07.2002 № 114-ФЗ «О противодействии экстремистской деятельности»; |