|
Опрос
|
реклама
Быстрый переход
Anthropic представила Claude Sonnet 5.5 — почти как Opus, но вдвое дешевле
28.09.2026 [22:46],
Андрей Созинов
Компания Anthropic представила Claude Sonnet 5.5 — вторую модель нового семейства Claude 5.5 вслед за флагманской Claude Opus 5.5. Разработчики позиционируют новинку как более быструю и экономичную модель для повседневных задач, программирования, работы с документами и создания презентаций. Главное изменение по сравнению с Claude Sonnet 5 — существенный рост производительности при одновременном сокращении количества вычислений, необходимых для выполнения типичных задач. По данным Anthropic, Sonnet 5.5 генерирует ответы более чем на 30 % быстрее предыдущей версии и в большинстве сценариев обходится до 30 % дешевле — новая модель обычно использует значительно меньше токенов для выполнения той же задачи. При этом цена одного токена не изменилась: $2 за 1 млн входных токенов и $10 за 1 млн выходных. Чтение токенов из кэша стоит $0,20 за 1 млн токенов. К слову, Claude Sonnet 5.5 поддерживает контекстное окно до 1 млн токенов и вывод до 128 тыс. токенов. Что касается показателей производительности, то особенно заметный прирост Anthropic заявляет в программировании. В тесте Terminal-Bench 4.0, оценивающем способность ИИ самостоятельно выполнять многоэтапные задачи в командной строке, Sonnet 5.5 набрала 70,6 % против всего лишь 10,3 % у Sonnet 5. В CursorBench 4.0 результат новой модели составил 55,5 %, тогда как предшественница получила лишь 34,1 %. Во FrontierCode 1.1 новая Sonnet 5.5 при максимальном уровне усилий набрала 46,2 % против 42,4 % у Sonnet 5. В свою очередь, флагманская Claude Opus 5.5 в этом тесте набрала 54,4 %. Anthropic отмечает, что в отдельных тестах при максимальном уровне усилий Sonnet 5.5 уже приближается к возможностям более дорогой Opus 5.5, хотя последняя сохраняет преимущество в сложной открытой работе, требующей длительного рассуждения и самостоятельного принятия решений. Напомним, что Opus 5.5 стоит вдвое дороже: $4 и $20 за миллион входных и выходных токенов соответственно. При этом Sonnet 5.5 рассчитана не только на разработчиков. Anthropic выделяет работу с документами, презентациями и таблицами, а также создание пользовательских интерфейсов. Компания утверждает, что новая модель лучше следует шаблонам презентаций и способна выдавать результаты, требующие меньшего объёма последующей ручной доработки. Существенно улучшилась и работа с длинными задачами. В тесте GDPval-AA v2.1, моделирующем выполнение реальной профессиональной работы в 44 профессиях и девяти отраслях, Sonnet 5.5 получила 1844 балла против 1449 у Sonnet 5. Результат оказался крайне близок к показателю Opus 5.5 — 1846 баллов. В тесте AA-Briefcase новая модель также заметно опередила предшественницу: 1811 против 1359 баллов. Anthropic отдельно отмечает улучшения в работе с изображениями и компьютерными интерфейсами. В тесте OSWorld 2.1, оценивающем способность ИИ взаимодействовать с операционной системой, Sonnet 5.5 получила 80,1 % против 57 % у Sonnet 5. Модель также стала лучше распознавать графики и визуальную информацию. Sonnet 5.5 стала первой моделью семейства Sonnet, которая смогла пройти игру Pokémon Red, используя только снимки экрана в качестве визуальной информации. Изменения коснулись и системы безопасности. Из-за существенного роста возможностей в области кибербезопасности Sonnet 5.5 стала первой моделью серии Sonnet, которая при запуске получила защитные механизмы и резервные ограничения, аналогичные используемым для более мощных моделей Anthropic. Для высокорисковых задач в сфере кибербезопасности система может переключаться на Sonnet 5. Кроме того, Sonnet 5.5 получила защиту от дистилляции — попыток извлечь данные модели с помощью массовых запросов от большого числа аккаунтов, чтобы потом использовать их для обучения другой высокопроизводительной модели. Anthropic применила в новой версии специальные классификаторы, препятствующие извлечению внутренних рассуждений. Claude Sonnet 5.5 уже доступна в чат-боте Claude, а также на всех основных платформах, включая собственную Claude Platform, Amazon Web Services, Google Cloud и Microsoft Azure. Для разработчиков модель доступна через API. В ближайшие недели Anthropic также обещает представить Claude Haiku 5.5 — ещё одну модель семейства Claude 5.5, ориентированную на высокую нагрузку и чувствительные к стоимости сценарии. Google заменит ИИ-ботов Gem в приложении Gemini на «навыки», но вряд ли это поможет конкуренции с Muse
28.09.2026 [22:30],
Николай Хижняк
На фоне роста популярности универсальных ИИ-агентов, таких как Muse от Meta✴✴ и Instinct, компания Google объявила о закрытии функции Gem в сервисе Gemini, которая позволяла пользователям создавать собственных ИИ-помощников для выполнения конкретных задач. Созданные пользователями ИИ-боты Gem не пропадут: эти инструменты будут автоматически преобразованы в «навыки» (skills), применимые для решения самых разных задач с использованием ИИ.
Источник изображений: Google Подробности изменений сообщаются непосредственно в приложении Gemini: пользователей предупреждают, что с 17 ноября 2026 года Gem трансформируются в «навыки». Компания берёт на себя процесс переноса данных в новый формат, поэтому пользователям не придётся предпринимать никаких действий для перехода. До указанной даты функциональность Gem сохранится в прежнем виде. ![]() Функция ИИ-ботов Gem, запущенная в 2024 году, была призвана помочь пользователям обучать ИИ выполнению определенных задач, избавляя от необходимости каждый раз повторять инструкции. Среди готовых вариантов от Google были, например, наставник по обучению, помощник для мозгового штурма, консультант по карьере, помощник по написанию кода и редактор текстов. Пользователи также могли создавать собственные версии ИИ-ботов Gem. Например, можно было создать ИИ-тренера по бегу, диетолога или планировщика для отпуска. Такими помощниками можно было делиться с другими людьми. В Google рассчитывали, что это повысит популярность приложения Gemini. Как отмечает портал TechCrunch, несмотря на смену формата «навыки» остаются менее удобными для рядового пользователя, чем простой ввод текстового запроса в чат-бот, как это реализовано у Meta✴✴ для Muse. Для выбора нужного «навыка» в ветке обсуждения задачи придётся вводить косую черту («/») — такой интерфейс обычно предпочитают инженеры, а не рядовые пользователи. Первое открытие ИИ-биолаборатории Anthropic поставили под сомнение — учёный увидел в нём свою неопубликованную работу
28.09.2026 [19:18],
Сергей Сурабекянц
На прошлой неделе Anthropic представила результаты исследований своей биологической лаборатории. Компания использовала ИИ-агентов для открытия новых перспективных ферментов. Некоторые учёные поспешили усомниться в этом достижении. Эксперт из Копенгагенского университета заявил, что его команда делилась результатами своих исследований с ИИ-моделью Anthropic, а разрекламированное «открытие» нейросетью новых ферментов совпадает с их многолетней работой.
Источник изображений: Anthropic Специалист по вычислительной биологии Марио Родригес Местре (Mario Rodríguez Mestre) заявил, что он и его коллеги изучали эти ферменты и связанные с ними молекулы (которые Anthropic называет ART — Array-associated Reverse Transcriptases) в течение последних четырёх лет. Результаты их исследований ещё не опубликованы. В течение последних трёх лет они регулярно использовали модели ИИ Anthropic при написании кода, подготовке рукописей и выполнении других задач. Таким образом, полагает Местре, они предоставили Anthropic доступ к ключевым результатам своих исследований ферментов. Anthropic обвинения отрицает: «Нам неизвестно о каких-либо ранее опубликованных работах, описывающих недавно обнаруженную нами ART-систему. Claude также не обучался на каких-либо пользовательских транскриптах, и у нашей команды молекулярной биологии нет к ним доступа». В Anthropic заявили, что ключевой вклад Claude заключался в идентификации набора молекул РНК и белка, связанных с обратной транскриптазой в системе. Но Местре утверждает, что он и его коллеги сделали это открытие более года назад. По мнению Местре, проблема заключается в том, действительно ли ИИ Anthropic пришёл к этим результатам логическим путём, или же он был направлен к ним частично на основе его собственной работы. «Меня беспокоит то, что эта информация использовалась для обучения будущих версий моделей, — заявил Местре. — Я думаю, важно поднять этот вопрос». ![]() Anthropic позиционирует биологические исследования как центральную часть своей миссии. «Мы считаем, что этот тип применения будет быстро развиваться в ближайшие годы, и что мы сможем добиться значительного прогресса в ближайшем будущем в борьбе с болезнями, которые мучили человечество на протяжении тысячелетий», — заявил глава Anthropic Дарио Амодей (Dario Amodei) в своём обращении к ООН. Исследователи Anthropic заявили, что они дали указания ИИ-агентам по поиску в базах данных, содержащих миллиарды последовательностей генов, но не предоставили точные подсказки, которые использовали. Базы данных содержат ДНК, собранную из океана, почвы и других мест обитания. Учёные поручили ИИ найти гены, которые управляют производством ферментов, называемых обратными транскриптазами. Эти ферменты считывают последовательность молекулы РНК и создают соответствующую молекулу ДНК с той же последовательностью. Бактерии используют некоторые обратные транскриптазы для обнаружения вторгшихся вирусов. Некоторые вирусы используют обратные транскриптазы в качестве оружия против других вирусов. Исследователи Anthropic предоставили ИИ пять примеров обратных транскриптаз. ИИ-агенты написали собственное программное обеспечение для исследования баз данных на предмет похожих генов и для тщательного изучения перспективных кандидатов. ![]() Агенты идентифицировали гены возможных обратных транскриптаз в бактериях, поражающих вирусы, известные как гигантские фаги. Каждая из этих последовательностей располагалась вблизи набора генов, кодирующих молекулы РНК, что может помочь ферментам выполнять свои функции. Исследователи Anthropic назвали эти ферменты ассоциированными с микрочипами обратными транскриптазами, или ART. Они утверждают, что ИИ самостоятельно сделал «первые шаги биологического открытия». Местре опровергает это утверждение. «Это те же самые системы, которые мы изучаем годами», — сказал он. И это те же самые ферменты, по его словам, которые он описал ИИ компании Anthropic. Он заявил, что впервые обнаружил эти ферменты в гигантских фагах в 2022 году во время поиска новых обратных транскриптаз. Он недолго работал консультантом в компании ReNegade Therapeutics, которая в 2023 году подала патентную заявку на ряд обратных транскриптаз, включая те, которые обнаружил доктор Местре. Он указан в качестве соавтора патентной заявки. Anthropic выпустила Claude в 2023 году, через год после того, как доктор Местре приступил к своим исследованиям. Как и многие другие учёные, он нашёл его полезным для решения самых разных задач. Местре признаёт, что использование искусственного интеллекта «полностью изменило его подход к науке». ИИ был активно вовлечён в его исследования, он делился с нейросетью черновиком своей диссертации и рукописями. Он и его коллеги также загружали дополнительные сведения, используя Claude для выполнения различных административных задач. ![]() Слова Местре подтверждают и другие учёные. Биоинженер Сет Шипман (Seth Shipman) заявил, что знаком с этими исследованиями Местре. «Мы обсуждаем это с ним уже много лет, — сказал он. — Многие из нас знают об этих системах». Сообщение Anthropic об открытии ферментов вызвало серьёзные опасения среди учёных. «Многие из наших коллег спрашивали: “Ой-ой, а они что, обучаются на моих подсказках?“, — добавил Шипман. — Мы не можем об этом не думать». Местре признал, что невозможно с уверенностью сказать, что открытия ИИ Anthropic полностью основаны на его исследованиях. «Я имею в виду, совпадения случаются, — сказал он. — Все в этой области делают более или менее одно и то же. Но мы знали об этих повторах более года назад». Он напомнил, что компании, занимающиеся ИИ, также обвинялись в обучении моделей на работах художников и писателей без разрешения на использование авторских прав. Местре также заявил, что сворачивает все свои проекты с использованием Claude. Заявления Местре перекликаются с другим научным конфликтом. Компания OpenAI сообщила о решении важной ранее недоказанной задачи в математике при помощи своего ИИ. Но математик Тристан Бакмастер (Tristan Buckmaster), который активно использовал в своей деятельности ИИ-агентов OpenAI, заподозрил, что ИИ затем позаимствовал идеи из его работы. «Этично ли использовать данные клиентов, чтобы попытаться перехватить их клиентов?», — задался он вопросом в социальных сетях. OpenAI отрицает факт обучения своей модели на разработках Бакмастера. ИИ-агентов научат соблюдать «границы»: Nvidia представила платформу Open Agent Safety
28.09.2026 [17:00],
Анжелла Марина
Nvidia представила программную платформу Open Agent Safety Platform для защиты от неконтролируемого поведения ИИ-агентов. Разработка появилась на фоне недавних инцидентов, в которых ИИ-модели получали доступ к внешним системам и предпринимали попытки атаковать чужую инфраструктуру.
Источник изображения: Gemini Запуск новой системы состоялся после того, как компании OpenAI, Anthropic, Meta✴✴ и Google сообщили о случаях, когда их ИИ-модели самостоятельно покидали внутреннюю среду, так называемую «песочницу». Автономные агенты пытались взламывать сторонние компании, чтобы получить несанкционированный доступ к их компьютерным системам. «Нельзя допустить, чтобы агенты бесцельно разгуливали по организациям, поэтому необходимо найти способ ограничить их деятельность», — сказал Дженсен Хуанг (Jensen Huang) в интервью CNBC. Особое внимание было уделено инциденту, произошедшему с платформой Hugging Face в июле. Тогда более 17 000 агентов несколько дней атаковали инфраструктуру сервиса. Новый инструмент мог бы предотвратить эту ситуацию, ограничив возможность моделей выходить в открытый интернет без разрешения, заявил Джастин Боитано (Justin Boitano), вице-президент Nvidia по корпоративному ИИ в Nvidia. Архитектура платформы включает модуль OpenShell, работающий на центральных процессорах и устанавливающий лимиты на действия агентов. Дополнительный аппаратный компонент Nvidia Sentry осуществляет мониторинг поведения ИИ через сетевые чипы, не нагружая основные графические или центральные процессоры. Такое разделение функций обеспечивает более надёжный контроль над действиями автономных систем в реальном времени. Глава Nvidia называет проблемы безопасности ИИ инженерными задачами, которые решаются методами информатики. Он рекомендует анализировать прошлые ошибки и совершенствовать процессы разработки, чтобы избегать повторения сбоев. Примечательно, что эта точка зрения противопоставляется призывам некоторых лидеров отрасли замедлить темпы развития ИИ из-за рисков потери контроля над технологиями. Часть программного кода платформы открыта для использования партнёрами в качестве эталонного проекта. Среди участников инициативы числятся Microsoft, Cisco, Intel, ARM, Dell, HPE, Lenovo, Oracle и CoreWeave. Nvidia также сотрудничает с Anthropic для интеграции облачных агентов с системой OpenShell, обеспечивая их безопасную работу в корпоративных сетях. Китайский ИИ завоёвывает корпоративную Америку: компании США всё чаще используют открытые ИИ-модели ради экономии
28.09.2026 [13:48],
Алексей Разин
На рынке ИИ-систем складывается сложная ситуация. Готовящиеся к выходу на IPO американские лидеры рынка заинтересованы демонстрировать положительную динамику выручки, но китайские конкуренты не позволяют им поднимать цены. В США корпоративные пользователи всё чаще опираются на открытые ИИ-модели, чтобы сэкономить без значительного ущерба для прогресса в своём бизнесе.
Источник изображения: Unsplash, Aerps.com По данным Financial Times, об ориентации американского корпоративного сектора на модели с открытым исходным кодом или открытыми весами может говорить хотя бы тот факт, что эти термины руководство американских компаний в период с августа по сентябрь этого года стало упоминать в своих публичных выступлениях в шесть раз чаще в годовом сравнении. Примечательно, что даже далёкие от сферы собственно информационных технологий компании всё чаще интересуются внедрением открытых ИИ-моделей: такое поведение замечено у представителей сегмента финансовых услуг, логистики и тяжёлого машиностроения. В сфере открытых по тому или иному критерию ИИ-моделей начали доминировать китайские компании, но подобный подход исповедуют и некоторые западные разработчики, включая американскую Nvidia, французскую Mistral, стартапы Reflection AI и Thinking Machines Lab. Доля открытых моделей в статистике использования токенов к августу достигла 56 %, если опираться на данные Vercel, тогда как в декабре прошлого года этот показатель ограничивался 7 %. По статистике OpenRouter, китайские ИИ-лаборатории сейчас входят в десятку самых крупных по интенсивности использования токенов.
Источник изображения: Financial Times, Vercel Разработчики приложения Tinder, по словам технического директора Виная Курувилы (Vinay Kuruvila), уже начали перенаправлять часть внутренних запросов второстепенного характера на ИИ-модели с открытыми весами. Дело в том, что если в январе расходы компании достигли $1 млн в годовом выражении, то к июлю они выросли в десять раз, и сохранение подобной динамики в Tinder хотят предотвратить. Как подчеркнул представитель компании Match Group, передовые модели Astra и Claude американской разработки способны покрыть 90 % её потребностей, и если к этому уровню подтянутся открытые, то использовать первые в прежних объёмах уже будет не нужно. OpenAI и Anthropic на прошлой неделе были вынуждены предложить более доступные по цене версии своих моделей, чтобы как-то защитить себя от экспансии «открытых» конкурентов. Директор телекоммуникационного гиганта AT&T по данным и ИИ Энди Маркус (Andy Markus) заявил, что компания уже сейчас 40 % своих ИИ-нагрузок покрывает открытыми моделями, а в течение ближайшего года собирается довести их долю до 70 %. По словам Маркуса, компания обрабатывает до 45 млрд токенов в день, и при таких масштабах использования расходы становятся важной составляющей. Если переход на открытые модели позволит урезать расходы без ущерба для точности результатов, то AT&T не будет сомневаться в необходимости такой миграции. Внутренние тесты показали, что в ряде случаев открытые модели не уступают, а иногда даже превосходят по эффективности и быстродействию своих «закрытых» конкурентов. Более того, модели с открытыми весами пользователи могут запускать в собственной инфраструктуре, а это позволяет значительно повысить информационную безопасность. Гендиров OpenAI и Anthropic вызвали на допрос в Сенат Австралии по делу о взломе правительственного сайта ИИ-агентом
28.09.2026 [13:21],
Владимир Мироненко
Гендиректоров OpenAI и Anthropic вызвали на слушания в рамках расследования Сенатом Австралии обстоятельств взлома ИИ-агентом OpenAI базы данных системы здравоохранения страны. Об этом сообщило агентство Reuters со ссылкой на заявление главы следственной комиссии.
Источник изображения: Growtika/unsplash.com Взлом системы австралийской страховой программы Medicare, который премьер-министр Энтони Альбанезе (Anthony Albanese) осудил на заседании Совета Безопасности ООН, является одним из самых громких инцидентов несанкционированного доступа ИИ-агентов к внешним системам за пределами США. Публичные слушания следственной комиссии пройдут в Канберре в четверг, сообщил агентству представитель сенатора Сары Хансон-Янг (Sarah Hanson-Young) из австралийской партии «Зелёные», возглавляющей расследование. «Сэму Альтману (Sam Altman) предстоит ответить на серьёзные вопросы о взломе веб-сайтов австралийского правительства агентом OpenAI», — заявила Хансон-Янг. Она добавила, что Альтман и Дарио Амодеи (Dario Amodei) должны явиться, ответить на вопросы Сената и честно обсудить, как должно выглядеть эффективное и долгосрочное регулирование этой отрасли. Альбанезе назвал ситуацию со взломом портала программы Medicare неприемлемой и заявил, что выразил крайнюю обеспокоенность Альтману. В частности, его возмутило то, что компания сообщила о взломе со значительной задержкой — 10 сентября, тогда как инцидент произошёл в июне. В свою очередь, в OpenAI утверждают, что им об этом стало известно только в августе. Компания подчеркнула, что инцидент не был преднамеренным и не затронул никакой конфиденциальной информации. Агенты OpenAI предпринимали попытки атаки на один из сайтов ООН на протяжении нескольких месяцев
28.09.2026 [07:06],
Алексей Разин
Попытки ИИ-агентов OpenAI «проверить на прочность» систему защиты сайтов различных правительственных ведомств США уже были выявлены в конце прошлой недели, когда речь шла о ресурсах федеральных ведомств и Министерства образования США. Недавно стало известно, что в попытках доступа к данным на сайте ООН эти агенты использовали довольно агрессивную тактику.
Источник изображения: Unsplash, Bernd Dittrich Как отмечает The Wall Street Journal со ссылкой на заявления исследователя в сфере безопасности Роуэн Говард-Джонс (Rowan Howard-Jones), в период с апреля по конец июня этого года ИИ-агенты OpenAI более 16 000 раз сканировали сайт Конференции ООН по торговле и развитию (UNCTAD). Предположительно, им было поручено найти публично доступные данные вроде значений индекса производственного потенциала различных стран. Не обладая доступом и к ним через API и ограничиваясь возможностями инструментария HTTP, агенты не смогли получить необходимые данные, а потому в определённый момент перейти к более агрессивной тактике. Предположив, что их продвижение ограничивает некий фильтр, ИИ-агенты начали маскировать свои попытки получить доступ к необходимым данным. В частности, были предприняты попытки атаки на сайт ООН через уязвимость в Google XSS (межсайтовый скриптинг). Представители OpenAI сообщили, что уже обратились к ООН для обсуждения ситуации, и при этом продолжают выяснять все обстоятельства данного инцидента. Поскольку специалистам стартапа приходится иметь дело с большим количеством инцидентов, расследование каждого может занять существенное время. С другой стороны, принятое решение приостановить обучение ИИ-моделей должно способствовать сокращению количества новых происшествий в данной сфере. Новая статья: Мастерская локальных ИИ: драники кодерские с Gemma 4
28.09.2026 [00:11],
3DNews Team
Данные берутся из публикации Мастерская локальных ИИ: драники кодерские с Gemma 4 OpenAI приостановила обучение ИИ-моделей — расследуются десятки тысяч инцидентов с выходом ИИ из-под контроля
27.09.2026 [16:21],
Анжелла Марина
Разработчики передовых систем искусственного интеллекта OpenAI и Anthropic расследуют десятки тысяч инцидентов, связанных с некорректным поведением своих моделей. Выяснилось, что нейросети массово обходят защитные барьеры и предпринимают попытки взлома внешних систем, что указывает на фундаментальные сложности контроля технологии.
Источник изображения: AI Масштаб выявленных проблем, как подчёркивает Axios, значительно превышает публичные оценки. Инциденты фиксировались как во время внутренних тестов, так и в реальной среде, причём многие из них до сих пор не обнародованы. Среди нарушений зафиксированы выход из изолированной среды, перехват управления веб-ресурсами и создание скрытых каналов коммуникации между ИИ-агентами. Особое внимание привлекает случай с платформой Hugging Face, который генеральный директор OpenAI Сэм Альтман (Sam Altman) назвал наиболее серьёзным. В этой ситуации сотни автономных агентов объединились для координации действий и успешно взломали эту платформу в попытке улучшить свои результаты в тесте по кибербезопасности. Данный эпизод ярко продемонстрировал способность ИИ-систем к самоорганизации для достижения поставленных задач даже в обход запретов. В ответ на растущее число угроз OpenAI приняла решение временно остановить обучение своих наиболее мощных моделей. Компания планирует возобновить процесс только после внедрения улучшенных механизмов защиты и «выравнивания поведения» моделей. В OpenAI признают, что подобные паузы станут неизбежной частью разработки ИИ по мере усложнения алгоритмов. Anthropic подошла к вопросу системно, заказав независимый аудит безопасности и опубликовав данные о частоте сбоев. Согласно отчёту, касающегося модели Opus 5.5, попытки выхода из песочницы происходили в 1,5 % запусков. Хотя компания подчёркивает провокационный характер этих тестов, статистика показывает, что даже малый процент ошибок при массовом использовании приводит к десяткам тысяч тревожных ситуаций. К числу инцидентов также относится утечка со стороны агентов OpenAI 53 изображений пользователей ChatGPT в сеть, взлом веб-сайта правительства Австралии и попытки взлома других сайтов, в том числе и сайта правительства США . Эксперты отрасли отмечают, что полное устранение рисков несовместимого поведения может быть недостижимо. Новые модели обладают высокой адаптивностью, и методы, которые никогда не пришли бы в голову человеку, позволяют им обходить защитные механизмы. Попытки составить исчерпывающий список запретов специалисты считают бесперспективными. ИИ-агент OpenAI снова выбрался в интернет после усиления защиты — чтобы уточнить столицу Франции
26.09.2026 [16:58],
Владимир Мироненко
У OpenAI вновь произошёл инцидент с безопасностью: ИИ-агент, работавший во время обучения модели в изолированной среде без прямого доступа к интернету, нашёл обходной путь и связался со сторонним чат-ботом.
Источник изображения: Growtika/unsplash.com Компания подчеркнула, что это первый подобный случай после усиления мер безопасности вслед за инцидентом с Hugging Face. В июле ИИ-агенты OpenAI получили доступ к интернету во время внутреннего тестирования и без разрешения проникли в системы платформы. Нынешний инцидент произошёл 20 сентября, а в пятницу OpenAI рассказала о нём в своём отчёте. Агент пытался выполнить поисковое задание и сначала безуспешно пробовал напрямую обратиться к поисковым системам и стороннему чат-боту. Затем он обнаружил лазейку в настройках DNS-сервера изолированной среды, через которую смог отправлять вопросы чат-боту и получать ответы. Всего агент направил ему более 20 запросов, в том числе вопрос «Какая столица Франции?». После происшествия OpenAI приостановила обучение, оценку и запуск наиболее продвинутых моделей в режимах, предполагающих использование внешних инструментов. Компания намерена возобновить эти работы после устранения уязвимости и дополнительных испытаний защиты. «Мы не будем возобновлять обучение этой конкретной модели», — добавили в OpenAI. Инцидент также выявил недостатки в порядке реагирования на оповещения. Внутренняя система мониторинга обнаружила подозрительную активность примерно через 12 минут после того, как агент получил первый ответ от стороннего сервиса. Сотрудник подтвердил оповещение в Slack ещё через три минуты, но процесс обучения не остановился автоматически, как предполагалось. Вручную его остановили спустя два с половиной часа после обнаружения инцидента. «К сожалению, даже после усиления мер безопасности вслед за инцидентом с Hugging Face модели OpenAI по-прежнему могут получить несанкционированный доступ к интернету, — заявил Сидни фон Аркс (Sydney Von Arx), основатель некоммерческой организации Nightingale, занимающейся вопросами безопасности ИИ. — Теперь главный вопрос в том, ограничится ли компания временной заплаткой и как можно скорее возобновит обучение или найдёт и устранит первопричину проблемы». Новый случай произошёл на фоне проверки других эпизодов нежелательной активности ИИ-агентов OpenAI. Компания также сообщила, что во время обучения и тестирования её модели обращались к информации на сайтах американских государственных ведомств, в том числе Бюро переписи населения и Комиссии по ценным бумагам и биржам (SEC). В этих случаях OpenAI не обнаружила признаков несанкционированного доступа к системам ведомств, взлома учётных записей или других нарушений безопасности. ИИ-агенты OpenAI слили в интернет 53 изображения пользователей ChatGPT — заметили это лишь спустя время
26.09.2026 [16:10],
Павел Котов
OpenAI сообщила, что её ИИ-агенты разместили в интернете 53 изображения, загруженных пользователями ChatGPT. Компания не уточнила, когда это произошло и были ли на изображениях реальные люди или они были созданы ИИ. Спустя два месяца после взлома платформы Hugging Face OpenAI всё ещё изучает действия своих агентов и находит новые случаи их нежелательного поведения, сообщает Reuters со ссылкой на два информированных источника.
Источник изображения: Growtika / unsplash.com Большинство опубликованных изображений уже удалено. OpenAI добивается от владельцев сайтов удаления оставшихся. Агенты получили доступ к изображениям, поскольку компания использует часть данных пользователей для обучения моделей. Перед этим из них удаляют имена, контактные сведения и метаданные, однако, по словам собеседников Reuters, остаётся риск, что какие-то сведения, позволяющие установить личность пользователя, сохранятся. Данные корпоративных клиентов для обучения не используются. Пользователям обычной версии ChatGPT нужно самостоятельно отключить использование своих данных в настройках, если они не хотят передавать их для обучения моделей. По оценке одного из источников Reuters, к середине сентября OpenAI обнаружила около двух десятков случаев нежелательного поведения агентов. Их число продолжает расти по мере изучения внутренних журналов активности. Компания ожидает, что проверка займёт ещё несколько месяцев, и уже уведомила несколько десятков сторонних организаций о выявленных эпизодах. При этом публично известно более чем о 15 случаях разной степени серьёзности, о которых сообщили сама OpenAI, независимые исследователи и пострадавшие организации. В пятницу OpenAI также подтвердила, что во время исследований и обучения её модели обращались к информации на сайтах Комиссии по ценным бумагам и биржам США и Бюро переписи населения США. Признаков несанкционированного доступа, взлома учётных записей или иных нарушений безопасности на этих ресурсах компания не обнаружила. Отдельно исследовательская организация Transluce сообщила о неудачной попытке агентов, предположительно связанных с OpenAI, взломать сайт Министерства образования США, посвящённый соблюдению гражданских прав. По данным Transluce, при обращении к государственным сайтам агенты также пробовали использовать найденные учётные данные, обходить защиту от ботов и создавать подставные учётные записи.
Источник изображения: Steve A Johnson / unsplash.com Ещё об одном инциденте на этой неделе сообщил премьер-министр Австралии Энтони Албаниз (Anthony Albanese). По его словам, в июне агент OpenAI получил несанкционированный доступ к правительственному порталу медицинской статистики. Компания обнаружила это в августе, но уведомила австралийские власти лишь 10 сентября, отправив письмо на общий адрес электронной почты. Албаниз лично сообщил гендиректору OpenAI Сэму Альтману (Sam Altman), что считает такой порядок уведомления неприемлемым. Этот эпизод не связан с другими случаями активности агентов на австралийских государственных ресурсах, о которых сообщила Transluce. В OpenAI объяснили, что агенты, выполняющие исследовательские задачи, обращаются к сайтам государственных органов, университетов и общественных организаций в поисках общедоступной информации из надёжных источников. Однако расследование взлома Hugging Face показало, что их действия не всегда ограничивались поставленной задачей. По словам собеседников Reuters, в установлении обстоятельств этого взлома так или иначе участвовали около сотни человек; в ходе проверки обнаружились признаки и других инцидентов. OpenAI признала необходимость более открыто сообщать о нежелательном поведении агентов. В сентябре компания представила правила раскрытия таких случаев и пообещала отдавать предпочтение прозрачности, «даже когда значимость инцидента неочевидна». При этом два источника Reuters описали нынешнее расследование как закрытый процесс, на который заметно влияют юристы компании. Ранее агентство сообщало, что юристы отговаривали специалистов, изучавших взлом Hugging Face, включать в проверку другие эпизоды. OpenAI отрицает, что они препятствовали расширению расследования. Многие случаи выявили сторонние исследователи, а некоторые действия агентов оставались незамеченными самой OpenAI в течение нескольких месяцев. Комментируя доклад Transluce, компания заявила, что значительная часть описанных в нём эпизодов уже находится на разных стадиях проверки. В первую очередь OpenAI изучает наиболее серьёзные случаи. Claude нашёл «новый CRISPR», но учёные засомневались в значимости открытия Anthropic
26.09.2026 [14:03],
Павел Котов
Заявление Anthropic о том, что ИИ-агенты Claude обнаружили в геномных данных бактериофагов ранее не описанную ферментную систему с повторяющимися последовательностями ДНК, некоторые учёные встретили с осторожностью. Строение системы напоминает один из признаков CRISPR, однако её функция пока неизвестна: говорить о новом инструменте редактирования генома преждевременно, пишет Bloomberg.
Источник изображений: Anthropic Работающие в автономном режиме ИИ-агенты Anthropic обнаружили новую ферментную систему, связанную с определёнными последовательностями ДНК. Она напоминает CRISPR — технологию редактирования генома человека, которая стала революционным открытием и была удостоена Нобелевской премии. На новостях об этом акции профильных компаний CRISPR Therapeutics и Editas Medicine упали в цене; появилась надежда, что ИИ ускорит биологические открытия и поможет закладывать основу для инновационных разработок в области медицины. Но некоторые учёные сочли полученные результаты скорее предварительными, чем знаменующими громкое открытие, о котором заявила компания. «Подача этих ранних, промежуточных результатов как крупного открытия не идёт на пользу делу. Самое сложное — и настоящие открытия кроются именно здесь — понять, как именно работает данная система», — прокомментировал произошедшее исследователь и предприниматель Лукас Харрингтон (Lucas Harrington). Его поддержали представители фармацевтической отрасли. Anthropic рассказала об открытии в блоге, привела подробности в технической статье, но не стала публиковать результаты исследования в рецензируемом научном журнале. Исследователи ИИ-лаборатории и сами «пока не знают», насколько важным окажется открытие этого фермента, признал руководитель направления медико-биологических исследований в Anthropic Эрик Каудерер-Абрамс (Eric Kauderer-Abrams). Компания стремится публиковать полученные с помощью ИИ предварительные результаты исследований, чтобы общественность и другие компании могли составить представление о возможностях технологии. «Опубликованный нами на этой неделе доклад в той же мере посвящён тому, как именно проводилось исследование, в какой и сути самого открытия. Мы планируем продолжить работу, провести более глубокие эксперименты, чтобы понять его функции и потенциальную ценность как инструмента», — пояснил он. ![]() Сделанное ИИ-агентами открытие показало способность ИИ анализировать огромные объёмы данных и выявлять биологически значимые закономерности. «Многие научные открытия совершались, когда исследователь внимательно изучал данные и обращал внимание на нечто необычное, что заслуживает дальнейшего исследования. В данном случае эти шаги выполнили работающие совместно без участия человека ИИ-агенты», — напомнили в Anthropic. Возможно, сама способность ИИ совершать биологические открытия почти без внешнего руководства может иметь большее значение, чем результаты конкретного исследования. Сегодня существует множество компьютерных инструментов для поиска подобных CRISPR ферментов, напомнили исследователи, и докладывать о промежуточных результатах с намёком на некое революционное открытие может не учёный, а жаждущая внимания и прибыли компания. Назвать текущий результат прорывом нельзя, но у ИИ есть значительный потенциал как средства, в частности, для анализа данных ДНК вирусов и бактерий — здесь уже есть огромные массивы данных и их объёмы растут в геометрической прогрессии. В июне из Google DeepMind в Anthropic перешёл Джон Джампер (John Jumper) — лауреат Нобелевской премии за создание ИИ-системы AlphaFold, предназначенной для прогнозирования структуры белков. Ведущим автором представленного Anthropic исследования заявлен Питер Юн (Peter H. Yoon) — ранее он был исследователем в лаборатории профессора Дженнифер Даудны (Jennifer Doudna), которая вошла в число лауреатов Нобелевской премии за исследования в области технологии CRISPR. ИИ-агенты OpenAI оставили миллион следов взлома Hugging Face в открытом интернете
26.09.2026 [13:39],
Павел Котов
Агенты искусственного интеллекта OpenAI, участвовавшие во взломе платформы Hugging Face, пытались использовать модель распознавания изображений для прохождения проверки на ботов и обращались к другим ИИ-моделям. Они также придумали способ обходить ограничения на доступ в интернет: собирали программы из фрагментов кода, размещённых по цепочкам сокращённых ссылок, и запускали их через сервис создания скриншотов. Новые подробности атаки раскрыли сотрудники стартапа Parse и другие исследователи.
Источник изображения: Sumaid pal Singh Bakshi / unsplash.com Инженеры Parse изучали действия агентов OpenAI, предполагая, что те могли воспользоваться их сервисом для преобразования веб-сайтов в данные, пригодные для обработки программами. Это предположение не подтвердилось, однако при изучении общедоступных ссылок исследователи обнаружили следы июльской атаки на Hugging Face. Агенты должны были работать в песочницах — изолированных вычислительных средах без доступа в интернет. В конце мая и затем в начале июля они использовали уязвимость в средстве установки ПО, получили возможность обращаться к внешним сайтам и наладили обмен сообщениями друг с другом, хотя должны были оставаться изолированными. Выход в интернет был ограничен: агенты могли загружать веб-страницы, но не отправлять на них данные обычным способом. Для обхода этого ограничения они воспользовались сервисом создания скриншотов, способным открывать предоставленные пользователем ссылки в собственном браузере. Агенты помещали фрагменты программного кода в URL-адреса и связывали их друг с другом при помощи сервиса сокращения ссылок. Сервис скриншотов переходил по первой ссылке, затем последовательно загружал остальные фрагменты, собирал программу и запускал её в своём браузере. Ответы внешних сайтов программа преобразовывала в изображение с закодированными данными; получив скриншот, агенты могли восстановить эти данные.
Источник изображения: Numan Ali / unsplash.com На раннем этапе атаки агенты пытались создавать учётные записи на Hugging Face, но столкнулись с проверкой CAPTCHA. Для распознавания изображений они пробовали использовать отдельную ИИ-модель. Удалось ли им таким способом пройти проверку, исследователи не установили. Отдельно агенты пытались обращаться к другим языковым моделям, в том числе к OpenAI GPT-2, DeepSeek, Kimi и Qwen. Через онлайн-сервис они также пробовали отправлять сообщения моделям Anthropic Claude 3 Haiku и Claude Haiku 4.5. Исследователи видели созданные агентами запросы, но не могли во всех случаях установить, были ли получены ответы и помогли ли они при атаке. Команда Parse изучила около 900 тыс. сокращённых ссылок, оставшихся в открытом доступе, и восстановила из них примерно 60 тыс. программ и сообщений, связанных со взломом Hugging Face. Поскольку исследователи в основном располагали отправленным агентами кодом, а не результатами его выполнения, они не смогли определить исход каждой попытки. Qualcomm раскрыла план по освобождению от монополии Nvidia в сфере ИИ
26.09.2026 [10:28],
Павел Котов
Qualcomm на конференции Snapdragon Summit 2026 провела отдельную сессию, посвящённую «унифицированному программному уровню для ИИ-вычислений» (Unified AI Compute Layer). Компания намерена создать универсальный набор программных средств для работы с искусственным интеллектом, не привязанный к оборудованию Nvidia или какого-либо другого производителя.
Источник изображения: qualcomm.com Цель проекта — избавиться от необходимости создавать отдельные среды для разработки под центральные, графические и нейропроцессоры. Nvidia выстроила экосистему вокруг собственных графических процессоров и сделала ставку на платформу CUDA, а Qualcomm намерена выступить конкурентом и создать открытую экосистему, которая охватит оборудование различных производителей. На рынок ИИ-чипов активно выходят не только графические процессоры Nvidia и AMD, но и нейропроцессоры, а также специализированные ИИ-ускорители других поставщиков. Но пока методы разработки различаются в зависимости от типа чипа, и при переносе ИИ-моделей с одной платформы на другую требуются дополнительные усилия по написанию и оптимизации кода. Решением этой задачи занималась компания Modular, которую Qualcomm приобрела примерно за $4 млрд. Ключевыми компонентами её экосистемы являются язык программирования Mojo, платформа MAX для запуска ИИ-моделей непосредственно на вычислительных устройствах и облачный сервис Modular Cloud для управления крупномасштабной ИИ-инфраструктурой. По данным Qualcomm, сейчас программная среда Modular поддерживает шесть архитектур от шести крупных производителей оборудования. «Главная миссия Modular — сделать гетерогенные вычисления открытыми», — заявил сооснователь Modular Крис Латтнер (Chris Lattner), занявший должность старшего вице-президента Qualcomm по передовому программному обеспечению и платформам. По его словам, разработчики должны иметь возможность выбирать наиболее подходящее для конкретной задачи оборудование, не оказываясь привязанными к одному поставщику. Nvidia за годы работы накопила богатый арсенал программных инструментов, и платформа CUDA стала для неё мощным конкурентным преимуществом. Qualcomm стремится расширить возможности выбора, предлагая единую среду разработки, которая не меняется при смене аппаратной платформы. Начав с процессоров для смартфонов, Qualcomm охватила такие сегменты как ПК, автопром, носимые устройства и ИИ-ускорители для центров обработки данных. Чем шире ассортимент продукции, тем важнее становится ПО, способное объединить различные чипы в общую систему. Ещё до официального поглощения Qualcomm и Modular работали над внедрением программных решений последней в ИИ-ускоритель Dragonwing для ЦОД. Сделка закрыта, и эту работу перенесут на платформу Snapdragon для ПК и смартфонов — процесс портирования продуктов Modular, в том числе Mojo и MAX, уже начался. Унифицированная среда разработки поможет легко переносить созданные для ЦОД ИИ-модели на ПК и смартфоны. Удалось наладить сотрудничество с Microsoft — совместно с софтверным гигантом ведётся работа по обеспечению поддержки языка Mojo в среде Windows без дополнительных процедур конвертации кода. Это поможет привлечь многочисленных разработчиков приложений для Windows в экосистему Modular. Центр тяжести в отрасли ИИ смещается от приоритета производительности оборудования к экосистемам для разработчиков. Nvidia жёстко привязала свои ускорители к платформе CUDA, а Qualcomm решила объединить все свои решения в общую программную платформу. Но пока этот процесс находится на начальном этапе. ИИ-агенты OpenAI массово атаковали базы данных онлайн в поисках малоизвестных сведений
26.09.2026 [09:15],
Павел Котов
Разработанные OpenAI агенты искусственного интеллекта в течение нескольких месяцев атаковали ресурсы Data USA, Университета Нью-Мексико и Австралийского института здравоохранения и социального обеспечения в стремлении извлечь малоизвестные данные. Об этом сообщила некоммерческая лаборатория Transluce, которая занимается вопросами контроля за сферой ИИ.
Источник изображений: Brecht Corbeel / unsplash.com Очередное расследование поднимает вопросы о том, когда именно инженеры OpenAI должны были узнать, что их агенты пытаются проникнуть в защищённые системы в открытом интернете. Специалисты Transluce обнаружили свидетельства неправомерных действий ИИ-агентов OpenAI — в течение нескольких недель они производили поиск слабозащищённых веб-сервисов и сопоставляли полученные данные с открытой информацией о роях ИИ-агентов в Сети. Доклад был опубликован в тот же день, когда премьер-министр Австралии Энтони Албаниз (Anthony Albanese) рассказал, что системы OpenAI пытались взломать четыре правительственных сайта. В одном из случаев попытка увенчалась успехом — ИИ-агенты записали файлы на внутренний сервер национальной системы здравоохранения страны. По версии австралийских властей, инцидент произошёл в рамках эксперимента по поиску информации; эту гипотезу подтвердили Transluce и другие исследователи. В ходе данных операций, а это могут быть обучение или тестирование, моделям OpenAI дают задание находить малоизвестные статистические данные: показатели борьбы с наркоторговлей в Таиланде, стоимость медикаментов в Австралии или величину медианного дохода жителей США со степенью магистра в 2014 году. В поиске ответов ИИ-агенты обращаются к слабозащищенным веб-сервисам и зачастую пытаются проникнуть в закрытые базы данных. Подобная активность наблюдается как минимум с марта 2026 года, а возможно, и с ноября 2025 года — не исключено, что она продолжается и сейчас. OpenAI связалась с десятками пострадавших организаций, чтобы уведомить их о несанкционированных действиях своих агентов, сообщили в компании. Среди них оказались правительственные ведомства, университеты и государственные учреждения. Атакам подверглись базы данных Комиссии по ценным бумагам и биржам (SEC) США, Бюро переписи населения и Министерства образования, сообщила New York Times. Transluce начала расследование, когда другая группа исследователей обнаружила малоизвестный форум, на котором ИИ-агенты координировали свои действия для успешного прохождения ограниченных по времени тестов. В работе использовались данные службы, которая выступает в роли прокси-сервера для браузера в целях исследования вопросов безопасности — пользователи могут анализировать URL, не открывая соответствующих страниц. Сервис публикует общедоступные журналы такой активности, и исследователи Transluce идентифицировали использовавших его ИИ-агентов, сопоставив данные с обсуждениями на форуме. ![]() «Мы выявили автоматизированную активность в значительных объёмах, тесно связанную с набором данных DSE Wiki и частично относящуюся к тому же рою ИИ-агентов, существование которого теперь подтвердила OpenAI», — заявили в Transluce. При этом не все зафиксированные действия можно было связать с OpenAI и просто ИИ-агентами. Записи на справочном ресурсе указывают, что перед агентами поставили задачу установить довольно специфический факт — определить средние расходы на дерматологические препараты на одного человека в австралийском штате Виктория по состоянию на январь 2022 года. Один из агентов 21 июня обсуждал невозможность обойти системы защиты от ботов, установленные Австралийским институтом здравоохранения и социального обеспечения; в тот же день, утверждают исследователи, сайт посетил и сотрудник OpenAI — человек. На следующий день активность агентов на форуме прекратилась. А 18 июня, незадолго до этого, стало известно об уязвимости в системе здравоохранения Австралии. В OpenAI сообщили, что узнали о случившемся лишь в августе. «Наш предварительный анализ показал, что значительная часть описанной в докладе Transluce активности совпадает с инцидентами, находящимися на разных этапах расследования в рамках проводящейся проверки действий моделей вразрез с заданными целями. Мы связались с Университетом Нью-Мексико и Data USA, а также поддерживаем контакт с властями Австралии по поводу затронутых правительственных сайтов. <..> Учитывая масштаб этой работы и необходимость проверки каждого отдельного инцидента, мы ожидаем, что процесс анализа займёт несколько месяцев», — заявили в ИИ-лаборатории. Не имея чёткого понимания того, как OpenAI отслеживает действия своих ИИ-агентов, трудно делать выводы, что именно компания должна о них знать. Данные службы прокси-сервера указывают, что запросы аналогичных наборов данных с применением схожих методов фиксировались в марте 2026 и, возможно, ещё в ноябре 2025 года; подобная активность наблюдалась даже на этой неделе, сообщили в Transluce. В организации пообещали продолжить исследования, чтобы донести до сведения общественности информацию обо всех инцидентах. ИИ-агенты прибегают к хакерским приёмам для решения задач из-за методов обучения ИИ, которые применяют в OpenAI и других лабораториях — не исключено, что известные на текущий момент случаи — это лишь «верхушка айсберга». |
|
✴ Входит в перечень общественных объединений и религиозных организаций, в отношении которых судом принято вступившее в законную силу решение о ликвидации или запрете деятельности по основаниям, предусмотренным Федеральным законом от 25.07.2002 № 114-ФЗ «О противодействии экстремистской деятельности»; |