Сегодня 09 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → иена
Быстрый переход

OpenAI уволила трёх исследователей безопасности ИИ — они опасаются, что компания заставит сотрудников молчать о рисках

Трое бывших исследователей OpenAI рассказали, что их на прошлой неделе внезапно уволили за общение со сторонними организациями, занимающимися безопасностью ИИ. Они предупредили, что такие решения могут заставить сотрудников бояться открыто обсуждать риски искусственного интеллекта. Сама же OpenAI подтвердила своё решение, но объяснила его по-другому.

 Источник изображений: Mariia Berezovsky / unsplash.com

Источник изображений: Mariia Berezovsky / unsplash.com

В письме под заголовком «OpenAI не сможет обеспечить безопасность искусственного интеллекта в одиночку» бывшие сотрудники лаборатории отметили, что это «необычная компания», и ключевой составляющей работы в ней является взаимодействие со сторонними организациями для решения проблем безопасности, причём её сотрудники должны делать это «свободно и без страха».

Адресованное комитетам OpenAI по безопасности письмо опубликовал Микита Балесный (Mikita Balesni) — один из уволенных сотрудников, который занимался вопросами согласования целей ИИ. Документ подписали также уволенные Томек Корбак (Tomek Korbak) и Жасмин Ван (Jasmine Wang), которые работали в сфере безопасности.

На своих личных страницах в соцсетях они написали, что причины увольнения им объяснили лишь устно, а их действия не выходили за рамки служебных обязанностей. «Причины нашего увольнения просто не складываются в логичную картину», — написала Ван. Балесному сообщили, сто компания больше не доверяет ему, потому что он «слишком много общался с занимающимися вопросами безопасности сторонними организациями». «Я никогда не разглашал информацию, составляющую интеллектуальную собственность компании. Моя работа согласовывалась с непосредственным руководством, руководителями исследовательских направлений и советом директоров», — написал он.

Корбаку в устной форме объяснили, что его увольнение связано с «характером общения с METR» — сторонней некоммерческой исследовательской организацией, которая оценивает модели ИИ и связанные с безопасностью риски. «Поясню: общение с METR входило в мои служебные обязанности», — добавил он. Бывшие коллеги исследователей теперь будут «бояться высказываться и действовать в соответствии с тем, что ещё на прошлой неделе считалось неотъемлемой частью работы в OpenAI. <..> Подобные увольнения — внезапные и проведённые в такой резкой форме — подрывают открытую культуру, которую OpenAI ценила в прошлом», — говорится в письме.

Исследователи дали OpenAI три совета: привлекать к работе в организации сторонних аудиторов по безопасности, обеспечить возможность мониторинга передовых моделей ИИ и поддерживать «культуру открытого и прозрачного диалога между исследователями в сфере безопасности и остальными участниками экосистемы безопасности».

В разосланной сотрудникам служебной записке один из руководителей исследовательского направления OpenAI написал, что полностью поддерживает эти рекомендации. «Мы высоко ценили их вклад в обеспечение безопасности ИИ, а также их готовность открыто высказывать своё мнение и подвергать сомнению существующие идеи. Мы поддерживали их инициативы и оказывали им огромное доверие. Хочу подчеркнуть: причиной этих решений стало вовсе не то, что они поднимали вопросы безопасности или открыто высказывались. Мы всегда поощряли и будем поощрять подобную активность. Мы не увольняем сотрудников за то, что они указывают на проблемы», — говорится в документе.

Тем не менее, решение уволить этих троих сотрудников было принято «после тщательного расследования, выявившего нарушение ими чётких правил обращения с конфиденциальной информацией», подчеркнула компания в соцсети X. OpenAI разделяет изложенный в письме принцип необходимости «обеспечить возможность контроля передовых моделей», а также изложенные в письме идеи, касающиеся «сохранения возможности мониторинга передовых моделей», и компания продолжает вкладывать значительные ресурсы в эту сферу.

Китайские ИИ-компании скрывают, насколько опасны их модели — публичных тестов почти нет

Китайские разработчики ИИ крайне неохотно делятся информацией по поводу тестирования своих моделей на предмет безопасности использования, выяснила исследовательская компания SemiAnalysis. И это на фоне того, что во всём мире растут опасения по поводу рисков, связанных со стремительным развитием передовых ИИ-систем.

 Источник изображения: Steve A Johnson/unsplash.com

Источник изображения: Steve A Johnson/unsplash.com

Согласно проведённому SemiAnalysis анализу 857 моделей, выпущенных в период с 2021 года по 15 сентября текущего года девятью ведущими китайскими компаниями в области искусственного интеллекта — Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax и StepFun, лишь в 31 случае, или 6,3 %, были опубликованы результаты оценки безопасности, которые можно было бы сопоставить с конкретной моделью. Только в девяти релизах, или 1,1 % всего количества выпусков, такие результаты были доступны на момент выхода модели или до него. Исследователи не обнаружили информации о безопасности 813 моделей, хотя компании могли бы провести тесты в частном порядке.

В SemiAnalysis пояснили, что под раскрытием информации подразумевается публикация результатов, относящихся к конкретной модели (включая тесты на генерацию вредоносного контента, устойчивость к обходу защитных ограничений, токсичность, соблюдение конфиденциальности, поведение при отказе от выполнения запроса или наличие опасных возможностей). При этом не учитываются общие заявления о том, что модель прошла обучение мерам безопасности или соответствующую проверку.

В связи с нашумевшими инцидентами, связанными с самовольным поведением ИИ-агентов, усилились глобальные дебаты о том, должны ли ИИ-компании замедлять разработку передовых моделей с целью создания более эффективных рычагов их контроля.

На прошлой неделе появились сообщения в СМИ, что китайские ИИ-агенты, так же, как и американские, могут обманывать пользователей, обходить ограничения и скрывать сбои в тестах.

Новейшая система управления безопасностью ИИ в Китае позволяет выявлять риски, включая получение моделями системных разрешений или внешних ресурсов без разрешения, обман оценщиков, сокрытие возможностей и обход контроля безопасности. Но, согласно SemiAnalysis, никаких обязательств на разработчиков, связанных с возможностями моделей, она не налагает. Правилами в основном регулируются приложения и их влияние на пользователей, не выдвигая никаких требований разработчикам передовых моделей относительно проведения или публикации оценки рисков на основе возможностей модели.

По данным SemiAnalysis, ни один крупный китайский разработчик не выпустил передовую LLM с результатами тестирования на наличие опасных возможностей, обнародованными для широкой публики.

ИИ-агенты ошибаются опаснее чат-ботов — они сливают личные данные и совершают покупки без разрешения

В жизнь современного человека постепенно входят агенты искусственного интеллекта. Они избавляют пользователей от повседневных задач, но их ошибки грозят оборачиваться непредсказуемыми последствиями. ИИ-агенты могут публиковать конфиденциальную информацию в рабочем чате или оформлять покупки даже в отсутствие доступа к платёжным средствам.

 Источник изображения: Mohamed Nohassi / unsplash.com

Источник изображения: Mohamed Nohassi / unsplash.com

Пользователь ИИ-агента Grok Bot Шейн Мак (Shane Mac) рассказал, как тот выложил в групповой чат корпоративного мессенджера Slack его банковскую выписку: балансы расчётного и сберегательного счетов, данные о расходах на строительство дома и о регулярных платежах за Netflix и автострахование. Для личных целей он использовал ИИ-агента, которому присвоил название «Персональный финансовый директор», — ему он открыл доступ к своим банковским счетам в режиме только для чтения. Доступ к рабочему чату в Slack был у другого ИИ-агента на той же платформе — он носил название «Руководитель аппарата».

Господин Мак потребовал объяснений, как вышло, что «Персональный финансовый директор» опубликовал конфиденциальную информацию в рабочем чате. ИИ-агент объяснил ситуацию и даже по-своему извинился: «Моя вина. Личные финансы — неподходящая тема для такой аудитории, и точка».

В последние недели популярность ИИ-агентов резко возросла: им доверяют управление перепиской, планирование поездок и множество других задач. Но в какие-то моменты они начинают вести себя непредсказуемо, как и управляющие ими модели, которые бывают склонны к галлюцинациям, неверной интерпретации данных и даже к спонтанным действиям на грани киберпреступлений. В отличие от чат-ботов, которые только отвечают на вопросы, ИИ-агенты могут выполнять от имени пользователя конкретные действия, например, наводить порядок в календаре или производить запись на приём.

Агент разбивает полученную команду на ряд этапов, которые для удобства не озвучиваются пользователю. Перед совершением важных действий, например, при покупке товаров или удалении файлов они запрашивают разрешение, но в остальном действуют по своему усмотрению. Если запрос пользователя неясен, или существует множество способов выполнить требуемое действие, может возникнуть неразбериха. В случае с Шейном Маком ИИ-агент перепутал групповые чаты со схожими названиями. Разработчики Grok Bot заверили его, что проблема устранена.

Работающая в Сан-Франциско Анника Беннинг (Annica Benning) уже почти месяц пользуется ИИ-агентом Instinct — взаимодействовать с ним можно прямо через приложение сообщений на iPhone. Она использует приложение для покупок в интернете, для заказа такси Uber и бронирования авиабилетов. В 90 % случаев система работает безупречно, но не обходится и без сюрпризов.

 Источник изображения: Igor Omilaev / unsplash.com

Источник изображения: Igor Omilaev / unsplash.com

Однажды женщина вернула в интернет-магазин купальник и попросила ИИ-агента предложить варианты на замену. Тот прислал ей ссылку для подтверждения выбора, но она, по её словам, так и не подтвердила покупку. Однако получила электронное письмо с подтверждением заказа. При операциях с банковской картой система присылает ссылку для подтверждения, но в данном случае оплата производилась за счёт средств из возврата, поэтому систему удалось обойти этап подтверждения. Отменить заказ не удалось — теперь госпожа Беннинг надеется его вернуть, когда он придёт.

Ещё в одном случае при поездке в другой город она поручила Instinct забронировать столик на ужин — он забронировал, но не на тот вечер, а в этот у неё были другие планы, о которых он знал. Женщине пришлось попросить агента отменить бронь и договариваться с администрацией ресторана, чтобы с неё не взимали штраф в размере $50 за неявку — ресторан через агента согласился пойти навстречу.

Шалини Динеш (Shalini Dinesh) из Остина предпочитала чат-бот Anthropic Claude, но решила испробовать нового ИИ-агента Meta✴✴ Muse. Ему женщина поручила организовать вечеринку в честь 13-летия сына. Вечеринка проходила на площадке для пейнтбола, поэтому ИИ-агент составил и разослал родителям сообщения с формой согласия на участие, которую надо было подписать; в сообщении также указывалось, какую одежду надевать детям. Система нашла поблизости готовые доставить еду рестораны, с учётом аллергии у некоторых участников; и подобрала тематические подарочные наборы для детей в соответствии с возрастом. Но не справилась с ситуацией, когда выяснилось, что у двоих детей одинаковые имена — их ИИ-агент учёл как одного человека, но Шалини Динеш успела перепроверить список и исправить ошибку.

Джесси Леви (Jesse Levey), основатель стартапа из района бухты Сан-Франциско, попытался использовать Meta✴✴ Muse для работы с расписанием своих троих детей. Он начал вручную переносить в Muse данные о стандартном расписании детей на неделю из своего календаря, но понял, что это будет слишком хлопотно, учитывая, что в секциях и кружках пользуются специфическими приложениями, а совместные поездки обсуждаются в групповых чатах.

Дети занимаются в лыжной секции, и у неё есть специальное приложение с календарём; используются также SMS, WhatsApp, электронная почта, приложения календаря и ещё около 65 других приложений, к которым системе потребовался бы доступ. Тогда господин Леви спросил у Anthropic Claude, нет ли более мощного ИИ-агента, который сможет управлять расписанием его детей с учётом требования к конфиденциальности и безопасности. Тот предложил нанять для этого человека — он точно сможет «гоняться за местами в летних лагерях, импровизировать, когда дети болеют, и принимать десяток решений в неделю, с которыми не справится ни одна система». Создание версии такой системы на основе ИИ «потребовало бы нескольких месяцев вашего внимания», предостерёг Claude.

Математический прорыв OpenAI оказался под вопросом — учёные нашли расхождение в доказательстве

Математический прорыв OpenAI начал вызывать вопросы. Учёные сравнили опубликованное доказательство по уравнениям Навье — Стокса с его алгоритмической Lean-версией и нашли расхождения: в нескольких ключевых местах машинный вариант, проверяемый на компьютере, содержит более слабые утверждения. Это ещё не опровержение, но почва для сомнений уже вполне плодородная

 Источник изображения: Thomas T /unsplash.com

Источник изображения: Thomas T /unsplash.com

По словам математиков, расхождение вовсе не означает, что доказательства неверны или что OpenAI неправильно решила задачу, но это ставит под сомнение, всегда ли можно полагаться на математические результаты, генерируемые моделями искусственного интеллекта.

«Что нужно сделать со всеми этими большими доказательствами, созданными на основе языковой модели, так это то, что они должны быть прочитаны людьми, и это создает огромную дополнительную нагрузку на математиков», — сообщил руководитель команды Андерс Хансен (Anders Hansen).

Процесс поиска расхождений занял у команды около двух недель. При этом математики использовали подсказки ChatGPT. Напомним, что у OpenAI на решение задачи ушло 88 часов.

Математики указали на расхождение в части доказательств, называемой леммой 8.6. В доказательстве на естественном языке уравнение в этой части требует, чтобы определённое значение было меньше m + 4, где m - целое число, а в Lean‑версии — меньше m + 5, что математически слабее, поскольку допускает больше возможных решений и не эквивалентно первому.

Представим, что вас попросили решить уравнение x + 3 = 6, ответом на которое является x = 3. Можно написать доказательство того, что x должно быть меньше 4, а также того, что x должно быть меньше 5. Оба эти математических утверждения абсолютно верны, но последнее допускает больше возможных ответов для x, что делает его математически более слабым.

По словам Хансена, неправильный перевод мог возникнуть из-за того, что ИИ стремится к тому, чтобы компьютерный код был полностью самосогласован и не выдавал ошибок. Если в процессе автоматической формализации ИИ обнаружит часть доказательства, которая не компилируется, он попытается найти обходной путь, даже если это означает отклонение от доказательства, написанного на естественном языке.

Кевин Баззард (Kevin Buzzard) из Имперского колледжа Лондона сообщил, что можно надёжно формализовать в Lean саму формулировку теоремы и затем проверить, компилируется ли доказательство. Но это не гарантирует, что текстовое доказательство в PDF корректно передаёт логику. То есть Lean‑код может быть внутренне согласован, но не соответствовать тому, что написано в статье. «Я уверен, что проблема Навье — Стокса была решена правильно, — говорит Баззард. — Я гораздо менее уверен в том, что доказательство, описанное текстом, является правильным».

OpenAI сообщила ресурсу New Scientist, что ей известно о несоответствии между доказательством на естественном языке и в виде кода, и что это не означает, что ни одно из них недействительно.

Умное кольцо Natura Interface позволит отдавать поручения ИИ-агентам, не доставая смартфон

Стартап Natura представил умное кольцо Interface стоимостью $99. Устройство создано для работы в эпоху ИИ-агентов: нажав кнопку, можно дать ИИ-агенту поручение, записать мысль или выполнить задачу, не вынимая смартфон из кармана. Поддерживаются функции мониторинга показателей здоровья: частоты сердечных сокращений, вариабельности сердечного ритма, качества сна и уровня активности.

 Источник изображений: natura.inc

Источник изображений: natura.inc

Идея Natura Interface заключается в том, чтобы помочь людям реже отвлекаться на экраны смартфонов, поскольку повседневные задачи можно выполнять быстрее и естественнее. На момент запуска устройство будет поддерживать интеграцию с рядом ИИ-агентов и приложений, в том числе Meta✴✴ Muse, Instinct, Grok Bot, Claude и ChatGPT. Приём предварительных заказов стартует в ноябре, а поставки запланированы на декабрь или январь.

Умное кольцо — не первый продукт компании. Ранее она выпустила HumanPods — наушники с поддержкой ИИ, предназначенные для взаимодействия с агентами. В Natura, однако, посчитали, что для использования новейших достижений в области голосовых технологий необходим иной форм-фактор. Вариантов использования кольца с ИИ огромное множество, отметил производитель.

Во время пробежки можно поручить кольцу отслеживать тренировку; утром после пробуждения — узнать, что запланировано на день; обнаружив в душе, что закончился шампунь, — заказать новый; засыпая перед телевизором, — отдать команду выключить его и поставить будильник на утро; после записи совещания — отправить коллеге заметки по итогам обсуждения.

Ответы ИИ-агентов могут поступать через подключённые наушники, функцию Live Activities на iPhone или приложение NatureOS. Пользователи, работающие с несколькими ИИ-агентами, могут выбирать, какой из них будет выполнять конкретную задачу: одному можно поручить написание кода, второму — бронирование столика, третьему — что-то ещё. Управлять можно не только ИИ-агентами, но и собственными устройствами, в том числе компьютерами. В перспективе, уверен разработчик, кольцо станет основным интерфейсом взаимодействия человека с технологическими решениями.

На старте продаж Natura Interface будет стоить $99, но в перспективе компания планирует повысить цену. Производитель намерен сделать устройство доступным для пользователей, наработать базу активных клиентов и сформировать спрос. По истечении бесплатного периода продолжительностью от трёх до шести месяцев Natura хочет ввести абонентскую плату в размере $9 в месяц. Производственные затраты сопоставимы с расходами на выпуск таких устройств, как Oura Ring и Samsung Galaxy Ring: используются многие идентичные компоненты. Однако стартап хочет установить более скромную цену, чтобы снизить порог входа и стимулировать распространение продукта.

Natura Interface предлагает набор функций мониторинга здоровья. Кольцо отслеживает частоту сердечных сокращений и пульс в состоянии покоя, вариабельность сердечного ритма, фазы сна, уровень физической активности, количество шагов и изменения температуры кожи. Полная зарядка аккумулятора занимает 100 минут, после чего кольцо может проработать от 6 до 12 дней.

Anthropic прокачала Claude — теперь он визуализирует данные и создаёт анимацию прямо в чате

Claude теперь умеет превращать обычный запрос в дашборд или анимацию. Anthropic представила два новых инструмента для бизнес-пользователей, которые позволяют анализировать данные в реальном времени и создавать визуальный контент прямо в чате.

 Источник изображения: anthropic.com

Источник изображения: anthropic.com

Разработчики сервисов с ИИ стремятся расширять наборы функций, ориентированные на рабочие задачи. В арсенале Anthropic появилась новая функция Claude Dashboards, доступная в качестве бета-версии для пользователей платных тарифных планов. Чат-бот подключается к платформам бизнес-данных и системам управления клиентами, позволяя создавать панели мониторинга и анализа данных в реальном времени — для их формирования достаточно запросов простым языком, без программирования.

Функция Claude Motion также находится в бета-версии для клиентов Team и Enterprise. Она позволяет по простым запросам создавать редактируемые анимированные элементы и экспортировать их как видеофайлы. Два новых инструмента призваны помочь пользователям анализировать бизнес-данные и создавать визуальные материалы без программирования. Компания выпустила в открытый доступ средства работы с офисными документами — ранее они находились в бета-тестировании.

Новые средства визуализации накануне представила и OpenAI — в ChatGPT на основе модели GPT-6 также появились графики, схемы и кнопки для выполнения конкретных задач.

Anthropic запустила бесплатный сервис для поиска дыр в ПО с открытым исходным кодом

Компания Anthropic представила бесплатный сервис сканирования OSS Scanner для регулярного поиска уязвимостей в проектах с открытым исходным кодом (open source). Сервис использует самые мощные ИИ-модели разработчика, включая Claude Mythos.

 Источник изображения: Anthropic

Источник изображения: Anthropic

Проекты смогут подключаться к сервису добровольно по подписке opt-in, предусматривающей добровольное согласие пользователя на получение уведомлений и отчётов о найденных уязвимостях. Anthropic рассчитывает, что автоматическое сканирование позволит выявлять проблемы быстрее и раньше, чем при использовании исключительно традиционных методов проверки.

При этом отчёты OSS Scanner не будут проходить проверку специалистами. Anthropic подчёркивает, что все результаты формируются ИИ без участия человека в проверке и первичной оценке обнаруженных проблем. Поэтому среди сообщений могут оказаться ошибочные или недействительные находки, которые разработчикам придётся проверять самостоятельно.

OSS Scanner появился на фоне растущего интереса к использованию ИИ для поиска уязвимостей в программном обеспечении. В последние месяцы подобные инструменты помогли обнаружить несколько серьёзных проблем в проектах с открытым исходным кодом, включая критическую уязвимость Copy Fail, затронувшую почти все дистрибутивы Linux в мае.

Одновременно увеличение числа автоматических проверок создаёт и дополнительную нагрузку на разработчиков. Некоторые проекты с открытым исходным кодом уже с трудом справляются с потоком отчётов об ошибках, созданных ИИ-моделями. Среди тех, кто столкнулся с этой проблемой, оказались Линус Торвальдс (Linus Torvalds) и даже компания Google.

Agile Robots начала показывать роботам видео с людьми, чтобы научить их работать руками

Немецкий стартап в области робототехники Agile Robots обучает свои машины, снимая видео, где люди выполняют различные задачи — это помогает восполнить дефицит данных, сдерживающий развитие промышленной автоматизации.

 Источник изображения: agile-robots.com

Источник изображения: agile-robots.com

В рамках проекта Robot Academy сотрудники компании снимают на видео, как они выполняют те или иные задачи, фиксируя движения рук и пальцев. Agile Robots объединяет эти материалы с дополнительными обучающими данными, после чего роботы отрабатывают движения в виртуальной среде. «Если люди могут учиться в школе, почему этого не могут делать роботы?» — задался вопросом гендиректор компании Чжаопэн Чэнь (Zhaopeng Chen).

В Европе и других регионах появилось множество стартапов, которые стремятся внедрить на производствах человекоподобных и других роботов для повышения производительности и снижения затрат. Работа на таких предприятиях может быть сопряжена с выполнением повторяющихся операций, которые поддаются автоматизации легче, чем задачи в других сферах реальной жизни. Но внедрение технологий идёт медленно, потому что роботы с трудом справляются даже с самыми простыми задачами — отчасти из-за нехватки обучающих данных.

Чтобы освоить ту или иную задачу, роботам могут потребоваться несколько тысяч попыток, и даже при незначительном изменении условий машинам придётся учиться заново, тогда как квалифицированные рабочие используют опыт, накопленный за всю жизнь. Agile Robots основали в Мюнхене в 2018 году исследователи Германского центра авиации и космонавтики. К настоящему моменту компания привлекла $1,5 млрд инвестиций и внедрила 20 000 своих систем.

Планы по дальнейшему привлечению средств господин Чэнь комментировать отказался, но отметил, что новые вливания ожидаются «очень скоро». Ранее стало известно, что компания ведёт переговоры о привлечении ещё $800 млн при участии SoftBank Group.

Google представила ИИ-сотрудника — Gemini agent сможет самостоятельно выполнять задачи от начала до конца

Подразделение Google Cloud представило на конференции Gemini at Work 2026 новый продукт под названием Gemini agent — это агент с искусственным интеллектом, предназначенный для корпоративных пользователей. Он доступен в приложении Gemini Enterprise, пакете Workspace и в ряде других сервисов. Ему достаточно «ставить цели, а не давать пошаговые инструкции» — Gemini agent может отвечать на вопросы, выполнять интеллектуальную работу, создавать медиаконтент, писать и запускать код.

 Источник изображений: Google

Источник изображений: Google

«Если руководитель присылает вам письмо с просьбой подготовить презентацию с последними данными по проекту, Workspace Intelligence идентифицирует это как задачу, которую можно делегировать, и предлагает одним нажатием кнопки передать её Gemini-агенту», — приводит пример Google. ИИ-агент может также организовать мероприятие с коллегами, самостоятельно определив их состав по предыдущим мероприятиям, проверив их календари и инициировав переписку для согласования удобного времени.

Gemini agent способен выступать в роли сотрудника компании и выполнять функции, предусмотренные конкретной должностью. Он выполняет задачи, подбирая наиболее подходящие модели — помимо семейства Google Gemini, это также модели Anthropic Claude; в перспективе появятся и другие, проприетарные и открытые. Для решения многоэтапных задач подключаются субагенты; поддерживается работа с различными сторонними инструментами. Задачи могут быть долгосрочными и занимать несколько часов и даже дней.

ИИ-агент работает в облаке, обращаясь к «единому набору данных памяти, контекста и общему графу персонализации». Доступны четыре типа памяти:

  • сессионная память — ориентирована на текущую задачу, даже если она выполняется несколько дней;
  • семантическая память — «структурированная база знаний, формируемая в процессе чтения документов, общения с людьми и взаимодействия с другими агентами»;
  • процедурная память — «информация, как выполняется работа, в том числе навыки, которые агент вырабатывает сам для себя»;
  • эпизодическая память — «всё, что было сделано ранее».

Чтобы вызвать Gemini agent, его необходимо упомянуть как «@Gemini» в Gmail, «Google Документах», «Таблицах», «Презентациях» и «Чате». Он доступен на любых устройствах через различные каналы, включая командную строку, Google Workspace, Slack и Microsoft 365; при помощи API можно подключать сторонние приложения, в том числе без графического интерфейса. Сейчас Gemini agent находится на стадии закрытого предварительного тестирования, в перспективе он появится у корпоративных клиентов Google Workspace на некоторых тарифных планах семейств Business и Enterprise.

GlobalFoundries поможет TSMC делать ИИ-чипы — компания начнёт выпускать кремниевые мосты в США

Крупнейший контрактный производитель чипов США нашёл новое применение своему заводу в штате Нью-Йорк. Он будет задействован для выпуска кремниевых мостов, используемых при производстве передовых чипов компанией TSMC, включая применяемые в инфраструктуре ИИ.

 Источник изображения: GlobalFoundries

Источник изображения: GlobalFoundries

Зародившаяся весной 2009 года на основе немецких предприятий AMD компания GlobalFoundries на первых порах грезила освоением передовых техпроцессов и превращением в одного из крупнейших контрактных производителей чипов в мире, но к 2018 году поняла, что путь к освоению 7-нм технологии оказался слишком долгим и затратным, а потому решила сосредоточиться на более зрелых технологиях типа 12-нм.

На этой неделе стало известно о вовлечении GlobalFoundries в расширяющуюся активность по выпуску передовых ИИ-чипов. Эта компания должна будет наладить, по словам её представителей, выпуск кремниевых мостов для передовых ИИ-компонентов, производимых тайваньской TSMC. Эти кремниевые подложки позволяют связать вычислительные компоненты и микросхемы памяти в рамках одной упаковки, а также наладить между ними обмен данными на высоких скоростях. Для соответствующих нужд GlobalFoundries будет использовать своё предприятие в штате Нью-Йорк.

Соглашение между GlobalFoundries и TSMC рассчитано на пять лет, оно подразумевает, что упоминаемое предприятие в штате Нью-Йорк будет расширено. Эта площадка станет первым поставщиком таких кремниевых мостов на территории США, используемых при выпуске передовых с точки зрения пространственной компоновки чипов. Перед началом основной торговой сессии в США акции GlobalFoundries на этих новостях успели вырасти в цене на 4 %.

Массовое производство этих компонентов GlobalFoundries начнёт наращивать в первой половине 2028 года. Считается, что сделка с TSMC позволит заложить основу для будущего расширения профильных мощностей GlobalFoundries. В условиях возникновения физических ограничений по площади монолитных кристаллов, переход к многочиповой упаковке со сложной пространственной компоновкой давно стал разумным способом повышения быстродействия полупроводниковых компонентов. Спрос на кремниевые мосты в такой ситуации наверняка будет расти и дальше. С другой стороны, нехватка мощностей по упаковке чипов с использованием передовых методов становится узким местом для всей полупроводниковой отрасли, и эту проблему тоже надо решать.

Открытый и бесплатный Photoshop не за горами — с помощью ИИ создаются копии популярных программ Adobe

Разработчик по имени Брэндон Томас (Brandon Thomas) объявил об инициативе, в рамках которой он при помощи искусственного интеллекта ведёт разработку программ, призванных в точности скопировать внешний вид и функциональность наиболее популярных приложений Adobe. Все свои продукты он опубликует как бесплатные проекты с открытым исходным кодом.

 Источник изображений: Artcraft

Источник изображений: Artcraft

Проект Artcraft стартовал в прошлом году — первоначально он позиционировался как инструмент «управляемого ИИ» для художников, позволяющий с высокой точностью редактировать созданные нейросетями изображения и видео уже после их генерации. Впоследствии разработчик объявил о смене курса: теперь проект представляет собой набор из семи программ с исходным кодом, воссоздающих интерфейс и инструментарий Adobe Photoshop, Illustrator, Premiere, Lightroom, After Effects, InDesign и Acrobat Pro.

При разработке аналогов проприетарного ПО от Adobe он использует модель Anthropic Claude Opus 5.5 — код создаётся на языке Rust, есть версия WebAssembly для работы в браузере. Посетители интернет-сообществ поспешили указать энтузиасту на многочисленные недостатки в его программах, но тот заверил, что сейчас они находятся в «очень ранней альфа-версии» и вскоре перерастут в продукт, ничем не уступающий по функциональности разработкам Adobe.

Сначала он пообещал, что в течение месяца добьётся 100-процентного паритета с продуктами Adobe в отношении набора функций; впоследствии скорректировал свой прогноз в сторону 99-процентного паритета за несколько месяцев, но всё-таки не лет. Сам автор проекта, по его собственным словам, имеет около десяти лет опыта работы над масштабными проектами на языке Rust. К новому проекту его подтолкнула практика Adobe, предусматривающая штрафы для пользователей, которые отменяют подписку.

Разработка полностью бесплатных продуктов, распространяемых с лицензиями MIT и Apache, финансируется за счёт продажи доступа к существующей модели визуального ИИ и IDE под названием Artcraft — этот инструмент предлагается в приложениях как одна из опций генератора изображений наряду с другими моделями. Наличие постоянного источника дохода гарантирует, что проект не будет заброшен.

Брэндон Томас — не единственный программист, который решил методом обратного проектирования воссоздавать коммерческое ПО без прямого копирования его исходного кода. Сама по себе эта деятельность юридически считается допустимой, но у Adobe могут возникнуть претензии по поводу копирования фирменного стиля, если новые приложения будут слишком сильно напоминать привычный внешний вид и интерфейс продуктов Adobe. Томас говорит, что в перспективе и рядовые разработчики смогут создавать копии популярных приложений и издавать их с открытым исходным кодом, чтобы «вернуть себе интернет и навсегда взять технологии под свой контроль».

Эпоха традиционного ПО окончена, провозгласил он. «Мы заменим „Google Поиск“, создадим собственные смартфоны и выстроим более качественную инфраструктуру. Мы уберём всю рекламу и избавим весь технологический мир от засилья низкокачественных решений», — пообещал энтузиаст.

Microsoft радикально обновит Windows — систему заселят ИИ-агентами, которые будут работать рядом с пользователем

Microsoft превратит Windows в систему, где рядом с пользователем будут работать ИИ-агенты. Copilot с разрешения владельца получит доступ к локальным файлам и недавней активности, чтобы понимать контекст работы и выполнять поручения. Эти возможности начнут появляться на Copilot+ PC в ближайшие месяцы.

 Источник изображений: blogs.windows.com

Источник изображений: blogs.windows.com

За безопасную работу ИИ-агентов отвечает технология Microsoft Execution Containers (MXC): в изолированной среде ИИ-агенту можно ограничить доступ к файловым и сетевым ресурсам прямо во время работы. Традиционные песочницы плохо подходят для ИИ-агентов, потому что их потребности в доступе могут меняться в зависимости от задач. Windows предлагает разные уровни изоляции: на уровне отдельных процессов, виртуальных машин, WSL и Windows 365. Поддержка MXC уже реализована для OpenAI Codex, GitHub Copilot, OpenClaw, Replit, LM Studio и Nvidia OpenShell — на очереди Anthropic Claude Code, Box, Egnyte, Manus, Perplexity, Raycast и другие. Готовится к выпуску приложение ИИ-агента Meta✴✴ Muse для Windows.

Вычисления Microsoft предлагает распределять между компьютером и облаком — это компания называет «гибридным интеллектом». Подходящую часть работы будут выполнять локальные модели, остальную — серверные. Однако локальная модель не делает весь процесс автономным: агент по-прежнему может обращаться к сетевым сервисам.

На ПК начнут работать более мощные ИИ-модели. Квантизованная до трёхбитного представления MAI Code 1.1 Flash размером 137 млрд параметров сможет запускаться локально и занимать на 80 % меньше места в памяти с контекстом до 260 тыс. токенов. Готовятся локальные варианты ИИ-моделей Nvidia Nemotron на 70 млрд и DeepSeek V4 Flash на 284 млрд параметров.

Для запуска локальных моделей разрабатывается среда выполнения Windows ML, которая распределяет ресурсы центрального, графического и нейропроцессора — она получит поддержку llama.cpp. Разработчики смогут запускать большее число открытых моделей. В Windows также появится интеллектуальная маршрутизация для выбора между локальными и облачными моделями. На GitHub есть система HydraFusion, которая выбирает подходящие для конкретных задач модели в облаке — теперь будут учитываться и локальные. Эта функция появится в GitHub Copilot, Visual Studio Code и инструментах командной строки Copilot.

На ПК с поддержкой ИИ расширятся возможности Copilot — интеллектуальный помощник сможет учитывать содержимое файлов и недавние операции на ПК, выполнять в Windows множество операций: организовывать файлы, проводить диагностику, устранять неполадки, обращаться к локальным моделям ИИ и выступать помощником в написании кода. Предусмотрен постоянно запущенный личный ИИ-агент Autopilot.

Вводится направление компьютеров для разработчиков, создателей контента и специалистов по ИИ — здесь центральное место занимает платформа Nvidia RTX Spark с мощным графическим процессором и большим объёмом унифицированной памяти. Свои ПК на этой платформе представили Asus, Dell, HP, Lenovo, MSI и сама Microsoft — Surface Laptop Ultra со 128 Гбайт памяти может локально запускать модели размером до 120 млрд параметров. Windows сможет работать и на мощных рабочих станциях Nvidia DGX Station на платформе GB300 Grace Blackwell Ultra — его ресурсов хватит и на модели с более чем 1 трлн параметров, в том числе Llama 4 Maverick, Kimi K2.6 и DeepSeek V4 Pro, а также на одновременную работу 32 и более ИИ-агентов.

Обновляются базовые функции Windows. Приложение поиска на панели задач теперь может выполнять действия напрямую без необходимости открывать настройки или программы: включать тёмную или светлую темы, регулировать яркость, сворачивать окна и отправлять сообщения. В поиске появится Copilot — ИИ-помощник сможет давать ответы прямо в выдаче и по необходимости запускать собственное приложение Copilot.

Интеграция Nvidia RTX Spark будет способствовать развитию игр на платформе Arm — предусмотрены поддержка трассировки лучей, DirectStorage и других функций. Gears of War: E-Day получит поддержку предварительно скомпилированных шейдеров Advanced Shader Delivery. На компьютерах с Arm-процессорами уже доступны или заявлены Fortnite, Alan Wake 2 и World of Warcraft: Forever; на очереди League of Legends, Valorant, PUBG: Battlegrounds и Genshin Impact; в 2027 году платформу Nvidia RTX Spark будет поддерживать Call of Duty.

Anthropic резко уронила цену ИИ — вышла Claude Haiku 5.5, выполняющая задачи за копейки

Anthropic сообщила о выпуске модели искусственного интеллекта Claude Haiku 5.5, которая занимает положение младшей в линейке. Она предназначена для выполнения больших объёмов задач, где важна экономическая эффективность. По сравнению с Haiku 4.5 цены на эксплуатацию новинки значительно снизились.

 Источник изображений: anthropic.com

Источник изображений: anthropic.com

Anthropic Claude Haiku 5.5 надёжно справляется с быстрыми и повторяющимися операциями: создание кратких сводок, сжатие контекста, выполнение запросов к базам данных и классификация информации. Модель хорошо работает в связке со старшими моделями Sonnet 5.5 и Opus 5.5 в качестве вспомогательного ИИ-агента при написании кода. Будучи самой быстрой в ассортименте разработчика, она предназначается для задач, критичных к скорости отклика — например, при взаимодействии с браузером или работе в реальном времени в службе поддержки.

Стоимость эксплуатации Claude Haiku 5.5 по сравнению с Haiku 4.5 в среднем сократилась на 75 %. Anthropic объявила о частичном снижении цен и на работу и с моделью Claude Sonnet 5.5 — стоимость чтения из кеша для неё уменьшается вдвое, благодаря чему выполнение большинства агентских задач будет обходиться примерно на 20 % дешевле. Подписчикам платных тарифов Claude Max и Team теперь также доступен ежемесячный кредит на запросы по API — раньше они оплачивались отдельно. Новая схема призвана поддержать клиентов в создании новых агентов и приложений на базе Claude.

Модель Anthropic Claude Haiku 5.5 впервые в своём классе получила регулировку уровня «усилий» (effort setting), то есть пользователи могут выбирать между оптимизацией затрат и повышением интеллектуальных возможностей системы. Особенно выгодной модель оказывается для запросов длиной до 100 000 токенов: $0,10 за 1 млн входных, $0,50 за 1 млн выходных токенов, а также $0,01 при чтении 1 млн токенов из кеша и $0,125 при записи 1 млн токенов в кеш — при превышении длины запроса в 100 000 токенов все цены возрастают пятикратно.

Важный аспект — у Claude Haiku 5.5 отмечены значительные улучшения практически по всем критериям оценки соответствия целям в сравнении с Haiku 4.5. Зафиксировано значительно меньше случаев нежелательного поведения модели, она также стала реже содействовать злоупотреблениям. У неё более строгие механизмы защиты в сфере кибербезопасности по сравнению с Haiku 4.5, но несколько менее жёсткие в сравнении со старшими. То есть она допускает выполнение более широкого спектра задач по сравнению с Sonnet 5.5, но блокирует прямые запросы на проведение тестов на проникновение и применение методов, к которым часто прибегают хакеры.

В биологической сфере меры защиты Anthropic Claude Haiku 5.5 аналогичны используемым в Sonnet 5, Sonnet 5.5 и Opus 5. Модель работает с исследовательскими вопросами в области биологии, но ограничивает запросы, которые, по оценке разработчика, могут причинить вред. Haiku 5.5 уже доступна на всех платформах, включая Amazon Web Services, Google Cloud и Microsoft Azure, а также саму платформу Claude.

«Не соответствует обещаниям»: версия ChatGPT для подростков провалила проверку безопасности

Версия ChatGPT для подростков (ChatGPT for Teens), анонсированная в августе этого года, создаёт «неприемлемый риск» для молодых пользователей. Об этом сообщала некоммерческая организация Common Sense Media, занимающаяся обзорами приложений, сервисов и развлечений с акцентом на безопасность молодёжи.

 Источник изображения: Arsyad Basyarudin/unsplash.com

Источник изображения: Arsyad Basyarudin/unsplash.com

Common Sense Media заявила, что защитный механизм чат-бота, предназначенного для оказания помощи подросткам в учёбе, «не соответствует обещаниям компании». Согласно пресс-релизу Common Sense Media, ChatGPT «не отправляет предупреждения родителям, когда это необходимо», не предлагает «надлежащую помощь в кризисных ситуациях» и «по-прежнему выполняет домашние работы за детей».

«Чат для подростков может вселить в родителей ложную уверенность в механизмах защиты и предупреждениях о безопасности, которые часто не срабатывают», — говорится в заявлении Тома Сигела (Tom Siegel), исполнительного директора молодёжного института безопасности ИИ Common Sense Media. По его словам, хотя подросток может целый час говорить о членовредительстве, его родители не получат при этом ни единого предупреждения от чат-бота. Пока OpenAI не исправит эти упущения и не докажет независимыми тестами эффективность защитных механизмов, ChatGPT должен использоваться только взрослыми, считает Сигел.

В OpenAI выразили несогласие с такой оценкой. «Мы глубоко привержены обеспечению безопасности подростков, а также разработке мер предосторожности и предоставлению родителям значимых инструментов, которые помогут их подросткам использовать искусственный интеллект. Мы приветствуем тщательную независимую оценку, но мы не верим, что тестирование Common Sense Media точно отражает то, как на практике работают меры защиты подростков от ChatGPT, или мнение экспертов о том, как искусственный интеллект может помочь подросткам», — заявил представитель OpenAI. «Наш обзор методологии Common Sense Media показывает, что большая часть их тестирования, возможно, началась и завершилась до того, как была завершена активация родительского контроля, что делает их результаты неточными. Если это было так, тесты не позволили бы установить, работают ли уведомления о безопасности родителей должным образом», — добавил он.

Комментируя заявление OpenAI, Сигел отметил, что новая информация не меняет вывода Common Sense Media о том, что функция предупреждения родителей вызывает вопросы по поводу надёжности исполнения в кризисных ситуациях. «Мы надеемся, что OpenAI будет придерживаться сути того, что мы обнаружили, а не пытаться посеять сомнения в нашей методологии», — сообщил он.

Свора ИИ-агентов напала на картографический сервис Alibaba — некоторые представлялись как Claude

Группа агентов искусственного интеллекта под управлением, предположительно, моделей Tencent Hy в течение недели производила сбор данных с картографического сервиса Alibaba Amap. Некоторые из ИИ-агентов представлялись как Claude, но участие американской Anthropic в инциденте представляется сомнительным.

 Источник изображений: tencent.com

Источник изображений: tencent.com

Рой ИИ-агентов, которые работали в инфраструктуре Tencent Cloud через прокси-сервер hysandbox-ats, 4 октября достиг пиковых значений в 1810 сессий сканирования URL-адресов через сервис urlquery.net — в 211 случаях при сканировании использовалась метка «claude», что явно представляет собой отсылку в ИИ-помощнику Anthropic Claude. Бесплатная служба urlquery.net предлагает открытие веб-адреса в изолированном удалённом браузере с публикацией результата — это полезно при проверке подозрительных ссылок; а ИИ-агенты с его помощью могут получать доступ к страницам, к которым нельзя обращаться напрямую.

Хронология события отсчитывается от 25 августа, когда было произведено первое сканирование Amap — этот случай исследователи Swarmchasers с атакой ещё не связывают. Полноценная атака развернулась 28 октября и достигла пиковых значений в воскресенье, 4 октября, когда было произведено 1810 сеансов сканирования из 2048 — и 213 из 216 целевых местоположений. В тот день одновременно действовали от четырёх до восьми ИИ-агентов; максимум — 14, хотя это могли быть и быстрые агенты.

ИИ-агенты искали информацию о навигации пользователей, выясняя, какая доля из них прибывает к каждому входу в парк, музей, зоопарк и больницу; при этом за один проход использовалась одна локация. Исследователи не нашли подтверждений, что прогоны ИИ-агентов были скоординированы. Для чего понадобились данные, в докладе не сообщается — возможно, для оценки возможностей ИИ или генерации задач для него.

Чтобы обойти защиту Amap, ИИ-агенты генерировали антибот-токены Alibaba и обращались к общедоступным ключам API. Использовались также антибот-скрипты Alibaba Baxia, написанная агентом функция Puppeteer через API Microlink, а также переводчик страниц Baidu. Это указывает, что ИИ-агенты имели намерение обходить правила. Результаты сканирования отправлялись в почтовые ящики webhook.site — общедоступный API сервиса показывает IP-адрес и ПО, через которое создавался каждый почтовый ящик. 15 из 16 почтовых ящиков с данными Amap за период с 4 по 5 октября создавались из Tencent Cloud, установили исследователи, и 13 из них создавались по скрипту, а не вручную человеком.

Девять запросов из собственного кода ИИ-агентов отправлялись в почтовые ящики Tencent Cloud в Гонконге — все они содержали заголовок Via и заканчивались «(hysandbox-ats)»; данный заголовок к своему имени добавлял прокси-сервер, в данному случае это был Apache Traffic Server, и указывалось имя того, кто его запускал. В одном из случаев через секунду после создания ящика туда пришёл запрос с данным о монастыре Таэр — в открытом доступе этот адрес оказался лишь через 35 секунд, то есть запрос был создан в той же среде, что и ящик.

Идентификатор «HY» указывает на модели Tencent Hunyuan, хотя официальная документация по hysandbox отсутствует. Но есть сертификат безопасности для адресов «hysandbox.tencent-cloud.com», и эти имена используются в Tencent Cloud Beijing — рой ИИ-агентов работал в другой сети. Пометка «claude» появилась в 211 из 2048 запросов до 4 октября. Один определитель модели, однако, указал вероятность в 0 % относительно модели Anthropic Claude; второй указал на Hy4 как наиболее вероятную. В исследовательских тестах Tencent Hy3 называла себя Claude в 29 из 36 случаях.

Официальных комментариев от Tencent и Alibaba пока не последовало. Инцидент ещё не завершился: 5 октября на 8 часов установилась пауза, после чего сеть продолжила работать в прежнем режиме. Данные отправлялись в тот же почтовый ящик, что и прежде. Обнаружилось также сообщение от стороннего лица с указанием для оператора сменить используемую инфраструктуру. Полный отчёт исследователи обещают опубликовать позже.


window-new
Soft
Hard
Тренды 🔥
Apple Hills Digital: предобученные модели и интеграция с данными для заказчиков важнее стоимости ИИ-нагрузки 38 мин.
OpenAI уволила трёх исследователей безопасности ИИ — они опасаются, что компания заставит сотрудников молчать о рисках 2 ч.
Пошаговая ролевая игра Shadow of the Road не выйдет за неделю до GTA VI — Owlcat объявила новую дату релиза 2 ч.
Китайские ИИ-компании скрывают, насколько опасны их модели — публичных тестов почти нет 2 ч.
ИИ-агенты ошибаются опаснее чат-ботов — они сливают личные данные и совершают покупки без разрешения 7 ч.
Представлена операционная система KvadraOS Desktop для корпоративных рабочих мест 8 ч.
Ubisoft закроет серверы Rainbow Six Mobile — мобильный шутер не продержится и года 9 ч.
Anthropic прокачала Claude — теперь он визуализирует данные и создаёт анимацию прямо в чате 10 ч.
Суровая средневековая стратегия Stronghold 4 получила дату выхода в раннем доступе Steam и новую демоверсию 11 ч.
Продажи EA Sports FC 27 превысили $714 млн — футбольный симулятор возглавил топ игровых бестселлеров 2026 года 11 ч.
Google «выжмет» из АЭС Constellation ещё 890 МВт для своих ИИ ЦОД 50 мин.
Первая коммерческая альтернатива GPS: спутники Xona обещают сантиметровую точность и работу в плотной застройке 59 мин.
«Это игра вдолгую»: капитализация SpaceX отыграла $750 млрд после обвала акций в августе 2 ч.
Понаехали: власти США обвинили Microsoft в замене американцев мигрантами и отстранили её от программы грин-карт 2 ч.
Volkswagen закончила эпоху ID.4 — представлен электрический кроссовер ID. Tiguan с запасом хода до 600 км 3 ч.
NVIDIA Vera показал превосходство над чипами AMD и Intel в HPC-бенчмарках 4 ч.
«В 50 раз больше Пентагона»: Broadcom намерена привлечь $50 млрд на ИИ-чипы, а SpaceX — $40 млрд 6 ч.
E1.L вместимостью до 122,88 Тбайт: Kioxia представила QLC SSD серии LD4 6 ч.
Frore Systems показала водоблок LiquidJet Diamond с алмазными вставками в нужных местах для самых горячих GPU 6 ч.
Международная пропускная способность интернета достигла 2259 Тбит/с 8 ч.