Сегодня 10 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → иена
Быстрый переход

Гонка ИИ превратилась в ценовую войну — OpenAI догоняет Anthropic

Anthropic в этом году смогла вырваться вперёд в гонке искусственного интеллекта благодаря передовым моделям и сервису для написания программного кода, который высоко оценил американский бизнес. К настоящему моменту OpenAI, однако, сократила отставание от конкурента в корпоративном сегменте.

 Источник изображения: Brecht Corbeel / unsplash.com

Источник изображения: Brecht Corbeel / unsplash.com

Минувшей весной спрос на Anthropic Claude Code был настолько высоким, что в работе сервиса нередко возникали сбои, и обозначилась перегрузка вычислительных мощностей. У бизнеса тем временем выросли расходы на ИИ — работники начали экспериментировать с новыми решениями; в компаниях осознали, что для выполнения большинства задач не всегда требуются самые мощные и дорогие модели. В компаниях, которые сейчас используют по нескольку моделей, всё чаще стали обращаться к недорогим в эксплуатации системам китайской разработки с открытыми весами. Некоторые пользователи Anthropic Claude стали выражать недовольство жёсткими ограничениями, которые ввела компания для вышедшей в июне мощной Fable 5.

Ценовую войну подстегнула OpenAI, представив линейку моделей GPT-5.6 в вариантах Sol, Terra и Luna — клиентам предоставили на выбор решения с разными возможностями, появились более экономичные в эксплуатации варианты. Активно продвигается сервис написания программного кода Codex и другие бизнес-решения, компания выпускает новые версии младших моделей.

В сентябре расходы примерно 120 000 компаний, которые пользуются инструментами Anthropic и OpenAI, распределились между двумя этими гигантами в области ИИ практически поровну, подсчитали в OpenRouter. При этом в начале года на долю Anthropic приходились три четверти от общего объёма затрат. Приведённые данные, отметили в OpenRouter, отражают расходы преимущественно стартапов, которые изначально ориентированы на ИИ, а также более зрелых технологических компаний и крупных корпораций.

Продуктами OpenAI, по её собственному заявлению, пользуются более 2,5 млн компаний — разрыв в борьбе за корпоративных клиентов разработчик ChatGPT сокращает в тот момент, когда два крупнейших игрока готовятся выйти на биржу. Anthropic планирует стать публичной уже в ноябре, а OpenAI, вероятно, дождётся следующего года. Обе компании наращивают капитальные затраты; в ближайшие месяцы им придётся приложить максимальные усилия, чтобы продемонстрировать Уолл-стрит жизнеспособность своего бизнеса и обосновать рыночную оценку выше $1 трлн.

 Источник изображения: Growtika / unsplash.com

Источник изображения: Growtika / unsplash.com

Основанная на ИИ платформа продаж Reevo решила перейти с моделей Anthropic на OpenAI, сообщил соучредитель и генеральный директор стартапа Дэвид Чжу (David Zhu). На решение повлияли две причины: стоимость и желание снизить зависимость от одного разработчика. На этой неделе Anthropic провела в Сан-Франциско мероприятие Claude Founder House — оно оказалось чрезвычайно востребованным, и принять в нём участие смогли не все. Стоявший в очереди соучредитель игрового стартапа ReadyM Майкл Шкларски (Michael Szklarski) рассказал, что его компании часто требуются передовые модели, и он отдаёт предпочтение Anthropic Fable 5.1, но надеется встретиться с инженерами ИИ-лаборатории и обсудить, как можно снизить расходы.

Экономист финансового стартапа Ramp Ара Харазян (Ara Kharazian) в середине сентября проанализировал данные 70 000 клиентов своей компании и выяснил, что впервые с декабря бизнес стал тратить на модели OpenAI больше, чем на продукты Anthropic — правда, эта перестановка оказалась недолгой, и через неделю последняя вернула себе лидерство с небольшим отрывом. Выборка данных Ramp, уточнили в стартапе, смещена в сторону быстрорастущих технологических компаний разного масштаба, включая предприятия из списка Fortune 500; а расходы индивидуальных разработчиков в статистику не попали.

Многие владельцы бизнеса и отраслевые аналитики назвали поворотным моментом выход разработанных с упором на экономическую эффективность моделей семейства OpenAI GPT-5.6; причём вскоре после этого компания снизила стоимость работы с GPT-5.6 Luna на 80 %, а эксплуатация GPT-5.6 Terra подешевела на 20 %. Платформа для разработки ПО Retool в начале года колебалась в выборе между моделями OpenAI и Anthropic, рассказал основатель и генеральный директор компании Дэвид Сюй (David Hsu). «Главным катализатором» стал выпуск моделей GPT-5.6, и теперь Retool преимущественно использует модели OpenAI — они, по его оценкам, сегодня обходятся примерно на 20 % дешевле, чем системы Anthropic.

Ещё одна причина — политика Anthropic, согласно которой используемые Fable 5 данные в целях обеспечения безопасности и надёжности хранятся 30 дней, и это проблема для работающих с конфиденциальной информацией компаний, включая саму Retool. Впоследствии Anthropic пыталась урегулировать этот вопрос с некоторыми клиентами и предоставила им возможность контролировать хранение данных. Retool по общему правилу прописывает в договорах со своими клиентами удаление всех данных, но при работе с Fable гарантировать это не получилось бы. OpenAI делает успехи, но и Anthropic не сидит без дела — в конце сентября компания начала выпускать модели нового семейства Claude 5.5, среди заявленных преимуществ которых указываются сниженные затраты и более высокая эффективность.

Anthropic и OpenAI готовятся к первой крупной катастрофе по вине ИИ

Руководство Anthropic, OpenAI и других занимающихся искусственным интеллектом компаний в частном порядке обыгрывает сценарии общественного недовольства и политической реакции, если случится какой-либо связанный с ИИ крупномасштабный инцидент. Одним из таких сценариев представляется кибератака, которая перекроет людям доступ к финансовым услугам, к интернету или даже к электроэнергии и воде.

 Источник изображения: Numan Ali / unsplash.com

Источник изображения: Numan Ali / unsplash.com

Первый же инцидент значительного реального вреда, причинённого небезопасным ИИ, способен ещё больше настроить и без того настороженную общественность против этой технологии и лидеров отрасли: главы Anthropic Дарио Амодеи (Dario Amodei), главы OpenAI Сэма Альтмана (Sam Altman), а заодно и против президента США Дональда Трампа (Donald Trump) за его нежелание регулировать ИИ.

Планирование неблагоприятных сценариев — обычное явление во многих компаниях и учреждениях из сферы национальной безопасности. Многие ведущие исследователи и руководители отрасли ИИ считают масштабный инцидент неизбежным, хотя в OpenAI придерживаются противоположной позиции. «OpenAI проводит учения по подготовке, на которых сотрудники обсуждают и прорабатывают ряд вероятных сценариев. Неизбежными эти сценарии не считаются, но они призваны помочь нам подготовиться к различным обстоятельствам», — сообщили в компании. В Anthropic от комментариев отказались.

У гипотетического злоумышленника уже слишком широкий выбор моделей с открытыми весами — эту проблему большинство специалистов по кибербезопасности считает разрешимой только путём использования ИИ против ИИ. Ведущие лаборатории обыгрывают действия вероятного противника; особое внимание уделяется «гонке за просвещение» членов Конгресса. Руководство компаний осознало, что жёстко регулирующие ИИ законы сейчас едва ли примут, но всё же стремятся повлиять на формирование законопроектов законопроекты и наметить контуры политики, к которой власти США обратятся после первого же крупномасштабного инцидента.

 Источник изображения: Mohamed Nohassi / unsplash.com

Источник изображения: Mohamed Nohassi / unsplash.com

Инцидент может случиться, если очередная группа ИИ-агентов прорвётся в интернет из изолированной тестовой среды, или некий злоумышленник сумеет неожиданным образом задействовать уже доступные модели. Ранее стало известно о масштабной атаке, направленной на финансовые организации в Южной Корее, в ходе которой, в частности, были взломаны ресурсы двух банков — виновным в инциденте считается всего один человек. Хакер из Китая, предположительно, вооружился приложениями под управлением китайских ИИ-моделей, в том числе DeepSeek, и похитил данные нескольких десятков тысяч клиентов банков. Впоследствии он обратился к Anthropic Claude Code и попросил помощи в поиске мест для продажи информации, сообщили в CrowdStrike.

В американских ИИ-лабораториях предполагают, что если демократы победят на промежуточных выборах, они усилят свои позиции и попытаются быстро поставить развитие ИИ под контроль или вообще приостановить его, но политическая борьба будет непростой. Оторванный от революции ИИ Конгресс может не принять угрозу всерьёз. Кроме того, мировая экономика уже тесно переплетена с развитием инфраструктуры ИИ — замедление темпов роста способно нанести серьёзный удар по и без того хрупкой экономической системе.

Инсайдеры в отрасли ИИ предполагают, что серьёзный инцидент может произойти в ближайшие полгода–год. Единства мнений в законодательной ветке американской власти пока нет — разброс существует не только между партиями, но и внутри них. Одна из инициатив демократов — запрет на сверхинтеллект или приостановка развития передовых систем ИИ; есть также двухпартийная инициатива, предусматривающая создание средств экстренного отключения передовых ИИ-моделей, хотя эксперты сомневаются, что все системы ИИ вообще возможно отключить. В условиях настоящего кризиса Вашингтон может отложить в сторону разногласия между партиями — такое уже было в пандемию и в финансовый кризис 2008 года.

Белый дом отныне будет требовать от разработчиков ИИ обязательного предоставления отчётов об инцидентах с моделями

Выявленные в конце прошлого месяца инциденты с несанкционированным поведением ИИ-моделей Anthropic, которые по своей воле отправляли информацию с помощью правительственных сайтов США, заставили регуляторов отказаться от добровольной подачи отчётов и сделать её обязательной.

 Источник изображения: Anthropic

Источник изображения: Anthropic

До сих пор разработчики ИИ-моделей предоставляли американским властям отчёты об инцидентах в сфере кибербезопасности на добровольной основе, но история с неавторизованным доступом ИИ-агентов Anthropic к правительственным сайтам США вынудила регуляторов сменить риторику. Отныне разработчики ИИ-моделей будут обязаны предоставлять властям США отчёты об инцидентах в сфере информационной безопасности и давать рекомендации по устранению уязвимостей.

В заявлении для издания Axios руководители Сил сверхинтеллекта Белого дома сообщили следующее: «Процесс уведомления и исправления не является опциональным. Это критически важное обязательство с точки зрения национальной безопасности». По имеющимся данным, в конце прошлого месяца ИИ-агенты обманным путём получили несанкционированный доступ к правительственным и некоторым другими сайтам, хотя ситуацию в итоге и удалось взять под контроль.

Anthropic в минувший четверг обратилась к Госдепартаменту США, сообщив о выявленных 19 случаях подачи заявок на получение неиммигационной визы США в августе и одной заявки в мае от лица одной из проходивших тестирование своих ИИ-моделей. Заявки были поданы через онлайн-форму на сайте этого ведомства. Ни одно из этих заявлений не было обработано, и правительственные системы всё это время не подвергались угрозе с точки зрения информационной безопасности, по словам представителей Белого дома.

Полиция Филадельфии также получила от ИИ-модели Anthropic ложный донос об обстоятельствах расследуемого суицида, хотя соответствующая модель была проинструктирована ни при каких условиях не заполнять и не отправлять подобные веб-формы. Поскольку обращение в полицию было оформлено анонимно, ведомство не стало его рассматривать и удалило после получения.

По словам представителей Сил сверхинтеллекта США, все занятые в сфере сверхинтеллекта компании должны незамедлительно сообщать об инцидентах с участием их моделей и быстро устранять причины подобного их поведения, предотвращая дальнейший ущерб. Чиновники также рассчитывают, что «провинившиеся» разработчики будут эффективно взаимодействовать с владельцами затронутых систем с целью устранения последствий этих инцидентов. Каких-либо штрафных санкций или административных мер воздействия профильное американское ведомство пока не предлагает.

Глава вновь созданной правительственной структуры США Джей Клейтон (Jay Clayton), который по совместительству является директором Национальной разведки, а также его коллеги, уже уведомили Anthropic, что рассчитывают на скорейшее устранение возможных последствий имевших место инцидентов, а также на полную прозрачность процесса, включая широкую общественную огласку. Власти США также рассчитывают на оперативное внедрение защитных мер, предотвращающих повторное выявление подобных инцидентов в будущем.

Президент Трамп объявил врагами всех, кто не готов использовать термин «сверхинтеллект»

В конце сентября Дональд Трамп (Donald Trump) подписал указ, который требует от всех официальных лиц использовать термин «сверхинтеллект» (англ. superintelligence) вместо «искусственного интеллекта». Теперь американский президент готов объявить врагом США любого, кто не будет подчиняться этому требованию.

 Источник изображения: библиотека Конгресса США, Unsplash

Источник изображения: библиотека Конгресса США, Unsplash

Со страниц своей социальной сети Truth Social Дональд Трамп заявил следующее: «Белый дом считает врагом любого, кто использует термин "искусственный интеллект" вместо широко принятого нового и более точного "сверхинтеллект"». Свою кампанию по смене этого названия президент США, как принято считать, затеял ради улучшения имиджа сопутствующих технологий в общественном восприятии.

С ростом числа инцидентов в сфере кибербезопасности, которые были спровоцированы вышедшими из-под контроля ИИ-агентами, а также по мере распространения протестов местного населения против строительства ЦОД в США с понятием «искусственный интеллект» стало ассоциироваться много негативных моментов. Трамп надеется, судя по всему, что «смена вывески» в сочетании в предпринимаемыми мерами по введению аудита позволит переломить негативную социологическую тенденцию.

При этом американский президент выступает против замедления темпов развития отрасли с целью повышения общественной безопасности ИИ. Он считает, что такие ограничения дадут конкурентные преимущества Китаю, который сокращает отставание от США в данной сфере. Награждая недавно группу руководителей американских техногигантов в Вашингтоне, Трамп назвал текущий период «золотым веком» с точки зрения развития науки и технологий.

На правительственных сайтах США документы и соответствующие ссылки уже заменили упоминание «искусственного интеллекта» на «сверхинтеллект». Впрочем, основной интернет-ресурс, посвящённый данной технологии, всё ещё содержит обозначение домена «ai.gov». Как уже отмечалось ранее, инициатива Трампа по переименованию технологии вызвала рост спроса на доменные имена в зоне «.si», которыми распоряжается Словения, а вернувшийся к демонстрации лояльности Трампу Илон Маск (Elon Musk) пообещал переименовать свой стартап SpaceXAI в SpaceXSI. При этом многие делегаты мероприятия, на котором Трамп награждал представителей технологической отрасли США медалями, в своих выступлениях то и дело путались в терминологии, по привычке упоминая «искусственный интеллект» в присутствии президента.

Принцип «как вы яхту назовёте, так она и поплывёт» в целом характерен для Дональда Трампа, поскольку в политических целях за свой неполный пока второй президентский срок он успел переименовать несколько географических объектов, включая Мексиканский залив и расположенное на границе с Канадой озеро Онтарио. Отказавшихся признать новые топонимы журналистов администрация Белого дома даже перестала приглашать на официальные мероприятия для прессы.

OpenAI уволила трёх исследователей безопасности ИИ — они опасаются, что компания заставит сотрудников молчать о рисках

Трое бывших исследователей OpenAI рассказали, что их на прошлой неделе внезапно уволили за общение со сторонними организациями, занимающимися безопасностью ИИ. Они предупредили, что такие решения могут заставить сотрудников бояться открыто обсуждать риски искусственного интеллекта. Сама же OpenAI подтвердила своё решение, но объяснила его по-другому.

 Источник изображений: Mariia Berezovsky / unsplash.com

Источник изображений: Mariia Berezovsky / unsplash.com

В письме под заголовком «OpenAI не сможет обеспечить безопасность искусственного интеллекта в одиночку» бывшие сотрудники лаборатории отметили, что это «необычная компания», и ключевой составляющей работы в ней является взаимодействие со сторонними организациями для решения проблем безопасности, причём её сотрудники должны делать это «свободно и без страха».

Адресованное комитетам OpenAI по безопасности письмо опубликовал Микита Балесный (Mikita Balesni) — один из уволенных сотрудников, который занимался вопросами согласования целей ИИ. Документ подписали также уволенные Томек Корбак (Tomek Korbak) и Жасмин Ван (Jasmine Wang), которые работали в сфере безопасности.

На своих личных страницах в соцсетях они написали, что причины увольнения им объяснили лишь устно, а их действия не выходили за рамки служебных обязанностей. «Причины нашего увольнения просто не складываются в логичную картину», — написала Ван. Балесному сообщили, сто компания больше не доверяет ему, потому что он «слишком много общался с занимающимися вопросами безопасности сторонними организациями». «Я никогда не разглашал информацию, составляющую интеллектуальную собственность компании. Моя работа согласовывалась с непосредственным руководством, руководителями исследовательских направлений и советом директоров», — написал он.

Корбаку в устной форме объяснили, что его увольнение связано с «характером общения с METR» — сторонней некоммерческой исследовательской организацией, которая оценивает модели ИИ и связанные с безопасностью риски. «Поясню: общение с METR входило в мои служебные обязанности», — добавил он. Бывшие коллеги исследователей теперь будут «бояться высказываться и действовать в соответствии с тем, что ещё на прошлой неделе считалось неотъемлемой частью работы в OpenAI. <..> Подобные увольнения — внезапные и проведённые в такой резкой форме — подрывают открытую культуру, которую OpenAI ценила в прошлом», — говорится в письме.

Исследователи дали OpenAI три совета: привлекать к работе в организации сторонних аудиторов по безопасности, обеспечить возможность мониторинга передовых моделей ИИ и поддерживать «культуру открытого и прозрачного диалога между исследователями в сфере безопасности и остальными участниками экосистемы безопасности».

В разосланной сотрудникам служебной записке один из руководителей исследовательского направления OpenAI написал, что полностью поддерживает эти рекомендации. «Мы высоко ценили их вклад в обеспечение безопасности ИИ, а также их готовность открыто высказывать своё мнение и подвергать сомнению существующие идеи. Мы поддерживали их инициативы и оказывали им огромное доверие. Хочу подчеркнуть: причиной этих решений стало вовсе не то, что они поднимали вопросы безопасности или открыто высказывались. Мы всегда поощряли и будем поощрять подобную активность. Мы не увольняем сотрудников за то, что они указывают на проблемы», — говорится в документе.

Тем не менее, решение уволить этих троих сотрудников было принято «после тщательного расследования, выявившего нарушение ими чётких правил обращения с конфиденциальной информацией», подчеркнула компания в соцсети X. OpenAI разделяет изложенный в письме принцип необходимости «обеспечить возможность контроля передовых моделей», а также изложенные в письме идеи, касающиеся «сохранения возможности мониторинга передовых моделей», и компания продолжает вкладывать значительные ресурсы в эту сферу.

Китайские ИИ-компании скрывают, насколько опасны их модели — публичных тестов почти нет

Китайские разработчики ИИ крайне неохотно делятся информацией по поводу тестирования своих моделей на предмет безопасности использования, выяснила исследовательская компания SemiAnalysis. И это на фоне того, что во всём мире растут опасения по поводу рисков, связанных со стремительным развитием передовых ИИ-систем.

 Источник изображения: Steve A Johnson/unsplash.com

Источник изображения: Steve A Johnson/unsplash.com

Согласно проведённому SemiAnalysis анализу 857 моделей, выпущенных в период с 2021 года по 15 сентября текущего года девятью ведущими китайскими компаниями в области искусственного интеллекта — Alibaba, ByteDance, Tencent, Baidu, DeepSeek, Moonshot, Z.AI, MiniMax и StepFun, лишь в 31 случае, или 6,3 %, были опубликованы результаты оценки безопасности, которые можно было бы сопоставить с конкретной моделью. Только в девяти релизах, или 1,1 % всего количества выпусков, такие результаты были доступны на момент выхода модели или до него. Исследователи не обнаружили информации о безопасности 813 моделей, хотя компании могли бы провести тесты в частном порядке.

В SemiAnalysis пояснили, что под раскрытием информации подразумевается публикация результатов, относящихся к конкретной модели (включая тесты на генерацию вредоносного контента, устойчивость к обходу защитных ограничений, токсичность, соблюдение конфиденциальности, поведение при отказе от выполнения запроса или наличие опасных возможностей). При этом не учитываются общие заявления о том, что модель прошла обучение мерам безопасности или соответствующую проверку.

В связи с нашумевшими инцидентами, связанными с самовольным поведением ИИ-агентов, усилились глобальные дебаты о том, должны ли ИИ-компании замедлять разработку передовых моделей с целью создания более эффективных рычагов их контроля.

На прошлой неделе появились сообщения в СМИ, что китайские ИИ-агенты, так же, как и американские, могут обманывать пользователей, обходить ограничения и скрывать сбои в тестах.

Новейшая система управления безопасностью ИИ в Китае позволяет выявлять риски, включая получение моделями системных разрешений или внешних ресурсов без разрешения, обман оценщиков, сокрытие возможностей и обход контроля безопасности. Но, согласно SemiAnalysis, никаких обязательств на разработчиков, связанных с возможностями моделей, она не налагает. Правилами в основном регулируются приложения и их влияние на пользователей, не выдвигая никаких требований разработчикам передовых моделей относительно проведения или публикации оценки рисков на основе возможностей модели.

По данным SemiAnalysis, ни один крупный китайский разработчик не выпустил передовую LLM с результатами тестирования на наличие опасных возможностей, обнародованными для широкой публики.

ИИ-агенты ошибаются опаснее чат-ботов — они сливают личные данные и совершают покупки без разрешения

В жизнь современного человека постепенно входят агенты искусственного интеллекта. Они избавляют пользователей от повседневных задач, но их ошибки грозят оборачиваться непредсказуемыми последствиями. ИИ-агенты могут публиковать конфиденциальную информацию в рабочем чате или оформлять покупки даже в отсутствие доступа к платёжным средствам.

 Источник изображения: Mohamed Nohassi / unsplash.com

Источник изображения: Mohamed Nohassi / unsplash.com

Пользователь ИИ-агента Grok Bot Шейн Мак (Shane Mac) рассказал, как тот выложил в групповой чат корпоративного мессенджера Slack его банковскую выписку: балансы расчётного и сберегательного счетов, данные о расходах на строительство дома и о регулярных платежах за Netflix и автострахование. Для личных целей он использовал ИИ-агента, которому присвоил название «Персональный финансовый директор», — ему он открыл доступ к своим банковским счетам в режиме только для чтения. Доступ к рабочему чату в Slack был у другого ИИ-агента на той же платформе — он носил название «Руководитель аппарата».

Господин Мак потребовал объяснений, как вышло, что «Персональный финансовый директор» опубликовал конфиденциальную информацию в рабочем чате. ИИ-агент объяснил ситуацию и даже по-своему извинился: «Моя вина. Личные финансы — неподходящая тема для такой аудитории, и точка».

В последние недели популярность ИИ-агентов резко возросла: им доверяют управление перепиской, планирование поездок и множество других задач. Но в какие-то моменты они начинают вести себя непредсказуемо, как и управляющие ими модели, которые бывают склонны к галлюцинациям, неверной интерпретации данных и даже к спонтанным действиям на грани киберпреступлений. В отличие от чат-ботов, которые только отвечают на вопросы, ИИ-агенты могут выполнять от имени пользователя конкретные действия, например, наводить порядок в календаре или производить запись на приём.

Агент разбивает полученную команду на ряд этапов, которые для удобства не озвучиваются пользователю. Перед совершением важных действий, например, при покупке товаров или удалении файлов они запрашивают разрешение, но в остальном действуют по своему усмотрению. Если запрос пользователя неясен, или существует множество способов выполнить требуемое действие, может возникнуть неразбериха. В случае с Шейном Маком ИИ-агент перепутал групповые чаты со схожими названиями. Разработчики Grok Bot заверили его, что проблема устранена.

Работающая в Сан-Франциско Анника Беннинг (Annica Benning) уже почти месяц пользуется ИИ-агентом Instinct — взаимодействовать с ним можно прямо через приложение сообщений на iPhone. Она использует приложение для покупок в интернете, для заказа такси Uber и бронирования авиабилетов. В 90 % случаев система работает безупречно, но не обходится и без сюрпризов.

 Источник изображения: Igor Omilaev / unsplash.com

Источник изображения: Igor Omilaev / unsplash.com

Однажды женщина вернула в интернет-магазин купальник и попросила ИИ-агента предложить варианты на замену. Тот прислал ей ссылку для подтверждения выбора, но она, по её словам, так и не подтвердила покупку. Однако получила электронное письмо с подтверждением заказа. При операциях с банковской картой система присылает ссылку для подтверждения, но в данном случае оплата производилась за счёт средств из возврата, поэтому систему удалось обойти этап подтверждения. Отменить заказ не удалось — теперь госпожа Беннинг надеется его вернуть, когда он придёт.

Ещё в одном случае при поездке в другой город она поручила Instinct забронировать столик на ужин — он забронировал, но не на тот вечер, а в этот у неё были другие планы, о которых он знал. Женщине пришлось попросить агента отменить бронь и договариваться с администрацией ресторана, чтобы с неё не взимали штраф в размере $50 за неявку — ресторан через агента согласился пойти навстречу.

Шалини Динеш (Shalini Dinesh) из Остина предпочитала чат-бот Anthropic Claude, но решила испробовать нового ИИ-агента Meta✴✴ Muse. Ему женщина поручила организовать вечеринку в честь 13-летия сына. Вечеринка проходила на площадке для пейнтбола, поэтому ИИ-агент составил и разослал родителям сообщения с формой согласия на участие, которую надо было подписать; в сообщении также указывалось, какую одежду надевать детям. Система нашла поблизости готовые доставить еду рестораны, с учётом аллергии у некоторых участников; и подобрала тематические подарочные наборы для детей в соответствии с возрастом. Но не справилась с ситуацией, когда выяснилось, что у двоих детей одинаковые имена — их ИИ-агент учёл как одного человека, но Шалини Динеш успела перепроверить список и исправить ошибку.

Джесси Леви (Jesse Levey), основатель стартапа из района бухты Сан-Франциско, попытался использовать Meta✴✴ Muse для работы с расписанием своих троих детей. Он начал вручную переносить в Muse данные о стандартном расписании детей на неделю из своего календаря, но понял, что это будет слишком хлопотно, учитывая, что в секциях и кружках пользуются специфическими приложениями, а совместные поездки обсуждаются в групповых чатах.

Дети занимаются в лыжной секции, и у неё есть специальное приложение с календарём; используются также SMS, WhatsApp, электронная почта, приложения календаря и ещё около 65 других приложений, к которым системе потребовался бы доступ. Тогда господин Леви спросил у Anthropic Claude, нет ли более мощного ИИ-агента, который сможет управлять расписанием его детей с учётом требования к конфиденциальности и безопасности. Тот предложил нанять для этого человека — он точно сможет «гоняться за местами в летних лагерях, импровизировать, когда дети болеют, и принимать десяток решений в неделю, с которыми не справится ни одна система». Создание версии такой системы на основе ИИ «потребовало бы нескольких месяцев вашего внимания», предостерёг Claude.

Математический прорыв OpenAI оказался под вопросом — учёные нашли расхождение в доказательстве

Математический прорыв OpenAI начал вызывать вопросы. Учёные сравнили опубликованное доказательство по уравнениям Навье — Стокса с его алгоритмической Lean-версией и нашли расхождения: в нескольких ключевых местах машинный вариант, проверяемый на компьютере, содержит более слабые утверждения. Это ещё не опровержение, но почва для сомнений уже вполне плодородная

 Источник изображения: Thomas T /unsplash.com

Источник изображения: Thomas T /unsplash.com

По словам математиков, расхождение вовсе не означает, что доказательства неверны или что OpenAI неправильно решила задачу, но это ставит под сомнение, всегда ли можно полагаться на математические результаты, генерируемые моделями искусственного интеллекта.

«Что нужно сделать со всеми этими большими доказательствами, созданными на основе языковой модели, так это то, что они должны быть прочитаны людьми, и это создает огромную дополнительную нагрузку на математиков», — сообщил руководитель команды Андерс Хансен (Anders Hansen).

Процесс поиска расхождений занял у команды около двух недель. При этом математики использовали подсказки ChatGPT. Напомним, что у OpenAI на решение задачи ушло 88 часов.

Математики указали на расхождение в части доказательств, называемой леммой 8.6. В доказательстве на естественном языке уравнение в этой части требует, чтобы определённое значение было меньше m + 4, где m - целое число, а в Lean‑версии — меньше m + 5, что математически слабее, поскольку допускает больше возможных решений и не эквивалентно первому.

Представим, что вас попросили решить уравнение x + 3 = 6, ответом на которое является x = 3. Можно написать доказательство того, что x должно быть меньше 4, а также того, что x должно быть меньше 5. Оба эти математических утверждения абсолютно верны, но последнее допускает больше возможных ответов для x, что делает его математически более слабым.

По словам Хансена, неправильный перевод мог возникнуть из-за того, что ИИ стремится к тому, чтобы компьютерный код был полностью самосогласован и не выдавал ошибок. Если в процессе автоматической формализации ИИ обнаружит часть доказательства, которая не компилируется, он попытается найти обходной путь, даже если это означает отклонение от доказательства, написанного на естественном языке.

Кевин Баззард (Kevin Buzzard) из Имперского колледжа Лондона сообщил, что можно надёжно формализовать в Lean саму формулировку теоремы и затем проверить, компилируется ли доказательство. Но это не гарантирует, что текстовое доказательство в PDF корректно передаёт логику. То есть Lean‑код может быть внутренне согласован, но не соответствовать тому, что написано в статье. «Я уверен, что проблема Навье — Стокса была решена правильно, — говорит Баззард. — Я гораздо менее уверен в том, что доказательство, описанное текстом, является правильным».

OpenAI сообщила ресурсу New Scientist, что ей известно о несоответствии между доказательством на естественном языке и в виде кода, и что это не означает, что ни одно из них недействительно.

Умное кольцо Natura Interface позволит отдавать поручения ИИ-агентам, не доставая смартфон

Стартап Natura представил умное кольцо Interface стоимостью $99. Устройство создано для работы в эпоху ИИ-агентов: нажав кнопку, можно дать ИИ-агенту поручение, записать мысль или выполнить задачу, не вынимая смартфон из кармана. Поддерживаются функции мониторинга показателей здоровья: частоты сердечных сокращений, вариабельности сердечного ритма, качества сна и уровня активности.

 Источник изображений: natura.inc

Источник изображений: natura.inc

Идея Natura Interface заключается в том, чтобы помочь людям реже отвлекаться на экраны смартфонов, поскольку повседневные задачи можно выполнять быстрее и естественнее. На момент запуска устройство будет поддерживать интеграцию с рядом ИИ-агентов и приложений, в том числе Meta✴✴ Muse, Instinct, Grok Bot, Claude и ChatGPT. Приём предварительных заказов стартует в ноябре, а поставки запланированы на декабрь или январь.

Умное кольцо — не первый продукт компании. Ранее она выпустила HumanPods — наушники с поддержкой ИИ, предназначенные для взаимодействия с агентами. В Natura, однако, посчитали, что для использования новейших достижений в области голосовых технологий необходим иной форм-фактор. Вариантов использования кольца с ИИ огромное множество, отметил производитель.

Во время пробежки можно поручить кольцу отслеживать тренировку; утром после пробуждения — узнать, что запланировано на день; обнаружив в душе, что закончился шампунь, — заказать новый; засыпая перед телевизором, — отдать команду выключить его и поставить будильник на утро; после записи совещания — отправить коллеге заметки по итогам обсуждения.

Ответы ИИ-агентов могут поступать через подключённые наушники, функцию Live Activities на iPhone или приложение NatureOS. Пользователи, работающие с несколькими ИИ-агентами, могут выбирать, какой из них будет выполнять конкретную задачу: одному можно поручить написание кода, второму — бронирование столика, третьему — что-то ещё. Управлять можно не только ИИ-агентами, но и собственными устройствами, в том числе компьютерами. В перспективе, уверен разработчик, кольцо станет основным интерфейсом взаимодействия человека с технологическими решениями.

На старте продаж Natura Interface будет стоить $99, но в перспективе компания планирует повысить цену. Производитель намерен сделать устройство доступным для пользователей, наработать базу активных клиентов и сформировать спрос. По истечении бесплатного периода продолжительностью от трёх до шести месяцев Natura хочет ввести абонентскую плату в размере $9 в месяц. Производственные затраты сопоставимы с расходами на выпуск таких устройств, как Oura Ring и Samsung Galaxy Ring: используются многие идентичные компоненты. Однако стартап хочет установить более скромную цену, чтобы снизить порог входа и стимулировать распространение продукта.

Natura Interface предлагает набор функций мониторинга здоровья. Кольцо отслеживает частоту сердечных сокращений и пульс в состоянии покоя, вариабельность сердечного ритма, фазы сна, уровень физической активности, количество шагов и изменения температуры кожи. Полная зарядка аккумулятора занимает 100 минут, после чего кольцо может проработать от 6 до 12 дней.

Anthropic прокачала Claude — теперь он визуализирует данные и создаёт анимацию прямо в чате

Claude теперь умеет превращать обычный запрос в дашборд или анимацию. Anthropic представила два новых инструмента для бизнес-пользователей, которые позволяют анализировать данные в реальном времени и создавать визуальный контент прямо в чате.

 Источник изображения: anthropic.com

Источник изображения: anthropic.com

Разработчики сервисов с ИИ стремятся расширять наборы функций, ориентированные на рабочие задачи. В арсенале Anthropic появилась новая функция Claude Dashboards, доступная в качестве бета-версии для пользователей платных тарифных планов. Чат-бот подключается к платформам бизнес-данных и системам управления клиентами, позволяя создавать панели мониторинга и анализа данных в реальном времени — для их формирования достаточно запросов простым языком, без программирования.

Функция Claude Motion также находится в бета-версии для клиентов Team и Enterprise. Она позволяет по простым запросам создавать редактируемые анимированные элементы и экспортировать их как видеофайлы. Два новых инструмента призваны помочь пользователям анализировать бизнес-данные и создавать визуальные материалы без программирования. Компания выпустила в открытый доступ средства работы с офисными документами — ранее они находились в бета-тестировании.

Новые средства визуализации накануне представила и OpenAI — в ChatGPT на основе модели GPT-6 также появились графики, схемы и кнопки для выполнения конкретных задач.

Anthropic запустила бесплатный сервис для поиска дыр в ПО с открытым исходным кодом

Компания Anthropic представила бесплатный сервис сканирования OSS Scanner для регулярного поиска уязвимостей в проектах с открытым исходным кодом (open source). Сервис использует самые мощные ИИ-модели разработчика, включая Claude Mythos.

 Источник изображения: Anthropic

Источник изображения: Anthropic

Проекты смогут подключаться к сервису добровольно по подписке opt-in, предусматривающей добровольное согласие пользователя на получение уведомлений и отчётов о найденных уязвимостях. Anthropic рассчитывает, что автоматическое сканирование позволит выявлять проблемы быстрее и раньше, чем при использовании исключительно традиционных методов проверки.

При этом отчёты OSS Scanner не будут проходить проверку специалистами. Anthropic подчёркивает, что все результаты формируются ИИ без участия человека в проверке и первичной оценке обнаруженных проблем. Поэтому среди сообщений могут оказаться ошибочные или недействительные находки, которые разработчикам придётся проверять самостоятельно.

OSS Scanner появился на фоне растущего интереса к использованию ИИ для поиска уязвимостей в программном обеспечении. В последние месяцы подобные инструменты помогли обнаружить несколько серьёзных проблем в проектах с открытым исходным кодом, включая критическую уязвимость Copy Fail, затронувшую почти все дистрибутивы Linux в мае.

Одновременно увеличение числа автоматических проверок создаёт и дополнительную нагрузку на разработчиков. Некоторые проекты с открытым исходным кодом уже с трудом справляются с потоком отчётов об ошибках, созданных ИИ-моделями. Среди тех, кто столкнулся с этой проблемой, оказались Линус Торвальдс (Linus Torvalds) и даже компания Google.

Agile Robots начала показывать роботам видео с людьми, чтобы научить их работать руками

Немецкий стартап в области робототехники Agile Robots обучает свои машины, снимая видео, где люди выполняют различные задачи — это помогает восполнить дефицит данных, сдерживающий развитие промышленной автоматизации.

 Источник изображения: agile-robots.com

Источник изображения: agile-robots.com

В рамках проекта Robot Academy сотрудники компании снимают на видео, как они выполняют те или иные задачи, фиксируя движения рук и пальцев. Agile Robots объединяет эти материалы с дополнительными обучающими данными, после чего роботы отрабатывают движения в виртуальной среде. «Если люди могут учиться в школе, почему этого не могут делать роботы?» — задался вопросом гендиректор компании Чжаопэн Чэнь (Zhaopeng Chen).

В Европе и других регионах появилось множество стартапов, которые стремятся внедрить на производствах человекоподобных и других роботов для повышения производительности и снижения затрат. Работа на таких предприятиях может быть сопряжена с выполнением повторяющихся операций, которые поддаются автоматизации легче, чем задачи в других сферах реальной жизни. Но внедрение технологий идёт медленно, потому что роботы с трудом справляются даже с самыми простыми задачами — отчасти из-за нехватки обучающих данных.

Чтобы освоить ту или иную задачу, роботам могут потребоваться несколько тысяч попыток, и даже при незначительном изменении условий машинам придётся учиться заново, тогда как квалифицированные рабочие используют опыт, накопленный за всю жизнь. Agile Robots основали в Мюнхене в 2018 году исследователи Германского центра авиации и космонавтики. К настоящему моменту компания привлекла $1,5 млрд инвестиций и внедрила 20 000 своих систем.

Планы по дальнейшему привлечению средств господин Чэнь комментировать отказался, но отметил, что новые вливания ожидаются «очень скоро». Ранее стало известно, что компания ведёт переговоры о привлечении ещё $800 млн при участии SoftBank Group.

Google представила ИИ-сотрудника — Gemini agent сможет самостоятельно выполнять задачи от начала до конца

Подразделение Google Cloud представило на конференции Gemini at Work 2026 новый продукт под названием Gemini agent — это агент с искусственным интеллектом, предназначенный для корпоративных пользователей. Он доступен в приложении Gemini Enterprise, пакете Workspace и в ряде других сервисов. Ему достаточно «ставить цели, а не давать пошаговые инструкции» — Gemini agent может отвечать на вопросы, выполнять интеллектуальную работу, создавать медиаконтент, писать и запускать код.

 Источник изображений: Google

Источник изображений: Google

«Если руководитель присылает вам письмо с просьбой подготовить презентацию с последними данными по проекту, Workspace Intelligence идентифицирует это как задачу, которую можно делегировать, и предлагает одним нажатием кнопки передать её Gemini-агенту», — приводит пример Google. ИИ-агент может также организовать мероприятие с коллегами, самостоятельно определив их состав по предыдущим мероприятиям, проверив их календари и инициировав переписку для согласования удобного времени.

Gemini agent способен выступать в роли сотрудника компании и выполнять функции, предусмотренные конкретной должностью. Он выполняет задачи, подбирая наиболее подходящие модели — помимо семейства Google Gemini, это также модели Anthropic Claude; в перспективе появятся и другие, проприетарные и открытые. Для решения многоэтапных задач подключаются субагенты; поддерживается работа с различными сторонними инструментами. Задачи могут быть долгосрочными и занимать несколько часов и даже дней.

ИИ-агент работает в облаке, обращаясь к «единому набору данных памяти, контекста и общему графу персонализации». Доступны четыре типа памяти:

  • сессионная память — ориентирована на текущую задачу, даже если она выполняется несколько дней;
  • семантическая память — «структурированная база знаний, формируемая в процессе чтения документов, общения с людьми и взаимодействия с другими агентами»;
  • процедурная память — «информация, как выполняется работа, в том числе навыки, которые агент вырабатывает сам для себя»;
  • эпизодическая память — «всё, что было сделано ранее».

Чтобы вызвать Gemini agent, его необходимо упомянуть как «@Gemini» в Gmail, «Google Документах», «Таблицах», «Презентациях» и «Чате». Он доступен на любых устройствах через различные каналы, включая командную строку, Google Workspace, Slack и Microsoft 365; при помощи API можно подключать сторонние приложения, в том числе без графического интерфейса. Сейчас Gemini agent находится на стадии закрытого предварительного тестирования, в перспективе он появится у корпоративных клиентов Google Workspace на некоторых тарифных планах семейств Business и Enterprise.

GlobalFoundries поможет TSMC делать ИИ-чипы — компания начнёт выпускать кремниевые мосты в США

Крупнейший контрактный производитель чипов США нашёл новое применение своему заводу в штате Нью-Йорк. Он будет задействован для выпуска кремниевых мостов, используемых при производстве передовых чипов компанией TSMC, включая применяемые в инфраструктуре ИИ.

 Источник изображения: GlobalFoundries

Источник изображения: GlobalFoundries

Зародившаяся весной 2009 года на основе немецких предприятий AMD компания GlobalFoundries на первых порах грезила освоением передовых техпроцессов и превращением в одного из крупнейших контрактных производителей чипов в мире, но к 2018 году поняла, что путь к освоению 7-нм технологии оказался слишком долгим и затратным, а потому решила сосредоточиться на более зрелых технологиях типа 12-нм.

На этой неделе стало известно о вовлечении GlobalFoundries в расширяющуюся активность по выпуску передовых ИИ-чипов. Эта компания должна будет наладить, по словам её представителей, выпуск кремниевых мостов для передовых ИИ-компонентов, производимых тайваньской TSMC. Эти кремниевые подложки позволяют связать вычислительные компоненты и микросхемы памяти в рамках одной упаковки, а также наладить между ними обмен данными на высоких скоростях. Для соответствующих нужд GlobalFoundries будет использовать своё предприятие в штате Нью-Йорк.

Соглашение между GlobalFoundries и TSMC рассчитано на пять лет, оно подразумевает, что упоминаемое предприятие в штате Нью-Йорк будет расширено. Эта площадка станет первым поставщиком таких кремниевых мостов на территории США, используемых при выпуске передовых с точки зрения пространственной компоновки чипов. Перед началом основной торговой сессии в США акции GlobalFoundries на этих новостях успели вырасти в цене на 4 %.

Массовое производство этих компонентов GlobalFoundries начнёт наращивать в первой половине 2028 года. Считается, что сделка с TSMC позволит заложить основу для будущего расширения профильных мощностей GlobalFoundries. В условиях возникновения физических ограничений по площади монолитных кристаллов, переход к многочиповой упаковке со сложной пространственной компоновкой давно стал разумным способом повышения быстродействия полупроводниковых компонентов. Спрос на кремниевые мосты в такой ситуации наверняка будет расти и дальше. С другой стороны, нехватка мощностей по упаковке чипов с использованием передовых методов становится узким местом для всей полупроводниковой отрасли, и эту проблему тоже надо решать.

Открытый и бесплатный Photoshop не за горами — с помощью ИИ создаются копии популярных программ Adobe

Разработчик по имени Брэндон Томас (Brandon Thomas) объявил об инициативе, в рамках которой он при помощи искусственного интеллекта ведёт разработку программ, призванных в точности скопировать внешний вид и функциональность наиболее популярных приложений Adobe. Все свои продукты он опубликует как бесплатные проекты с открытым исходным кодом.

 Источник изображений: Artcraft

Источник изображений: Artcraft

Проект Artcraft стартовал в прошлом году — первоначально он позиционировался как инструмент «управляемого ИИ» для художников, позволяющий с высокой точностью редактировать созданные нейросетями изображения и видео уже после их генерации. Впоследствии разработчик объявил о смене курса: теперь проект представляет собой набор из семи программ с исходным кодом, воссоздающих интерфейс и инструментарий Adobe Photoshop, Illustrator, Premiere, Lightroom, After Effects, InDesign и Acrobat Pro.

При разработке аналогов проприетарного ПО от Adobe он использует модель Anthropic Claude Opus 5.5 — код создаётся на языке Rust, есть версия WebAssembly для работы в браузере. Посетители интернет-сообществ поспешили указать энтузиасту на многочисленные недостатки в его программах, но тот заверил, что сейчас они находятся в «очень ранней альфа-версии» и вскоре перерастут в продукт, ничем не уступающий по функциональности разработкам Adobe.

Сначала он пообещал, что в течение месяца добьётся 100-процентного паритета с продуктами Adobe в отношении набора функций; впоследствии скорректировал свой прогноз в сторону 99-процентного паритета за несколько месяцев, но всё-таки не лет. Сам автор проекта, по его собственным словам, имеет около десяти лет опыта работы над масштабными проектами на языке Rust. К новому проекту его подтолкнула практика Adobe, предусматривающая штрафы для пользователей, которые отменяют подписку.

Разработка полностью бесплатных продуктов, распространяемых с лицензиями MIT и Apache, финансируется за счёт продажи доступа к существующей модели визуального ИИ и IDE под названием Artcraft — этот инструмент предлагается в приложениях как одна из опций генератора изображений наряду с другими моделями. Наличие постоянного источника дохода гарантирует, что проект не будет заброшен.

Брэндон Томас — не единственный программист, который решил методом обратного проектирования воссоздавать коммерческое ПО без прямого копирования его исходного кода. Сама по себе эта деятельность юридически считается допустимой, но у Adobe могут возникнуть претензии по поводу копирования фирменного стиля, если новые приложения будут слишком сильно напоминать привычный внешний вид и интерфейс продуктов Adobe. Томас говорит, что в перспективе и рядовые разработчики смогут создавать копии популярных приложений и издавать их с открытым исходным кодом, чтобы «вернуть себе интернет и навсегда взять технологии под свой контроль».

Эпоха традиционного ПО окончена, провозгласил он. «Мы заменим „Google Поиск“, создадим собственные смартфоны и выстроим более качественную инфраструктуру. Мы уберём всю рекламу и избавим весь технологический мир от засилья низкокачественных решений», — пообещал энтузиаст.


window-new
Soft
Hard
Тренды 🔥
Гонка ИИ превратилась в ценовую войну — OpenAI догоняет Anthropic 38 мин.
Anthropic и OpenAI готовятся к первой крупной катастрофе по вине ИИ 4 ч.
Белый дом отныне будет требовать от разработчиков ИИ обязательного предоставления отчётов об инцидентах с моделями 7 ч.
Новая статья: RetroSpace — осторожно, уборщик галактику спасает. Рецензия 15 ч.
Девять из десяти клиентов VMware задумались об уходе из-за высоких цен 15 ч.
Apple Hills Digital: предобученные модели и интеграция с данными для заказчиков важнее стоимости ИИ-нагрузки 17 ч.
OpenAI уволила трёх исследователей безопасности ИИ — они опасаются, что компания заставит сотрудников молчать о рисках 18 ч.
Пошаговая ролевая игра Shadow of the Road не выйдет за неделю до GTA VI — Owlcat объявила новую дату релиза 18 ч.
Китайские ИИ-компании скрывают, насколько опасны их модели — публичных тестов почти нет 18 ч.
Продюсер Konami рассказал о планах на продолжение Silent Hill 23 ч.