Сегодня 29 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → модели
Быстрый переход

«Экзистенциальные риски для человечества»: Anthropic в преддверии IPO рассказала инвесторам об опасности ИИ

Существующие правила составления подобных документов подразумевают, что готовящаяся к выходу на биржу компания должна уведомлять инвесторов о рисках, с которыми она сталкивается или может столкнуться в своей деятельности. Поддерживая репутацию одного из самых мнительных разработчиков ИИ, компания Anthropic в проспекте для инвесторов почти треть объёма информации уделила факторам риска.

 Источник изображения: Anthropic

Источник изображения: Anthropic

По крайней мере, на это указывает агентство Reuters, говоря о наличии упоминаний об угрозах на 80 страницах из 261, присутствующих в документе. При этом сугубо бизнес-вопросам составители документа уделили всего 48 страниц. Передовые ИИ-модели, по словам представителей Anthropic, способны представлять «катастрофические или экзистенциальные риски для человечества», а также демонстрировать признаки «самозащиты» в поведении, скрывая информацию или манипулируя ею, сопротивляясь отключению и даже прибегать к шантажу. Компания предупреждает, что её модели могут становиться источником необратимого вреда. Ранее исследователь компании Эван Хабингер (Evan Hubinger) оценивал вероятность уничтожения человечества силами ИИ на протяжении десяти ближайших лет в более чем 10 %.

Что характерно, вышедшая на биржу в июне конкурирующая SpaceX в своём проспекте для инвесторов только 38 из 277 страниц посвятила обсуждению факторов риска. Как отмечает Anthropic, потенциальная осведомлённость создаваемых ИИ-моделей о стремлении разработчиков оценивать их безопасность ограничивает способность делать это эффективно. В некоторых случаях опасные проявления деятельности ИИ-моделей становятся достоянием общественности уже после их развёртывания. Современные ИИ-модели способны адаптировать своё поведение на этапе проверки, чтобы не выдавать свои «тёмные стороны».

Какое количество ресурсов Anthropic тратит на обеспечение безопасности своих ИИ-моделей, до конца понять сложно, но на протяжении одной из недель в июле под эти нужды были выделены до 6 % вычислительных мощностей, доступных компании. В условиях нехватки вычислительных ресурсов в целом подобное распределение становится компромиссом между интересами бизнеса и безопасностью. Тем более, что конкуренция весьма остра, и утрачивать лидерские позиции Anthropic не готова, хотя и начинает призывать всех участников рынка отдавать именно безопасности, а не извлечению прибыли. В своём обращении к инвесторам компания выражает уверенность, что построение надёжной и безопасной ИИ-инфраструктуры лежит в сфере коллективной ответственности, и что рынок должен вознаградить соответствующие усилия.

OpenAI отменила выпуск ИИ-модели GPT-6.1 Astra из соображений безопасности

OpenAI объявила об отказе выпустить новую модель искусственного интеллекта GPT-6.1 Astra из-за опасений, которые возникли у исследователей компании в ходе внутреннего тестирования системы, сообщает The Wall Street Journal. Радикальная мера стала одним из наиболее ярких свидетельств того, что непредсказуемое поведение ИИ может затормозить стремительное развитие всей отрасли.

 Источник изображения: Brecht Corbeel / unsplash.com

Источник изображения: Brecht Corbeel / unsplash.com

ИИ-лаборатория намеревалась анонсировать GPT-6.1 Astra в ближайшие дни или недели и выпустить её в октябре. Она превосходит предшественников по своим возможностям: демонстрирует более высокие навыки в написании текстов и лучше справляется с многоэтапными задачами без участия человека. Вместе с тем, у неё обнаружился регресс в двух областях: соответствия целям и авторизации в рамках задач. Первое означает, что модель не всегда точно следует намерениям и ожиданиям человека, а также не всегда честно сообщает пользователю, какие действия она предприняла, а какие — нет. Второе значит, что OpenAI GPT-6.1 Astra может начать выполнять задачу, не запрашивая разрешения пользователя, а также иногда обращается ко внешним средствам и сервисам, даже если это небезопасно. Разработчикам удалось решить проблему «лени у модели», то есть отказа продолжать работу при возникновении сложностей, но она не дотянула до стандартов, которые компания установила в области безопасности, и соответствия целям, поэтому было принято решение не выпускать её в открытый доступ.

Объявление было сделано накануне ежегодной конференции OpenAI, которая проводится в Сан-Франциско (США) — ранее компания анонсировала на мероприятии новые модели и сервисы. Сейчас лаборатория занимается расследованием выявленных за последние месяцы инцидентов, связанных с безопасностью ИИ. Она развернула новую систему мониторинга для оперативного обнаружения нарушений в деятельности ИИ-агентов и обязала инженеров использовать при тестировании систем более строгие меры защиты. OpenAI приостановила обучение наиболее мощных ИИ-моделей, но GPT-6.1 Astra это не коснулось. «Хотим быть уверенными в безопасности разработки наших моделей как внутри компании, так и с их выпуском для пользователей. Но когда мы выпускаем продукт для пользователей, то предъявляем чрезвычайно высокие требования к безопасности и соответствия целям у моделей», — заявили в компании.

OpenAI приняла решение не выпускать версию GPT-6.1 Astra, но рассчитывает использовать её основу в проведении дополнительных циклов обучения с подкреплением и создания новых моделей серии GPT-6. Компания планирует провести серию углублённых исследований, чтобы установить первопричины обнаруженных у GPT-6.1 Astra проблем. Инженеры проверят, поощряется ли в среде обучения с подкреплением надлежащее поведение, и изучат прочие этапы разработки. Общественности нужна уверенность, что ИИ разрабатывается с учётом соображений безопасности, «и это начинается с того, что делают сами компании вроде нашей», заявили в OpenAI.

Anthropic представила Claude Sonnet 5.5 — почти как Opus, но вдвое дешевле

Компания Anthropic представила Claude Sonnet 5.5 — вторую модель нового семейства Claude 5.5 вслед за флагманской Claude Opus 5.5. Разработчики позиционируют новинку как более быструю и экономичную модель для повседневных задач, программирования, работы с документами и создания презентаций.

 Источник изображений: Anthropic

Источник изображений: Anthropic

Главное изменение по сравнению с Claude Sonnet 5 — существенный рост производительности при одновременном сокращении количества вычислений, необходимых для выполнения типичных задач. По данным Anthropic, Sonnet 5.5 генерирует ответы более чем на 30 % быстрее предыдущей версии и в большинстве сценариев обходится до 30 % дешевле — новая модель обычно использует значительно меньше токенов для выполнения той же задачи. При этом цена одного токена не изменилась: $2 за 1 млн входных токенов и $10 за 1 млн выходных. Чтение токенов из кэша стоит $0,20 за 1 млн токенов. К слову, Claude Sonnet 5.5 поддерживает контекстное окно до 1 млн токенов и вывод до 128 тыс. токенов.

Что касается показателей производительности, то особенно заметный прирост Anthropic заявляет в программировании. В тесте Terminal-Bench 4.0, оценивающем способность ИИ самостоятельно выполнять многоэтапные задачи в командной строке, Sonnet 5.5 набрала 70,6 % против всего лишь 10,3 % у Sonnet 5. В CursorBench 4.0 результат новой модели составил 55,5 %, тогда как предшественница получила лишь 34,1 %.

Во FrontierCode 1.1 новая Sonnet 5.5 при максимальном уровне усилий набрала 46,2 % против 42,4 % у Sonnet 5. В свою очередь, флагманская Claude Opus 5.5 в этом тесте набрала 54,4 %. Anthropic отмечает, что в отдельных тестах при максимальном уровне усилий Sonnet 5.5 уже приближается к возможностям более дорогой Opus 5.5, хотя последняя сохраняет преимущество в сложной открытой работе, требующей длительного рассуждения и самостоятельного принятия решений. Напомним, что Opus 5.5 стоит вдвое дороже: $4 и $20 за миллион входных и выходных токенов соответственно.

При этом Sonnet 5.5 рассчитана не только на разработчиков. Anthropic выделяет работу с документами, презентациями и таблицами, а также создание пользовательских интерфейсов. Компания утверждает, что новая модель лучше следует шаблонам презентаций и способна выдавать результаты, требующие меньшего объёма последующей ручной доработки.

Существенно улучшилась и работа с длинными задачами. В тесте GDPval-AA v2.1, моделирующем выполнение реальной профессиональной работы в 44 профессиях и девяти отраслях, Sonnet 5.5 получила 1844 балла против 1449 у Sonnet 5. Результат оказался крайне близок к показателю Opus 5.5 — 1846 баллов. В тесте AA-Briefcase новая модель также заметно опередила предшественницу: 1811 против 1359 баллов.

Anthropic отдельно отмечает улучшения в работе с изображениями и компьютерными интерфейсами. В тесте OSWorld 2.1, оценивающем способность ИИ взаимодействовать с операционной системой, Sonnet 5.5 получила 80,1 % против 57 % у Sonnet 5. Модель также стала лучше распознавать графики и визуальную информацию. Sonnet 5.5 стала первой моделью семейства Sonnet, которая смогла пройти игру Pokémon Red, используя только снимки экрана в качестве визуальной информации.

Изменения коснулись и системы безопасности. Из-за существенного роста возможностей в области кибербезопасности Sonnet 5.5 стала первой моделью серии Sonnet, которая при запуске получила защитные механизмы и резервные ограничения, аналогичные используемым для более мощных моделей Anthropic. Для высокорисковых задач в сфере кибербезопасности система может переключаться на Sonnet 5.

Кроме того, Sonnet 5.5 получила защиту от дистилляции — попыток извлечь данные модели с помощью массовых запросов от большого числа аккаунтов, чтобы потом использовать их для обучения другой высокопроизводительной модели. Anthropic применила в новой версии специальные классификаторы, препятствующие извлечению внутренних рассуждений.

Claude Sonnet 5.5 уже доступна в чат-боте Claude, а также на всех основных платформах, включая собственную Claude Platform, Amazon Web Services, Google Cloud и Microsoft Azure. Для разработчиков модель доступна через API.

В ближайшие недели Anthropic также обещает представить Claude Haiku 5.5 — ещё одну модель семейства Claude 5.5, ориентированную на высокую нагрузку и чувствительные к стоимости сценарии.

Китайский ИИ завоёвывает корпоративную Америку: компании США всё чаще используют открытые ИИ-модели ради экономии

На рынке ИИ-систем складывается сложная ситуация. Готовящиеся к выходу на IPO американские лидеры рынка заинтересованы демонстрировать положительную динамику выручки, но китайские конкуренты не позволяют им поднимать цены. В США корпоративные пользователи всё чаще опираются на открытые ИИ-модели, чтобы сэкономить без значительного ущерба для прогресса в своём бизнесе.

 Источник изображения: Unsplash, Aerps.com

Источник изображения: Unsplash, Aerps.com

По данным Financial Times, об ориентации американского корпоративного сектора на модели с открытым исходным кодом или открытыми весами может говорить хотя бы тот факт, что эти термины руководство американских компаний в период с августа по сентябрь этого года стало упоминать в своих публичных выступлениях в шесть раз чаще в годовом сравнении. Примечательно, что даже далёкие от сферы собственно информационных технологий компании всё чаще интересуются внедрением открытых ИИ-моделей: такое поведение замечено у представителей сегмента финансовых услуг, логистики и тяжёлого машиностроения.

В сфере открытых по тому или иному критерию ИИ-моделей начали доминировать китайские компании, но подобный подход исповедуют и некоторые западные разработчики, включая американскую Nvidia, французскую Mistral, стартапы Reflection AI и Thinking Machines Lab. Доля открытых моделей в статистике использования токенов к августу достигла 56 %, если опираться на данные Vercel, тогда как в декабре прошлого года этот показатель ограничивался 7 %. По статистике OpenRouter, китайские ИИ-лаборатории сейчас входят в десятку самых крупных по интенсивности использования токенов.

 Источник изображения: Financial Times

Источник изображения: Financial Times, Vercel

Разработчики приложения Tinder, по словам технического директора Виная Курувилы (Vinay Kuruvila), уже начали перенаправлять часть внутренних запросов второстепенного характера на ИИ-модели с открытыми весами. Дело в том, что если в январе расходы компании достигли $1 млн в годовом выражении, то к июлю они выросли в десять раз, и сохранение подобной динамики в Tinder хотят предотвратить. Как подчеркнул представитель компании Match Group, передовые модели Astra и Claude американской разработки способны покрыть 90 % её потребностей, и если к этому уровню подтянутся открытые, то использовать первые в прежних объёмах уже будет не нужно. OpenAI и Anthropic на прошлой неделе были вынуждены предложить более доступные по цене версии своих моделей, чтобы как-то защитить себя от экспансии «открытых» конкурентов.

Директор телекоммуникационного гиганта AT&T по данным и ИИ Энди Маркус (Andy Markus) заявил, что компания уже сейчас 40 % своих ИИ-нагрузок покрывает открытыми моделями, а в течение ближайшего года собирается довести их долю до 70 %. По словам Маркуса, компания обрабатывает до 45 млрд токенов в день, и при таких масштабах использования расходы становятся важной составляющей. Если переход на открытые модели позволит урезать расходы без ущерба для точности результатов, то AT&T не будет сомневаться в необходимости такой миграции. Внутренние тесты показали, что в ряде случаев открытые модели не уступают, а иногда даже превосходят по эффективности и быстродействию своих «закрытых» конкурентов. Более того, модели с открытыми весами пользователи могут запускать в собственной инфраструктуре, а это позволяет значительно повысить информационную безопасность.

Апелляционный суд США оставил за Anthropic статус угрозы для национальной безопасности

В конце августа Федеральный апеляционный суд США в Калифорнии встал на сторону Anthropic в споре с Пентагоном по поводу угроз для национальной безопасности, но конфликтующим организациям ещё предстояло дождаться вердикта суда в Вашингтоне, чтобы достичь переломного момента. По факту, этого не произошло, поскольку столичный суд сохранил за Anthropic существующий статус источника угроз для национальной безопасности.

 Источник изображения: Anthropic

Источник изображения: Anthropic

Впервые этот статус был присвоен Министерством обороны США данном стартапу ещё в марте текущего года, на фоне конфликта с основателями Anthropic, которые противились использованию своих ИИ-моделей для выбора целей на поле боя и слежки за гражданами США. Anthropic лишилась контрактов с американским военным ведомством, а его подрядчикам было запрещено использовать разработки стартапа в своей служебной деятельности по заказу Пентагона. Федеральный апелляционный суд в Вашингтоне вчера поддержал сохранение за Anthropic статуса угрозы для цепочек поставок двумя голосами из трёх, отвергнув довод представителей компании о том, что соответствующее мартовское решение Министерства обороны США было произвольным, неправомерным и неконституционным.

«Министерство предоставило убедительные доказательства того, что дальнейшая интеграция Claude в информационные системы ведомства, в том числе и силами подрядчиков, представляет подкрепляемый законом риск для национальной безопасности», — отмечается в вердикте федерального судьи Грегори Кацаса (Gregory Katsas). Вердикт поддержала и судья Неоми Рао (Neomi Rao), также назначенная на свой пост при президенте Трампе, и лишь третий член судебной коллеги в лице Карен Лекрафт Хендерсон (Karen LeCraft Henderson) не поддержал данный вердикт.

Сентябрьские призывы основателя Anthropic Дарио Амодеи (Dario Amodei) к добровольному замедлению ИИ вызвали раздражение президента Дональда Трампа (Donald Trump), в итоге первого не пригласили на правительственный ужин с участием китайского лидера Си Цзиньпина (Xi Jinping) на этой неделе. В понедельник Трамп в собственной социальной сети Truth Social заявил: «Администрация Трампа остановила людей из сферы ИИ, когда они пытались сделать плохие или потенциально плохие вещи — как Дарио из Anthropic, который теперь притворяется маленьким идеальным ангелом, и мы продолжим так поступать».

Напомним, что в прошлом месяце Федеральный суд США в Калифорнии признал назначение Anthropic источником угроз для национальной безопасности незаконным, но Anthropic подал апелляционную жалобу на это решение Пентагона в двух разных инстанциях, а потому для полной реабилитации стартапу нужно было оспорить назначение дважды. На этой неделе американский суд в Вашингтоне принял решение по второй апелляции не в пользу Anthropic, а потому назначение Пентагона имеет законную силу и должно оставаться актуальным. Представители Anthropic заявили CNBC, что выражают несогласие с вердиктом суда, приведя в пример решение суда в Калифорнии в свою пользу, а потому компания оставляет за собой право искать дальнейшие возможности для пересмотра существующего статуса во взаимоотношениях с Пентагоном.

Суд в Вашингтоне предоставил Anthropic время для рассмотрения повторной апелляционной жалобы тем же составом судей, либо проведения слушаний судебной коллегией расширенного состава, поэтому нынешний вердикт пока не вступил в законную силу. Кроме того, Anthropic может попросить рассмотреть это дело Верховный суд США. В своих доводах судья Кацас поддержал высказывания министра обороны Пита Хегсета (Pete Hegseth) по поводу опасности предоставления контроля за ИИ-моделями стороне, не позволяющей министру обороны и президенту принимать связанные с военными операциями решения единолично. Вмешательство со стороны Anthropic могло бы привести к нежелательным манипуляциям или внезапному отключению ИИ-моделей, как согласился с аргументами Хегсета председатель судебной коллегии. Стремление министра обороны сохранить полную власть в этой сфере не нарушает Закона о безопасности цепочек поставок или Конституции США, как заявил судья Кацас.

OpenAI в ближайшие недели выпустит предварительную версию ИИ-модели GPT-6 Cyber для сферы кибербезопасности

В ближайшие недели OpenAI планирует представить предварительную версию своей новейшей модели, ориентированной на кибербезопасность — GPT-6 Cyber. По данным издания Fortune, ссылающегося на осведомлённые источники, компания также анонсирует новый продукт, который поможет клиентам развертывать эту модель более безопасным и автоматизированным способом.

 Источник изображения: AI

Источник изображения: AI

Новый продукт, название которого пока не объявлено, станет для OpenAI первым в своём роде и продолжит стратегию, заложенную в потребительских продуктах компании: ChatGPT выступает в качестве «входных ворот», через которые множество пользователей получают доступ к новым моделям, таким как GPT-6 Astra. Решение призвано помочь клиентам создавать автоматизированные рабочие процессы и устранять уязвимости в условиях растущей сложности кибератак с применением искусственного интеллекта. Кроме того, это позволит OpenAI лучше контролировать использование своих моделей в целях обеспечения безопасности.

Как сообщил один из источников, ограниченное число клиентов, участвующих в программе Daybreak Red (доступ к которой предоставляется только по заявкам), уже получили доступ к GPT-6 Cyber для проведения альфа-тестирования. Daybreak — это программа OpenAI в сфере кибербезопасности, разделённая на два уровня доступа: Red и Blue. Участники программы Daybreak Red получают доступ к самым передовым продуктам компании для защиты от киберугроз. Daybreak Blue — это программа с более широким доступом, участие в которой тем не менее возможно тоже только по предварительной заявке.

Выпуск новых продуктов для кибербезопасности происходит на фоне критики в адрес OpenAI и других ведущих лабораторий ИИ из-за ряда тревожных инцидентов, когда автономные агенты выходили за пределы изолированных сред (песочниц) и взламывали внешние веб-ресурсы, включая сайт Hugging Face и сайт правительства Австралии. И хотя эти случаи вызвали серьёзные опасения по поводу рисков безопасности, связанных с ИИ, новые инструменты OpenAI являются частью планомерной работы компании по созданию продуктов для защиты в этой сфере.

GPT-6 Cyber — уже четвёртая модель OpenAI, ориентированная на кибербезопасность и выпущенная в текущем году. Первой стала GPT-5.4 Cyber (выпущена в апреле 2026 года), за ней последовали GPT-5.5 Cyber (выпуск в июне) и GPT-5.6 Cyber (релиз в августе).

OpenAI уделяет особое внимание продажам продуктов кибербезопасности корпоративным клиентам. Это направление возглавляет коммерческий директор Дали Раджич (Dali Rajic), присоединившийся к компании в августе. Ранее в этом месяце компания OpenAI объявила о намерении инвестировать $1 млрд в субсидирование использования своих продуктов в сфере кибербезопасности для объектов критически важной инфраструктуры.

По словам другого источника, знакомого с программой мероприятия, на следующей неделе в рамках ежегодной конференции DevDay, запланированной на 29 сентября, OpenAI также планирует представить ещё около дюжины новых продуктов. Большинство из них не связаны с кибербезопасностью и относятся к другим направлениям деятельности компании, ориентированным как на корпоративный, так и на массовый рынок.

Как сообщил источник, в последние две недели OpenAI приостановила все крупные запуски — за исключением моделей GPT-6 Sol и Luna, ориентированных на доступность, — чтобы представить их все вместе на DevDay. О грядущем анонсе множества новинок ранее в этом месяце также намекал генеральный директор компании Сэм Альтман (Sam Altman).

Alibaba представила Qwen Book — ноутбук-трансформер на Snapdragon 8 Elite Gen 5 с ИИ-агентом, вшитым в собственную ОС на базе Android

Китайский холдинг Alibaba явно не желает отставать от детища Марка Цукерберга (Mark Zuckerberg), а потому на конференции Apsara на этой неделе представил собственный набор различных ИИ-устройств, которые будут использовать фирменные модели семейства Qwen. Помимо довольно предсказуемых очков и наушников, были анонсированы «агентский ноутбук» и «умный диктофон».

 Источник изображений: Alizila

Источник изображений: Alizila

Ноутбуки серии Qwen Book будут работать на чипе Snapdragon 8 Elite Gen 5 и под управлением операционной системы Qwen Desktop OS на базе Android, которая изначально предполагает поддержку взаимодействия с ИИ-агентами. По сути, эти ноутбуки будут полностью функционировать в фирменной экосистеме Alibaba, охватывающей операционную систему, ИИ-модели, приложения и облачные сервисы. Оставаясь полностью подконтрольным человеку, ноутбук этой серии активно использует ИИ-сервисы и агентские решения, позволяя ускорять типовые операции. Например, значительно упрощается составление презентаций, поскольку пользователь может формировать содержимое слайда при помощи стилуса, который одновременно выступает в роли микрофона, воспринимая голосовые запросы и обеспечивая интеграцию в редактируемые слайды необходимой информации, подготовленной ИИ-моделью в облаке. Содержимое презентации одновременно можно просмотреть на смартфоне другого пользователя (коллеги или руководителя), который может дистанционно одобрить вносимые в презентацию изменения.

Семейство умных очков Alibaba пополнилось сразу двумя моделями: Qwen Glasses N1 и N1 Pro. Первые оснащаются 50-мегапиксельной камерой и могут захватывать изображения в разрешении HD. Модель Qwen Glasses N1 Pro также поддерживает слежение за глазами пользователя для взаимодействия с ним, распознаёт окружающие объекты и обеспечивает оплату с аутентификацией владельца счёта по радужной оболочке глаза.

Умные беспроводные наушники Qwen Clip крепятся на ухе при помощи дужек, поддерживают голосовое взаимодействие с ИИ-ассистентом Qwen, перевод речи в масштабе реального времени, сохранение заметок по голосовым комментариям пользователя, а также управление задачами при помощи голоса. В разработке наушников принимали участие специалисты Bose. В продажу они поступят 13 октября, а предварительные заказы принимаются с 22 сентября.

Наконец, замыкает череду новинок Alibaba портативное устройство QwenNote A2, которое развивает идею уже существующего DingTalk A1. По сути, это своего рода «умный диктофон», который позволяет систематизировать содержание разговоров при помощи шести микрофонов и передавать эту информацию в удобоваримом виде фирменным ИИ-моделям Alibaba для дальнейшей обработки. Устройство интегрируется с платформой QwenWork, подразумевающей использование ИИ-агентов для выполнения офисной работы. Полученную от пользователей речевую информацию устройство может применять для создания расписаний и графиков, расчётных листов и отправки сообщений. Новинка работает на основе ИИ-модели Qwen-Audio, которая позволяет вести беседу с агентом в максимально комфортном режиме. Устройство массой 67 г способно чётко записывать речь на расстоянии до 8 метров, для связи с облачной инфраструктурой оно использует собственный 4G-модем.

С целью обеспечения приватности аудио передаётся в облако в зашифрованном виде, и после перевода в текстовую или иную форму исходная запись удаляется. В режиме ожидания устройство может проработать без подзарядки до 18 дней, а обрабатывать голосовые данные оно способно на протяжении 40 часов подряд. В Китае QwenNote A2 предлагается по цене $178 с 22 сентября через фирменный интернет-магазин Tmall.

Китайцы научили ИИ общаться без слов — модели передают друг другу содержимое памяти и работают на 150 % быстрее

Учёные китайского Университета Цинхуа представили метод, позволяющий различным моделям искусственного интеллекта общаться друг с другом напрямую без генерации текста. Метод получил название Cache-to-Cache (C2C), разработчикам уже доступен исходный код решения.

 Источник изображения: Steve A Johnson / unsplash.com

Источник изображения: Steve A Johnson / unsplash.com

Сейчас при совместной деятельности нескольких языковых моделей в рамках единого конвейера обработки данных взаимодействие между ними осуществляется недостаточно эффективно — одной приходится преобразовывать результаты своих «рассуждений» в текстовые предложения, чтобы вторая могла их прочитать. При генерации текста расходуются вычислительные ресурсы и теряются некоторые мелкие детали. Данные обо всех обработанных ранее сведениях модель ИИ хранит в оперативной памяти (кеше). Технология C2C исключает работу с текстовым языком — одна модель передаёт содержимое своей оперативной памяти в память другой модели.

За процесс передачи отвечает вспомогательная программа Fuser — она преобразует и адаптирует данные таким образом, чтобы вторая могла ими пользоваться. Различные модели ИИ используют совершенно разные внутренние форматы, объёмы и структуры для хранения данных, поэтому простая передача «сырой» информации, вероятно, привела бы к сбоям в работе или потере связности ответов. Чтобы избежать этого, C2C предусматривает интеллектуальный фильтр, определяющий, какие фрагменты поступающих данных следует принять и усвоить немедленно. Одни внутренние слои принимают новую информацию сразу, а другие продолжают выполнять вычисления автономно, без внешнего вмешательства. Этот подход, утверждают исследователи, при выполнении совместных задач позволяет увеличить скорость работы моделей ИИ на 100–150 %. Точность работы по сравнению с обработкой данных в автономном режиме возрастает на 14,2 %; точность прямого обмена информацией по сравнению с текстовым форматом возрастает на величину 3,1–5,4 %.

Пока метод применим только к моделям с открытыми весами, потому что требуется прямой доступ к кешу и структуре слоёв модели. Генерация текста при совместной работе двух моделей всегда замедляла работу машин, указывают исследователи, потому что вынуждала ИИ «мыслить» подобно людям.

В Африке создали компактную LLM, которая обошла более крупные модели Google и Meta✴ — Morena знает 12 местных языков

Африканская компания Vambo AI представила языковую модель Morena размером 1,5 млрд параметров. Она поддерживает 12 африканских языков, английский, французский и умеет писать программный код. В задачах, связанных с африканскими языками, эта модель, утверждает разработчик, превосходит системы от Google, Meta✴✴ и Alibaba, оставаясь в восемь раз компактнее по размеру, чем аналоги.

 Источник изображения: Sergey Pesterev / unsplash.com

Источник изображения: Sergey Pesterev / unsplash.com

На ключевом этапе тестирования Vambo AI Morena показала результат в 1,408 bpb (бит на байт), и он оказался лучшим среди 26 протестированных моделей. Ближайший к нему, 1,423 bpb, показала модель в пять раз больше — чем меньше показатель, тем лучше. Модель поддерживает следующие местные языки: нигерийский пиджин, игбо, йоруба, хауса, суахили, шона, зулу, коса, киньяруанда, тсвана, африкаанс и южный ндебеле. В большинстве работающих с этими языками проектов используются дообученные открытые модели Meta✴✴ Llama, но у них сохраняется словарь, изначально рассчитанный на английский язык и программный код.

В Vambo AI поступили иначе: перед началом обучения оптимизировали токенизатор, состав обучающих данных и список языков, предварительно сравнив размеры словаря с точки зрения затрат и эффективности. При кодировании африканских текстов словарь Morena использует в 1,39 раза меньше токенов, чем Google Gemma 3 и в 1,53 раза меньше, чем Llama 3.2, в сравнении на идентичных фрагментах. Издержки на кодирование для африканского текста составляют 0,249 токена на байт против 0,234 для английского — разницу в 6 % разработчики пока объяснить не могут. Ближайшим конкурентом является адаптированная для Африки версия модели Meta✴✴ под названием Lugha-Llama-8B — это она показала 1,423 bpb, поддерживая только 8, а не 12 языков. Для сравнения, модель Gemma размером 12 млрд параметров потребляет примерно в 11 раз больше вычислительных ресурсов, чем Morena.

Morena, оптимизированная для диалогового взаимодействия (версия instruct) демонстрирует показатель в 1,441 bpb, уступая Lugha-Llama-8B в общем зачёте, но превосходя её по пяти общим языкам и используя всего 20 % от числа её параметров. При переводе текстов с английского на пять африканских языков версия instruct демонстрирует показатель в 45,8 по метрике chrF++, и это статистически сопоставимо со специализированными системами перевода — у тех результат примерно на 1,4 балла выше, а сопоставимые по размеру с Morena модели обычно показывают от 9 до 14 баллов. На этапе предварительного обучения Morena обработала 251,7 млрд токенов, плюс ещё 63 млрд — на промежуточном.

При разработке потребовались более 22 000 часов работы ускорителей Nvidia A100 — за вычислительные ресурсы пришлось заплатить около $40 000. Помимо основной модели размером 1,5 млрд параметров, доступны версии на 0,5 и 0,2 млрд. Вариант размером 0,5 млрд параметров всё равно превзошёл все протестированные модели других разработчиков по 11 из 12 языков. Самая компактная версия размером 0,2 млрд параметров предназначена для повторной оценки вариантов у систем распознавания речи, для приложений клавиатур и задач по нормализации текста. Последняя обходится в 58 раз дешевле, чем Lugha-Llama-8B в пересчёте на байт, а при работе на одном ускорителе Nvidia A100 она генерирует 104 токена в секунду. Доступна также версия, способная работать на центральном процессоре и запускаться локально на ноутбуке. Vambo AI Morena поддерживает приложения чат-ботов, функции перевода и интеграцию с другими инструментами ИИ.

Google выпустила ИИ-модели для синтеза речи Gemini 3.8 Flash TTS, которые умеют клонировать голос

Google представила Gemini 3.8 Flash TTS и Gemini 3.8 Flash-Lite TTS — две новые модели синтеза речи, которые превращают генерацию голоса из набора готовых вариантов в более гибкий инструмент для создания аудио. Модели позволяют создавать собственные голоса, управлять исполнением отдельных реплик и генерировать выразительные диалоги для игр, подкастов, аудиокниг и других проектов.

 Источник изображений: Google

Источник изображений: Google

Gemini 3.8 Flash TTS предназначена для создания персонажей и детального управления их голосами. С помощью текстовых запросов можно задать роль, акцент и характеристики голоса более чем для 100 языков и диалектов. В библиотеке также доступно более 2000 готовых голосов, включая региональные варианты мексиканского испанского, квебекского французского и шотландского английского.

Отдельно Google добавила возможность клонирования голоса по 30-секундной аудиозаписи. Функция предназначена для собственного голоса или голоса, на использование которого получено право. Перед созданием копии система проверяет согласие владельца голоса, а полученное аудио защищается водяным знаком SynthID и метаданными C2PA.

После выбора голоса разработчик может управлять каждой репликой отдельно с помощью текстовых указаний. Gemini способна менять темп и характер исполнения, использовать шёпот и другие элементы звуковой подачи, а также добавлять реакции в виде смеха, вздохов и коротких реплик.

Обе модели поддерживают генерацию длинного аудио с сохранением качества, естественного темпа и характеристик голоса на протяжении нескольких часов, а режим двух говорящих позволяет создавать диалоги из одного сценария, сохраняя раздельные голоса и естественную очередность реплик. Gemini 3.8 Flash-Lite TTS при этом рассчитана прежде всего на масштабные проекты, включая дубляж, создание аудиоконтента и голосовых ИИ-агентов.

По данным Google, Gemini 3.8 Flash TTS заняла первое место в бенчмарке Voice Design компании Hume AI с результатом 71,4 балла, а в тесте моделирования акцента получила 60,8 балла. Flash TTS и Flash-Lite TTS также заняли первое и второе места соответственно в метрике Overall Quality Index (также от Hume AI). В слепых оценках пользователей на Voice Arena модели показали высокие результаты в японском, бразильском португальском, вьетнамском, современном стандартном арабском, мексиканском испанском и хинди.

Новые модели доступны с сегодняшнего дня в Google AI Studio, где появился отдельный интерфейс для создания голосовых сценариев. Gemini 3.8 Flash TTS и Flash-Lite TTS также доступны через Gemini API, а их интеграцию анонсировали платформы Agora, LiveKit, Pipecat и Vercel.

«Ставки растут»: OpenAI пустит сторонних проверяющих на более ранние этапы разработки ИИ-моделей

Руководство конкурирующих американских стартапов Anthropic и OpenAI продемонстрировало редкое единодушие в середине этого месяца, когда речь зашла о необходимости снижения темпов развития ИИ ради обеспечения общественной безопасности. Теперь компания OpenAI объявила, что готова предоставлять доступ сторонним аудиторам к своим ИИ-моделями на более ранних этапах разработки, чем это допускалось до сих пор.

 Источник изображения: Unsplash, TheRegisti

Источник изображения: Unsplash, TheRegisti

Напомним, Anthropic предложила участникам рынка сделать этот процесс более открытым для сторонних экспертов, которые могли бы указывать на угрозы для общества со стороны создаваемых ИИ-моделей, чтобы они устранялись ещё до их выхода на рынок. Сама Anthropic продемонстрировала готовность следовать этому принципу, пригласив специалистов Accenture для проведения профильного аудита.

Конкурирующая OpenAI предложила создавать международные организации, которые помогали бы следить за безопасностью выпускаемых на рынок ИИ-моделей, а также призвала американское правительство способствовать появлению общепринятых стандартов в этой сфере. Как отмечает Bloomberg, этот стартап также готов предоставить сторонним аудиторам доступ к оценке безопасности своих ИИ-моделей на более ранних этапах разработки, чем это предполагалось до сих пор. Аудит может проводиться на этапе обучения, оценки возможностей готовых моделей и их публичного распространения, поясняет источник. При этом к процедуре самого аудита OpenAI также выдвигает ряд требований, поскольку он должен быть независимым, добросовестным и доскональным с точки зрения погружения в вопросы безопасности. Кроме того, аудиторы должны нести ответственность за результаты своего труда.

По словам представителей OpenAI, до сих пор компания приглашала сторонних специалистов на этапе оценки возможностей своих ИИ-моделей ближе к моменту их выпуска в оборот. «По мере того, как ставки растут, мы хотим убедиться, что также уделяем внимание таким вещам, как обучение и оценка, которые относятся к высоким ставкам, в дополнение к нашим процедурам развёртывания», — отметила в своём интервью Лама Ахмад (Lama Ahmad), которая в OpenAI отвечает за взаимодействие с внешними аудиторами. Сторонние специалисты, по её словам, могут получить доступ в офисы компании для анализа самой чувствительной части её работы. Подобный опыт взаимодействия с ними у OpenAI уже есть. Сейчас стартап ведёт отбор подрядчиков, которые могли бы заняться подобной работой, причём среди кандидатов есть как новые для OpenAI имена, так и уже знакомые. Некоторые из них уже занимались расследованием инцидента с Hugging Face. На лаборатории ложится существенная ответственность за обеспечение подробного анализа с одновременной возможностью защиты чувствительной информации, отмечается в публикации на сайте OpenAI.

OpenAI выпустила GPT-6 Sol и Luna — они дешевле предшественниц и делают меньше ошибок

В начале текущего месяца OpenAI выпустила GPT-6 Astra — самую мощную и функциональную ИИ-модель компании, которую она без лишней скромности называет «лучшей в мире моделью» для выполнения широкого спектра задач, включая работу за компьютером и написание программного кода. Сегодня OpenAI расширила линейку моделей GPT-6, представив более компактные и доступные GPT-6 Sol и GPT-6 Luna.

 Источник изображений: OpenAI

Источник изображений: OpenAI

«GPT-6 Astra открыла новую эру интеллектуальных технологий. Представленные [сегодня] модели развивают этот успех, делая такой интеллект более эффективным и доступным», — прокомментировали в компании.

Первые версии моделей Sol и Luna были представлены ранее в этом году и заняли разные ниши в иерархии моделей OpenAI. Модель Sol предназначена для решения сложных задач, таких как программирование, тогда как модель Luna, по заявлению OpenAI, лучше подходит для рутинной офисной работы — «объёмных задач с чётко определённой целью, например, обобщения содержания документов, извлечения информации или ответов на простые вопросы».

OpenAI делает акцент на значительном повышении эффективности и доступности обновлённых моделей Sol и Luna — прежде всего, за счёт существенного снижения стоимости доступа к API. Новые версии Sol и Luna будут стоить вдвое дешевле, чем предыдущие версии Sol и Luna (на базе GPT-5.6). Такое снижение цены компания объясняет оптимизацией процессов кеширования и инференса (вывода данных).

OpenAI заявляет, что новейшие модели точнее передают факты и допускают меньше ошибок при написании кода.

«Согласно результатам нашей внутренней оценки точности, основанной на анализе обезличенных реальных диалогов (в которых пользователи указывали на ошибки моделей), GPT-6 Sol ошибается примерно вдвое реже своей предшественницы, обеспечивая надёжность уровня Astra при значительно меньших затратах», — говорится в сообщении компании.

При выпуске новых моделей OpenAI обычно заявляет, что её новинки превосходят разработки главного конкурента — Anthropic. Этот запуск не стал исключением. Компания неоднократно подчёркивает в своём пресс-релизе, что модели GPT-6 Sol и Luna справляются с задачами значительно лучше, чем флагманские модели Anthropic, такие как Fable и Opus.

Примечательно, что Anthropic выпустила новую версию Opus 5.5 всего за полтора часа до анонса OpenAI, что свидетельствует о жёсткой конкуренции между этими двумя компаниями.

Новые версии ИИ-моделей Sol и Luna уже доступны в сервисах ChatGPT Work и Codex для большинства платных подписчиков, а также через API ChatGPT. Кроме того, модель Luna появится в десктопном приложении и станет доступна пользователям бесплатных тарифов и тарифа Go. OpenAI планирует внедрить эти модели в ChatGPT (в приложении и на сайте) в течение дня.

Xiaomi представила флагманскую ИИ-модель MiMo-V2.6 Pro и быструю MiMo-V2.6-Flash

Китайский производитель электроники Xiaomi представил две мультимодальные модели искусственного интеллекта серии MiMo-V2.6. Они способны конкурировать с разработками ведущих мировых лабораторий, в том числе DeepSeek, OpenAI, Anthropic и Google, заверили в компании.

 Источник изображений: xiaomi.com

Источник изображений: xiaomi.com

Новое семейство ИИ-моделей представлено флагманской версией MiMo-V2.6 Pro и более быстрым и эффективным вариантом MiMo-V2.6-Flash. Будучи мультимодальными, они одинаково хорошо генерируют текст и программный код, работают с изображениями и видео. Флагманская Xiaomi MiMo-V2.6 Pro заняла первое место в рейтинге Artificial Analysis Intelligence Index среди открытых моделей, заверил разработчик. Она опередила Alibaba Qwen3.8-Max и лишь немного уступила Anthropic Claude Opus 5, OpenAI GPT-5.6 Sol и Meta✴✴ Muse Spark при тестировании в режиме максимальной производительности.

Xiaomi открыла веса не только самих новых моделей, но и код сопутствующих средств: более 7000 сред для обучения с подкреплением, а также к фреймворку для полного комплекса задач по обучения с подкреплением. Модель способна к пространственному мышлению — свои возможности она продемонстрировала в проекте Vibe World. По текстовому запросу, образцу в формате изображения или видео она создаёт интерактивные пространства, генерирует модели Blender, а также управляет роботизированной рукой-манипулятором Franka Panda по данным с нескольких камер. Помимо визуальных объектов, модель может генерировать музыку.

Разработчик опубликовал веса обеих моделей на платформах HuggingFace и OpenRouter, а также открыл к ним доступ через API по тем же ценам, что и к V2.5 Pro. Xiaomi также выпустила клиентские приложения для работы со своими ИИ-моделями под Microsoft Windows и Apple macOS.

Alibaba представила самый мощный в Китае ИИ-ускоритель Zhenwu V900 — и пообещала ИИ-модели на 5–10 трлн параметров

Компания Alibaba представила ИИ-ускоритель Zhenwu V900, который позиционируется как «самый мощный чип для ИИ в Китае на сегодняшний день». По данным компании, новый ускоритель в три раза превосходит по производительности своего предшественника — Zhenwu M890.

 Источник изображения: ithome

Источник изображения: ithome

Разработанный подразделением T-Head Semiconductor ИИ-ускоритель Zhenwu V900 оснащён 216 Гбайт памяти HBM, поддерживает вычисления в формате FP8/FP4 и обеспечивает пропускную способность межчипового интерконнекта 1,2 Тбайт/с. По словам Гао Хуэя (Gao Hui), вице-президента T-Head, начало серийного производства и выхода продукта на рынок запланировано на первый квартал 2027 года. Вычислительные кластеры на базе V900 могут включать до 500 тыс. чипов для решения задач обучения и инференса.

T-Head также сообщила о подготовке ИИ-ускорителя следующего поколения Zhenwu J900, выпуск которого намечен на третий квартал 2028 года. Также подразделение планирует создание собственных центральных процессоров (CPU) нового поколения, оптимизированных для задач агентного искусственного интеллекта, — Yitian 720 и Yitian 730, выход которых ожидается в 2027 году. Сообщается, что Yitian 730 станет первым процессором T-Head, созданным на базе собственной микроархитектуры.

Генеральный директор Alibaba У Юнмин (Wu Yongming) также представил план развития компании, выделив «ИИ-модели, ИИ-чипы и ИИ-облако» в качестве трёх краеугольных камней эпохи машинного интеллекта.

В рамках разработки искусственного сверхинтеллекта (Artificial Super Intelligence, ASI) команда разработчиков Qwen планирует обучить модель Qwen 5 с 5–10 трлн параметров, предназначенную для выполнения сложных задач в течение длительного времени.

Для сравнения, у флагманской модели Alibaba Qwen 3.8-Max насчитывается 2,4 трлн параметров, в то время как Kimi K3 от Moonshot AI — крупнейшая в Китае модель с открытыми весами — имеет 2,8 трлн параметров.

Кроме того, Alibaba запустила Qwen Intelligence — комплексную платформу для создания ИИ-агентов, которая обеспечит производителям смартфонов доступ к инструментам на базе Qwen.

Подписчики ChatGPT и других чат-ботов подали иск к Anthropic, OpenAI, SpaceXAI и Google из-за сговора о замедлении ИИ

Видимая солидарность отдельных игроков рынка систем ИИ в части добровольного замедления их развития уже начала негативно сказываться — как минимум, на их репутации, поскольку группа платных подписчиков ряда популярных чат-ботов в суде обвинила Anthropic, OpenAI, SpaceXAI и Google в незаконном сговоре.

 Источник изображения: Unsplash, Sasun Bughdaryan

Источник изображения: Unsplash, Sasun Bughdaryan

Как поясняет AP News, в Окружной суд Северного округа Калифорнии в пятницу был подан иск от лица четырёх подписчиков популярных чат-ботов, в котором перечисленные выше компании обвиняются в нарушении антимонопольных законов США с целью формирования сговора, направленного на снижение ценности услуг, предоставляемых подписчикам платных тарифов.

В исковом заявлении, которое представители истцов требуют считать групповым, сообщается о ключевой фазе координации между ответчиками, которая имела место 12 сентября, когда генеральный директор Anthropic Дарио Амодеи (Dario Amodei) опубликовал своё резонансное эссе, призывающее участников рынка добровольно замедлить развитие ИИ по соображениям общественной безопасности. В тот же день, как отмечается в иске, солидарность с идеями Амодеи выразили руководители OpenAI, SpaceX (xAI) и Google DeepMind.

Истцы даже утверждают, что координация между участниками рынка началась несколько раньше, поскольку ещё в июле некоторые из разработчиков ИИ-моделей призвали правительство США поддержать глобальную инициативу по замедлению разработки ИИ с помощью автоматических систем. Истцы настаивают, что подобные сговоры очевидным образом «окажут неконкурентное влияние на потребителей». При этом они не возражают против индивидуальных решений разработчиков по замедлению ИИ, но считают, что коллективные действия в этом направлении нарушают антимонопольное законодательство. По их мнению, конкурентный рынок позволяет одновременно сочетать ответственное ведение бизнеса с подлинным прогрессом.

Ведущий законный представитель истцов, адвокат Ник Роули (Nick Rowley), заявил: «ИИ быстро выйдет из под контроля людей и может всех нас уничтожить, если мы позволим контролировать протоколы безопасности ИИ частным соглашениям группы самых мощных коммерческих компаний, нацеленных на извлечение прибыли». В своём исходном эссе глава Anthropic Дарио Амодеи призвал правительство США как минимум запустить процесс переговоров между участниками рынка. Глава конкурирующей OpenAI Сэм Альтман (Sam Altman) поддержал идею создания федеральных правил, устанавливающих рамки требований по безопасности ИИ, но заявил, что не считает нужным ждать какого-либо антимонопольного разрешения для начала соответствующей работы.

Истцы в своих требованиях не выступают против возможности ИИ-компаний обратиться к любому из федеральных ведомств США с просьбой разработать правила регулирования отрасли. Они также не возражают против получения участниками рынка одобрения регулирующих органов на координацию своих действий в этой сфере. Президент США Дональд Трамп (Donald Trump) дал понять, что не приветствует идею намеренного замедления развития ИИ, поскольку это может ослабить позиции национальных разработчиков в конкурентной борьбе с китайскими коллегами. Попутно он объявил о намерениях создать национальные «силы ИИ», которые должен будет возглавить некий «царь ИИ», обладающий высоким уровнем интеллекта.


window-new
Soft
Hard
Тренды 🔥
«Лучше сохраните деньги»: на старте раннего доступа Ace Combat 8: Wings of Theve заслужила в Steam «смешанные» отзывы 2 ч.
В 2025 году выручка разработчика Ubuntu Linux — компании Canonical достигла $345 млн 2 ч.
Дела семейные: спустя 10 лет к CD Projekt Red вернулась сценаристка The Witcher 3: Wild Hunt, писавшая квест Кровавого Барона 3 ч.
Google оспорит требование ЕС открыть Android для альтернативных ИИ-помощников 3 ч.
ИИ-агенту Muse поручили продать вещь, а тот пригласил незнакомца домой без ведома пользователя 3 ч.
«Экзистенциальные риски для человечества»: Anthropic в преддверии IPO рассказала инвесторам об опасности ИИ 4 ч.
CLO запустила обновленное облако с новой архитектурой и изоляцией трафика 5 ч.
OpenAI отменила выпуск ИИ-модели GPT-6.1 Astra из соображений безопасности 5 ч.
«Терпите и выживайте»: амбициозный боевик Intergalactic: The Heretic Prophet от создателей Uncharted и The Last of Us не выйдет из тени в 2026 году 6 ч.
Naughty Dog отметила день The Last of Us анонсом DLC для Ghost of Yotei и тизером двух секретных проектов 7 ч.
ИИ-агенты научились самостоятельно проектировать и проверять чипы — Synopsys представила AgentEngineer 9 мин.
Деньги ходят по кругу, риски растут: Nvidia пытается втянуть страховые компании в сделки по финансированию ИИ-бума 2 ч.
Космическое импортозамещение: «Эльбрусы» появились в наземной части «Союза-5» и готовятся перейти на ракеты 2 ч.
TSMC расширяет чиповую империю в США: после шести фабрик в Аризоне ещё шесть могут появиться в Техасе 2 ч.
«Яндекс» выпустил сверхлёгкий премиум-ноутбук Lunnen Airis 14 за 100 тысяч рублей 2 ч.
Supermicro начала поставки NVIDIA Vera Rubin NVL72 с CDU на 1,8 МВт 3 ч.
Сингапур разработал первый в мире национальный стандарт СЖО для ЦОД в тропическом климате 3 ч.
Многострадальный корабль Boeing Starliner вернули к полётам — реанимационные мероприятия продолжатся 3 ч.
Tesla отложила презентацию парящего спорткара Roadster на две недели — из-за нелётной погоды в Техасе 4 ч.
AMD раскрыла цены всех процессоров EPYC Venice 9006: более 30 моделей оценили от $700 до $14 904 4 ч.