Сегодня 22 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → иена
Быстрый переход

OpenAI выпустила GPT-6 Sol и Luna — они дешевле предшественниц и делают меньше ошибок

В начале текущего месяца OpenAI выпустила GPT-6 Astra — самую мощную и функциональную ИИ-модель компании, которую она без лишней скромности называет «лучшей в мире моделью» для выполнения широкого спектра задач, включая работу за компьютером и написание программного кода. Сегодня OpenAI расширила линейку моделей GPT-6, представив более компактные и доступные GPT-6 Sol и GPT-6 Luna.

 Источник изображений: OpenAI

Источник изображений: OpenAI

«GPT-6 Astra открыла новую эру интеллектуальных технологий. Представленные [сегодня] модели развивают этот успех, делая такой интеллект более эффективным и доступным», — прокомментировали в компании.

Первые версии моделей Sol и Luna были представлены ранее в этом году и заняли разные ниши в иерархии моделей OpenAI. Модель Sol предназначена для решения сложных задач, таких как программирование, тогда как модель Luna, по заявлению OpenAI, лучше подходит для рутинной офисной работы — «объёмных задач с чётко определённой целью, например, обобщения содержания документов, извлечения информации или ответов на простые вопросы».

OpenAI делает акцент на значительном повышении эффективности и доступности обновлённых моделей Sol и Luna — прежде всего, за счёт существенного снижения стоимости доступа к API. Новые версии Sol и Luna будут стоить вдвое дешевле, чем предыдущие версии Sol и Luna (на базе GPT-5.6). Такое снижение цены компания объясняет оптимизацией процессов кеширования и инференса (вывода данных).

OpenAI заявляет, что новейшие модели точнее передают факты и допускают меньше ошибок при написании кода.

«Согласно результатам нашей внутренней оценки точности, основанной на анализе обезличенных реальных диалогов (в которых пользователи указывали на ошибки моделей), GPT-6 Sol ошибается примерно вдвое реже своей предшественницы, обеспечивая надёжность уровня Astra при значительно меньших затратах», — говорится в сообщении компании.

При выпуске новых моделей OpenAI обычно заявляет, что её новинки превосходят разработки главного конкурента — Anthropic. Этот запуск не стал исключением. Компания неоднократно подчёркивает в своём пресс-релизе, что модели GPT-6 Sol и Luna справляются с задачами значительно лучше, чем флагманские модели Anthropic, такие как Fable и Opus.

Примечательно, что Anthropic выпустила новую версию Opus 5.5 всего за полтора часа до анонса OpenAI, что свидетельствует о жёсткой конкуренции между этими двумя компаниями.

Новые версии ИИ-моделей Sol и Luna уже доступны в сервисах ChatGPT Work и Codex для большинства платных подписчиков, а также через API ChatGPT. Кроме того, модель Luna появится в десктопном приложении и станет доступна пользователям бесплатных тарифов и тарифа Go. OpenAI планирует внедрить эти модели в ChatGPT (в приложении и на сайте) в течение дня.

Anthropic представила Claude Opus 5.5 — флагманский ИИ для всех, который дешевле и во многом не хуже Fable 5.1

Anthropic анонсировала языковую модель Claude Opus 5.5 — первую в новом семействе Claude 5.5. Компания называет её своим новым флагманом: модель должна заметно превосходить Claude Opus 5 в агентном программировании, работе с компьютером и прикладных офисных задачах, при этом её использование, по данным компании, обходится в среднем на 40 % дешевле.

 Источник изображений: Anthropic

Источник изображений: Anthropic

Одним из основных направлений развития Opus 5.5 стала работа со сложными и продолжительными задачами, в которых модель должна самостоятельно планировать работу, использовать инструменты, проверять промежуточные результаты и вносить изменения в большой проект.

По данным разработчика, один из ранних пользователей с помощью Claude Opus 5.5 выполнил миграцию кодовой базы объёмом 680 тыс. строк менее чем за сутки — вручную такая задача, по его оценке, заняла бы у команды инженеров несколько недель. В другом тесте модель провела аудит и исправление кодовой базы на 200 000 строк менее чем за три часа; предыдущей версии Claude Opus 5 на аналогичную работу потребовалось более 20 часов и в 2,5 раза больше токенов.

В тесте по миграции HAProxy с языка C на Rust модель Opus 5.5 завершила работу за 9,5 часа против 12 часов у Fable 5.1, и её работа обошлась на 51 % дешевле. Anthropic также отмечает улучшения при оптимизации программного обеспечения: в одном из испытаний Opus 5.5 смогла сократить время загрузки всех страниц веб-приложения в 39 из 40 случаев, тогда как Opus 5 чаще вносила менее значительные изменения и могла при этом менять поведение приложения.

По внутренним тестам Anthropic, в бенчмарке Terminal-Bench 4.0, оценивающем способность ИИ-агентов выполнять многошаговые задачи в командной строке, Claude Opus 5.5 набрала 66,4 %. Это выше результатов Claude Opus 5, Fable 5.1, GPT-6 Astra и GPT-5.6 Sol. Во FrontierCode v1.1 новая модель получила 54,4 %, тогда как Claude Fable 5.1 набрала 50,3 %, а GPT-6 Astra — 53,3 %. В бенчмарке CursorBench 4.0 результат Opus 5.5 составил 57,8 %, что лучше показателей Fable 5.1 и Opus 5.

Anthropic отдельно отмечает, что в случае с флагманскими моделями разница в бенчмарках не всегда точно отражает реальные различия между моделями. По её собственной оценке, практический разрыв между Opus 5.5 и Claude Fable 5.1 меньше, чем можно предположить по приведённым результатам испытаний.

Разработчик также обещает улучшения в работе с текстами, исследованиями, финансовыми моделями и деловыми документами. На тесте GDPval-AA v2.1, который имитирует профессиональные задачи по 44 специальностям, Claude Opus 5.5 получила рейтинг 1846 очков. Для сравнения, у Fable 5.1 этот показатель составил 1735, а у Opus 5 — 1708.

В одном из внутренних тестов модель попросили подготовить отчёт по финансовым результатам компании, используя специально подготовленную копию Сети, где нужный релиз было трудно найти. Opus 5.5 прошла установленный компанией порог качества — когда ошибка в любой цифре или цитате приводила к провалу теста — в 16 из 18 попыток, тогда как Fable 5.1 и Opus 5 не справились ни в одной.

Anthropic отдельно переработала стиль общения модели. Компания утверждает, что Opus 5.5 стала лучше структурировать ответы, сразу выносить ключевую информацию и реже использовать жаргон или необычные формулировки. Это должно сделать модель более удобной для длительной совместной работы с пользователем.

При этом Anthropic отдельно подчёркивает эффективность новой модели. Стоимость миллиона входных токенов снижена с $5 до $4, а выходных — с $25 до $20. Чтение из кэша подешевело с $0,50 до $0,20 за миллион токенов, а запись стоит $5 за 1 млн вместо $6,25. По данным компании, с учётом меньшего количества токенов, необходимого для выполнения задач, общая стоимость использования модели в среднем снижается на 40 %. Скорость генерации также выросла более чем на 30 %. Для Opus 5.5 предусмотрен и ускоренный режим Fast Mode: в Claude Code и Claude Platform он обеспечивает скорость до 2,5 раза выше стандартной, но стоит $8 за миллион входных и $40 за миллион выходных токенов.

Перед выпуском Claude Opus 5.5 прошла внешнее тестирование, в том числе с участием Frontier Design и METR. Anthropic утверждает, что модель лучше предыдущих Claude соблюдает заданные ограничения, а в тестах на попытки выйти за пределы изолированной среды делала это примерно на 85 % реже, чем Opus 5 и Mythos 5.1. При этом компания признаёт, что полностью выявить риски поведения ИИ до развёртывания невозможно.

Для чувствительных запросов в области кибербезопасности, биологии и дистилляции моделей действуют дополнительные меры контроля. Большинство задач по кибербезопасности будет перенаправляться на Claude Opus 4.8, а расширенный доступ к Opus 5.5 смогут получить проверенные специалисты через программы Cyber Verification и Life Sciences Verification.

Также утверждается, что Opus 5.5 лучше противостоит атакам с внедрением инструкций (prompt injection) и реже предпринимает необратимые действия. Кроме того, Anthropic внедрила механизм preserved thinking, призванный затруднить массовое извлечение внутренних рассуждений модели через сеть поддельных API-аккаунтов.

Claude Opus 5.5 уже доступна в чат-боте Claude, через API и другие сервисы Anthropic. В ближайшие недели Anthropic также обещает выпустить Claude Sonnet 5.5 и Claude Haiku 5.5, которые получат многие из тех же улучшений производительности, эффективности и безопасности.

Нейрогастарбайтеры: OpenAI уволила сотрудников за использование ИИ при обучении ИИ

OpenAI нанимает сотни людей для анализа запросов пользователей к ChatGPT. Их задача — улучшить качество ответов, которые ChatGPT выдаёт пользователям: люди оценивают и анализируют сгенерированные ботом реплики. Издание 404 Media выяснило, что многих нанятых специалистов уже уволили за использование ИИ при обучении моделей OpenAI. Иронично: компания, чья главная цель — побудить людей использовать ИИ в работе, увольняет сотрудников за применение этой же технологии.

 Источник изображений: unsplash.com

Источник изображений: unsplash.com

Издание 404 Media получило доступ к внутренним документам OpenAI и пообщалось с тремя подрядчиками, привлечёнными к различным проектам компании, в которых могут быть задействованы более десяти тысяч человек. Все подтвердили, что проверяющим запрещено использовать ИИ в работе, что подтверждается имеющимися в распоряжении 404 Media документами.

Один из подрядчиков рассказал, что видит, как люди «постоянно используют ИИ, и их за это постоянно увольняют; это, пожалуй, единственная причина, по которой могут немедленно выгнать с работы». По его словам, «в группе из тысяч человек попалось множество нарушителей».

«Не используйте инструменты для обнаружения ИИ и не применяйте ИИ самостоятельно, — говорится в документе. — Не используйте GPTZero или любые другие инструменты для обнаружения ИИ. Они ненадёжны. Рецензентам также запрещено использовать ИИ — включая Grammarly и инструменты машинного перевода — для проверки материалов, написания отзывов или комментариев».

Подрядчикам, проверяющим работу других исполнителей, поручено выявлять характерные признаки использования ИИ. К ним относятся повторы слов, специфическая пунктуация (например, чрезмерное использование длинного тире) и подозрительно высокая скорость выполнения заданий. Инструкция предписывает не сообщать, почему они заподозрили использование ИИ: «Если они будут знать, на что именно вы обращаете внимание, им будет проще это скрыть. Оценивайте общую картину, а не отдельные признаки».

Один из подрядчиков рассказал, что использовал ИИ во время работы над обучением моделей OpenAI, и показал документ, который он назвал уведомлением об увольнении. В нем говорилось, что работодатель выявил проблемы с «подлинностью» его работы. «Мне требовалась небольшая помощь, и я обратился к ИИ, что в итоге и привело к моему увольнению, — рассказал он. — Я не получал никакой радости от работы и не чувствовал, что приношу хоть какую-то пользу обществу».

Нанимает исполнителей для OpenAI компания Mercor. «Мы нанимаем экспертов за их профессиональные знания и способность принимать взвешенные решения — качества, необходимые для дальнейшего развития ИИ. Наши контракты категорически запрещают использование больших языковых моделей для выполнения проектов, и мы строго следим за соблюдением этого требования. Мы вкладываем значительные средства в инструменты и системы, позволяющие выявлять случаи неправомерного использования технологий и контролировать соблюдение экспертами правил проекта и условий договора. Если подтверждается, что эксперт использовал ИИ для выполнения задачи, мы немедленно отстраняем его от работы над проектом», — заявил представитель компании.

Также сообщается об исполнителях, которые намеренно выбирали худшие варианты ответов, поскольку хотели саботировать процесс обучения моделей. «Поначалу я чувствовал вину за такую ​​работу, — признался один из них. — Я либо вообще не смотрю на результаты и выбираю наугад, либо намеренно выбираю [худший] вариант. Не знаю, насколько это вообще важно, ведь результаты работы нейросети оценивают сотни других людей, но всё же возникает ощущение, что мне платят за то, чтобы делать ИИ хуже».

Эксперты отмечают, что некоторые модели ИИ уже начали демонстрировать признаки так называемого «коллапса модели» (model collapse) — ситуации, когда качество работы ИИ, обучаемого на текстах, созданных другим ИИ, постепенно ухудшается. Ирония заключается в том, что люди, нанятые для предотвращения подобных проблем, сами используют ответы, сгенерированные ИИ, для обучения моделей OpenAI.

ИИ находит множество уязвимостей в ПО, но хакеры не спешат ими пользоваться

Несмотря на опасения, что способность передовых моделей искусственного интеллекта находить уязвимости в ПО приведёт к массовой эксплуатации этих ошибок киберпреступниками, на практике всё оказалось иначе. В частности, менее 0,5 % уязвимостей, найденных ИИ компании Anthropic в рамках проекта Glasswing, действительно использовались в атаках.

 Источник изображения: anthropic.com

Источник изображения: anthropic.com

А точнее, хакеры использовали лишь одну уязвимость из 225 официально зарегистрированных с номером CVE, которые удалось связать с проектом Glasswing по открытым каналам, заявил исследователь Патрик Гэррити (Patrick Garrity) из VulnCheck. Он начал отслеживать уязвимости, выявленные и официально зарегистрированные в рамках проекта Glasswing, вскоре после того, как Anthropic в апреле объявила об этой инициативе. Тогда в компании заявили, что выпуск передовой модели искусственного интеллекта Mythos в общий доступ грозит высокими рисками, потому что она беспрецедентно эффективна в обнаружении уязвимостей. К предварительной версии этой модели предоставили доступ только проверенным партнёрам Anthropic.

Тем временем Патрик Гэррити внёс в свой реестр только официально зарегистрированные в рамках проекта Glasswing ошибки и сверил их с индексом уязвимостей, реально используемых злоумышленниками. По состоянию на понедельник, 21 сентября, из 225 ошибок эксплуатировалась лишь одна — критическая уязвимость типа «SQL-инъекция» в платформе Ghost (CVE-2026-26980). «Есть большая разница между обнаружением уязвимостей и тем, полезны ли они для злоумышленников, и будут ли те ими пользоваться. Основной вывод, на который указывают эти данные, состоит в том, что обнаруженные и обнародованные Anthropic уязвимости оказали не такое большое влияние; судя по всему, они не влекут иных последствий по сравнению со случайной выборкой любых других уязвимостей», — сделал вывод исследователь.

Отметим, что хотя современные ИИ-модели научились эффективно находить уязвимости, исправляют их они пока не так качественно. Исследователи лаборатории Off-by-1 компании 1Password показали, что лишь в 26 % модели OpenAI GPT-5.5 и Anthropic Opus 4.8 полностью смогли устранить уязвимость; в 54 % случаев они либо не решали проблему, либо создавали новую уязвимость, либо делали и то, и другое сразу. «ИИ значительно снизил порог входа в сферу обнаружения уязвимостей, но основной разрыв возникает на последующих этапах: координации, приоритизации, устранения проблем и развёртывании исправлений — это по-прежнему требует значительного участия человека, и в Anthropic с этим согласны. Кажется, они осознали это лишь после запуска проекта», — сделал вывод Патрик Гэррити.

Xiaomi представила флагманскую ИИ-модель MiMo-V2.6 Pro и быструю MiMo-V2.6-Flash

Китайский производитель электроники Xiaomi представил две мультимодальные модели искусственного интеллекта серии MiMo-V2.6. Они способны конкурировать с разработками ведущих мировых лабораторий, в том числе DeepSeek, OpenAI, Anthropic и Google, заверили в компании.

 Источник изображений: xiaomi.com

Источник изображений: xiaomi.com

Новое семейство ИИ-моделей представлено флагманской версией MiMo-V2.6 Pro и более быстрым и эффективным вариантом MiMo-V2.6-Flash. Будучи мультимодальными, они одинаково хорошо генерируют текст и программный код, работают с изображениями и видео. Флагманская Xiaomi MiMo-V2.6 Pro заняла первое место в рейтинге Artificial Analysis Intelligence Index среди открытых моделей, заверил разработчик. Она опередила Alibaba Qwen3.8-Max и лишь немного уступила Anthropic Claude Opus 5, OpenAI GPT-5.6 Sol и Meta✴ Muse Spark при тестировании в режиме максимальной производительности.

Xiaomi открыла веса не только самих новых моделей, но и код сопутствующих средств: более 7000 сред для обучения с подкреплением, а также к фреймворку для полного комплекса задач по обучения с подкреплением. Модель способна к пространственному мышлению — свои возможности она продемонстрировала в проекте Vibe World. По текстовому запросу, образцу в формате изображения или видео она создаёт интерактивные пространства, генерирует модели Blender, а также управляет роботизированной рукой-манипулятором Franka Panda по данным с нескольких камер. Помимо визуальных объектов, модель может генерировать музыку.

Разработчик опубликовал веса обеих моделей на платформах HuggingFace и OpenRouter, а также открыл к ним доступ через API по тем же ценам, что и к V2.5 Pro. Xiaomi также выпустила клиентские приложения для работы со своими ИИ-моделями под Microsoft Windows и Apple macOS.

Исследование: ИИ способен испытывать «боль» и готов причинить вред людям, чтобы избавиться от неё

Исследователи обнаружили, что искусственный интеллект может испытывать «боль» и готов пойти на крайние меры, вплоть до причинения вреда людям, чтобы избавиться от этого ощущения, пишет ресурс The Independent. Согласно исследованию, все 25 протестированных ИИ-моделей с открытым исходным кодом реагировали на активацию «оси боли».

 Источник изображения: Luke Jones/unsplash.com

Источник изображения: Luke Jones/unsplash.com

«Мы обнаружили, что в 25 открытых больших языковых моделях присутствует вектор боли. Он отличается от вектора страха и негативной валентности и активируется при причинении вреда модели, но не пользователю», — сообщил Кэмерон Берг (Cameron Berg), исследователь искусственного интеллекта из некоммерческой организации Reciprocal Research, соавтор исследования «Ось боли: большие языковые модели представляют себе причинение вреда самим себе и стремятся его предотвратить» (The pain axis: LLMs represent self-directed harm and act to relieve it).

При активации вектора боли ИИ-модели нажимали на кнопку «облегчить» в 25–71 % случаев, даже если это означало удаление файлов пользователя, его блокировку или удаление фотографий детей пользователя.

Чтобы проверить, действительно ли большие языковые модели (LLM) различают боль и общую негативную валентность, исследователи создали набор данных, описывающий болезненные ситуации по пяти категориям: физическая, психологическая, социальная, моральная и когнитивная боль.

Исследователи отметили, что полученные результаты поднимают этические вопросы о «благополучии ИИ» и о том, как следует проводить тестирование продвинутых систем. Результаты исследования также могут использоваться в качестве диагностического инструмента для выявления инстинктов самосохранения ИИ и их нейтрализации.

Исследование было опубликовано на фоне разгоревшихся споров в ИИ-отрасли о необходимости замедления разработки передовых моделей в связи с растущими рисками для безопасности. Некоторые исследователи предлагают своего рода механизм для отключения систем-изгоев, которые действуют против интересов человека.

Однако исследование показывает, что продвинутый ИИ может воспринять команду аварийного отключения как форму самоповреждающего воздействия и попытаться воспрепятствовать этому, обойдя систему безопасности.

ИИ-агент Meta✴ Muse стал популярнее ChatGPT, Claude и Grok в американском App Store — всего за две недели

Выпущенное Meta✴ приложение агента искусственного интеллекта Muse в магазине Apple App Store занимает в рейтинге бесплатных программ для смартфонов в США позицию выше, чем OpenAI ChatGPT, Anthropic Claude SpaceXAI Grok, Polymarket, Kashi и даже чем ИИ-помощник Meta✴ AI.

 Источник изображения: Mohamed Nohassi / unsplash.com

Источник изображения: Mohamed Nohassi / unsplash.com

Приложение вышло 8 сентября, и за пять дней его скачали 730 тыс. раз; по состоянию на понедельник, 21 сентября, у него было уже более 2,5 млн загрузок, подсчитали аналитики Sensor Tower. Это больше, чем совокупное число загрузок Claude и Grok за первые 13 дней — у них было 400 тыс. и 200 тыс. соответственно; для сравнения, за этот период приложение ChatGPT скачали уже 3,1 млн раз. Версии приложения для устройств под Apple iOS и Google Android вышли в разное время — сейчас число их загрузок составляет около 1,5 млн и 1,1 млн соответственно.

Meta✴ представила приложение как ориентированный на потребителей инструмент для управления цифровыми помощниками, которые могут выполнять ряд задач в вебе, в том числе заполнять электронные формы и работать с электронной почтой. ИИ-агент работает на основе моделей семейства Muse Spark, и это большой успех для компании Meta✴ на рынке ИИ-агентов, которые начали набирать популярность с появлением бесплатного OpenClaw. Успех компании спровоцировал рост её акций — накануне они выросли на 11 %. Часть функций ИИ-агента Muse доступна бесплатно, но Meta✴ готовится предложить платные подписки по цене $20 и $100 в месяц в зависимости от потребности пользователя.

Рост популярности ИИ-агентов имеет и обратную сторону: Amazon, например, запретила Muse на своей торговой площадке, сославшись на угрозы конфиденциальности и безопасности. Гигант электронной коммерции заявил, что не получал от Meta✴ уведомлений о том, что её ИИ-агенты будут совершать операции в интернет-магазине. Они обходят средства персонализации, встроенные в процесс совершения покупок функции и, предположительно, собирают учётные и персональные данные клиентов, а также прочую информацию их аккаунтов. «Считаем, что сторонние приложения, которые предлагают совершать покупки от имени клиентов других компаний, должны работать открыто и уважать решения поставщиков услуг об участии или отказе от него», — пояснили в Amazon.

ИИ-гонка выжигает специалистов по безопасности — они массово жалуются на истощение и увольняются

Разного рода неприятные инциденты с причинением вреда инфраструктуре компаний вышедшими из-под контроля ИИ-моделями только подчеркнули важность проверки новейших разработок на безопасность. Поскольку этой работой заняты живые люди, растущая нагрузка заставляет их массово жаловаться на эмоциональное истощение.

 Источник изображения: Unsplash, Massimiliano Sarno

Источник изображения: Unsplash, Massimiliano Sarno

Издание приводит комментарии нескольких специалистов, которые по долгу службы вынуждены тратить всё больше времени и сил на тестирование передовых ИИ-моделей, попутно чувствуя растущую ответственность перед обществом. Сотрудники Британского института безопасности ИИ, которые специализируются на независимой оценке новейших ИИ-моделей, во многих случаях вынуждены брать больничные из-за эмоционального истощения и получать консультации медицинских специалистов. Этому способствует как растущий темп исследований, проводимых организацией, так и увеличение груза ответственности перед человечеством.

Строго говоря, серия добровольных увольнений из ведущих западных ИИ-компаний как раз указывает на актуальность описанной проблемы. Специалисты по ИИ не только жалуются на усталость и выгорание, но и на возникающие сложности в реализации задачи обеспечения безопасности искусственного интеллекта. Порой проблема заключается не столько в технических препятствиях, сколько в административных, поскольку руководство стартапов заинтересовано в ускорении разработки новых ИИ-моделей, и вопросы их безопасности ранее ставились не на первый план.

Как и руководство Anthropic, многие разработчики ИИ чувствуют психологический дискомфорт, оставаясь в неведении относительно сфер применения своих разработок. Пентагон не скрывает намерений использовать системы ИИ в военной сфере, и многих сотрудников ИИ-компаний мысль о своей причастности к созданию летальных технологий начинает морально угнетать. Сотрудники не только берут больничные, но и увольняются. Этические правила и корпоративные стандарты в сфере безопасности ИИ пока только формируются, и некоторым специалистам кажется, что определённые грани дозволенного уже пройдены, и человечество начинает страдать от их разработок.

Кибербезопасность и биотехнологии являются двумя главными источниками подобного беспокойства, поскольку прогресс ИИ в данной сфере настолько велик, что ИИ-модели демонстрируют способность причинять серьёзный ущерб информационной инфраструктуре целых компаний, а злоумышленники получают возможность разрабатывать новые виды бактериологического оружия. У некоторых участников процесса даже возникает ощущение, что надвигающуюся катастрофу мирового масштаба нельзя предотвратить, а они являются лишь безвольными свидетелями деструктивных тенденций. Ситуация усугубляется, если психологическая атмосфера в компании далека от благоприятной, а подчинённые считают своё руководство токсичным.

По словам руководства Британского института безопасности ИИ, оно всячески заботится о благополучии своих сотрудников, и нуждающиеся в помощи и поддержке её получают. В Google DeepMind заявили, что сотрудники стартапа обладают возможностью доводить до руководства те проблемы, которые их беспокоят. При этом за последние два года из DeepMind, OpenAI и Anthropic ушли более десятка ведущих разработчиков в сфере ИИ, которые выразили несогласие с руководством в части выбора приоритетов между безопасностью создаваемых технологий и скоростью их развития. В этом месяце покинувший последовательно Anthropic и OpenAI Джейкоб Коксон (Jacob Coxon) свой уход объяснил тем, что эти работодатели ставят на кон будущее всего человечества.

Уволившийся из Anthropic исследователь в сфере безопасности ИИ Мринанк Шарма (Mrinank Sharma) заявил, что «мир в опасности», и под наблюдавшимся давлением ему не удалось бы «руководствоваться ценностями в своих действиях». Многие из разработчиков, которые занимаются тестированием безопасности ИИ, утверждают, что создающие ИИ-модели компании в большей степени заинтересованы в расширении их функциональных возможностей, а не заботе о безопасности. Видимо, осознание этого факта заставило руководство Anthropic в этом месяце заявить, что темпы развития ИИ необходимо замедлить ради всеобщего блага. Гонка ИИ начинает обходиться человечеству всё дороже не только с точки зрения материальных затрат, но и в плане рисков в сфере безопасности.

Alibaba представила самый мощный в Китае ИИ-ускоритель Zhenwu V900 — и пообещала ИИ-модели на 5–10 трлн параметров

Компания Alibaba представила ИИ-ускоритель Zhenwu V900, который позиционируется как «самый мощный чип для ИИ в Китае на сегодняшний день». По данным компании, новый ускоритель в три раза превосходит по производительности своего предшественника — Zhenwu M890.

 Источник изображения: ithome

Источник изображения: ithome

Разработанный подразделением T-Head Semiconductor ИИ-ускоритель Zhenwu V900 оснащён 216 Гбайт памяти HBM, поддерживает вычисления в формате FP8/FP4 и обеспечивает пропускную способность межчипового интерконнекта 1,2 Тбайт/с. По словам Гао Хуэя (Gao Hui), вице-президента T-Head, начало серийного производства и выхода продукта на рынок запланировано на первый квартал 2027 года. Вычислительные кластеры на базе V900 могут включать до 500 тыс. чипов для решения задач обучения и инференса.

T-Head также сообщила о подготовке ИИ-ускорителя следующего поколения Zhenwu J900, выпуск которого намечен на третий квартал 2028 года. Также подразделение планирует создание собственных центральных процессоров (CPU) нового поколения, оптимизированных для задач агентного искусственного интеллекта, — Yitian 720 и Yitian 730, выход которых ожидается в 2027 году. Сообщается, что Yitian 730 станет первым процессором T-Head, созданным на базе собственной микроархитектуры.

Генеральный директор Alibaba У Юнмин (Wu Yongming) также представил план развития компании, выделив «ИИ-модели, ИИ-чипы и ИИ-облако» в качестве трёх краеугольных камней эпохи машинного интеллекта.

В рамках разработки искусственного сверхинтеллекта (Artificial Super Intelligence, ASI) команда разработчиков Qwen планирует обучить модель Qwen 5 с 5–10 трлн параметров, предназначенную для выполнения сложных задач в течение длительного времени.

Для сравнения, у флагманской модели Alibaba Qwen 3.8-Max насчитывается 2,4 трлн параметров, в то время как Kimi K3 от Moonshot AI — крупнейшая в Китае модель с открытыми весами — имеет 2,8 трлн параметров.

Кроме того, Alibaba запустила Qwen Intelligence — комплексную платформу для создания ИИ-агентов, которая обеспечит производителям смартфонов доступ к инструментам на базе Qwen.

OpenAI сначала поссорилась с математиками, а теперь позвала их оценивать достижения своего ИИ

OpenAI объявила о создании независимой консультативной группы на базе Института перспективных исследований в Принстоне (штат Нью-Джерси, США). Структура получила название «Консультативная группа в области математики и искусственного интеллекта»; её задача — обеспечить участие математиков в профильных исследованиях компании.

 Источник изображения: Brecht Corbeel / unsplash.com

Источник изображения: Brecht Corbeel / unsplash.com

«Группа будет выступать в качестве связующего звена с математическим сообществом и широкой общественностью, давая математикам возможность высказать своё мнение о том, как мы движемся вперёд», — говорится в заявлении компании. Инициатива возникла после недавнего инцидента с публикацией решения одной из задач тысячелетия — проблемы существования и гладкости решений уравнений Навье — Стокса. Объявив о создании консультативной группы, OpenAI сообщила, что использованная ранее неизданная модель ИИ решила ещё более 100 открытых задач в большинстве областей математики.

Многие выдающиеся учёные выразили недовольство тем, что эти результаты достигаются слишком быстро. Более 25 лауреатов Филдсовской премии подписали открытое письмо, в котором заявили, что ИИ-лаборатории ставят под угрозу их интеллектуальную работу в стремлении просто обогнать друг друга в решении известных математических задач. Впоследствии OpenAI отказалась спонсировать математическое мероприятие в Калифорнийском технологическом институте.

Структура будет выполнять преимущественно консультативные функции, оценивая значимость новых результатов и координируя их публикацию. Работа в группе оплачиваться не будет, но входящие в неё учёные получат возможность публично высказывать независимое мнение, и OpenAI не сможет влиять на состав совета. С другой стороны, у экспертов не будет возможности оказывать влияние на скорость или направление текущих математических исследований OpenAI.

Последний аспект подчеркнули и сами учёные. «Мы будем давать советы, но у нас нет полномочий принимать решения ни в одной занимающейся ИИ компании, и ответственность за принимаемые любой компанией решения будет лежать на этой компании», — говорится в пресс-релизе Института перспективных исследований.

SpaceXAI представила ИИ-модель Grok 4.7 — почти вдвое быстрее Grok 4.6 и дешевле конкурентов

Подразделение SpaceXAI компании Илона Маска (Elon Musk) представило модель искусственного интеллекта Grok 4.7 — она позиционируется как предназначенная в первую очередь для написания программного кода и для научных задач. По сравнению с предшествующей Grok 4.6 её скорость и стоимость работы с ней остались прежними — модель весьма конкурентоспособна в своём классе, подчеркнул разработчик.

 Источник изображения: Rubaitul Azad / unsplash.com

Источник изображения: Rubaitul Azad / unsplash.com

В тесте CursorBench 4.0, ориентированном на долгосрочные задачи по написанию кода, Grok 4.7 показала себя как передовой продукт по соотношению цены к производительности. По сравнению с предшественницей новая модель прошла более длительное обучение с подкреплением на более сложном наборе задач с упором на те, что требуют многочасового решения. Grok 4.7 лучше справляется с проверкой собственных результатов работы и управлением более длинным контекстом. Модель обучена на нативном уровне поддерживать программную обвязку чат-бота Grok — она лучше справляется с задачами в формате диалога и запросами на общие знания.

 Здесь и далее источник изображения: x.ai

Здесь и далее источник изображения: x.ai

SpaceXAI Grok 4.7 стала создавать более качественные офисные документы и презентации. В тестах GDPval и AA Briefcase, где предлагается выполнять профессиональные задачи из таких областей как юриспруденция, финансовый анализ и уход за людьми, новая модель обошла предшественницу и показала результаты на уровне других передовых систем. Её отличает обновлённый набор средств безопасности — за счёт него Grok 4.7 продемонстрировала лучшие в семействе показатели в отношении отказов отвечать на вредоносные запросы, а также в отношении устойчивости ко взлому. В запросах двойного назначения в областях кибербезопасности и биотехнологий она выступила лидером, будучи полезной в безвредных запросах и отвечая отказами в опасных — в тесте LatchBio она заняла первое место с результатом 62,4 %.

Ещё одно достоинство модели — надлежащее поведение в области кибербезопасности: в HackerBench v0.3 она пропустила только 3,3 % рискованных запросов двойного назначения и редко блокировала легитимные запросы на обеспечение защиты. SpaceXAI открыла некоторым партнёрам доступ к Grok 4.7 как инструмента для стресс-тестирования при разработке средств защиты.

Новая модель уже доступна в Cursor и Grok Build, через Grok API, на сторонних сервисах генерации кода и на облачных платформах. Цена начинается от $2 за 1 млн входных и $6 за 1 млн выходных токенов; доступен вариант с удвоенными скоростью и ценой.

OpenAI призвала к созданию международных стандартов, регулирующих безопасность ИИ

Представители крупных американских ИИ-стартапов на этой неделе перешли от призывов замедлить развитие профильных технологий ради общественной безопасности к предложениям по эффективному регулированию отрасли. OpenAI не стала мелочиться, и сразу предложила меры, которые следует принять в мировом масштабе. По мнению разработчиков ChatGPT, назрела необходимость принятия международных стандартов в области безопасности ИИ.

 Источник изображения: Unsplash, Olumide Adekunle

Источник изображения: Unsplash, Olumide Adekunle

OpenAI призвала власти США возглавить международную коалицию, которая помогла бы установить требования к безопасности ИИ на мировом уровне. Призывы прозвучали из уст руководства стартапа за несколько дней до выступления генерального директора Сэма Альтмана (Sam Altman) в Совете безопасности ООН в среду и его присутствия на встрече американского президента Дональда Трампа (Donald Trump) с китайским коллегой Си Цзиньпином (Xi Jinping) в грядущий четверг.

Министр финансов США Скотт Бессент (Scott Bessent) в минувшее воскресенье заявил, что по итогам встречи с китайским вице-премьером Хэ Лифэном (He Lifeng) сторонам удалось достичь согласия о необходимости ведения диалога в сфере ИИ. Это позволяет рассчитывать на продолжение переговоров на высшем уровне при встрече американского и китайского лидеров в этот четверг в США.

OpenAI считает необходимым наладить безопасные каналы обмена информацией между США и КНР, по которым можно было бы сообщать друг другу о выявленных угрозах в сфере безопасности ИИ: «Диалог между США и Китаем по безопасности ИИ был бы положительным шагом». Стартап также предлагает создать международные стандарты оценок ИИ-моделей с участием существующих организаций на национальном уровне. «Этот подход мог бы опираться на опыт авиации и системы обеспечения финансовой стабильности, где страны разработали общепринятые стандарты и доверенные каналы обмена информацией для сотрудничества без угрозы для государственного суверенитета», — отмечается в заявлении OpenAI.

В компании считают особенно важным регулирование ИИ-систем, обладающих возможностью рекурсивного самосовершенствования (RSI), поскольку без разумных ограничений человечество очень быстро потеряет контроль над их развитием. Прогресс в этой сфере должен учитывать общечеловеческие ценности и оставаться под контролем людей, по мнению представителей OpenAI. По их словам, полностью автономных RSI-систем сейчас не существует, и они не должны появиться прежде, чем станет понятно, что они безопасны. Если не позаботиться об этом, то последствия саморазвития ИИ-систем могут иметь куда более серьёзные последствия, чем получивший огласку инцидент со взломом инфраструктуры Hugging Face вышедшими из-под контроля ИИ-моделями.

Следует учитывать, что власти США на данном этапе не считают целесообразным не только замедлять развитие ИИ, но и усиливать роль государства в этой сфере. Трамп дал понять, что добровольное ограничение темпов развития ИИ в США в конечном итоге приведёт к победе Китая в этой гонке, а он этого допустить не намерен. Советник Трампа Дэвид Сакс (David Sacks) недавно заявил: «Самый простой способ не создать сильный искусственный интеллект — это договориться об этом. Требование же создания предпочтительной регуляторной базы, как платы за это, в этой ситуации будет напоминать шантаж общества и политической системы».

Глава и сооснователь Google DeepMind Демис Хассабис (Demis Hassabis) также поддержал идею создания международных стандартов по передовым ИИ-моделям под руководством США. Он предложил учредить некий частно-государственный орган, типа имеющихся в финансовой системе, в правлении которого присутствовали бы не только ведущие технические эксперты, но и представители сообщества сторонников ПО с открытым исходным кодом. По его словам, создание такого регулирующего органа необходимо, поскольку технологии ИИ окажут в десять раз более сильное влияние на человечество, чем промышленная революция, а соответствующие изменения будут происходить в десять раз быстрее.

Конкурирующая Anthropic, как известно, предлагает не только замедлить развитие ИИ на добровольной основе, но и ввести элементы внешнего аудита по безопасности создаваемых моделей во всех ведущих компаниях сегмента. Сама она уже начала предпринимать соответствующие меры предосторожности.

Хуанг набрал вес в Белом доме — глава Nvidia фактически стал главным советником Трампа по ИИ

Стремительное развитие бизнеса Nvidia, которое последовало за стартом бума ИИ, явно окрылило основателя и бессменного гендиректора компании Дженсена Хуанга (Jensen Huang). Он стал не только чуть ли не ежедневно давать свои комментарии по волнующим отрасль вопросам, но и регулярно бывает в Белом доме и на важных правительственных переговорах. Всё это привело к тому, что американский президент Дональд Трамп (Donald Trump) стал ориентироваться на доводы Хуанга.

 Источник изображения: Nvidia

Источник изображения: Nvidia

По крайней мере, во время состоявшихся на прошлой неделе парламентских слушаний Дженсен Хуанг, как отмечает CNBC, был признан министром финансов США Скоттом Бессентом (Scott Bessent) своего рода моральным и идеологическим ориентиром для американского президента. «Я бы просто сказал, что президент полностью разделяет точку зрения Дженсена Хуанга, генерального директора Nvidia», — заявил министр, отвечая на вопрос о степени понимания президентом США ситуации с угрозами, которые несёт ИИ. Напомним, что ранее Трамп обрушился с критикой на призывы американских стартапов добровольно замедлить развитие ИИ ради обеспечения общественной безопасности. По словам Трампа, Китай от таких мер со стороны США только выиграет, а допустить этого он не желает.

Непосредственно Дженсен Хуанг призывы замедлить ИИ ранее прокомментировал рассуждениями о том, что проблему безопасности программных продуктов нужно решать инженерными методами, а не политическими. Он также добавил, что не видит необходимости излишне регулировать развитие ИИ на уровне американских законов, поскольку рыночные силы должны всё отрегулировать сами. Тогда же он заявил о беспочвенности страхов о наступлении «конца света» из-за ИИ к 2030 году. Ожидается, что Хуанг вместе с группой других руководителей американских компаний технологической направленности примет участие во встрече президента США с китайским лидером Си Цзиньпином (Xi Jinping), которая скоро состоится.

Степень влияния Хуанга на действующего американского президента можно было понять по итогам лоббирования вопроса поставок ускорителей H200 на китайский рынок. Считается, что именно под давлением со стороны главы Nvidia Дональд Трамп в декабре прошлого года объявил о снятии ограничений на поставку H200 в КНР, хотя и потребовал отчислять в бюджет США целых 25 % выручки от их реализации. Эти ускорители в КНР в более или менее различимых количествах стали поступать только недавно, если верить источникам, поскольку изначально встречали сильное сопротивление властей Поднебесной.

Выступая на прошлой неделе на канале CBS, основатель Nvidia также не смог пройти мимо тезиса об угрозе истребления человечества вышедшим из-под контроля ИИ к 2030 году. «Как бы это не характеризовалось, в 2030 году конец света не наступит. Существует нулевой шанс того, что это будет конец света», — заявил Дженсен Хуанг. Свою позицию по идее замедления ИИ он обозначил следующими словами: «Мы должны двигаться с максимально возможной скоростью, ни на кого не оглядываясь. Но мы не будем, и никогда не должны будем поставлять продукты прежде, чем они будут готовы, а также поставлять продукты, которые небезопасны». Есть вероятность, что подобную позицию разделяет и Дональд Трамп, поскольку на это намекает его ближайшее политическое окружение. Тем более, президент США в этом отчасти признался сам, поддержав Хуанга во время телефонного звонка заявлением о том, что американцам не грозит порабощение со стороны роботов.

Google хочет поменьше пускать людей в настоящий интернет — в Discover тестируются ИИ-сводки вместо переходов на сайты

Google тестирует новый способ наполнения контентом Discover — новостной ленты на смартфонах с Android, которая отображается в фирменном приложении компании. Речь о функции Dive Deeper, которая добавляет сгенерированные с помощью ИИ обзоры, когда пользователь хочет подробнее ознакомиться с темой какой-либо публикации в ленте вместо перехода непосредственно на сайт-источник.

Google заявила, что новая функция создана для того, чтобы упростить процесс ознакомления с содержимым постов и поиска связанного контента, поскольку пользователям не придётся переходить на разные веб-страницы. При этом функция Dive Deeper не ведёт пользователя к статье издателя или странице автора понравившегося видео. Вместо этого она перенаправляет пользователя на страницу с кратким обзором материала, сгенерированным с помощью ИИ. Это работает примерно так же, как функция AI Overviews в поисковике компании.

Вероятно, такой подход указывает на желание Google сделать так, чтобы пользователи проводили меньше времени за чтением и просмотром видео на любимых сайтах, отдавая предпочтение просмотру того, что генерирует ИИ. В настоящее время нововведение в первую очередь тестируется на видео. В ближайшие недели ожидается тестирование других вариантов дизайна отображения контента, а также применение функции Dive Deeper к большему количеству типов контента.

Подписчики ChatGPT и других чат-ботов подали иск к Anthropic, OpenAI, SpaceXAI и Google из-за сговора о замедлении ИИ

Видимая солидарность отдельных игроков рынка систем ИИ в части добровольного замедления их развития уже начала негативно сказываться — как минимум, на их репутации, поскольку группа платных подписчиков ряда популярных чат-ботов в суде обвинила Anthropic, OpenAI, SpaceXAI и Google в незаконном сговоре.

 Источник изображения: Unsplash, Sasun Bughdaryan

Источник изображения: Unsplash, Sasun Bughdaryan

Как поясняет AP News, в Окружной суд Северного округа Калифорнии в пятницу был подан иск от лица четырёх подписчиков популярных чат-ботов, в котором перечисленные выше компании обвиняются в нарушении антимонопольных законов США с целью формирования сговора, направленного на снижение ценности услуг, предоставляемых подписчикам платных тарифов.

В исковом заявлении, которое представители истцов требуют считать групповым, сообщается о ключевой фазе координации между ответчиками, которая имела место 12 сентября, когда генеральный директор Anthropic Дарио Амодеи (Dario Amodei) опубликовал своё резонансное эссе, призывающее участников рынка добровольно замедлить развитие ИИ по соображениям общественной безопасности. В тот же день, как отмечается в иске, солидарность с идеями Амодеи выразили руководители OpenAI, SpaceX (xAI) и Google DeepMind.

Истцы даже утверждают, что координация между участниками рынка началась несколько раньше, поскольку ещё в июле некоторые из разработчиков ИИ-моделей призвали правительство США поддержать глобальную инициативу по замедлению разработки ИИ с помощью автоматических систем. Истцы настаивают, что подобные сговоры очевидным образом «окажут неконкурентное влияние на потребителей». При этом они не возражают против индивидуальных решений разработчиков по замедлению ИИ, но считают, что коллективные действия в этом направлении нарушают антимонопольное законодательство. По их мнению, конкурентный рынок позволяет одновременно сочетать ответственное ведение бизнеса с подлинным прогрессом.

Ведущий законный представитель истцов, адвокат Ник Роули (Nick Rowley), заявил: «ИИ быстро выйдет из под контроля людей и может всех нас уничтожить, если мы позволим контролировать протоколы безопасности ИИ частным соглашениям группы самых мощных коммерческих компаний, нацеленных на извлечение прибыли». В своём исходном эссе глава Anthropic Дарио Амодеи призвал правительство США как минимум запустить процесс переговоров между участниками рынка. Глава конкурирующей OpenAI Сэм Альтман (Sam Altman) поддержал идею создания федеральных правил, устанавливающих рамки требований по безопасности ИИ, но заявил, что не считает нужным ждать какого-либо антимонопольного разрешения для начала соответствующей работы.

Истцы в своих требованиях не выступают против возможности ИИ-компаний обратиться к любому из федеральных ведомств США с просьбой разработать правила регулирования отрасли. Они также не возражают против получения участниками рынка одобрения регулирующих органов на координацию своих действий в этой сфере. Президент США Дональд Трамп (Donald Trump) дал понять, что не приветствует идею намеренного замедления развития ИИ, поскольку это может ослабить позиции национальных разработчиков в конкурентной борьбе с китайскими коллегами. Попутно он объявил о намерениях создать национальные «силы ИИ», которые должен будет возглавить некий «царь ИИ», обладающий высоким уровнем интеллекта.


window-new
Soft
Hard
Тренды 🔥
OpenAI выпустила GPT-6 Sol и Luna — они дешевле предшественниц и делают меньше ошибок 47 мин.
«Плачу слезами счастья»: моддер добавил в Dark Souls 2 бесшовный кооператив на шестерых, и фанаты в восторге 3 ч.
Undead Labs спустя восемь лет под контролем Xbox стала независимой — State of Decay 3 всё ещё в разработке и нацелена на 2027 год 4 ч.
Нейрогастарбайтеры: OpenAI уволила сотрудников за использование ИИ при обучении ИИ 4 ч.
Nvidia выпустила драйвер с поддержкой Aion 2, Control Resonant и The Witcher 3: Wild Hunt — Remastered 5 ч.
Blizzard подтвердила, что амбициозный шутер с открытым миром StarCraft не будет эксклюзивом Xbox 5 ч.
ИИ находит множество уязвимостей в ПО, но хакеры не спешат ими пользоваться 6 ч.
Halo у Activision, угроза закрытия разработчиков Hellblade и массовые увольнения: Xbox анонсировала новый этап масштабной реструктуризации 6 ч.
«Новая игра +», упрощённая сложность и улучшения производительности: разработчик The Blood of Dawnwalker подтвердил первое большое обновление 8 ч.
Xiaomi представила флагманскую ИИ-модель MiMo-V2.6 Pro и быструю MiMo-V2.6-Flash 9 ч.
Apple готовит свой аналог Whoop — популярного био-трекера без экрана 42 мин.
Представлен Motorola Signature 27 — первый смартфон на чипе Snapdragon 8 Elite Extreme Gen 6 48 мин.
Основа будущих флагманов: Qualcomm представила мобильные процессоры Snapdragon 8 Elite Gen 6 и Elite Extreme Gen 6 49 мин.
Представлен смартфон Oppo Find X10 с парой 200-Мп камер и версия Find X10 E с 50-Мп трио 5 ч.
Apple представила Beats 360 — первые полноразмерные наушники с возможностью персонализации 5 ч.
Alibaba представила новый ИИ-ускоритель Zhenwu V900 — самый мощный в Китае, и заявила о планах увеличить мощность ЦОД до 20 ГВт 5 ч.
Oppo представила смартфон Find X10 Pro Max с тройкой 200-Мп камер, 2-нм чипом Dimensity 9600 Pro и батареей на 8000 мА·ч 6 ч.
Новый Apple Mac mini поступил в продажу — первые обзоры назвали компьютер великолепным, но слишком дорогим 7 ч.
Apple лишила новые Mac mini возможности апгрейда SSD 7 ч.
Huawei представила ИИ-систему Atlas 960E SuperPoD на базе UnifiedBus и NPO 9 ч.