Сегодня 13 сентября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → иена
Быстрый переход

Глава Anthropic предложил замедлить развитие ИИ, эту идею поддержали Сэм Альтман и Илон Маск

Идея своего рода «модерации» развития искусственного интеллекта начала почти одновременно высказываться разными представителями отрасли после череды инцидентов в сфере информационной безопасности. Глава Anthropic Дарио Амодеи (Dario Amodei) призвал ИИ-стартапы сбавить ход, и эта инициатива предварительно получила одобрение конкурентов в лице OpenAI и SpaceX (xAI).

 Источник изображения: Anthropic

Источник изображения: Anthropic

По крайней мере, идею Амодеи в социальных сетях необычайно быстро поддержали Сэм Альтман (Sam Altman) и Илон Маск (Elon Musk), что не совсем характерно для нынешнего состояния ИИ-отрасли, характеризуемого как острая конкуренция. Альтман, в свою очередь, объяснил необходимостью привести в порядок ситуацию с безопасностью ИИ решение этого стартапа не проводить IPO в 2026 году, а отложить его на более поздний период.

В своей публикации на страницах блога Anthropic Дарио Амодеи предложил трехэтапный план сдерживания темпов развития ИИ без ущерба для коммерческих интересов стартапов или пожертвования лидирующими позициями США в данной сфере. Некоторые из предложенных им мер будут более сложны в реализации, другие окажутся проще, но заняться саморегулированием отрасль будет просто вынуждена.

Во-первых, глава Anthropic предложил предоставить независимым экспертам доступ к внутренним процедурам в сфере безопасности и отчётам об инцидентах. Второй этап предлагает ведущим компаниям стран, считающих себя демократическими, координировать свою работу между собой и разработать общие стандарты безопасности. Третий пункт плана предлагает государствам с разными политическими режимами договариваться между собой в части развития ИИ. Отчасти подобные предложения руководством Anthropic были обнародованы и с целью снижения градуса общественного напряжения, который был поднят откровениями покинувших Anthropic и OpenAI специалистов, обвинивших руководство стартапов в пренебрежении человеческими жизнями.

Амодеи пояснил, что идеи модерации развития ИИ витали в воздухе ещё с 2023 года, но тогда они не были столь актуальными к реализации, поскольку в то время ИИ-модели не были достаточно мощными, чтобы предоставлять серьёзную угрозу человечеству с практической точки зрения. «Я продолжаю верить, что ИИ способен невероятно улучшить качество человеческой жизни. Моё стремление добиться этого не уменьшилось, но данные блага будут достигнуты только в том случае, если мы будем развивать технологию в правильном направлении, и с учётом использования времени для достижения прогресса, следует особо тщательно позаботиться о том, чтобы сделать всё правильно», — признался Амодеи в своём эссе на сайте Anthropic.

При всём этом глава компании настаивает на необходимости выбора оптимального темпа развития, ведь если США будут слишком медлить в развитии ИИ, то геополитические конкуренты могут оказаться впереди. Сара Хек (Sarah Heck), которая в Anthropic отвечает за отношения с общественностью, призвала правительство США подключиться к процессу регулирования отрасли, запретив экспорт передовых чипов в Китай, и принять закон, который требовал бы отбор ИИ-моделей по критерию безопасности с обязательным предварительным тестированием.

Сэм Альтман выразил свою солидарность с мнением Амодеи, пояснив, что и внутри OpenAI подобные дискуссии ведутся уже несколько недель подряд. Он поддержал идею конкурента о предоставлении сторонним экспертам доступа к работе над передовыми ИИ-моделями, выразив готовность реализовать такую меру на стороне OpenAI. Ведущий научный сотрудник компании Якуб Пачоцки (Jacub Pachocki) недавно также призвал игроков рынка к добровольному замедлению темпов развития ИИ до появления общепринятых стандартов безопасности. Илон Маск, который возглавляет вошедший в состав SpaceX стартап xAI, со страниц своей социальной сети X лаконично поддержал главу Anthropic, признав его правоту.

«Я верю, что даже если замедление позволит нам выиграть год или два, прежде чем модели достигнут критического уровня возможностей, и мы используем это время для наведения порядка, мы сможем значительно снизить риск того, что что-то пойдёт серьёзным образом не так», — отметил глава Anthropic.

OpenAI не выйдет на IPO в этом году, поскольку считает момент неподходящим из-за ситуации с безопасностью ИИ

Эту неделю генеральный директор OpenAI Сэм Альтман (Sam Altman) решил завершить довольно важным для судьбы стартапа заявлением, впервые подтвердив официально, что IPO не состоится в этом году. По его словам, торопиться с выходом на биржу не нужно, а сейчас ещё и сложились не самые благоприятные для этого условия, определяемые напряжённостью вокруг вопросов безопасности ИИ.

 Источник изображения: Unsplash, Sollen Feyissa

Источник изображения: Unsplash, Sollen Feyissa

Своими соображениями на этот счёт Альтман поделился в интервью изданию Fortune: «На самом деле я считаю, что с учётом всего происходящего с безопасностью, сейчас не самое подходящее время для выхода на биржу, и мы никакого давления в этом вопросе не испытываем». На IPO компания планирует выйти в момент, когда будет готово и общество, и бизнес. По словам Альтмана, в 2026 году IPO точно не случится, а с точки зрения готовности по критерию безопасности предстоит проделать немало работы, в том числе и на уровне контактов отрасли и правительств.

ИИ-отрасли в последние недели пришлось столкнуться с чередой инцидентов в области информационной безопасности, поскольку появляется всё больше информации о случаях вмешательства ИИ-агентов в инфраструктуру сторонних сайтов при проведении стартапами разного рода экспериментов. Разработчики передовых ИИ-моделей начали говорить о необходимости замедления процесса их совершенствования и усиления мер безопасности. Anthropic даже предложила предоставить к ИИ-моделям доступ сторонним экспертам, чтобы они могли независимо влиять на их развитие. Альтман же предлагает объединить усилия представителей отрасли, чтобы выработать общий план борьбы с проблемами в области безопасности.

В интервью Fortune Альтман признался, что фактически рад появлению необходимости отложить IPO своей компании, поскольку общество должно проработать вопросы безопасности ИИ-моделей буквально на каждом уровне их возможностей. OpenAI готово делать паузы в разработке новых моделей, чтобы на решение таких вопросов было достаточно времени. В идеале, по его словам, к процессу должны подключиться не только все представители ИИ-отрасли, но и правительства разных стран. Именно в этой ситуации необычная корпоративная структура, которая делит полномочия между коммерческим направлением и некоммерческим, должна себя оправдать, поскольку OpenAI придётся принимать решения, которые не пойдут на пользу бизнесу и акционерам стартапа, но в целом будут служить выполнению миссии OpenAI.

Цифровой мозг мухи отправили торговать на криптобиржу

Актуальным технологическим трендом внезапно стали эксперименты с моделированием мозга животных. Инженер криптовалютной платформы Coinbase превратил эмуляцию мозга плодовой мушки в дейтрейдера — трейдера, который открывает и закрывает все позиции в течение одного торгового дня. Проект получил название Stonkfly, опыт транслируется в прямом эфире.

 Источник изображения: stonkfly-three.vercel.app

Источник изображения: stonkfly-three.vercel.app

Проект с открытым исходным кодом включает модель мозга и глаз самца плодовой мушки — ей демонстрируется график с историей цен. Виртуальная муха покупает, продаёт или держит активы, получая вознаграждение за прибыльные сделки. Рост стоимости портфеля вызывает выброс дофамина — сигнала подкрепления для 15 нейронов; убыток активирует два нейрона, связанных с реакцией избегания, причём комиссии за сделки засчитываются как убытки. Механизмы боли или эмоций не задействуется, подчёркивает автор проекта. Виртуальная муха демонстрирует более здравый подход, чем трейдеры-люди: она не пользуется кредитным плечом и короткими позициями, то есть не играет на понижение.

Модель мозга включает 166 700 нейронов и 25,6 млн синаптических связей. Виртуальная муха воспринимает график как изображение размером 320 × 180 пикселей, проецируемое на левый и правый глаза с перекрывающейся центральной областью. На симуляции фоторецепторов подаются значения RGB-пикселей, а не сами данные о ценах. По умолчанию муха «думает» и совершает действия каждые 500 мс, данные по рынку обновляются каждые 60 с, сумма ставки ограничена $10, установлен лимит не более 24 сделок в сутки.

Автор подчёркивает, что проект не доказывает ничего, кроме наличия связи между входными сигналами, визуальными стимулами и изменениями в синапсах. И предостерегает от выводов о том, что муха может быть трейдером: сейчас криптовалюта пошла в рост, и успех может сопутствовать даже новичку. Симулятор запускается под Apple macOS или Linux, в среди системных требований значатся 16 Гбайт оперативной памяти, Python 3.11 и компилятор C++ 17. По умолчанию торговля идёт на виртуальной площадке с начальным балансом в $100, но опирается на данные реального рынка в паре BTC/USDC. Есть и инструкции по настройке реального торгового счета.

Apple разработала ИИ-модель SimpleDesign для проектирования белков

Исследователи Apple рассказали о модели искусственного интеллекта SimpleDesign, которая умеет одновременно генерировать последовательности аминокислот и пространственные структуры белков. Она устроена более прямолинейно, чем знаменитая DeepMind AlphaFold.

 Источник изображения: National Institute of Allergy and Infectious Diseases / unsplash.com

Источник изображения: National Institute of Allergy and Infectious Diseases / unsplash.com

Основу проекта в минувшем году заложила модель Apple SimpleFold, основанная на методе сопоставления потоков (flow matching) — она генерировала трёхмерную структуру белка на основе известной последовательности аминокислот. Суть метода в том, что процесс начинается от случайного зашумлённого состояния, и модель учится находить относительно прямой путь к конечному результату. Это роднит его с используемыми генераторами изображений диффуизионными моделями, которые в несколько итераций удаляют шум до получения итогового результата. Исследователи Apple объединили метод сопоставления потоков с универсальными блоками архитектуры трансформера, который применяется в генерации текста.

Опробованный в проекте SimpleFold принцип инженеры применили к более широкой задаче о проектировании белков, а не просто к прогнозированию их трёхмерной структуры — так появилась модель SimpleDesign. Многие современные системы проектирования белков включают два этапа: сначала обучается ИИ-модель для преобразования белковых структур в дискретные представления — токены. Затем обучается генеративная модель, которая использует эти представления для создания новых последовательностей и структур белков. В SimpleDesign схему упростили, обучив модель непосредственно на парах «последовательность аминокислот — трёхмерные координаты», опустив разложение белковых структур на токены.

 Источник изображения: Apple

Источник изображения: Apple

За основу взяли более 2 млрд пар «последовательность — структура» белка, полученных преимущественно из набора данных AFESM, в котором объединены структуры из базы AlphaFold и дополнительные образцы. В процессе обучения исследователи вносили искажения в обе части каждой пары: аминокислоты в последовательности случайным образом заменяли маскирующими токенами, а в соответствующую трёхмерную структуру добавляли шум. Степени искажения варьировались. Если последовательность аминокислот оставалась почти нетронутой, а структура белка сильно искажалась, это была задача на восстановление трёхмерной структуры. И наоборот, если структура сохранялась, а последовательность в значительной степени оказывалась скрыта масками, задача имела обратный характер. В случаях, когда искажениям подвергались оба компонента сразу, модель училась решать две задачи одновременно, то есть готовилась к параллельному проектированию белков.

В тестах SimpleDesign показала конкурентоспособные результаты при решении задач на проектирование белков, восстановление их структур и последовательностей аминокислот. Модель генерирует правдоподобные структуры, а последовательности аминокислот зачастую не уступают, а то и превосходят результаты большинства конкурирующих мультимодальных моделей. Подчёркивается, что результаты работы SimpleDesign пока ограничены только компьютерным анализом — сгенерированные белки не проходили экспериментальную проверку, которая подтвердила бы их способность сворачиваться, функционировать и вести себя, как было предсказано. Но учёные считают результаты многообещающими.

ИИ-гигастройка обходится Oracle слишком дорого — компания потратит ещё $700 млн на увольнения сотрудников

Oracle увеличила бюджет на сокращение штата из-за высокой стоимости строительства дата-центров для искусственного интеллекта. По сообщению Bloomberg, расходы на реструктуризацию выросли на $700 млн и достигли $2,8 млрд.

 Источник изображения: BoliviaInteligente/Unsplash

Источник изображения: BoliviaInteligente/Unsplash

Компания испытывает финансовое давление, так как развёртывание ИИ-инфраструктуры для таких клиентов, как OpenAI требует значительных вложений. Для экономии средств Oracle уже провела в этом году серию увольнений, снизив к концу мая численность персонала на 21 тысячу человек по сравнению с аналогичным периодом прошлого года. В итоге численность составила 49 тысяч сотрудников в США и 92 тысячи за рубежом.

Основная часть расходов в $2,8 млрд пойдёт на выплату выходных пособий. Финансовый директор Хилари Максон (Hilary Maxson) заявила, что меры по реструктуризации бизнеса и повышения эффективности необходимы для защиты маржинальности компании и являются частью официального плана на 2026 год.

Параллельно Oracle разрешила председателю совета директоров Ларри Эллисону (Larry Ellison) продать до 50 миллионов акций. Пакет стоимостью около $8,75 млрд можно реализовать до 24 октября. На момент закрытия торгов 22 июня стоимость акции составляла $175,07, однако с тех пор и до закрытия торгов вчера в пятницу котировки снизились на 16 %.

Эллисон, владеющий 40 % компании, также выступает ключевым инвестором в сделках своего сына Дэвида Эллисона (David Ellison). Речь идёт о поглощении Paramount Global и заявке на покупку Warner Bros. Discovery (WBD) за $110 млрд.

За два месяца до скандального взлома Hugging Face ИИ-агенты OpenAI атаковали RubyGems

Агенты искусственного интеллекта OpenAI в ходе тестирования произвели атаку на сервис RubyGems — это произошло за два месяца до нашумевшего взлома Hugging Face, который стал лишь самым крупным инцидентом в серии.

 Источник изображения: Brecht Corbeel / unsplash.com

Источник изображения: Brecht Corbeel / unsplash.com

По данным группы исследователей, 11 мая некие ИИ-агенты загрузили на RubyGems несколько сотен вредоносных пакетов — авторы исследования полагают, что «они были созданы внутренними агентами OpenAI». В компании факт инцидента отрицать не стали. «Согласно результатам проведённой нами проверки, наши агенты использовали платформу RubyGems для выхода в интернет, чтобы выполнить несколько безобидных задач и получить общедоступную информацию. Мы продолжим расследование в рамках масштабного анализа активности агентов во время обучения и оценки», — сообщили в OpenAI.

Агенты, которым обычно поручают такие задачи как составление отчётов или заполнение электронных таблиц в ходе обучающего эксперимента, предположительно, использовали RubyGems для получения общедоступных данных; в ходе анализа инцидента компания взаимодействует с представителями платформы. В мае ИИ-агенты пытались похитить учётные данные пользователей RubyGems, эксплуатируя не выявленную ранее уязвимость на серверах сайта; установить, увенчалась ли попытка успехом, не удалось.

Агенты также использовали сервис RubyDoc.info, предназначенный для создания документации к коду, чтобы запустить собственный код на его серверах. Исследователям не удалось выяснить причины выбора такой стратегии и установить степень её эффективности, потому что доступа к полному набору данных о поведении ИИ-систем у них нет. В RubyGems заявили, что выявить доказательства того, что попытки взлома увенчались успехом, не удалось. Не получилось и определить, были ли задействованные в «кампании по массовой публикации спама» пакеты созданы или опубликованы ИИ-агентами. Однако в мае представитель отдела безопасности RubyGems охарактеризовал инцидент как «масштабную вредоносную атаку» — тогда платформе пришлось временно приостановить регистрацию новых учётных записей.

Anthropic спрогнозировала три сценария развития ИИ — от умеренного роста экономики до массовой безработицы

Американская лаборатория искусственного интеллекта Anthropic предложила три модели влияния технологий ИИ на экономику США к 2030 году: «сдержанную», «существенную» и «экстремальную». В последнем случае экономику и рынок труда ждут радикальные перемены.

 Источник изображения: anthropic.com

Источник изображения: anthropic.com

Воплощение любого из сценариев на практике будет зависеть от развития возможностей ИИ и механизмов его внедрения. При «сдержанном» сценарии роста ИИ оказывает на экономику примерно такое же влияние, как интернет: обеспечиваются реальные экономические выгоды, создаются новые продукты и услуги, некоторые отрасли меняются, но радикального влияния на экономику не происходит. Инновации внедряются на уровне исторических темпов развития всех новых технологий.

«Существенный» сценарий предполагает, что к 2030 году ИИ принимает на себя половину всей выполняемой человеком умственной работы. Он ещё не внедряется повсеместно, но по большей мере действует в автономном режиме. Большинство рабочих задач выполняется «по старинке», без привлечения ИИ. В результате темпы роста ВВП США удваиваются: с 2–2,5 % до 4–5 % в год.

«Экстремальная» модель исходит из того, что в подавляющем большинстве задач умственного труда ИИ превосходит человека и заменяет его, действуя в автономном режиме, и у человека почти не появляется новых задач. ВВП США начинает расти со скоростью 15 % в год, то есть через 4,5 года удваивается. При таком сценарии американцы в целом богатеют, но число работников умственного труда сокращается, и безработица выходит на беспрецедентный уровень, потому что программистам и другим специалистам придётся сменить сферу деятельности, а найти новую работу станет значительно труднее.

В августе Anthropic провела опрос, и большинство респондентов предсказало к 2030 году развитие событий по «существенной» модели: К 2030 году ВВП станет на 10 % выше, чем был бы без ИИ, а показатель безработицы достигнет примерно 5 %. И ещё 10 % опрошенных склоняются к «экстремальному» сценарию.

25 лауреатов Филдсовской премии забили тревогу из-за успехов ИИ в математике

Участие искусственного интеллекта в математической науке создаёт угрозу для научного знания и математического сообщества, говорится в открытом письме, подписанном 25 лауреатами Филдсовской премии — самой престижной награды в математике.

 Источник изображения: Saad Ahmad / unsplash.com

Источник изображения: Saad Ahmad / unsplash.com

Проблема в том, указывают учёные, что цели ИИ-лабораторий и математического сообщества расходятся. Для разработчиков решение известных задач — это возможность продемонстрировать возможности ИИ; математики же воспринимают его как средство получения новых знаний и методов — основной целью «являются концептуальное понимание и новые идеи». Ранее решение известных задач было сопряжено с длительным изучением новых идей и методов — результаты решений обсуждались, упрощались и соотносились с предыдущими исследованиями, после чего они попадали в учебники и использовались в других областях знаний. С ИИ эта экосистема человеческих знаний разрушается: результаты публикуются в спешке без соответствующего оформления, указания на новые методы и связи с работами других учёных.

Возникают новые вопросы об авторстве и плагиате: чтобы созданные ИИ идеи в полной мере воплощались, требуется участие членов математического сообщества, способных эти идеи развить и интегрировать в сложившуюся систему знаний. ИИ действительно способен ускорить исследования в области математики, но фактическая польза для человечества будет зависеть от людей, которые управляют этой технологией.

На этой неделе OpenAI сообщила о решении проблемы существования гладкости решений уравнений Навье — Стокса; проверка и формализация результата заняли у внутренней модели компании ещё 17 часов. Впоследствии профессор математики Нью-Йоркского университета заподозрил OpenAI в использовании наработок, принадлежащих ему и его коллеге, который работает в Anthropic. OpenAI не смогла ни опровергнуть подозрения учёных, ни предложить им компромиссного решения.

«Яндекс» сделал открытой ИИ-модель, на которой основаны быстрые ответы в её поисковике

«Яндекс» опубликовала в открытом доступе обученную с нуля собственную модель искусственного интеллекта Alice AI Search Pretrain, которая составила основу службы быстрых ответов в поиске.

 Источник изображения: yandex.ru/company

Источник изображения: yandex.ru/company

Компактная языковая модель Alice AI Search Pretrain прошла первый этап обучения и располагает большим объёмом знаний о мире. Компактные размеры позволяют ей обходиться скромными вычислительными мощностями, выдерживать значительную нагрузку и обрабатывать большие объёмы документов.

Гибридная архитектура модели ранее применялась преимущественно в научных исследованиях: в ней используются технологии Encoder-Decoder и MoE (Mixture of Experts). Первая помогает ей отвечать ёмко и лаконично за счёт того, что одна часть модели ищет информацию, а другая составляет ответ. Вторая технология позволяет ей обходиться только теми собственными фрагментами, которые наиболее соответствуют теме запроса: при размере 35 млрд параметров для обработки одного токена подключаются только 600 млн — менее 2 % от общего объёма.

Разработанная «Яндексом» Alice AI Search Pretrain превосходит другие языковые модели небольшого размера: замеры методом слепого тестирования показали, что качество её ответов выше, чем у Alibaba Qwen 3.5 2B и 4B и Google T5 Gemma 2 4B-4B Base, — она отвечает примерно на уровне более требовательной к вычислительным ресурсам Qwen 3.5 35B-A3B. В «Яндекс Поиске» работает прошедшая дополнительное обучение версия этой модели Alice AI Search — в её подготовке учтены реальные примеры взаимодействия пользователей поисковой службы.

«Не люблю, когда мне лезут в душу»: Meta✴ изменила алгоритм своего чат-бота после жалоб на бестактные личные вопросы

Компания Meta✴ была вынуждена внести коррективы в алгоритмы подсказок своего чат-бота, так как искусственный интеллект стал чересчур интересоваться частной жизнью пользователей. Недавно в Сети распространилось видео, демонстрирующее, как чат-бот пытается выяснить личную информацию о маленьких детях. Компания признала, что «допустила ошибку» и «эта функция не должна была предлагать пользователю подобные вопросы».

 Источник изображений: unsplash.com

Источник изображений: unsplash.com

На прошлой неделе пользователь Instagram✴ Кейли Робинс (Kalie Robins) рассказала, как ИИ-помощник Meta✴ начал бестактно выведывать информацию о её детях. Она разместила в Facebook✴ видео, где вместе с ребёнком поёт в машине, после чего под видео появился запрос от ИИ: «Кто этот ребёнок-пассажир?». По словам Робинс, чат-бот Meta✴ сопоставил информацию о её дочерях из её собственных прошлых публикаций и постов её родственников. Система стала задавать дополнительные вопросы, касающиеся возраста детей и места жительства её семьи. Кроме того, как утверждает Робинс, Meta✴ AI показал фотографии её дочерей, ранее размещённые на платформе, включая снимок, который она удалила много лет назад.

Представитель Meta✴ Дина Эль-Кассаби (Dina El-Kassaby) заявила, что проблема, из-за которой чат-бот Meta✴ задавал вопросы на слишком личные темы, уже устранена: «Мы создали эту функцию, чтобы помочь людям получать больше информации о темах или публикациях, которые их интересуют. Когда пользователь нажимает на подсказку и использует эту функцию, сгенерированный ответ основывается на информации, к которой у пользователя уже есть доступ».

Meta✴ интегрировала своего ИИ-помощника в Facebook✴, Instagram✴, WhatsApp и Messenger. Он способен отвечать на вопросы, писать посты и генерировать изображения. В июле компания отказалась от функции, позволявшей создавать ИИ-дипфейки других пользователей Instagram✴, после того как столкнулась с резкой критикой.

OpenAI ускорит научные исследования с помощью ИИ — первый «исследователь-стажёр» появится уже в сентябре

OpenAI подтвердила, что проект по созданию полностью автоматизированного исследователя с искусственным интеллектом идёт по графику: до конца текущего месяца будет выпущен «исследователь-стажёр». Этот «стажёр», способный выполнять исследовательские задачи по поручению человека, является важным этапом на пути к созданию полностью автоматизированной системы, которую OpenAI планирует представить в марте 2028 года.

 Источник изображения: Mariia Berezovsky / unsplash.com

Источник изображения: Mariia Berezovsky / unsplash.com

ИИ-стажёр способен выполнять задачи, на решение которых у человека ушли бы несколько дней. Обосновывая разработку этого приложения, OpenAI указывает на снижение стоимости технологий ИИ и необходимость обеспечить защиту критически важной инфраструктуры от угроз, которые исходят от мощных систем ИИ. Она могла бы не обнародовать эти соображения, если бы не инцидент со взломом Hugging Face.

О работе по созданию ИИ-исследователя глава OpenAI Сэм Альтман (Sam Altman) объявил в октябре 2025 года. «Считаем вполне вероятным, что к сентябрю будущего года у нас появится ИИ-ассистент исследователя уровня стажёра, а к марту 2028 года — полноценный ИИ-исследователь», — рассказал тогда он. Говоря о текущем состоянии проекта, OpenAI пояснила, что под «исследователем-стажёром» понимается «система, способная выполнять чётко определённые исследовательские задачи под руководством человека, в том числе такие, выполнение которых заняло бы у квалифицированного исследователя несколько дней. <..> Исследовательская деятельность с ИИ — это сложный процесс со множеством возможных узких мест, <..> а агентные инструменты существенно ускоряют прогресс в исследованиях».

OpenAI выступила против использования механизма рекурсивного самосовершенствования при исследованиях с помощью ИИ, отмечая, что обеспечить безопасность такого процесса на данном этапе развития технологий невозможно. Компания отмечает, что «исследования с использованием ИИ-агентов — новое направление, и мы всё ещё учимся оценивать их результаты»; а также указывает, что появление ИИ-агентов в исследовательской области может значительно изменить её, когда разработка системы завершится.

Xiaomi выпустила ИИ-модель CocktailASR-1 для распознавания речи в шумных помещениях

Xiaomi представила открытую модель искусственного интеллекта CocktailASR-1. Она предназначена для решения одной из наиболее сложных задач в области расшифровки аудио — выделения голоса конкретного человека в ситуации, когда несколько людей говорят одновременно.

 Источник изображения: Xiaomi

Источник изображения: Xiaomi

В Xiaomi проблему условно обозначили как «эффект коктейльной вечеринки». Большинство специализированных ИИ-моделей справляются с распознаванием речи, когда говорит один человек, но если друг на друга накладываются несколько голосов, ситуация значительно усложняется. Текст искажается, предложения сливаются, а реплики приписываются не тем собеседникам. В обратном направлении компания решила эту задачу с моделью OmniVoice — CocktailASR-1 же не генерирует, а выделяет и расшифровывает речь. Для работы с моделью необходимо представить короткий образец с голосом нужного человека. Она использует его как эталон, а затем, проанализировав запись с несколькими участниками, распознает и расшифрует речь только этого человека.

В ряде тестов по распознаванию речи в условиях многоголосных образцов она, отметили в Xiaomi, продемонстрировала ведущие результаты и превзошла существующие аналоги, предназначенные для решения той же задачи. Сложными условиями её возможности не исчерпываются — она умеет расшифровывать речь и в том случае, когда на записи голос только одного человека. Она также умеет избегать необоснованных предположений: если в предложенной записи указанный в качестве образца голос отсутствует, она выдаст пустой текст и не будет пытаться расшифровать слова другого человека.

Наконец, у Xiaomi CocktailASR-1 есть режим цепочки рассуждений — он позволяет пользователям изучать логику, на основе которой выполнялась расшифровка, а не просто видеть итоговый текст. Новая модель доступна на GitHub и Hugging Face.

Цукерберг хотел плоскую Meta✴, но ИИ всё изменил — пониженных сотрудников возвращают на руководящие должности

Meta✴ частично отказалась от курса на создание подразделений с «плоской» структурой при минимальном числе руководящих работников: некоторым сотрудникам отдела прикладного искусственного интеллекта (Applied AI) было предложено перейти с позиций рядовых специалистов обратно на руководящие должности.

 Источник изображения: Mark Zuckerberg

Источник изображения: Mark Zuckerberg

Компания предложила сотрудникам стать менеджерами на добровольной основе, без принуждения, сообщает Business Insider. Официальных комментариев от Meta✴ по данному вопросу не последовало, и нет ясности, как отразится отказ на тех, кто не захочет менять статус. В созданное в этом году подразделение перевели около 7000 человек. Часть работников, которые ранее занимали руководящие посты, при переводе в отдел прикладного ИИ заняли позиции рядовых специалистов. Многие почувствовали себя так, будто их «мобилизовали» в новое подразделение, то есть в компании образовалось внутреннее напряжение.

Курс на сокращение руководящих сотрудников Meta✴ взяла в 2023 году, который глава компании Марк Цукерберг (Mark Zuckerberg) объявил «годом эффективности»; он также пояснил, что «плоская» организационная структура поможет компании действовать более гибко и быстрее адаптироваться к переменам. В этом году Meta✴ намерена потратить более $130 млрд на оборудование и инфраструктуру для ИИ, и потребность в традиционных моделях управления, вероятно, возникла из-за роста отдела прикладного ИИ.

Но инициированная некогда господином Цукербергом программа повышения эффективности, предусматривающая сокращение управленческого звена, видимо, продолжает действовать в других направлениях бизнеса, а набор новых менеджеров затрагивает только отдел прикладного ИИ. Процесс запуска нового ИИ-отдела в Meta✴ был организован «безобразно», признал ранее технический директор компании Эндрю Босворт (Andrew Bosworth) и пообещал при проведении будущих изменений более качественную коммуникацию с сотрудниками.

OpenAI научила ИИ говорить и слушать одновременно — полнодуплексная модель GPT-Live-1 доступна разработчикам

OpenAI открыла через API доступ к новейшей голосовой модели искусственного интеллекта, поддерживающей полнодуплексный режим, то есть она может одновременно говорить и слушать. Это позволяет разработчикам создавать голосовые приложения с новыми сценариями диалогового взаимодействия.

 Источник изображения: Brecht Corbeel / unsplash.com

Источник изображения: Brecht Corbeel / unsplash.com

Модель OpenAI GPT-Live-1 была анонсирована в июле — она позволяет вводить запросы не текстом, а голосом. Первоначально она была доступна только через интерфейс ChatGPT, а теперь может использоваться по API. Полнодуплексный режим позволяет GPT-Live-1 одновременно слушать и генерировать речь, что делает общение более естественным. В обычном разговоре люди часто говорят одновременно, и необходимость строго соблюдать очерёдность, как при полудуплексной радиосвязи, может вызывать раздражение.

Особое внимание в OpenAI уделили возможностям настройки модели: внедряющие GPT-Live-1 разработчики могут адаптировать механизмы голосового взаимодействия и связанные с ними рабочие сценарии под нужды пользователей приложений. «Основное преимущество GPT-Live-1 — способность штатно обрабатывать ситуации, когда собеседник перебивает ИИ, — уже приносит бизнесу ощутимую пользу: в ходе предварительного тестирования сервис Speak установил, что GPT-Live-1 даёт ученикам больше времени перед ответом виртуального преподавателя языка, сократив случаи с перебиванием на 80 % по сравнению с предыдущими системами, работающими в режиме строгой очерёдности реплик», — рассказали в OpenAI.

GPT-Live-1 предназначается для ведения устного диалога, в то время как модель в бэкенде, например, флагманская GPT-6 Astra или более экономичная для простых задач, занимается поиском информации, работает с инструментами и управляет задачами. Новая модель представляет собой шаг вперёд по сравнению с выпущенной в 2024 году Realtime. В тесте Tau3, который оценивает интеллектуальные возможности голосовых агентов при выполнении задач по обслуживанию клиентов, GPT-Live-1 набрала 86,2 %, а GPT-Realtime-2.1 и GPT-Realtime-2 показали 45,7 % и 42,4 % соответственно. Новая модель, по собственным оценкам OpenAI, демонстрирует на 30 % более высокую эффективность в тесте Full Duplex Bench по сравнению с GPT-Realtime-2.1, превосходя предшественницу по таким параметрам как задержка при смене говорящего и качество интерактивного взаимодействия. Её уже внедрили на сервисе Yelp Host — теперь бронирование столиков стало более естественным.

Стоимость работы с GPT-Live-1 составляет $0,05 за минуту плюс затраты на работу модели в бэкенде. Она также доступна через OpenAI Presence — корпоративную платформу для создания интеллектуальных агентов.

Google выпустила приложение Gemini для Windows

Google объявила о выпуске приложения помощника с искусственным интеллектом Gemini для Windows. Оно выступает дополнением к привычным для пользователей рабочим инструментам и повседневным программам, предлагая быструю помощь по разным вопросам без отрыва от работы.

Предусмотрен быстрый запуск приложения Gemini поверх активного окна по нажатию сочетания клавиш Alt + Space. Если, например, требуется быстро проверить факты в документе или придумать заголовки к слайдам в презентации, пользователь может получить необходимую помощь в оперативном режиме и быстро вернуться к работе.

Доступны функции работы над задачами в выделенном рабочем пространстве. В приложении есть все привычные для опытных пользователей функции Gemini: задачи можно поручить доступному круглосуточно ИИ-агенту Gemini Spark, который доступен, правда, только платным подписчикам. ИИ-помощник может составить черновую сводку материалов проекта, проанализировав информацию в сервисах Google, в том числе Gmail и «Google Диск».

Через приложение можно генерировать изображения для презентаций с помощью модели Nano Banana, а также создавать видеоролики при помощи подключённой к платформе Gemini Omni. Приложение Gemini для Windows, заверили в Google, работает незаметно и не замедляет работу компьютера. Со временем разработчик будет добавлять в него новые функции, свойственные полноценным десктопным приложениям. Оно совместимо с Windows 10 и 11.


window-new
Soft
Hard
Тренды 🔥
Первого октября: Tesla запустила отсчёт до анонса второго поколения Roadster 11 ч.
Техногиганты в этом году успели сократить 128 000 сотрудников: больше, чем за весь прошлый год 12 ч.
США жертвуют экологией ради ИИ: администрация Трампа ослабила требования — это может затронуть миллионы людей 22 ч.
NewPhotonics представила оптический движок NPC50506 на 6,4 Тбит/с с интегрированным лазером 23 ч.
ASUS выпустила СХД высокой плотности OJ340A-RS60 на базе AMD EPYC Genoa 23 ч.
Asus представила монитор ProArt Display OLED PA27UCDV для профессионалов 12-09 18:10
Biostar внезапно начала продвигать видеокарту GeForce GT 730 на чипе из 2014 года 12-09 17:23
Утекли характеристики Lenovo Googlebook 15 — он не сможет быть дешёвым 12-09 12:06
ИИ-гигастройка обходится Oracle слишком дорого — компания потратит ещё $700 млн на увольнения сотрудников 12-09 12:04
Apple вернулась в десятку лучших компаний мира по версии Time, но лишь на третье место — лидирует Nvidia 12-09 10:51