Сегодня 07 октября 2026
18+
MWC 2018 2018 Computex IFA 2018
реклама
Теги → генератор
Быстрый переход

Google тихо обновила Nano Banana — новая версия 2.1 лучше работает с текстом, персонажами и панорамами

Предназначенная для генерации изображений модель искусственного интеллекта Google Nano Banana обновилась до версии 2.1. Она получила ряд новых возможностей по сравнению с Nano Banana 2.0, которая дебютировала ещё в феврале и уже тогда позволяла генерировать картинки в разрешении вплоть до 4K.

 Источник изображения: blog.google

Источник изображения: blog.google

Google не стала делать громких анонсов Nano Banana 2.1 и объявила о выпуске обновлённого генератора изображений в соцсетях. Модель превосходит предыдущую версию по всем параметрам, заверили в компании. Отмечаются улучшения в визуальном оформлении, редактировании с использованием масок и сохранении согласованности объектов. Более подробную информацию компания привела на сайте для разработчиков Gemini:

  • повысились качество и реалистичность при выходном разрешении 1K, 2K и 4K; по умолчанию — 1K;
  • устранены артефакты стыковки при широких и панорамных форматах кадра (1:4, 4:1, 1:8, 8:1) в разрешениях 2K и 4K;
  • повысились качество изображения текста и точность компоновки при работе с инфографикой;
  • функция объединения нескольких изображений получила поддержку до 14 референсных снимков — сохранение характеристик до 4 персонажей и точность воспроизведения до 10 объектов;
  • привязка к данным из веб-поиска и поиска по изображениям в Google;
  • доступны три уровня рассуждений — минимальный, средний (по умолчанию) и высокий.

Обновлённый генератор изображений Nano Banana 2.1 выступает как более эффективный аналог Nano Banana Pro, отметили в Google. Развёртывание новой модели уже стартовало в сервисах Google — в их число вошли Gemini, ИИ-режим в поиске, Google Flow, Stitch by Google, Google Ads и Gemini Enterprise Platform.

Учёные создали обои, которые вырабатывают электричество — их уже хватило на беспроводную клавиатуру

Учёные Бингемптонского университета (США) предложили альтернативу солнечным панелям на крышах домов — электроэнергию можно вырабатывать и внутри самого дома. В новой работе они описали технологию преобразования влажности воздуха в помещении в слабый электрический ток.

 Источник изображений: binghamton.edu

Источник изображений: binghamton.edu

Гигроэлектрические генераторы преобразуют влажность воздуха в электричество — до настоящего момента они использовались на открытом воздухе, вырабатывая микроватты энергии на квадратный сантиметр. Сложности для работы таких установок создают нестабильные погодные условия — ветер, колебания влажности и температуры воздуха. В этом плане условия внутри помещений обладают преимуществом: там поддерживается относительно постоянный уровень влажности — от 30 до 60 %, — и дополнительную влагу создаёт повседневная деятельность жильцов, такая как дыхание, приготовление пищи и водные процедуры.

Способные генерировать электричество обои создали на основе лабораторной бумаги Whatman 3 MM толщиной 340 мкм; соединения скрытно проложили с тыльной стороны. Две стороны листа соединяются через отверстия диаметром 1 мм — они прорезаются лазером и заполняются серебряной краской. Производственный процесс предполагает восковую и трафаретную печать, распыление вещества и лазерную обработку — условия «чистой комнаты» не требуются. Учёные стремятся к тому, чтобы все компоненты можно было изготавливать пригодным для массового производства методом печати.

Обои состоят из бумажных квадратов размером 2 × 2 см, каждый из которых поделён на три зоны. На край нанесена глицериносодержащая смесь — глицерин поглощает из воздуха водяной пар и превращает его в жидкую воду внутри бумаги. В средней зоне находится полимерный материал поливинилпирролидон (ПВП) — он имеет мелкие поры и прочнее удерживает воду, за счёт чего капиллярный эффект помогает затянуть влагу внутрь. А центральная часть обработана воском — он отталкивает жидкую воду, но сохраняет микроскопические поры, позволяя пару выходить наружу.

Химия в составе глицерина, целлюлозы и ПВП способствует высвобождению протонов (ионов водорода) из молекул воды. По краям таких скоплений образуется больше, в результате чего возникает электрический ток, который принимают графитовые электроды. Выходные показатели пока невелики: один элемент выдал напряжение около 0,34 В при влажности 80 %, а цепь из десяти элементов — около 2,9 В. Массив из 35 элементов обеспечил работу датчика влажности в течение примерно 15 минут, а самый крупный массив из 1596 элементов выдал 3,5 В при влажности около 38 %. Этого хватило для питания беспроводной клавиатуры на конденсаторе — итоговая величина мощности для настенной конфигурации не приводится.

Предложенный учёными материал работает и как буфер влажности, поглощая влагу и отдавая её обратно. В герметичной камере 30 × 30 × 15 см 28 элементов за четыре минуты снизили влажность с 75 до 50 %. Насыщенная водой бумага повысила влажность сухого воздуха с 15 до 20 % за 16 минут. В обычном помещении большой массив за 15 минут снизил влажность с 38 до 32 %.

Пока исследователям достаточно лишь подтвердить концепцию технологии. Реалистичная цель — обеспечить питание сенсоров, беспроводных модулей и устройств интернета вещей, а не заменить электросеть или солнечные панели. Если материал окажется достаточно долговечным, стена станет автономным датчиком, способным следить за состоянием воздуха в помещении.

OpenAI представила генератор изображений ChatGPT Images 2.5 с упором на редактирование

OpenAI представила обновлённый вариант генератора изображений ChatGPT Images 2.5 — в этой версии разработчик сделал упор не на способности модели рисовать красивую картинку, а на точности выполнения запросов пользователя при редактировании существующих.

 Источник изображений: openai.com

Источник изображений: openai.com

При загрузке исходной фотографии в качестве образца модель OpenAI ChatGPT Images 2.5 стала лучше сохранять идентичность ключевого объекта, например, человека, если нужно изменить стиль или сцену изображения. Повысилась точность выполнения инструкций: при редактировании модель эффективнее изменяет только те аспекты изображения, на которые указывает пользователь, не трогая остальных — это могут быть фон, предмет гардероба или надпись. Особенно важной новая возможность представляется при редактировании за несколько шагов — больше не придётся беспокоиться, что на одном из этапов лицо человека изменится, или действия предыдущего этапа будут сведены на нет на последующем.

Повысилась скорость работы: по сравнению с предшественницей OpenAI ChatGPT Images 2.5 может экономить до 50 % времени при выполнении запроса. Модель стала более восприимчивой к сложным запросам — она лучше обрабатывает описания композиций, текст, прозрачный фон и визуальные стили. При экспорте изображения можно быстро опубликовать не только саму картинку, но и соответствующий ей запрос, благодаря чему другие пользователи сервиса могут попытаться добиться того же результата со своим исходным изображением. Важным нововведением стала функция «Набросок» (Sketch): теперь прямо в интерфейсе ChatGPT можно от руки изобразить примерную схему того, что должно получиться на выходе — это пригодится, когда описать пространственную композицию словами оказывается непросто. Полезной окажется и функция шаблонов для типовых задач при генерации постеров или маркетинговых материалов.

Генератор изображений OpenAI ChatGPT Images 2.5 доступен на платформах ChatGPT, ChatGPT Work и Codex в десктопных и мобильных приложениях, а также в веб-интерфейсе и через API. Модель доступна в двух вариантах: в более простом и универсальном GPT-Image-2.5 Flare, который подойдёт для большинства задач; а также в медленном GPT-Image-2.5 Sunburst, который предлагает максимальный контроль и высокую точность редактирования. При генерации к картинкам добавляются невидимые «водяные знаки» и метаданные C2PA — маркировка обеспечивает прозрачность для созданных или отредактированных с помощью ИИ изображений.

Запущен Google Pics — графический ИИ-редактор, который бросает вызов Canva

Компания Google запустила новый инструмент для создания и редактирования изображений под названием Google Pics, который будет включён в пакет Google Workspace для бизнес-клиентов, а также доступен пользователям премиум-подписок Google AI Pro и Ultra.

 Источник изображения: Google

Источник изображения: Google

Представив Google Pics в мае, компания пообещала предоставить доступ к нему подписчикам тарифов Google AI Pro и Ultra в течение лета. И сдержала обещание, также сделав его доступным клиентам тарифов Business Standard, Business Plus, Enterprise Standard и Enterprise Plus. С сегодняшнего дня доступ к нему получили пользователи Google AI Pro for Education — как раз к началу нового учебного года.

Сообщается, что инструмент основан на модели генерации изображений Google Nano Banana. Подобно таким инструментам, как Adobe Express и Canva, новый продукт Google предназначен для повседневных задач дизайна. Например, его можно использовать для создания плакатов, постов в социальных сетях и других визуальных материалов и иллюстраций. Как и в других подобных приложениях, для создания изображений достаточно ввести текстовый запрос или загрузить уже имеющуюся картинку в качестве основы. «Pics сгенерирует то, что вы опишете, и даже предложит полезные варианты на основе вашего запроса», — сообщили в Google.

В отличие от Adobe Express, с инструментом Google Pics пользователь инициирует процесс создания изображения, а не разрабатывает его с нуля.

Приложение Google Pics также включает другие инструменты редактирования, например для выделения и преобразования объектов, изменения или перевода текста внутри изображений (на момент запуска поддерживается 29 языков) и т. д. Кроме того, оно поддерживает совместное редактирование и позволяет создавать несколько разных версий изображения на основе промптов, чтобы пользователь мог выбрать наилучшую.

С сегодняшнего дня Google Pics включён в Docs и Slides, затем наступит очередь Google Drive.

Следующая жертва ИИ — актёры: в Китае их массово заменяют цифровыми двойниками

Стремительно развивающаяся ИИ-отрасль стала угрозой для китайских актёров и онлайн-инфлюенсеров, пишет The Financial Times. Современные модели генерации видео, такие как Seedance 2.0 компании ByteDance, позволяют заменять людей цифровыми актёрами, значительно сокращая стоимость и сроки производства видеоконтента.

 Источник изображения: Jackson Sophat/unsplash.com

Источник изображения: Jackson Sophat/unsplash.com

По словам Грега Воллнера (Greg Wollner), актёра и продюсера короткометражных драм из Пекина, ситуация резко изменилась после выхода Seedance 2.0. До этого он снимался в трёх разных проектах в неделю, а после появления новой ИИ-модели «всё пошло наперекосяк». Многие друзья Воллнера «были вынуждены бросить то, что любят, и заняться чем-то другим», рассказал он. В мае, по данным аналитической компании DataEye, 89 из 100 самых популярных анимационных драм на Douyin, китайской версии TikTok от ByteDance, были созданы с помощью ИИ.

Китайская ассоциация сетевых аудиовизуальных услуг сообщила, что в I квартале 2026 года в стране было выпущено около 128 тыс. короткометражных сериалов — более чем втрое больше, чем за весь предыдущий год. При этом 95 % из них были созданы ИИ.

Масштаб происходящих изменений особенно заметен с учётом количества занятых в отрасли людей. По данным Национальной школы развития Пекинского университета за 2026 год, китайская индустрия короткометражных сериалов напрямую обеспечивает работой 690 тыс. человек. Согласно отчёту Китайской ассоциации сетевых аудиовизуальных услуг за 2024 год, около 15 млн человек называют прямые трансляции своей основной профессией.

ИИ активно вытесняет людей и из электронной коммерции с использованием прямых трансляций. Цифровые ведущие могут продавать товары круглосуточно, а их использование обходится примерно в 10 % стоимости работы людей. По состоянию на март цифровые ведущие торговой площадки JD.com использовались более чем 70 тыс. продавцов. Цифровой двойник известного стримера Ло Юнхао (Luo Yonghao) даже превзошёл реального человека по продажам в нескольких категориях товаров, заработав 55 млн юаней ($7,7 млн) всего за семь часов, сообщила Baidu.

Резко снизилась и стоимость производства контента. По словам профессора Университета Цинхуа и руководителя занимающейся ИИ-анимацией компании Zeelin Шэнь Яна (Shen Yang), в 2024 году на создание трёх-пятиминутной драмы команде из пяти человек требовалось около трёх месяцев. Теперь один сотрудник может выполнить такую работу за один-два дня. Производство одной минуты видео обходится в 600–800 юаней ($90–120), что примерно в десять раз дешевле производства с участием людей. Только в мае Zeelin выпустила около 8000 минутных эпизодов.

Некоторым исполнителям при этом приходится фактически участвовать в создании собственных цифровых заменителей. FT приводит пример ведущей популярной детской образовательной программы, которой предложили согласиться на создание ИИ-копии её внешности, голоса и манеры исполнения — в противном случае компания намеревалась найти других актёров. По словам ведущей, ещё недавно исполнителей, соглашавшихся на создание таких цифровых двойников, критиковали за то, что они отнимают работу у коллег, однако теперь происходящие изменения кажутся неизбежными.

Китайская MiniMax выпустила генератор видео H3

Китайский разработчик систем искусственного интеллекта MiniMax выпустил генератор видео H3, способный в качестве запросов обрабатывать текст, изображения, видео и аудио. Модель усиливает конкуренцию на быстрорастущем рынке Китая, где сейчас лидируют ByteDance и Kuaishou.

 Источник изображения: minimax.io

Источник изображения: minimax.io

Шанхайская компания заявила, что H3 может генерировать видео продолжительностью до 15 секунд в разрешении 2K с собственным стереозвуком. Поддерживается редактирование существующего контента, перенос движения из одного видео в другое, подключение инструкций и справочных материалов в различных форматах. В ближайшие дни MiniMax намерена открыть веса модели, что позволит всем желающим скачивать её и проводить дополнительную настройку.

Основанная в 2022 году MiniMax относится к когорте «ИИ-тигров» — стартапов с хорошим финансированием, конкурирующих с китайскими технологическими гигантами и американскими лидерами отрасли. В январе компания стала второй в группе вышедших на Гонконгскую биржу — первой была Z.ai. MiniMax также разрабатывает языковую модель размером 2,7 трлн параметров, утверждает источник Reuters.

H3 ориентирована на коммерческие направления, такие как реклама, электронная коммерция, дизайн продуктов и игры. Себестоимость её обслуживания, утверждает разработчик, втрое дешевле основных конкурирующих продуктов. MiniMax H3 может запускаться на нескольких китайских ИИ-ускорителях.

ByteDance представила Seedream 5.0 Pro — флагманскую ИИ-модель для генерации и редактирования изображений

ByteDance выпустила Seedream5.0 Pro —мультимодальную языковую модель для генерации изображений, предназначенную для выполнения функций производственного дизайна. Алгоритм ориентирован на создателей контента, дизайнеров, маркетологов и других людей, которым требуются насыщенные визуальные макеты, локализованный текст, функции точного редактирования и возможность многократного использования шаблонов, созданных на основе текстовых запросов.

 Источник изображения: testingcatalog.com

Источник изображения: testingcatalog.com

В Seedream 5.0 Pro разработчики реализовали несколько ключевых улучшений, включая возможность визуализации сложной инфографики, функции точного редактирования, генерацию реалистичных изображений и текстур портретов, а также поддержку ввода и генерации текста на разных языках. По данным ByteDance, алгоритм способен превращать данные, концепции и длинные тексты в профессиональные макеты, генерировать инфографику, изображения, UI-макеты, визуальные материалы для обучения и структурированные активы для коммерческого использования. По сравнению с предыдущими версиями ИИ-модели, новинка отличается более высоким уровнем согласованности между вводимым пользователем запросом и результатом генерации, улучшенной структурной целостностью и визуальной эстетикой.

Seedream 5.0 Pro поддерживает функцию выделения отдельных областей изображения с помощью точки или лассо для редактирования без повторной генерации всего кадра. Перекрытые объектом редактирования участки генерируются автоматически. При необходимости изображение можно разделить на отдельно редактируемые слои, такие как основной объект, фон, текст и декоративные элементы. ИИ-модель обеспечивает генерацию изображений фотореалистичного качества за счёт проработки освещения в кадре, текстуры кожи на портретах, добавления физически достоверных отражений и других эффектов. Алгоритм может обрабатывать запросы и создавать изображения с текстом на более чем 10 языках, включая русский, английский, китайский, немецкий, арабский и др. На данном этапе модель Seedream 5.0 Pro доступна для тестирования через API BytePlus.

Meta✴ представила Muse Image — свою первую серьёзную модель для генерации изображений, которая будет доступна Meta✴ AI и соцсетях

Meta✴✴ выпустила первую генерирующую изображения модель искусственного интеллекта, разработанную сформированным в прошлом году подразделением Superintelligence Labs. Muse Image интегрирована в графические редакторы приложений Meta✴✴ AI, Instagram✴✴ и WhatsApp; скоро она появится в Facebook✴✴ и Facebook✴✴ Messenger.

 Источник изображения: ***

Источник изображения: Meta✴✴

Модель стала новым членом семейства Muse, пришедшего на смену Llama. Muse Image располагает агентными функциями — она подключается к большой языковой модели Muse Spark, «чтобы проанализировать ваш запрос, выполнить поиск в интернете и спланировать работу до генерации», пояснил глава Superintelligence Labs Александр Ван (Alexandr Wang). Он также пообещал, что скоро компания выпустит модель Muse Video — она «конкурентоспособна по соответствию запросам, визуальной точности и временно́й согласованности».

В запросах к Muse Image можно упоминать аккаунты других пользователей Instagram✴✴, чтобы включать фото с их страниц в свои работы. Такого рода редактирование и генерация смогут работать только с общедоступными материалами; при этом пользователи смогут контролировать, как другие используют их контент при работе с ИИ. По запросам доступно редактирование изображений, а также создание дизайна приглашений и открыток. Ещё одна функция — создание нового дизайна для объектов недвижимости на платформе Facebook✴✴ Marketplace. Muse Image будет использоваться для 30 новых ИИ-эффектов при публикации в разделе Instagram✴✴ Stories для пользователей в США — впоследствии функция будет доступна и в других странах, а также в других разделах приложений Meta✴✴.

Учёные создали генератор идеальной случайности — надёжной, как швейцарские часы

Учёные из Швейцарской высшей технической школы Цюриха (ETH Zurich) сообщили о первом экспериментальном получении так называемой идеальной случайности — последовательности нулей и единиц, которую можно смело сертифицировать как лишённую скрытых параметров, что архиважно для криптографии, блокчейна и розыгрыша лотерей. Метод превосходит обычные квантовые технологии получения случайных величин, хотя опирается на основополагающие принципы квантовой механики.

 Источник изображения: ИИ-генерация ChatGPT/3DNews

Источник изображения: ИИ-генерация ChatGPT/3DNews

Настоящая неопределённость может быть получена только в квантовых приложениях, но даже она не является идеальной, а значит, уязвима для вдумчивого дешифрования. В любом физическом воплощении квантового генератора всегда присутствуют вещи, приводящие к предсказуемому дрейфу значений. Поэтому швейцарские учёные копнули глубже — смогли использовать для очищения квантовых данных базовые принципы квантовой механики, а именно — проверку неравенств Белла. Сегодня без измерений Белла в квантовых экспериментах — никуда. Только они надёжно подтверждают, к какой физике можно отнести результаты эксперимента — к классической или к квантовой.

Исследователи собрали систему для измерений Белла в виде двух сверхпроводящих кубитов, связанных 30-м линией связи, также охлаждённой. Система позволяет запутывать два кубита, а дальность в 30 метров означает, что квантовый эффект запутанности сработает без прямой передачи данных, ведь даже скорости света не хватит, чтобы в момент измерения передать информацию от одного кубита к другому.

После получения последовательности случайных нулей и единиц на предложенной платформе, специальный алгоритм «очищает» или, как говорят сами разработчики, служит своеобразным «усилителем» неопределённости. Проверка данных с помощью измерений Белла позволяет утверждать, что это фактически сертифицированная платформа для генерации истинно случайных значений. Это как атомные часы в измерениях — придёт время, уверены учёные, и подобные идеальные квантовые генераторы станут работать эталоном для получения случайных чисел. Настанет век настоящих случайностей — надёжных, как швейцарские часы!

Уход Sora открыл дорогу конкурентам: ИИ-генераторы видео Kling AI и AI Video ворвались в топы Apple App Store

Два приложения для создания видео с помощью ИИ — Kling AI и AI Video — поднялись на пятое и шестое места в рейтинге самых скачиваемых бесплатных приложений Apple App Store. Оба лидируют в своих категориях: Kling AI заняло первую строчку в «Графике и дизайне», AI Video — в «Фото и видео». Их рост начался спустя два месяца после закрытия видеосервиса Sora компании OpenAI. Оба приложения выигрывают от нового всплеска внимания пользователей iPhone к ИИ-генерации видео.

 Источник изображений: apps.apple.com

Источник изображений: apps.apple.com

OpenAI свернула Sora главным образом из-за стоимости обслуживания: бесплатный сервис потреблял слишком много ресурсов. Компания сосредоточилась на ChatGPT и Codex — инструментах для повышения продуктивности, причём Codex лучше раскрывается на платных тарифах.

 AI Video - AI Video Generator

AI Video - AI Video Generator

После ухода Sora конкурирующие ИИ-приложения стали активнее продвигать генерацию видео. Gemini и Grok уже позволяют превращать текстовые запросы и изображения в ролики, однако для этих универсальных чат-ботов видео остаётся лишь одной из возможностей.

 Kling AI: AI Image&Video Maker

Kling AI: AI Image&Video Maker

Kling AI и AI Video целиком посвящены созданию роликов. Kling AI появилось в App Store три месяца назад. AI Video выпущено компанией HUBX, у которой в магазине размещено 15 ИИ-приложений. Новое приложение нацелено на создание вирусных видеороликов. Выше обоих в рейтинге стоят только продукты OpenAI, Anthropic, Google и Meta✴✴. Sora тоже возглавляла чарт при запуске, но через несколько месяцев перестала показывать заметные результаты.

Генераторы изображений стали главным драйвером роста ИИ-чат-ботов

Выпуск моделей с генераторами изображений стимулирует увеличение популярности мобильных приложений с искусственным интеллектом — рост по сравнению с простыми обновлениями ускоряется в 6,5 раза, показала статистика аналитической компании Appfigures.

 Источник изображения: Milad Fakurian / unsplash.com

Источник изображения: Milad Fakurian / unsplash.com

Для OpenAI ChatGPT и Google Gemini появление генераторов изображений увеличивало аудиторию на десятки миллионов пользователей. В течение 28 дней после выхода генератора изображений Nano Banana с чат-ботом Gemini 2.5 Flash приложение набрало 22 млн новых пользователей, что соответствует росту числа загрузок более чем вчетверо за указанный период.

 Здесь и далее источник изображений: Appfigures

В случае генератора изображений в составе OpenAI GPT-4o рост аудитории составил 12 млн человек — в 4,5 раза быстрее по сравнению с базовым вариантом GPT-4o, а также GPT-4.5 и GPT-5. Аналогичная тенденция сработала и с появлением ленты Vibes в приложении Meta✴✴ AI, хотя оно предлагало генерацию не изображений, а видео — нововведение дало 2,6 млн дополнительных загрузок.

К сожалению для разработчиков, росту числа загрузок не всегда сопутствует рост выручки: в случае с Nano Banana компания Google заработала лишь на $181 тыс. больше; приложение Meta✴✴ AI с появлением Vibes существенного роста дохода не показало; и только в случае OpenAI модель GPT-4o с генератором изображения помогла компании нарастить выручку на $70 млн за 28 дней.

Единственным исключением из правил оказался взрывной рост в 28 млн загрузок с выходом модели DeepSeek R1, отметили в Appfigures. Всё потому, объясняют аналитики, что компания DeepSeek сама по себе стала мировой сенсацией из-за уникальных методов обучения ИИ с минимальными затратами по сравнению с конкурентами — генератора изображений в приложении не было.

Microsoft представила облегчённый ИИ-генератор изображений MAI-Image-2-Efficient

Microsoft анонсировала обновлённую версию модели искусственного интеллекта, которая генерирует изображения по текстовым запросам, — она получила название MAI-Image-2-Efficient. Она и её предшественница MAI-Image-2 генерируют качественные фотореалистичные картинки, при этом новая работает на 22 % быстрее и вчетверо эффективнее.

 Источник изображения: BoliviaInteligente / unsplash.com

Источник изображения: BoliviaInteligente / unsplash.com

В марте Microsoft запустила на платформах Copilot, Bing Image Creator и MAI Playground генератор изображений MAI-Image-2, который занял в рейтинге Arena.ai третье место среди себе подобных. Недавно компания расширила доступ к ней, добавив её на платформу Foundry наряду с MAI-Voice-1 и MAI-Transcribe-1. Обновлённая MAI-Image-2-Efficient создана для случаев, когда необходимо нечто быстрое, масштабируемое и не влекущие неоправданных расходов ресурсов. Если не требуется высокая точность изображений, MAI-Image-2-Efficient оказывается оптимальным вариантом — она пригодится для генерации иллюстраций в соцсетях, создания макетов-заглушек и миниатюр продуктов; то есть в тех случаях, когда скорость и объём контента важнее пиксельной точности.

Microsoft MAI-Image-2, напротив, проявляет себя во всей красе, когда востребован, например, качественный портрет героя, кинематографическая сцена и внимание к деталям, а аспект скорости отходит на второй план. Обновлённая MAI-Image-2-Efficient по ряду параметров превосходит не только предшественницу от самой Microsoft, но также работает на 40 % быстрее таких систем как Google Gemini 3.1 Flash, Gemini 3.1 Flash Image и Gemini 3 Pro Image.

Разработчики уже могут подключать MAI-Image-2-Efficient на платформах Microsoft Foundry и MAI Playground. Стоимость её работы составляет $5 за 1 млн входящих и $19,50 за 1 млн выходящих токенов — для сравнения, стоимость использования MAI-Image-2 составляет $5 и $33 соответственно. Скоро MAI-Image-2-Efficient появится в Copilot, Bing и на других платформах.

Alibaba выпустила HappyHorse — открытый ИИ-генератор видео, который обошёл всех конкурентов

На платформе Artificial Analysis опубликовали предназначенную для генерации видео модель искусственного интеллекта HappyHorse-1.0, которая со значительным отрывом обошла лидера в лице Seedance 2.0 от ByteDance.

 Источник изображения: happyhorse-ai.com

Источник изображения: happyhorse-ai.com

В категории генерации видео без звука по текстовому запросу HappyHorse-1.0 набрала рейтинг Elo 1357, опередив Seedance 2.0 на 84 балла; в задачах на анимацию статической картинки она показала Elo 1402, также выйдя на первое место. В генерации видео со звуком она оказалась второй, уступив Seedance 2.0 с 1215 баллами против 1220; а в анимации картинок снова оказалась первой с результатом 1160 против 1158 у прежнего лидера. Оторваться на 84 балла в этом рейтинге — это сильный результат, указывающий, что в слепом тестировании HappyHorse-1.0 оказывается лучше примерно в 62 % случаев.

Разработчиком HappyHorse-1.0 оказалась Future Life Lab при Taotian Group — это подразделение Alibaba отвечает за технологии электронной коммерции. Главой лаборатории является Чжан Ди (Zhang Di), прежде занимавший пост вице-президента Kuaishou и технического руководителя проекта Kling AI, ранее выпускавшего мощные генераторы видео. В конце 2025 года он начал работу в Taotian, и модель HappyHorse-1.0 стала первым проектом новой структуры. Примечательно, что у Alibaba уже был собственный ИИ-генератор видео Wan, который тоже оказался слабее нового проекта.

HappyHorse-1.0 представляет собой ИИ-модель на архитектуре 40-слойного трансформера с 15 млрд параметров, в котором данные генерируются диффузионным методом и обрабатываются единым потоком, включающим текст, изображения, видео и звук. Ресурсов ускорителя Nvidia H100 хватает для генерации 5-секундного клипа в разрешении 256p за 2 секунды; на генерацию 5-секундного ролика в 1080p уходят 38 секунд. Разработчики обещают в скором будущем выложить в открытом виде базовую модель HappyHorse-1.0, её уменьшенную дистиллированную версию, модуль повышения разрешения и код для запуска модели.

Nvidia вывела из беты динамический генератор кадров и режим MFG 6X в DLSS 4.5

Компания Nvidia завершила тестирование новых функций динамического мультикадрового генератора и режима MFG 6X в составе DLSS 4.5, включив их в стабильную версию приложения Nvidia App для управления графикой GeForce. Ранее данные функции были доступны только в составе бета-версий.

 Источник изображений: Nvidia

Источник изображений: Nvidia

Новые функции доступны в разделе «Графика» > «Настройка программы» > «Настройки драйвера» > DLSS Override > «Режим генерации кадров». Компания сообщает, что в настоящий момент динамический режим генерации кадров несовместим с функциями ограничения частоты кадров и вертикальной синхронизации (V-Sync).

В настройки Nvidia App также добавлены режимы генерации кадров 5X и 6X. По данным компании, в совместимых играх масштабирование может достигать шестикратного увеличения, а видеокарты серии GeForce RTX 50 могут повысить производительность в 4K-играх с трассировкой лучей на 35 % при переходе с четырёхкратного на шестикратный мультикадровый рендеринг.

Обновление также включает новую модель Frame Generation для видеокарт GeForce RTX 40-й и 50-й серий. По данным Nvidia, новая модель использует дополнительные данные движка в поддерживаемых играх для повышения чёткости мини-карт, статических элементов интерфейса и других компонентов пользовательского интерфейса при включённой функции Frame Generation.

Nvidia также продолжает внедрять обновления DLSS на уровне приложений, не дожидаясь выхода патчей для самих игр. В новый список игр, получивших поддержку функции DLSS Override, вошли: Arknights: Endfield, Black One Blood Brothers, Carmageddon: Rogue Shift, Code Vein II, Corsairs Legacy, Crimson Desert, Death Stranding 2: On the Beach, Demonologist, For Honor, Grounded 2, Half Sword, High On Life 2, John Carpenter’s Toxic Commando, Let It Die: Inferno, Lort, Marathon, Monster Hunter Stories 3, Nightmare Frontier, Nioh 3, Norse: Oath of Blood, Of Ash and Steel, Quarantine Zone: The Last Check, Reanimal, Resident Evil Requiem, Star Trek: Voyager — Across the Unknown, StarRupture, Styx: Blades of Greed, The Gold River Project, The Legend of Heroes: Trails Beyond the Horizon, Vampires: Bloodlord Rising и Yakuza Kiwami 3 & Dark Ties.

Новая версия приложения Nvidia App также добавляет оптимальные игровые настройки для Arknights: Endfield, Ashes of Creation, Highguard, StarRupture и The Last Caretaker. Кроме того, в приложении исправлен ряд проблем и ошибок. С их списком можно ознакомиться выше.

Скачать приложение Nvidia App можно с официального сайта Nvidia.

Google представила ИИ-модель Veo 3.1 Lite для генерации видео до 8 секунд — он дешевле Veo 3.1 и Veo 3.1 Fast

Компания Google анонсировала генератор видео Veo 3.1 Lite. В иерархии продуктов он находится ниже версии Veo 3.1 Fast. При этом версия Veo 3.1 остаётся флагманским решением компании. Veo 3.1 Lite является «наиболее экономичной моделью для работы с видео» от Google.

 Источник изображений: Google

Источник изображений: Google

Предназначенный для «приложений с большим объёмом видеоконтента» генератор Veo 3.1 Lite поддерживает преобразование текста в видео и изображений в видео, а также разрешения 720p или 1080p с горизонтальным (16:9) и вертикальным (9:16) соотношением сторон. Он предлагает ту же скорость генерации, что и Veo 3.1 Fast.

Пользователи могут настраивать продолжительность генерации в 4, 6 или 8 секунд — стоимость будет корректироваться соответствующим образом. Что касается цены, она составляет «менее 50 % от стоимости Veo 3.1 Fast», цена которого снизится 7 апреля.

Генератор видео Veo 3.1 Lite доступен через платный тарифный план в API Gemini и Google AI Studio. Решения для генерации видео Google Veo интегрированы в различные продукты компании, включая YouTube Shorts, Google Photos, Google Vids и приложение Gemini. Также генератор предлагается в составе видеоредактора Flow.


window-new
Soft
Hard
Тренды 🔥
Сценарист Resident Evil Requiem проговорился о сюжете масштабного дополнения к игре 2 ч.
Googlebook проиграл хромбукам по совместимости — поддержка PWA и Linux-приложений урезана, но Google обещает всё исправить 2 ч.
Google тихо обновила Nano Banana — новая версия 2.1 лучше работает с текстом, персонажами и панорамами 2 ч.
ИИ удвоил число отчётов об уязвимостях в ПО и инфраструктуре — но реальных находок стало лишь на 48 % больше 4 ч.
Хардкорный режим, генерация кадров FSR, DLSS 4.5 и не только: следующее крупное обновление для Dragon’s Dogma 2 не заставит себя долго ждать 5 ч.
Google выпустила EmbeddingGemma 2 — открытую модель для поиска по текстам, коду, изображениям, аудио и видео прямо на смартфоне 6 ч.
Журналист рассекретил эксклюзивную сделку Xbox с разработчиками GTA VI, но Microsoft всё отрицает 6 ч.
Банк Англии призвал не ждать скорой экономической выгоды от ИИ 7 ч.
ESU на носу: второй год расширенной поддержки Windows 10 обойдётся предприятиям в два раза дороже 15 ч.
«В Найт-Сити не бывает счастливых концов»: новый тизер Cyberpunk: Edgerunners 2 приготовил фанатов к эмоциональной травме 16 ч.
DayOne в ходе подготовки к IPO объявила о планаха более чем вдвое нарастить мощности своих ЦОД к 2028 году 21 мин.
ByteDance заняла пятую часть мощностей дата-центров в КНР, большая их часть арендована у сторонних операторов ЦОД 26 мин.
SpaceX получила добро на 15 000 спутников Starlink Mobile — они обеспечат смартфонам 5G-связь со скоростью до 150 Мбит/с 2 ч.
Google запаслась ещё не произведённой атомной энергией для своих дата-центров 4 ч.
Intel и TSMC могут вместе помочь Маску построить Terafab — но управлять чиповой фабрикой он будет сам 4 ч.
Китайский робот освоил вышивку шёлком — для этого ему пришлось научиться разделять нить на 16 волокон 4 ч.
Производители HDD делят головки: Toshiba пыталась купить производство магнитных головок у TDK, но Seagate предложила больше 5 ч.
Apple объединилась с LG для создания умного дверного звонка, домофона и термостата 5 ч.
Everspin расширила память x86-сервера с помощью MRAM PERSYST и CXL 6 ч.
Xbox вернулся к росту после «исторического минимума» — Аша Шарма раскрыла планы на Helix и не только 7 ч.